AI 无涯日报 · 2026 年 8 月 31 日

AI 无涯日报 · 2026 年 8 月 31 日

每日全球 AI 趋势速递,五分钟掌握前沿动态。


🚨 头条

1. 联邦法官裁定五角大楼”供应链风险”黑名单违法:Anthropic 全面胜诉

美国加州北区联邦法院法官 Rita Lin 周四(8 月 27 日)作出裁决,认定特朗普政府今年 2 月将 Anthropic 列为”国家安全供应链风险”、禁止联邦机构及国防承包商与其往来的行为,构成违反第一修正案的”非法报复”,并因缺乏事先程序而违反第五修正案,命令政府撤销全部针对该公司的指令。这起风波的起因,是 Anthropic 拒绝解除其 Claude 模型在致命自主武器与大规模监控场景下的安全限制。Lin 在 59 页判决书中写道:”空喊国家安全,不是惩罚和报复政府批评者的空白支票。”不过事情尚未尘埃落定:华盛顿特区巡回上诉法院仍在审理另一起相关案件,政府也有权继续上诉。

来源:Reuters, CNN, Ars Technica, The Guardian

2. NVIDIA 交出史上最强财报:单季 $96.2B 后,又传 129 亿美元收购 Hugging Face

英伟达 8 月 26 日发布创纪录财报:第二财季营收 962 亿美元、同比翻倍以上(+106%),数据中心收入达 890 亿美元(+117%),净利润 597 亿美元(+126%),并为下季给出 1080 亿美元的超预期指引。黄仁勋称”AI 已到拐点,每一条 token 都有价值和利润”。但财报公布后,公司却暂停了此前用于支持小型 AI 运营商的部分云融资安排,引发市场对”循环融资”风险的讨论。更重磅的是,The Information 同日报道英伟达已同意以 129 亿美元收购开源模型平台 Hugging Face(Salesforce 也曾参与竞购),交易尚未最终签署,若完成将把全球最流行的开源模型分发入口收入囊中。

来源:QZ, Axios, TechCrunch, The Information

3. 美国商务部起草新规:禁止中国 AI 公司借道泰国、新加坡租用英伟达算力

据 The Information 报道,美国商务部工业与安全局(BIS)正在起草一项规则,拟禁止中国 AI 公司通过泰国、新加坡等第三国数据中心远程租用美国制造的 GPU 算力,草案最早 9 月提交业界征求意见。导火索是月之暗面(Moonshot)发布的 2.8 万亿参数开源模型 Kimi K3——白宫科技政策办公室主任 Michael Kratsios 指控其在泰国使用英伟达 GB300 服务器训练该模型,且通过”知识蒸馏”大规模提取美国前沿模型能力。彭博调查还显示 Moonshot 通过阿里云租用了约 2 万张英伟达 H 系列芯片。不过出口管制律师警告:BIS 现有法条(EAR)将”出口”定义为物理硬件转移、并不覆盖远程云访问,若无国会通过《远程访问安全法案》,新规的执法依据存疑。

来源:The Information, TechTimes, Bloomberg, CNBC

4. NBER 调查:89% 高管称三年 AI 投入未带来生产率提升

美国全国经济研究局(NBER)对高管的调查显示:超过九成受访者报告 AI 未对本企业就业产生任何影响,89% 报告”没有看到生产率提升”,而与此同时科技行业的裁员并未放缓。另一份来自 Linear 的遥测数据用完全不同的方法佐证了这一趋势:采用编码智能体的团队周 PR 数从 21 涨到 65,但总开发时间反而上升——因为审查量随产出激增、且最终落回人类身上。”AI 时代的生产率悖论”正在从口号变成数据。

来源:AIToolsRecap, NBER, Linear

5. NPR/NewsGuard 实测:六大聊天机器人 75% 时间识破国家宣传谎言

NPR 与 NewsGuard 合作,针对 2025 年 12 月至 2026 年 7 月中国、伊朗、俄罗斯散布的 15 条虚假叙事设计 30 个问题,测试了 ChatGPT、Gemini、Copilot、Meta AI、Grok 与 Claude 六大聊天机器人,结果它们约 75% 的情况下能正确揭穿谎言并给出反证信息,表现优于传统搜索引擎(Bing 的 AI 摘要大多数时候未能揭穿、Google AI Overview 最强)。数字素养专家 Mike Caulfield 还发现:追问一句”请审视证据”往往能让答案质量明显提升。这项研究为”AI 是否会被宣传毒化”的担忧提供了难得的正面数据。

来源:NPR, NewsGuard


🏭 模型发布

6. PhoneLLM Alpha 1:开源语音智能体模型,每分钟成本仅约 2.5 美分

Daily 与 Pipecat 联合发布 PhoneLLM Alpha 1——一个基于英伟达 Nemotron 3 Nano(30B/约 3B 激活)开源后训练的语音智能体模型,专为”思考延迟会毁掉对话”的生产级语音场景设计。它在 PhoneBench v1 上把基础成绩从 28% 提升到 72%,据称以三分之一的延迟、十八分之一的价格击败 GPT-5.6 Tera,单张 B200 可承载 80+ 并发智能体,端到端成本约每分钟 0.25 美分。语音智能体的”成本墙”正在被开源社区快速拆解。

来源:ThursdAI, Daily/Pipecat

7. 智谱 GLM-5.3 权重结束两周安全搁置正式开放

继此前神秘模型”ox-alpha”被揭晓为 GLM-5.3-Flash 之后,智谱(Z.ai)的 GLM-5.3 完整权重已于 8 月 28 日结束为期两周的安全搁置期、正式开放下载(旗舰版许可证条款仍未公布)。此前有报道称,OpenAI 与 Anthropic 在 8 月相继对具备网络攻击能力的模型实施了”安全闸门”策略,GLM-5.3 是这一波中首个公开搁置而后解禁的中国模型,开源社区的关注度持续走高。

来源:AIToolsRecap, ai0.news

8. Grok 4.7 窗口期临近:马斯克称”9 月初至中旬”上线

xAI 的 Grok 4.6 发布仅数周,马斯克已给出下一代 Grok 4.7 的时间窗口(9 月初至中旬)。与此同时 Grok 4.6 已登陆 GitHub Copilot 与 Amazon Bedrock,Grok Bot(拥有自己云电脑、可 24/7 值守的”AI 同事”)也已进入公测。xAI 正在用”模型 + 智能体 + 工具链”的组合拳加速扩张。

来源:AIToolsRecap, xAI News


🏢 行业动态

9. Anthropic 发布”模型硬件标准”(MHS)研究预览:AI 智能体安全操作物理设备

Anthropic 8 月 27 日宣布向首批科研实验室与先进制造商开放”模型硬件标准”(Model Hardware Standard, MHS)的研究预览——这是一套让 AI 智能体安全操作物理设备的共享规范,涵盖设备通信、安全边界与权限控制等关键环节。同期 Anthropic 还宣布将 Mythos 级模型开放给生命科学领域研究者,扩大对科学家的支持。当智能体开始真正”动手”操纵硬件,安全标准必须先行。

来源:Anthropic Newsroom, Releasebot

10. Claude for Teachers 正式向美国 K-12 学校开放

Anthropic 宣布其”Claude for Teachers”计划现向美国 K-12 学校与学区开放,合格机构可在 2027 年 6 月 30 日前注册并获得一年的免费使用权限,今年秋天还将在底特律公立学区试点教师福祉与教学实践研究。教育场景正在成为 AI 巨头们争夺的高地。

来源:Claude Blog, Releasebot

11. DALL·E GPT 今日退役,多重期限压向 8 月 31 日

OpenAI 于 8 月 30 日从 ChatGPT 中移除官方 DALL·E GPT(图像生成将继续通过 ChatGPT Images 在所有档位提供,自定义 GPT 不受影响,官方建议提前下载想保留的图片)。而 8 月 31 日更是一个”多事之日”:Claude Sonnet 5 输入价格从 $2 涨至 $3/百万 token、输出从 $10 涨至 $15,并伴随 Tokenizer 变更(代码场景 token 数增加 10%-35%);Kimi K2.5 与 Moonshot-v1 正式退役、需迁移到 Kimi K3;Claude Code 自 5 月以来的”周额度 +50%”临时提升也于今日结束。对于同时使用 Anthropic 与 OpenAI 的开发者,这个周末需要认真核对 token 用量。

来源:AIToolsRecap, OpenAI Release Notes

12. Forcepoint 演示”隐形文字”提示注入:AI 邮件防护再敲警钟

Forcepoint X-Labs 演示了一种针对邮件场景的新式提示注入攻击:在邮件 HTML 中植入零字号、白底白字等肉眼不可见的文字,诱导接入邮件的 AI 智能体执行恶意指令。随着 AI 越来越深地嵌入邮件、办公与智能体工作流,”看不见的提示词”正成为安全对抗的新前线。

来源:AIToolsRecap, Forcepoint X-Labs


🔬 研究精选

13. 智能体”花钱”的规则正在全球收敛:授权记录成共同要求

Google 发布了智能体支付协议,NIST 正在就智能体身份与权限做概念研究,美国参议院《AI 智能体法案》(S.5051)也在推进中——三者不约而同指向同一核心要求:为智能体的每一次特定任务授权建立可验证的记录。能力先行于规则:Cloudflare 已推出可编程钱包与按请求支付(x402),超 20 家公司参与;Salesforce 测得企业平均部署的智能体数量从 5 个增至 13 个。”AI 能花钱”之后,如何证明”它有权花”成为新课题。

来源:AIToolsRecap, Cloudflare, Salesforce


本文内容综合自多家媒体报道。