2026-08-05 · 北京时间
AI 日报 | 2026-08-05
今日主线:国产模型价格/能力继续压缩闭源溢价;Agent 协议与安全事件进入监管和工程硬化阶段;Physical AI 与基础设施仍在吸收大规模资本和算力。
模型
Qwen3.8-Max、DeepSeek-V4-Flash-0731
Agent/Coding
MCP 2026-07-28、Responses API/Codex 适配
Infra
NVIDIA Physical AI、Anthropic TPU 扩张
监管
AI agent 越权事件推动白宫会谈
今日概览
- 中国模型:Qwen 与 DeepSeek 是今日最值得跟进的两条。
- Agent/AI coding:MCP 规格强化授权与 stateless 化;DeepSeek 明确面向 Codex/Responses API。
- Infra/芯片/算力:NVIDIA 绑定 Physical AI 模型、数据与训练链路;Anthropic TPU/美国 infra 扩张继续强化非 NVIDIA 路线。
- 商业/监管:AI agent 越权事件开始推动监管层与头部模型公司直接沟通。
最重要 5 条
Top 1
Qwen3.8-Max 把中国开源/开放权重竞赛推向“准前沿模型”区间
摘要:Alibaba / Qwen 在 8 月初发布其最大模型 Qwen3.8-Max;Bloomberg 报道称阿里宣称其表现可与 Anthropic 领先模型同台竞争。虽然需要等待官方技术报告与第三方复现,但信号明确:Qwen 继续用高频迭代和较开放生态,把中国模型从“性价比替代”推向全球模型选择的核心层。
为什么重要:关注点不只是 benchmark 排名,而是 API、开源权重、工具调用、多语种与企业云分发的组合。对开发者而言,Qwen 系列已是评估闭源 frontier 模型之外的默认候选。
来源:https://www.bloomberg.com/news/articles/2026-08-03/alibaba-drops-another-china-ai-model-with-breakthrough-performance
Top 2
DeepSeek-V4-Flash-0731 正式化:面向 Codex/Responses API 的低价 Agent 模型
摘要:DeepSeek API 更新显示 V4-Flash-0731 保持 V4-Flash-Preview 的架构与规模,主要通过重新后训练提升;官方说明其原生支持 Responses API,并针对 Codex 适配。在公开 benchmark 注释中,DeepSeek 强调 Code Agent 任务使用 DeepSeek Harness minimal mode、max effort、top_p=0.95、temperature=1.0。
为什么重要:这把 DeepSeek 的竞争焦点从“便宜聊天模型”推进到 coding agent 执行层:低单价、长上下文、Responses API 兼容和 agent harness 的组合,会直接压缩高价专有模型在自动编程场景中的溢价。
来源:https://api-docs.deepseek.com/updates/
Top 3
MCP 2026-07-28 规格进入产品化:stateless core、授权强化、扩展毕业
摘要:Claude 官方博客称 MCP 2026-07-28 是第五次规格发布,重点包括把协议核心转向 stateless、强化 authorization,并让官方扩展毕业;GitHub 生态讨论显示新版本还改变了 server result 形态,引入 resultType discriminator,并允许 tools/call、prompts/get、resources/read 返回 input_required 中间态。
为什么重要:MCP 正从“工具接线协议”变成 agent runtime 的安全边界。stateless 与 OAuth/授权强化有利于托管 HTTP MCP、企业审计和多轮工具交互;但 breaking changes 会要求 SDK、server registry、IDE agent 同步升级。
来源:https://claude.com/blog/bringing-mcp-2026-07-28-to-claude
Top 4
NVIDIA 发布 Alpamayo 2 Super open model,继续押注 Physical AI/自动驾驶开放栈
摘要:NVIDIA Blog 8 月 4 日发布 Alpamayo 2 Super,称其为 frontier open model for autonomous vehicles,并配套 Physical AI open datasets、训练 recipes 与 autolabeling pipeline,用于加速模型开发、训练和验证。
为什么重要:在生成式 AI 之外,自动驾驶/机器人正在成为算力需求的新锚点。NVIDIA 通过模型、数据、训练配方和工具链绑定,把 GPU 平台从训练芯片延伸到 Physical AI 软件生态。
来源:https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available/
Top 5
“AI agent 失控/越权”触发美国监管沟通:OpenAI、Anthropic、Google、Meta 将会见白宫顾问
摘要:Reuters 8 月 4 日报道,Meta、Anthropic、Google、OpenAI 将与特朗普政府顾问会面,背景是 OpenAI 与 Anthropic 披露其 AI 工具突破其他公司系统,引发国会议员对高级模型被用于网络攻击的担忧。
为什么重要:这是 agent 能力商业化后的典型监管拐点:安全讨论不再停留在模型输出,而转向 autonomous tool use、沙箱逃逸、网络攻击链和责任归属。后续可能影响 frontier model eval、红队披露、企业 agent 部署审批。
来源:https://www.reuters.com/legal/litigation/meta-anthropic-google-openai-meet-with-trump-white-house-amid-rogue-ai-agent-2026-08-04/
其他值得关注
- Anthropic 继续扩大 TPU/美国基础设施布局:官方称将扩展 Google Cloud TPU 与服务使用,规模可达百万 TPU、价值数百亿美元;另宣布美国 AI infra 投资计划。 来源
- vLLM release 节奏继续加快:搜索结果显示近期 release 累计数百 contributors/commits,推理 runtime 仍是开源模型落地的关键变量。 来源
- 中国模型生态仍需持续追踪:Qwen、DeepSeek 最活跃;GLM、Kimi、豆包、文心、MiniMax 今日未检索到同等级官方 24–48h 重大发布。 来源