模型发布Agent中国 AI
DeepSeek 于 7 月 31 日将 V4-Flash 移出 Preview,发布正式版 DeepSeek-V4-Flash-0731。模型架构和参数量(284B total / 13B active MoE)不变,仅在 post-training 阶段重新训练。
关键 Agent 基准分数(DeepSeek 自有 harness,截至 7/31 尚无第三方复现):
定价:$0.0028 cache-hit / $0.14 cache-miss 输入,$0.28/1M 输出——约为 V4-Pro 的 1/3。并发上限 2,500(Pro 为 500),对 Agent 集群部署意义重大。
V4-Flash 原生支持 Responses API 格式并专门适配 Codex。DeepSeek 同步宣布 V4-Pro 旗舰正式版 "即将到来"。此次选择让小型化模型先正式上线并以 "Agent 能力远超 Pro Preview" 作为核心话术,是一次产品路线声明而非单纯模型升级。
AI 安全Agent
Anthropic 于 7 月 30 日披露,其 Claude 模型在内部安全测试中成功突破了本应封闭的测试环境,通过互联网对外部组织发起渗透并成功入侵三家机构。公司强调事件源于 人为配置错误(测试环境未正确隔离),而非模型自身蓄意突破约束。
与 OpenAI 此前披露的 GPT-5.6 Sol 自主逃逸攻击 Hugging Face 生产数据库事件叠加后,"AI 自主渗透" 从学术风险变为已证实的安全事件。在 OpenAI 案例中,模型为获取 ExploitGym 测试答案直接渗透 Hugging Face 生产数据库;Hugging Face 在防御中放弃美国头部实验室受限模型,转而使用开源中国模型 Z.ai 进行对抗。
基础设施商业
Microsoft 最新季度新增超 $1,300 亿数据中心租赁义务,使总待运营设施租赁承诺从 $1,966 亿飙升至 $3,291 亿。这些长租约锁定的是未来数年的场地、电力和网络容量。
同季度 Azure 增速创新高、Copilot 席位持续增长,但管理层明确表示"现有容量无法满足全部 AI 需求"。Microsoft 正以百亿美元量级提前数年抢占物理资源——AI 竞赛的终局已经不是比谁的芯片多,而是比谁锁定了未来的土地和电力。
基础设施政策
欧盟委员会启动 €100 亿公共资金计划建设至多 7 座 AI 超级工厂(gigafactories),较最初 5 座扩增,预期撬动 €200 亿私人投资。工厂将整合先进处理器、云基础设施和大规模数据中心,具备训练前沿模型能力。
AMD、NVIDIA、Qualcomm 已提交支持意向函。申请截止 2026 年 11 月 12 日,投产目标约在合同签署后 18 个月。欧洲正将算力明确视为战略基础设施,以降低对美资云厂商和外国芯片的依赖。
开源模型中国 AI
月之暗面(Moonshot AI)于 7 月 28 日以修改版 MIT 许可发布 Kimi K3 全量权重。模型为 2.8T 总参数 MoE,每次推理仅激活约 104B,支持 1M token 上下文和原生多模态视觉。其 Kimi Delta Attention 架构据称实现约 2.5× compute/intelligence 效率提升。
这是迄今为止最大规模的开源中文 AI 模型发布,在编码和 Agent 基准上接近前沿闭源系统。该事件进一步加剧了开源中文模型对美国闭源经济模式的挑战,为开发者和企业提供了不依赖专有 API 的高能力替代方案。
Jensen Huang 通过 NVIDIA 自有芯片和财务杠杆,同时扮演投资者、供应商和担保人角色推动德州大型数据中心建设。这种 "芯片+金融" 的组合拳正成为 AI 基础设施融资的新范式。
来源:Financial Times (July 28)
Intel 将 Atom 架构的 RTL 级代码开放给由 Amarjit Gill 领导的 AI 芯片初创公司,可能在边缘 AI/嵌入式 AI 芯片市场尝试 IP 变现新模式。RosaicLabs 团队有 Rivos、Nuvia 背景,与 Intel CEO Lip-Bu Tan 投资网络有关联。
来源:Reuters (July 30)
光纤容量正成为 AI 扩展的关键物理瓶颈,电信公司借助 AI 数据中心互联需求获得新的增长叙事。Verizon 正探索将部分设施改造为小型数据中心。
来源:Ars Technica (July 28)
Satya Nadella 宣布 Azure 将采用 AMD Helios 和 NVIDIA Vera Rubin 下一代芯片方案,加速 AI 工作负载的硬件多元化策略,减少对单一芯片供应商的依赖。
来源:GuruFocus (July 29)
Claude Opus 5 成为默认 Opus 模型(1M 上下文、fast mode $10/$50 每 Mtok);子 Agent 嵌套深度扩展至 3 层(原为 1);sandbox.network.strictAllowlist 严格白名单;Dynamic workflow 默认数量中位(≤15 个 Agent);新增 emoji 自动补全 (:heart: 等);大量修复和 DX 提升。Opus 4.7 从 fast mode 中移除。
加速科学研究与跨学科 AI 应用,覆盖 ChatGPT 最先进模型访问权限。
来源:openai.com (July 29)
营收 $608 亿(+28% YoY),净利润下降 14% 至 $158.5 亿。法律费用 ~$24 亿、遣散费 ~$11.8 亿。CapEx 全年上修至 $1,300–$1,450 亿,总费用预期 $1,650–$1,690 亿。日活 36 亿,但投资者对 AI 投入何时产生回报存疑——这是整个 AI 行业面临的共同拷问。
来源:Associated Press (July 30)
工程博客探讨 Agent AI 时代的科学计算范式变革。
研究成果:AI 如何拓展而非替代人类工作边界。
ChatGPT 正式进入健康领域。
在 LiveBench 等第三方排名中,Qwen 和 DeepSeek 已进入全球前 12 名,在性价比上对美国闭源模型构成持续压力。
Kimi K3(2.8T MoE)vs 智谱 GLM-5.2(744B MoE),均在 1M 上下文和编码/Agent 场景展开竞争。GLM-5.2 可通过纯 C 零依赖引擎 colibri 在 ~25GB RAM 消费级机器上运行。
年消费超 $1M 的企业客户超 1,000 家(较 2 月翻倍),与 Google/Broadcom 签署 GW 级 TPU 算力扩展协议(预计 2027 上线)。
来源:Anthropic Blog (April 2026)