过去 24–48 小时没有单一压倒性 frontier model 大发布;更值得关注的是 agent/coding 与推理基础设施的连接层:DeepSeek 将 Codex 集成写入官方文档,Cloudflare 继续把 Workers AI 包装成 agent runtime,vLLM 高速迭代,NVIDIA 则把安全工具联盟纳入 AI infra 叙事。
1. DeepSeek API 增加 Codex 集成路径
摘要:DeepSeek 文档显示,Responses API 当前支持 deepseek-v4-flash 与 OpenAI Codex 集成,deepseek-v4-pro 预计 2026 年 8 月初加入;定价页同样提示 Responses API 现阶段仅支持 flash。
为什么重要:这不是一次模型权重发布,但它把国产模型直接接入主流 coding-agent 工作流,意味着开发者可在 Codex CLI/agent harness 中替换底层模型,测试成本、延迟与中文代码场景表现。
来源链接
2. Cloudflare Workers AI 继续补齐 Agent 基础设施
摘要:Cloudflare Agents/Workers AI 资料强调 large models、structured outputs、tool calling、长上下文,以及 Dynamic Workers 沙箱执行 AI 生成代码。
为什么重要:边缘平台正在从"推理 API"转为 agent runtime:模型、工具调用、隔离执行、网关与存储在同一网络内组合,降低多区域 agent 应用的部署复杂度。
来源链接
3. vLLM release 线继续高速迭代
摘要:vLLM GitHub releases 页面显示最新 v0.26.0 release notes,包含 411 commits、212 contributors(61 new)。
为什么重要:开源推理栈的提交密度仍是观察模型部署成本的领先指标;vLLM 的模型覆盖、调度和硬件后端变化会直接影响企业自托管与云厂商托管推理。
来源链接
4. NVIDIA 推动 Open Secure AI Alliance
摘要:NVIDIA 博客称其与创始成员成立 Open Secure AI Alliance,共建并分享促进 AI 负责任使用与信任的开放工具。
为什么重要:安全、评测、供应链和部署治理正成为 AI infra 的标配层;NVIDIA 试图把生态从芯片/CUDA 延伸到安全工具与行业规范。
来源链接
5. OpenAI Codex CLI releases 值得持续跟踪
摘要:OpenAI Codex releases 页面继续作为终端 coding agent 的官方变更入口;近期 coding-agent 生态还出现多 harness/skills 兼容层。
为什么重要:Agent coding 的竞争点正在从单次补全转向 repo 级执行、review、测试闭环和多模型后端;版本变化可能影响企业开发工作流。
来源链接