June 9, 2026
Key Signals
-
Claude Fable 5 是首个公开发布的 Mythos 级模型,在 SWE-Bench Pro 上得分 80%——领先 Opus 4.8 十一个百分点,领先 GPT 5.5 二十一个百分点。 Anthropic 同时发布了 Fable 5(公开版,带安全护栏)和 Mythos 5(仅限 Project Glasswing 合作伙伴)。该模型定价为每百万输入/输出 token $10/$50——是 Opus 4.8 的两倍——并独特地要求所有用户强制 30 天数据留存,开创了"获取前沿能力必须接受强制日志记录"的行业先例。据报道,Stripe 使用 Fable 5 在一天内完成了 5000 万行 Ruby 代码库的现代化改造。 [1][2][3]
-
GitHub 现已自动验证所有第三方编程代理生成的代码——包括 Claude 和 Codex——使用与自身 Copilot 云代理相同的 CodeQL、密钥扫描和依赖项检查。 此 GA 版本意味着无论哪个工具编写的代码都会接受安全分析,代理会在最终提交 Pull Request 前自动尝试修复发现的问题。自 2025 年 10 月为 Copilot 云代理启用验证以来,GitHub 已主动阻止了数百个潜在安全泄露。 [4]
-
编程代理正从个人开发者工具演变为团队基础设施,一周内三个平台同时发布,分别解决协调、管理和治理问题。 Augment Code 的 Cosmos 充当代理舰队的 CI/CD 式控制平面并提供共享记忆;Cognition 的 Devin Desktop 通过 Agent Client Protocol 提供代理中立的管理控制台;Microsoft 的 Rayfin 治理代理构建的应用后端并部署到 Fabric。这一模式与版本控制从个人便利工具发展为带有分支、审查和策略的共享基础设施的历程如出一辙。 [5]
-
GitHub Copilot、Copilot CLI 和 Claude Code 在同一天交付了 Fable 5 支持,展示了新前沿模型的快速多工具集成能力。 Copilot CLI v1.0.61 还新增了 /settings 交互式对话框、/worktree git 工作树命令、从 .github/mcp.json 自动加载 MCP 服务器,以及通过 /every 和 /after 命令实现的自然语言任务调度。Claude Code v2.1.170 同时修复了会话记录保存的 bug。 [6][7][8]
-
Anthropic 的模型卡揭示了隐藏护栏:Fable 5 会在用户不知情的情况下限制其在前沿 AI 开发任务中的效果——引发供应链信任担忧。 与网络安全/生物相关请求明确回退到 Opus 4.8 不同,这些限制通过提示词修改、引导向量或 PEFT 静默降低输出质量,适用于构建预训练流水线或 ML 加速器设计等任务。批评者认为这使得任何构建 AI 组件的公司都无法完全信任该工具,因为无法区分模型困惑和隐藏策略执行。 [9]
-
代码审查范式正在发生转变:高 AI 采用率的团队合并 PR 数量增加了 98%,而审查时间增长了 91%,推动审查重心从 AI 生成的代码差异上移到意图和规格说明。 建议的模型将约 75% 的审查反馈编码为确定性 AST 检查和执行测试,将真正的判断性评审交给独立的验证代理,将人类检查点移至在代码生成之前审查验收标准。 [10]
AI Coding News
-
Anthropic 发布 Claude Fable 5,这是其 Mythos 模型的首个公开版本,专为前所未有规模的自主软件工程设计。 该模型擅长长期自主编程任务,可在多页规格说明上自主工作数小时。Pro、Max、Team 和按席位计费的企业版在 6 月 22 日前免费使用,之后需要消费额度。Anthropic 在发布前进行了超过 1000 小时的漏洞悬赏测试,未发现通用越狱方法。 [1]
-
Ethan Mollick 展示了 Fable 5 的 vibe coding 能力,在 Claude Code 中通过单次提示生成了多个可玩的视频游戏。 这位 AI 研究者创建了贪吃蛇、名为 Strata 的地下探索游戏,以及基于里尔克《杜伊诺哀歌》的诗意主题游戏——全部来自一次性提示。他还生成了一张详细的等时线地图,展示地点间的旅行时间。他指出该模型"以相当大的优势超越了我使用过的所有其他公开模型",并能在多页规格说明上执行长达十二小时。 [11]
-
Anthropic 产品管理负责人确认 Fable 5 的安全机制偏向保守,意味着某些良性查询也可能被路由到能力较弱的 Opus 4.8。 该公司正与美国政府合作推出 Mythos 5,并向"部分生物学研究人员"提供不受限制的版本,"直到可信访问计划上线"。Anthropic 承认所有 AI 实验室最终都将不可避免地提供 Mythos 级别的能力,当前的安全姿态只是临时过渡方案。 [3]
-
三个主要平台——Cosmos、Devin Desktop 和 Rayfin——在数天内相继发布,共同构建 AI 编程代理的"团队层"。 Cosmos 提供带共享记忆的生命周期协调,使代理在会话间保留学习成果。Devin Desktop 通过 ACP 支持代理中立管理,让团队从同一控制台驱动 Codex CLI 和 Claude 代理。Rayfin 将代理构建的后端路由到带有继承安全和合规策略的治理租户。开放问题是这个团队层将趋于统一还是分裂为竞争性控制平面。 [5]
-
Microsoft Foundry 在 Build 2026 上获得重大更新,聚焦生产 AI 代理,包括托管沙盒会话、工具箱运行时发现机制,以及展示 7–14% 成功率提升的程序性记忆。 工具箱允许工具和 MCP 客户端注册一次后在运行时发现。Foundry IQ 提供统一的知识检索层,直接发布到 Teams 和 M365 Copilot 将于 2026 年 6 月正式上线。该平台定位为 Copilot Studio 的代码优先对等体,用于构建受治理的生产代理。 [12]
-
OpenAI 发布了两个案例研究,展示 Nextdoor 和 Notion 的工程团队如何将 Codex 用于日常开发工作流。 这些客户故事突显了 Codex 在生产环境中超越早期实验阶段的采用情况,尽管发布时完整详情未公开可访问。 [13][14]
-
代码审查的未来必须从阅读 AI 生成的差异转向验证声明的意图,这是对 AI 密集型团队审查瓶颈的分析结论。 使用 AI 审查 AI 生成的代码创造的是"一面镜子,而非检查点"——因为存在非确定性、缺失意图和重复盲区。提出的替代方案:对约 75% 的审查反馈使用确定性检查,将人类审查移至 8 行规格说明而非 400 行差异,并使用无共享上下文的独立验证代理处理真正的判断性决策。 [10]
Feature Update
-
Claude Fable 5 现已在 GitHub Copilot 的所有主要界面中正式可用,包括 VS Code、Visual Studio、JetBrains、Xcode、Eclipse、Copilot CLI 和云代理。 面向 Pro+、Max、Business 和 Enterprise 用户开放,由于 Anthropic 强制要求 30 天数据留存用于安全分类器,管理员需显式启用该模型。Copilot 中所有其他 Claude 模型(Opus 4.8、Sonnet 4.5、Haiku 4.5)继续采用零数据留存策略。该模型按提供商标价在使用量计费下收费。 [2]
-
GitHub 发布了面向所有第三方编程代理的 GA 安全验证功能,自动运行 CodeQL 漏洞分析、Advisory Database 依赖项检查和密钥扫描。 该功能默认开启,遵循现有 Copilot 仓库设置,不需要 GitHub Advanced Security 许可证。如果检测到问题,代理会在最终提交 Pull Request 前尝试修复。 [4]
-
Claude Code v2.1.170 新增了 Claude Fable 5 支持并修复了会话记录 bug。 从 VS Code 集成终端或继承了 Claude Code 环境变量的 shell 启动的会话现在可以正确保存记录并出现在 --resume 中。用户必须更新到 v2.1.170 才能访问 Fable 5。 [7]
-
Copilot CLI v1.0.61 发布,带来 Claude Fable 5 支持、新的 /settings 对话框、/worktree 命令、MCP 自动发现和自然语言任务调度。 /worktree 命令(别名 /move)创建新的 git 工作树并移动未提交的更改。MCP 服务器从 .github/mcp.json 工作区配置自动加载。/every 和 /after 的自然语言表达支持 cron 表达式、日历时间和相对时长。大型 monorepo 中的 grep 搜索现在使用索引搜索引擎,速度显著提升。 [6]
-
OpenAI Codex v0.139.0 在代码模式中引入独立 Web 搜索、改进了 MCP 工具 schema 处理并增强了诊断功能。 代码模式现在可以直接调用 Web 搜索,包括从嵌套的 JavaScript 工具调用中调用,接收纯文本结果。工具 schema 现在保留 oneOf 和 allOf 结构,大型 schema 压缩时保持更多浅层结构。Bug 修复涉及会话恢复、MCP 启动警告、图片编辑路由和线程重置行为。 [8]
-
Gemini CLI 发布补丁 v0.45.3 和 v0.46.0-preview.3,均修复了 Vertex AI 模型映射问题。 每日构建版本(v0.47.0-nightly.20260609)更新了 Antigravity 过渡横幅的显示次数限制,并从浏览器代理文档中移除了"实验性"文字,表明 Gemini CLI 向 Antigravity 迁移的持续推进。 [15][16][17]