Anthropic 正式发布了 Claude Fable 5.1 和限量版 Mythos 5.1。这不仅仅是增量更新,更是对编程和知识处理两大关键领域的领导地位宣示。然而,最大的悬念不在于基准测试,而在于安全架构:该公司首次引入了一种协议,用于阻止通过操纵对话历史来“剥离”模型的尝试。
性能与经济性:押注智能体能力
API 价格与前代持平:每百万输入 token 10 美元,每百万输出 token 50 美元。但真正的成本节约来自架构改进。缓存读取成本降低了 75%,降至每百万次操作 0.25 美元。据该公司估计,典型场景现在成本降低 25%,而复杂的智能体任务则可节省高达 45% 的费用。
性能数据令人印象深刻。在 Terminal-Bench-Science 0.1 测试中,Fable 5.1 得分 52.6%,而 Fable 5 仅为 24.7%——翻倍增长。在 Terminal-Bench 4.0 基准测试中,成绩为 55.8%,稳超 Opus 5(52.3%)和 OpenAI 的 GPT-5.6 Sol(37.3%)。AutomationBench 中的表现几乎翻倍,达到 31.4%。模型知识库已更新至 2026 年 6 月。
保护新时代:“通过对话蒸馏”的终结
关键创新在于——禁止新的 API 账户编辑上下文历史。从技术上讲,这堵住了竞争对手通过重写长期对话中的先前消息来提取模型“原始推理”并保留内部逻辑记录的漏洞。据我所知,这正是蒸馏(用昂贵模型的输出来训练廉价模型)的常见手段。
问题比想象中更严重。2 月份,我记录了超过 1600 万条与蒸馏相关的对话,由约 24,000 个可疑账户发起。Anthropic 直接点名三家中国实验室:DeepSeek、Moonshot AI 和 MiniMax。仅 Moonshot 就贡献了 340 万次请求。白宫科技政策办公室主任迈克尔·克拉齐奥斯更进一步,指责 Moonshot 复制旗舰模型以打造 Kimi K3。
务实的过渡策略
限制仅适用于 8 月 31 日之后创建的账户。现有用户不会感受到变化,而 Fable 5 将至少可用到 2027 年 6 月。Fable 5.1 的支持将持续到至少 2027 年 9 月。
我的分析: 这是对“灰色”AI 实验室商业模式的一次先发制人打击。保护内部逻辑不仅是技术细节,更是重塑竞争格局的战略壁垒。问题在于,新的绕过方法会多快出现。AI 领域的军备竞赛才刚刚开始。