Anthropic发布Claude Fable 5.1与Mythos 5.1:编程性能超越前代及GPT-5.6 Sol
9月2日,Anthropic于当地时间9月1日正式推出Claude Fable 5.1与Claude Mythos 5.1模型,公司称其为“全球最先进的编程与知识工作模型”。两款模型采用相同基础模型,区别在于安全防护等级:Fable 5.1面向所有用户开放,Mythos 5.1仅通过可信访问计划向经过审核的网络安全和生命科学领域机构提供。
Anthropic披露的基准测试数据显示,Fable 5.1在多项测试中超过前代Fable 5、Opus 5及OpenAI的GPT-5.6 Sol:
- Terminal-Bench-Science 0.1(智能体科学研究):Fable 5.1得分52.6%,Fable 5为24.7%、Opus 5为29.0%、GPT-5.6 Sol为22.4%。
- Terminal-Bench 4.0(智能体编程):Fable 5.1得分55.8%,Mythos 5.1在更宽松安全防护下达60.9%。
- GDPval-AA v2(知识工作):Fable 5.1得分1853,高于Opus 5的1824和Fable 5的1723。
Fable 5.1的缓存读取费用下调75%,降至每百万词元0.25美元。典型工作负载下,成本比Fable 5低约25%;高度智能体化工作负载最高可降低45%。基础定价不变:输入每百万10美元,输出每百万50美元。
Anthropic推出全新的企业级前沿防护措施(EFS),将零数据保留的隐私保护与先进安全防护相结合,客户数据存储在由企业完全控制的云基础设施中,而非Anthropic系统。EFS将于今年秋季分阶段向企业客户推出。
- 分子设计:Mythos 5.1在三个靶点的结合亲和力比蛋白质设计竞赛最佳作品高出10倍,12个靶点命中率接近50%(行业典型为10%-15%)。
- 计算分析:Fable 5.1基于NASA麦哲伦任务雷达图像,绘制了覆盖金星三分之一区域的高分辨率高程地图,分辨率精细至2-3公里,高程精度提升25%。
- 计算生物学:Mythos 5.1通过编写自定义GPU内核,将七个深度学习模型速度提升至多2.5倍,预计可降低GPU成本30%-60%。
Fable 5.1已为生成文本加入不可见水印(符合欧盟AI法案要求),正在以私人预览形式推出检测API。Fable 5.1现已在AWS、Google Cloud和Microsoft Azure上通过Claude API提供;Mythos 5.1目前仅面向经审核的美国组织开放。