当地时间9月1日,Anthropic宣布推出Claude Fable 5.1和Claude Mythos 5.1两款新模型。公司将其定位为“全球最先进的编程与知识工作模型”。
同一模型,两种安全等级
Fable 5.1与Mythos 5.1采用完全相同的基础模型,唯一的区别在于安全防护等级。
Fable 5.1面向所有用户开放;Mythos 5.1则仅通过可信访问计划,向经过审核的网络安全和生命科学领域的机构提供。
这种“同一模型、差异化防护”的设计,既让普通用户享受到最强能力,也让高风险研究场景有更灵活的操作空间。
性能:八项基准测试全面领先
Anthropic披露的基准测试数据显示,Fable 5.1在多项测试中超越了前代Fable 5、Opus 5以及OpenAI的GPT-5.6 Sol。
在智能体科学研究基准Terminal-Bench-Science 0.1中,Fable 5.1得分52.6%,而Fable 5仅为24.7%、Opus 5为29.0%、GPT-5.6 Sol为22.4%——新模型的得分是前代的两倍多。

在智能体编程基准Terminal-Bench 4.0中,Fable 5.1得分55.8%,Mythos 5.1在更宽松的安全防护下达到60.9%。
知识工作方面,Fable 5.1在GDPval-AA v2测试中获得1853分,高于Opus 5的1824分和Fable 5的1723分。

新模型的最大特点是强化了智能体能力——更擅长处理持续时间长、步骤多的复杂任务,并在过程中自主验证结果、调整优先级。
官方描述是:无论此前让Claude处理什么任务,Fable 5.1都能做得更多,并且把最难的部分完成得更出色。
成本:缓存读取砍价75%,最高省45%
价格方面,Fable 5.1的基础定价保持不变:输入每百万token 10美元,输出每百万token 50美元。
真正的变化发生在缓存读取环节——价格从每百万token 1美元降至0.25美元,降幅达75%。
缓存读取在智能体任务中占了成本的大头。
Anthropic用今年8月实际使用数据测算:典型工作负载下,Fable 5.1的整体成本比Fable 5低约25%;对于上下文更重、工具调用更多的高度智能体化任务,降幅最高可达45%。
安全与隐私:误报减少60%,EFS今秋上线
安全防护方面,Anthropic对Fable 5.1的防护机制进行了改进。在网络安全领域,新版防护措施的误报拦截数量比此前减少约60%。
Fable 5.1现在可用于发现软件漏洞,但不会用于开发针对这些漏洞的利用程序。
生物学领域,Anthropic与美国政府合作建立了访问计划,允许研究人员利用Mythos 5.1的高级生物学能力。
数据隐私方面,Anthropic推出了全新的企业级前沿防护措施(Enterprise Frontier Safeguards,EFS),将零数据保留的隐私保护与先进的安全防护相结合,客户数据存储在由企业完全控制的云基础设施中。EFS将于今年秋季开始分阶段向企业客户推出。
科研实战:蛋白质设计、金星地图、GPU加速
Anthropic还展示了新模型在科研领域的实战成果。

蛋白质设计方面,Mythos 5.1利用开源蛋白质设计和折叠工具,在三个靶点上设计的结合亲和力比Adaptyv Bio蛋白质设计竞赛最佳方案高出10倍;在全部12个靶点上命中率接近50%,而当前蛋白质设计领域的典型命中率仅为10%至15%。

天文学方面,Fable 5.1基于NASA麦哲伦号30多年前的雷达图像训练了一个神经网络,为金星三分之一的表面生成了新的高分辨率地形图,分辨率从之前的10至20公里精细到2至3公里,高程精度提升了25%。
计算生物学方面,Mythos 5.1通过编写自定义GPU内核并缓存中间结果,将7个开源深度学习模型的运行速度提升了最高2.5倍。
发布时机:IPO前的最后亮相
这次发布的时间节点颇为微妙。据The Information此前披露,已秘密提交IPO文件的Anthropic可能在9月7日美国劳动节之后正式公开招股书。Fable 5.1很可能是公司公开递表前的最后一次重量级模型发布。
不过,新模型上线后也有用户追问——能否同时给出“更透明、更慷慨”的会话和每周额度。此前8月29日,Anthropic宣布提高“标准周额度”,但这个数字是相对于5月以前的旧标准计算,与用户正在使用的临时额度相比实际反而有所下降。

(素材来自:Anthropic 智算芯能前沿网综合)
本文由智算芯能前沿网编辑整理,转载请注明出处。
