
9月1日,Anthropic一口气推出两款新模型——Claude Fable 5.1和Claude Mythos 5.1。官方口径是“全球最先进的编程与知识工作模型”,翻译成大白话:写代码更狠了,干脑力活更聪明了,而且比上一代还便宜不少。
两款模型共用同一个“大脑”,区别在于安全级别。Fable 5.1向所有用户开放,像个身手敏捷的通用工具;Mythos 5.1则只向通过审核的网络安全和生命科学机构开放,属于“受管制”版本。
先看最硬核的跑分数据。在智能体编程基准Terminal-Bench 4.0测试中,Fable 5.1得分55.8%,比前代Fable 5的24.7%翻了一倍还多。更刺激的是,它把OpenAI的GPT-5.6 Sol(22.4%)甩开了整整30多个百分点。在科学研究基准Terminal-Bench-Science中,Fable 5.1拿下的52.6%对比GPT-5.6 Sol的22.4%,几乎是碾压局。
价格方面更有意思——性能涨了,钱反而省了。缓存读取费用直接砍掉75%,降到每百万词元0.25美元。典型工作负载下的成本比Fable 5低约25%,如果是高度智能体化的活儿,最高能省45%。基础定价保持原样:输入每百万词元10美元,输出每百万词元50美元。这波操作等于告诉整个行业:性能升级和降价可以同时发生。
Anthropic这次在安全上也做了文章。Fable 5.1的误报拦截数量比之前减少了约60%,现在它能帮你找软件漏洞,但不会拿去写攻击代码。生物领域则和美国政府合作搞了个访问计划,科学家可以用Mythos 5.1研究高级生物学问题。
科学落地案例也拿出来展示了。比如,Mythos 5.1做蛋白质设计,在三个靶点上的结合亲和力比竞赛最佳作品高出10倍,在12个靶点上的命中率接近50%——目前行业的典型水平只有10%到15%。再比如,Fable 5.1拿NASA麦哲伦任务30多年前的雷达图像训练神经网络,画出了覆盖金星三分之一区域的高清高程地图,分辨率从原来的10到20公里精细到了2到3公里。还有更务实的:Mythos 5.1通过写自定义GPU内核,把七个开源深度学习模型的速度提升了最多2.5倍,意味着GPU成本能省下30%到60%。
一个值得留意的细节是合规动作。Anthropic在2026年7月签了欧盟《人工智能法案》的透明度准则,从2026年8月2日之后发布的模型输出都要加不可见水印。Fable 5.1已经这么做了,水印不影响输出质量,也不含用户个人对话信息,监管机构可以拿专门API来检测。这算是大模型厂商首次大规模把水印落到商业产品上。
两款模型现在都上线了,Fable 5.1可通过AWS、Google Cloud、Azure和Claude API用上,Mythos 5.1目前只对美国审核过的机构开放。
Anthropic这波操作背后其实是一套清晰的商业逻辑:不跟你拼参数大小,拼的是实际干活的能力、成本和安全。当“更聪明+更便宜”不再是营销话术而是真实跑分时,OpenAI的压力不会小。