
Anthropic今天推出了两款新一代AI模型:主模型Claude Fable5.1,以及服务于网络安全和生命科学专项项目的限用版本Mythos5.1。两个模型共用一套技术底座,最大的变化是——更强的大脑,更低的账单,以及首次内置的AI文本水印。
先说性能。在Terminal-Bench 4.0智能体编码测试里,Fable5.1拿到55.8分,Mythos5.1更冲到60.9分。科学研究推理测试Terminal-Bench-Science 0.1上,Fable5.1得分为52.6,是上一代Fable5的两倍,也把GPT-5.6Sol甩在了身后。翻译成人话就是:让AI自己动手写代码、做实验设计的能力,这次是真升级了。
价格上的动作更直接。新模型把缓存读取价格砍到每百万Token只要0.25美元,比白菜价还白菜价。在典型工作负载下,企业用户能省25%左右的推理成本,而长时间跑复杂Agent任务的场景,最高能省45%。之前很多公司被顶级模型的推理费用劝退,Fable5.1想解决的就是这个问题。
另外还有个值得关注的细节:Fable5.1和Mythos5.1是Claude系列第一批内置AI文本水印的产品。这意味着AI生成的文字可以被探测追溯,对打击深度伪造和信息造假多了一层技术防线。
安全过滤机制也做了优化。模型识别软件漏洞的自主能力增强,网络安全场景误报率降低了60%,生物学无害查询的误报率则下降85%——简单说,AI现在更清楚什么时候该报警,什么时候不该瞎报警。Mythos5.1之所以只对特定项目开放,也正是因为它在这些高危领域拥有更强的权限。
AI模型的竞赛正在从“谁的参数大”转向“谁跑得起、用得上”。Fable5.1把推理性能、编码能力和商业成本放进同一个天平上校准,这可能是2025年AI行业最值得关注的信号之一。