昊梵体育网

Anthropic 刚刚放出大招——正式发布 Claude Fable 5.1 和 Mythos 5.1,号称「全球最先进的编程与知识工作模型」。 几个值得关注的点: · 性能断层式领先:科研 Agent 基准 Terminal-Bench-Science

Anthropic 刚刚放出大招——正式发布 Claude Fable 5.1 和 Mythos 5.1,号称「全球最先进的编程与知识工作模型」。

几个值得关注的点:

· 性能断层式领先:科研 Agent 基准 Terminal-Bench-Science 得分 52.6%,是上一代 Fable 5 的两倍多,也是 GPT-5.6 Sol 的 2.3 倍;代码工程基准从 42% 飙到 55.8%
· 能力更强还更便宜:基础定价不变,但缓存读取价格直降 75%,典型任务总成本降约 25%,复杂 Agent 任务最高省 45%
· 真·无人值守:Ramp 测试中连续自主运行 38 小时,自行修正实验误差、并行启动六组实验,一整夜后返回结果和建议;还帮对冲基金 Millennium 找到了一个潜伏四五年的幽灵 Bug
· AI 亲自下场做科研:用 NASA 30 年前的雷达数据重绘了金星三分之一面积的高分辨率地图;蛋白质设计命中率逼近 50%,行业平均只有 10%-15%

有意思的是,Fable 5.1 和 Mythos 5.1 其实是同一个模型,区别只在安全等级——前者面向所有人,后者只给通过审核的网安和生命科学团队。

时间点也很微妙:Anthropic 最快 9 月底 IPO,这边刚发布,OpenAI 那边就预告了 Astra 模型。AI 巨头的军备竞赛,越来越卷了。

你会第一时间升级试用吗?AI大模型 Anthropic