欢迎光临
我们一直在努力

最新Claude Fable 5上线:这次,AI真的开始接“硬活”了

最近圈里最热的讨论大概就是:Anthropic 把之前一直“藏着用”的 Mythos 级模型,正式以 Claude Fable 5 的形式放到了普通用户面前。

先说清楚,Fable 5 和 Mythos 5 本质上是同一个底层模型的两个版本。Mythos 5 继续只给少数审核过的安全机构、基础设施厂商和专业研究者用;Fable 5 则加了一层安全分类器,开放给普通用户。 名字也挺有意思:Mythos 是“神话”,Fable 是“寓言”。可以理解为:神话级能力,做了安全包装后,讲给所有人听。

这次真正值得关注的,不是“又一个跑分第一”,而是它开始能接真实工作里的硬任务了。

从官方公布的数据看,Fable 5 / Mythos 5 在编程、长任务、视觉理解、知识工作上都比 Opus 4.8 明显更强。比如 SWE-Bench Pro 达到 80.3%,Opus 4.8 是 69.2%;FrontierCode 更夸张,29.3% 对 13.4%,直接翻了一倍多。空间推理 Blueprint-Bench 也是 38.6% 对 14.5%,差距很明显。

不过这里要讲一句实话:有些带星号的安全相关测试,比如 Terminal-Bench、ExploitBench,表里更像是 Mythos 5 的成绩。普通用户拿到的 Fable 5,如果碰到网络安全、生物化学、模型蒸馏这类敏感问题,会静默切回 Opus 4.8。官方说超过 95% 的会话不会触发 fallback。也就是说,你正常写代码、读文档、看财报、做运营分析,大多数时候用到的就是 Mythos 级底座;但别指望拿它去做高风险攻击或敏感实验设计。

公众反馈也很有意思。开发者普遍最兴奋,因为它不是只会写几个函数,而是能理解大项目、做迁移、查 bug、补测试。比如官方提到,Stripe 让 Fable 5 处理一个超大规模 Ruby 代码库迁移任务。原本人工团队可能要两个月,Fable 5 在一天内完成了核心迁移工作。 知识工作者关注的是它的长文档能力:合同、财报、论文、会议纪要这些材料,以前 AI 很容易读到后面忘前面,现在 Fable 5 的 1M 上下文和长程稳定性,让它更像一个能连续干活的助理。也有人担心价格,毕竟 $10 / $50 每百万 token,是 Opus 4.8 标准价的两倍,不适合拿来问“今天吃什么”。

使用时间方面要注意:官方在23 日后会从订阅中移除,改成 API 按量计费。简单说,这段时间就是体验窗口,能用就尽量用起来。

目前OneDone AI 已经支持 Claude Fable 5。 如果你想试,不建议只问它“你是谁”“写篇文案”。直接上传你的代码、合同、财报、论文、截图或业务资料,让它处理一个真实任务,你会更容易感受到这次升级的价值。 入口已经开了,想体验 Fable 5 的朋友,可以直接到OneDone AI去体验。不需要头疼魔法,以及昂贵的价格,冲多少用多少。在这里插入图片描述

赞(0)
未经允许不得转载:171主机测评 » 最新Claude Fable 5上线:这次,AI真的开始接“硬活”了
分享到: 更多 (0)

评论 抢沙发

  • 昵称 (必填)
  • 邮箱 (必填)
  • 网址