9月2日·星期三 12:00·来源:InfoQ

Fable 5.1 正式发布:性能翻倍、Agent成本下降45%,Anthropic 把顶级模型送进真实世界

Anthropic于9月1日正式发布Claude Fable 5.1与Mythos 5.1。两者基于同一底层模型,区别在于安全级别:Fable 5.1面向普通用户与企业开放,Mythos 5.1仅限受信任的网络安全及生命科学机构访问。新模型在智能体科学研究测试中成绩较前代翻倍,在编程、知识工作等任务中全面提升,Agent工作负载调用成本最高下降约45%。价格方面,缓存读取价降至每百万Token 0.25美元,降幅75%,但最高推理强度下任务成本较前代高约20%。在Terminal-Bench-Science 0.1测试中,Fable 5.1得分52.6%,远超Fable 5的24.7%。Anthropic强调模型更注重追查问题根因,投资机构Millennium案例显示其成功定位了困扰工程师四五年的罕见崩溃缺陷。外部评审平台CodeRabbit测试则显示,两者代码评审召回率几乎无差异。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(InfoQ)→