Anthropic发布Fable 5.1:性能登顶成本降25%,剑指2万亿美元IPO

Anthropic发布Fable 5.1:性能登顶成本降25%,剑指2万亿美元IPO

当地时间9月1日,Anthropic推出新一代旗舰模型Fable 5.1,并面向拥有相应权限的高风险机构推出宽松护栏版Mythos 5.1。公司在多项编程与科研基准测试中超过上一代Fable 5以及OpenAI的GPT-5.6 Sol,并将典型工作负载的预期成本较Fable 5下调约25%。此次发布正值Anthropic最快于9月底登陆美股IPO前夕,被市场视为对其约2万亿美元估值的强力背书。

性能:八项公开基准全部夺冠

Fable 5.1在编程、知识工作与长周期Agent任务上均有显著提升。其中科研基准Terminal-Bench-Science从24.7%跃升至52.6%,多项公开基准实现全面登顶。公司称新模型尤其强化了长时间、多步骤任务的执行能力。

长周期Agent能力成核心卖点

Fable 5.1可连续数小时完成编程、研究等工作,并自主验证结果、调整任务优先级,更适配企业级自动化与科研辅助场景。

成本:缓存读取价格直降75%

Anthropic将缓存读取价格从每百万token 1美元降至0.25美元,降幅达75%;典型智能体任务成本最高可降约45%。在中低推理强度下即可用更低成本达到上一代高推理强度相当甚至更好的表现,性价比成为本轮升级重点。

对比项 Fable 5 Fable 5.1
缓存读取价格(每百万token) 1美元 0.25美元(降75%)
典型工作负载成本 基准 约降25%
高度Agent化任务成本 基准 最高降45%
Terminal-Bench-Science 24.7% 52.6%

商业化:企业数据留存EFS与IPO背书

同步推出的企业前沿防护(EFS)安全架构,面向企业级数据留存与合规需求。公司最快9月底叩开美股大门,若按约2万亿美元估值募资,有望刷新SpaceX创下的全球最高IPO募资纪录,也标志着头部大模型公司从「拼性能」全面转向「拼性价比+拼商业化」。

FAQ

Q1:Fable 5.1相比上一代最大变化是什么?

性能与成本双线突破:基准测试登顶,同时缓存读取价格降75%、典型负载成本降约25%,长周期Agent任务能力显著强化。

Q2:Mythos 5.1是什么定位?

是面向高风险机构的宽松护栏版本,适合需更低使用限制、但具备更强安全与合规能力的科研与特殊场景。

Q3:缓存读取降价对企业意味着什么?

企业级长上下文与多轮对话的重复调用成本大幅下降,直接压低Agent类应用的推理账单,利好规模化部署。

Q4:本次发布与AnthropicIPO有何关联?

在IPO前夕展示领先性能与明确降本路径,是为估值提供硬支撑,也回应资本市场对大模型盈利能力的关切。

© 版权声明
THE END
喜欢就支持一下吧
点赞11 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容