昨天,Anthropic 发布了 Claude Fable 5.1。
不绕弯子,这次主要更新了两件事:长任务能力更强,实际使用成本更低。
01长任务更强
Fable 5.1 的提升主要集中在 Agent 编程、多步骤研究,以及文档、表格和幻灯片等知识工作。
官方三项关键评测的变化最明显:
1科学与工程终端任务从 24.7% 涨到 52.6%,提高 113%;
2复杂商业工作流从 17.1% 涨到 31.4%,提高 84%;
3Agent 终端编程从 42.0% 涨到 55.8%,提高 33%。
![]()
▲ 图:Anthropic 官方评测,Fable 5.1 一列已标红。
但不能把它概括成“整体性能翻倍”。Artificial Analysis 的综合指数从上一代的 62 分涨到 66 分,相对提高约 6.5%。
准确的说法是:Fable 5.1 在需要连续调用工具、保存状态的复杂任务上,进步更大。
02实际成本更低
API 输入和输出标价没变,仍是每百万 Token 10 美元和 50 美元。
降价的是缓存读取,从每百万 Token 1 美元降到 0.25 美元,下降 75%。
Agent 会反复读取相同的代码、文档和历史记录,所以缓存越便宜,长任务越省钱。
Anthropic 估算,普通工作负载的实际成本可下降约25%,高度 Agent 化任务最高可下降约45%。
这里降的是实际使用成本,不是 API 全面降价。
Artificial Analysis 的测试里,Fable 5.1 High 与上一代 Fable 5 Max 同为 62 分,单项任务成本却从 3.14 美元降到 1.43 美元,下降约 54.5%。
![]()
▲ 图:Artificial Analysis 的 Intelligence Index 与 Cost per Task 对比。
就这么简单。
短对话、改文案、简单代码,便宜模型依然更划算。需要长时间运行、反复读取大量上下文的 Agent 工作流,才是 Fable 5.1 真正有优势的地方。
以上结论来自 Anthropic、System Card 和 Artificial Analysis 的公开数据。
你更在意性能提升,还是实际账单能降多少?
觉得有用 → 点个❤️在看转给朋友
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.