美国当地时间9月1日,Anthropic同时发布Claude Fable 5.1和Claude Mythos 5.1。两款模型使用相同底层架构,区别仅在安全限制:Fable 5.1面向Pro、Max、Team及企业用户全面开放,Mythos 5.1仅通过审核机制向部分网络安全与生命科学专业用户提供。
Anthropic CEO达里奥·阿莫迪在发布中给出的定位很直接:这是当前全球最强模型。Anthropic官方基准显示,Fable 5.1在编码、科学研究、知识工作、业务自动化等全部8项测试中均列第一。最引人注目的是科研智能体能力:在Terminal-Bench-Science 0.1测试中,Fable 5.1得分52.6%,GPT-5.6 Sol仅22.4%,Fable 5为24.7%。Fable 5.1在这项任务上的成绩是GPT-5.6 Sol的2.3倍。
Ramp测试中,Fable 5.1在无人值守下连续运行38小时,主动发现此前实验存在标签误差,启动6项新实验并返回结果。投资公司Millennium则用Fable 5.1解决了一个困扰四五年的罕见崩溃问题——模型通过反汇编第三方软件库并与核心转储文件比对,定位到外部库中的Bug。
价格策略同步调整。输入和输出价格不变,但缓存读取价格从每百万Token 1美元降至0.25美元,降幅75%。Anthropic测算,典型工作负载整体成本较Fable 5下降约25%,复杂编码和高度代理化任务成本最高可降45%。
不过第三方机构Artificial Analysis给出了更冷静的视角:在最高推理强度下,Fable 5.1单任务平均成本为3.76美元,反而比Fable 5高20%,原因是其输出Token消耗约为前代的1.7倍。若将推理强度调至xhigh,单任务成本降至2.72美元。
科学研究案例是另一重点。蛋白质设计实验中,Mythos 5.1在12个靶点上生成近50%有效结合剂命中率,行业典型水平为10%至15%;计算建模方面,Fable 5.1利用NASA麦哲伦号雷达图像,将金星高程图分辨率从10-20公里提升至2-3公里;计算生物学方向,Mythos 5.1通过编写定制GPU内核,将7个开源深度学习模型推理速度最高提升2.5倍。
安全机制也有调整。Fable 5.1在网络安全场景中平均干预次数减少约60%,企业数据可通过全新的Enterprise Frontier Safeguards存放在客户自己控制的云基础设施中,预计今年秋季分阶段推出。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.