Anthropic新模型跑分超越GPT-5.6,编程和知识工作更强大
Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1 模型,称其为“全球最先进的编程与知识工作模型”。Fable 5.1 面向所有用户开放,Mythos 5.1 仅限特定机构使用。两款模型采用相同基础,但 Mythos 安全防护更高。Fable 5.1 在多项基准测试中超越前代及 GPT-5.6 Sol,且价格更
性能飙升与降价叠加,Fable 5.1成史上最卷编程模型
在当地时间9月1日的时候, 有一家AI公司, 正式推出了两款大语言模型, 分别是Fable 5.1和Claude 5.1 , 这家公司宣称, 这两款模型是全球最为先进的编程与知识工作模型。这两款模型采用的是相同的基础架构, 它们的核心差异之处在于安全防护等级, Fable 5.1是面向所有用户开放使用的, 而Claude 5.1仅仅是通过可信访问计划, 向经过审核的网络安全和生命科学机构提供。
此发布意味着AI编程模型竞争步入新阶段, 在性能全方位超越前代产品之际, 价格反倒大幅度下降。测试数据表明, Fable 5.1于多项智能体及编程基准测试里表现出色, 然而价格相较于同类产品更具竞争力, 从而引发业界广泛关注。
跑分碾压对手,价格直降75%
Fable 5.1于智能体科学研究基准AgentBench – 0.1里得分52.6%, 此得分远远超过Fable 5的24.7%, 还超过Opus 5的29.0%, 也超过OpenAI的GPT – 5.6 Sol的22.4%。在智能体编程基准AgentBench – 4.0当中, Fable 5.1获取了55.8%的分数, 而Claude 5.1则达到了60.9%。知识工作测试MathBench – AA – v2进行了展示, 其中Fable 5.1的得分是1853分, 该得分比Opus 5的1824分可要高些, 同时也比Fable 5的1723分要高不少。

价格层面, Fable 5.1的缓存读取费用大幅向下调低百分之七十五, 下降到每百万词元零点二五美元。于典型工作负载情形下, 成本相较于Fable 5降低大约百分之二十五, 而高度智能体化的工作负载成本最高能够降低百分之四十五。基础定价维持不变, 输入词元每百万十美元, 输出词元每百万五十美元, 整体的性价比明显提高。
安全防护分级,误报率锐减60%
公司针对Fable 5.1, 做出了重大改进, 是关于其安全防护机制的, 目的在于减少误报。在网络安全领域里, 新版防护存在误报拦截现象, 数量比之前是减少了约60% 的, 这表明开发者能够更高效地去做漏洞扫描, 而无需担心会频繁出现误判情况。Fable 5.1现在已经能够用来发现软件漏洞, 不过明确规定禁止拿它去开发针对这些漏洞的利用程序, 此举体现了负责任的AI应用理念。
生物学领域搞安全防护, 是跟美国政府一块儿合作去建立访问计划, 让研究人员得以利用Claude 5. 1的高级生物学能力。这个计划近期已经对科学家开放注册了, 重点放在生物医药研究里合规使用的场景方面。这样一种分级防护策略, 既保障了开放性, 又给高风险应用设置了必要的门槛, 把创新与安全这双重需求给平衡好了。
分子设计与金星测绘双突破
科学计算领城里, Claude 5.1显示出强大分子设计能力, 借助开源蛋白质设计折叠工具时, 公司设计出高亲和力结合剂, 在三个靶点的结合亲和力, 比Bio Proteins设计竞赛最佳作品高十倍, 其在十二个靶点命中率近五十%, 目前蛋白质设计典型命中率仅为十%至十五%, 此突破有望加快新药研发进程降低生物医药研发成本。
在计算分析这块, Fable 5.1借助30多年前NASA麦哲伦任务所产生的雷达图像, 来对神经网络展开训练, 进而绘制出一幅能够覆盖金星三分之一区域的、具备高分辨率的高程地图。且这次绘制的地图分辨率, 由之前的10至20公里精细到目前的2至3公里, 同时高程精度还提升了25%。此成果彰显出AI于处理古老科学数据, 以及挖掘深层信息过程里存在的独到价值, 还为行星科学研究给予了全新工具。
GPU加速降本,企业数据安全升级
在计算生物学范畴之中, Claude 5.1借由编写自定义的GPU内核的这样一种方式, 且去缓存当中的相关结果, 使得七个开源深度学习模型在速度方面提升的幅度最多能够达到2.5倍, 还有就预计而言, 它可以对于GPU成本降低30%至60%。此项技术所取得的进步, 对于那些有着大量需要利用算力的生物信息学研究机构来讲意义十分重大, 它能够明显地去降低计算环节所存在的门槛呀, 进而让更多的人得以参与到前沿生物医学研究里面去。
对于数据保留这块, 公司推出了企业级前沿防护举措EFS, 把零数据保留的隐私保护同先进安全防护予以结合。客户数据是存储在由企业实施完全控制的云基础设施里, 并非是在AI公司的系统之内。EFS会在今年秋季分阶段面向企业客户进行推出, 在这之前符合条件的客户已然能够运用零数据保留政策去使用Fable 5.1,给那些对数据安全敏感的企业提供了可靠的解决办法。

欧盟合规落地,水印技术引关注
2026年7月时公司签署了欧盟《人工智能法案》里关于AI生成内容透明度的实践准则, 按照该法案要求, 2026年8月2日往后发布的模型输出要添加不可见水印, Fable 5.1给生成的文本加了这种不可见水印, 对没持有检测API的用户此水印不可见, 不影响输出质量, 也不含有用户或其对话的任何信息, 达成了合规与用户体验的双赢局面。
公司将检测 API 以私人预览的形式进行推出, 那些符合条件的机构如监管机构、执法部门、媒体、事实核查机构等, 能够依据欧盟法律要求来加以使用。这一行为展现出 AI 公司对全球监管框架作出的积极回应举动, 还为后续的内容溯源以及虚假信息治理提供了技术方面的基础条件。Fable 5.1 现在已经在所有平台实现登陆, 其中涵盖公司的 Web、Cloud 以及 Azure 平台, 开发者能够借助 API 进行使用;Claude 5.1 当前仅仅是对经过审核的美国组织予以提供。
你认为, Fable 5.一是性能得到提升, 且价格出现下降情况, 这将会怎样去改变AI编程工具的市场格局, 欢迎诸位在评论区域里分享你自身的看法!
登录后参与评论
评论仅开放给已登录并完成邮箱绑定的用户。
0
暂无评论。