Anthropic 正式发布 Claude Opus 5.5:性能对标 Fable 5.1,成本降低 40% - 果核剥壳

9 月 23 日,Anthropic 宣布推出 Claude Opus 5.5 模型,这是全新 Claude 5.5 家族的首个成员。官方表示,该模型在大多数工作场景中的表现可媲美 Claude Fable 5.1,而运行成本较 Opus 5 降低 40%。

Anthropic 正式发布 Claude Opus 5.5:性能对标 Fable 5.1,成本降低 40%

性能大幅跃升

据 Anthropic 公告,Opus 5.5 在性能上较 Opus 5 显著提升。早期测试中,一名测试者借助该模型在不到一天内完成了原定需数周时间的 68 万行代码迁移任务。在软件优化方面,当被要求缩短网页应用每个页面的加载时间时,Opus 5.5 在 40 次尝试中成功 39 次,而 Opus 5 仅做出小改进且改变了应用原有行为。另有测试者让多个 Claude 模型依据单一提示构建游戏,Opus 5.5 凭借画面表现和精致度获得最高评分。

安全性达到历史新高

在 Anthropic 的自动化行为审计中,Opus 5.5 取得了迄今所有模型中的最高分数。该模型采取难以逆转行动或越界的概率更低,抗提示注入能力也优于 Opus 5。官方同时扩大了对齐测试范围,新增更长任务、不可完成任务及基于真实事件的场景。

鉴于 Opus 5.5 在生物学和网络安全领域的能力与 Claude Mythos 5.1 相当,官方在部署时采取了与 Claude Fable 5.1 类似的防护措施。经审核的机构即日起可申请生命科学验证项目;未来几周内,认证的网络安全从业者也将获得网络验证项目的访问权限。

价格与速度双优化

Opus 5.5 所需计算量低于 Opus 5,默认设置下典型工作负载成本降低 40%,输出速度提升 30% 以上。定价方面:输入和输出 Token 分别为 4 美元和 20 美元/百万 Token,较 Opus 5 下调 20%;缓存命中价格为 0.20 美元/百万 Token,降幅达 60%。

此外,Anthropic 放宽了 Pro、Max、Team 等套餐的使用时间限制,并为订阅用户推出速率限制重置功能。在沟通能力上,新模型表达更自然清晰,善于将关键信息前置。Claude Sonnet 5.5 与 Haiku 5.5 将于未来几周发布。在官方基准测试中,Opus 5.5 在智能编码、计算机使用和知识工作领域保持领先地位。

 

如果您喜欢本站,点击这儿不花一分钱捐赠本站

这些信息可能会帮助到你: 下载帮助 | 报毒说明 | 进站必看

修改版本安卓软件,加群提示为修改者自留,非本站信息,注意鉴别

赞 (0)
上一篇 2天前
下一篇 2天前

相关推荐

发表回复

评论问题之前,点击我,能帮你解决大部分问题

您的电子邮箱地址不会被公开。 必填项已用*标注