AI

Claude Sonnet 5.5发布:单任务成本最高降30%,性能逼近Opus 5.5

Anthropic发布Claude 5.5系列第二款模型Sonnet 5.5,侧重日常开发与知识工作。其API价格不变,但单项任务成本最高降30%,输出速度提升超30%。在多项代码与知识工作测试中,Sonnet 5.5性能逼近Opus 5.5,并在部分测试中超越GPT-6 Sol。此外,模型安全防护能力显著提升,系列第三款模型Haiku 5.5将于未来几周发布。

来源:36氪 ↗

Claude Sonnet 5.5发布:成本降30%,性能逼近Opus 5.5

Anthropic 发布了 Claude 5.5 系列的第二款模型 Claude Sonnet 5.5。与定位更高的 Opus 5.5 不同,Sonnet 5.5 侧重日常开发、代码修复及文档等工作,核心卖点是速度更快、成本更低。

核心升级:少花 Token,提升速度

Sonnet 5.5 的 API 价格与上一代 Sonnet 5 持平(输入2美元/百万Token,输出10美元/百万Token)。但其完成任务所需的计算量减少,单项任务成本最高降低 30%,输出速度提升超 30%。
在 Coding 场景中,新模型对代码库理解更快,能批量处理工具调用。在 Terminal-Bench 4.0 中得分 70.6%(Sonnet 5 为 10.3%);在 CursorBench 4.0 上达到 55.5%(Sonnet 5 为 34.1%)。

与 Opus 5.5 及 GPT-6 Sol 的对比

Opus 5.5 面向复杂、开放式任务,价格更高(输入4美元,输出20美元)。Sonnet 5.5 则适合明确的开发任务。在部分测试中,Sonnet 5.5 已非常接近 Opus 5.5,如 CursorBench 4.0 得分分别为 55.5% 和 57.8%。但在复杂开放式工作上,Opus 5.5 依然更强。
对比 OpenAI GPT-6 Sol,Sonnet 5.5 在知识工作方面表现更优。在 GDPval-AA v2.1 测试中,Sonnet 5.5 得分 1844,GPT-6 Sol 为 1487。

安全能力与后续规划

Sonnet 5.5 首次被纳入接近旗舰模型级别的网络安全防护体系,并增加了针对模型蒸馏的防护分类器。
随着 Sonnet 5.5 上线,Claude 5.5 系列已有 Opus 5.5 和 Sonnet 5.5。面向高并发、成本敏感场景的 Haiku 5.5 将在未来几周发布。

原始来源: 36氪 ↗

本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。

更多「AI」资讯

让品牌在 AI 中生长

免费诊断你的品牌 AI 可见度