
Anthropic正式发布Claude Sonnet 5.5模型。在Terminal-Bench 4.0代理编程测试中,该模型得分高达70.6%,不仅远超Sonnet 5的10.3%,更击败了得分为66.4%的旗舰模型Opus 5.5。这是首款搭载前沿级网络安全防护机制及防推理提取分类器的Sonnet系列模型。
性能跃升与成本优化
Anthropic表示,相较于前代模型,Sonnet 5.5的运行速度提升超过30%,单项任务成本降低多达30%。其定价定为每百万输入令牌2美元,每百万输出令牌10美元。公司称此价格与此前Sonnet 5的定价保持一致。
然而,这一价格表述存在疑点。今年6月的报道指出,上述价格实为Sonnet 5截至8月31日前的入门优惠价,此后已调整为输入3美元、输出15美元。此次公告中的价格对比,可能仅参照了旧有的入门价格,或意味着此前的涨价计划并未实际执行。
安全能力下放与防御机制
Sonnet 5.5是首款继承原本仅用于最强大模型严格限制的Sonnet版本。其网络安全能力与Opus 5相当,高风险网络请求将自动回退至Sonnet 5处理,而生物安全保护级别保持不变。
此外,该模型引入了针对“思维链”提取的第二道防线。通过分类器绑定推理过程与生成内容,旨在阻止类似今年8月研究人员从多家科技公司系统中解码出大量API密钥和密码的推理提取攻击。
综合评估与合规背景
在涵盖44个职业的GDPval-AA测试中,Sonnet 5.5得分为1,844分,略低于Opus 5.5的1,846分,但显著高于Sonnet 5的1,449分。Anthropic指出,Opus在处理需持续判断力的开放式任务上仍具明显优势。
公司方面呈现出一套看似矛盾的说辞:一方面声称Sonnet 5.5未推动模型能力边界,因此对齐评估范围较窄;另一方面又强调其网络能力的大幅提升足以证明采用前沿级防护措施的合理性。此举也呼应了欧盟《人工智能法案》第55条的要求,该条款规定具有系统性风险的通用模型提供商须加强基础设施保护并进行对抗性测试,相关义务及罚款权力已于2025年8月生效。