
Anthropic正式推出Claude Opus 5.5,这是其新系列模型的首款产品。该公司表示,新模型在运行速度提升30%以上的同时,总运营成本较Opus 5降低约40%,并在大多数任务中达到了与Claude Fable 5.1相当的性能水平。
据Anthropic披露,Opus 5.5在多项基准测试中表现优异。在代理式编程任务中,其在Terminal-Bench 4.0上的得分(66.4%)显著高于Fable 5.1(55.8%)及OpenAI的GPT-6 Astra(57.9%)。在知识工作(GDPval-AA v2.1)和多学科推理(Humanity's Last Exam)等指标上,Opus 5.5同样领先于Fable 5.1和GPT-6 Astra。仅在业务流程自动化和部分科学研究基准上,GPT-6 Astra略占优势。Anthropic强调,Opus 5.5以更低的单位任务成本实现了与竞品相当甚至更优的性能。
降价增效:Token价格下调20%
为回应客户对成本和效率的关切,Anthropic大幅调整了定价策略。Opus 5.5的输入Token价格为每百万4美元,输出Token为每百万20美元,较Opus 5分别下调20%。此外,缓存读取成本从每百万0.50美元降至0.20美元,降幅达60%;缓存写入成本也从6.25美元降至5美元。
得益于模型效率的提升,Opus 5.5生成输出所需的Token数量更少。结合价格下调,其总体运营成本比Opus 5降低约40%。对于订阅用户,五小时使用限制相应延长25%,并新增保存一次重置限制的功能,以应对突发需求。
Claude Sonnet 5.5和Haiku 5.5预计将在未来几周内推出,届时将在性能、效率和安全方面实现类似的提升。
优化沟通风格与安全机制
针对早期模型因公式化、复杂的“类克劳德式”(Claudish)写作风格受到的批评,Opus 5.5进行了针对性优化。新模型优先呈现核心信息,减少行话使用,并更严格地遵循写作指令。早期测试反馈显示,其表达更加清晰自然,更适合长时间工作会话。
在安全方面,Opus 5.5是首款具备与Fable 5.1同等网络安全、生物技术及前沿大模型开发防护措施的Opus系列模型。当触发特定安全分类器时,请求将被透明路由至其他模型:大多数网络安全任务转由Opus 4.8处理,涉及生物学或前沿LLM开发的请求则路由至Opus 5。经验证的组织可通过生命科学验证计划申请用于生物研究,网络安全验证计划也将在未来几周扩展至Opus 5.5。
强化合规与反蒸馏措施
Anthropic呼吁随着模型能力提升提高安全标准,主张公共政策应在设定自动化AI研究模型的安全标准中发挥更大作用。外部组织Frontier Design和METR已在发布前对Opus 5.5完成测试。
为应对“蒸馏攻击”并符合欧盟《AI法案》,Opus 5.5引入了多项新措施。包括首次随Fable 5.1推出的“保留思考”(Preserved Thinking)功能,防止API用户通过编辑上下文提取推理过程。该措施适用于2026年8月31日或之后创建的API账户中的Fable 5.1和Opus 5.5。此外,新模型强制启用“思考”模式,提供零数据保留选项,并添加水印以满足合规要求。Anthropic引用2026年9月的威胁报告称,已检测并阻止了利用数千虚假账户进行的非法蒸馏活动。
目前,Claude Opus 5.5已在Amazon Web Services、Google Cloud和Microsoft Azure等平台上线。开发者可通过模型ID claude-opus-5-5 进行调用。