
Anthropic于周二正式发布Claude Opus 5.5。该模型在多数任务中的能力与公司更昂贵的Fable 5.1相当,且在典型工作负载下的运行成本较前代降低40%。此次发布距Opus 5问世仅两个月,凸显了AI行业在激烈竞争下向效率优先的战略转变。
对于开发者和企业而言,这一更新解决了长期痛点。Opus 5.5使长周期智能体编码项目和复杂知识型工作更具可行性。其输出速度提升超过30%,长会话中占据主要成本的缓存读取费用下降60%,降至每百万token 0.20美元。输入价格为每百万token 4美元,输出价格为每百万token 20美元,均低于Opus 5的费率。
早期用户反馈积极。Clio公司软件工程师Sean Heintz表示,该模型在处理涉及六个代码库的大型工程任务时,连续运行超过18小时,始终专注于定义服务交互并以最小返工应用更改,生成的代码注释简洁实用,“很难找到负面评价”。
基准测试与独立评估
基准测试显示,Opus 5.5在智能体编码、计算机操作及知识工作方面表现领先,并在多项内部测试中超越Fable 5.1。在一项将HAProxy服务器软件从C语言重写为Rust语言的评估中,Opus 5.5耗时9.5小时,而Fable 5.1需12小时且成本高出51%,两者重写后的代码均通过了几乎所有回归测试。
独立机构METR和Frontier Design的预发布测试进一步佐证了其安全性。在自动化行为审计中,Opus 5.5得分最高,尝试绕过安全边界的可能性比Opus 5或Mythos 5.1低85%。目前,生物安全和网络安全分类器保持激活状态,经认证的研究人员可通过专用计划获得扩展访问权限。
此外,模型的沟通风格显著优化。Opus 5.5将关键信息前置,减少行话使用,更严格地遵循写作规则,使回复更加自然清晰。测试人员指出,这种改进对于工程师并行监控多个智能体的场景至关重要。
定价压力重塑企业AI预算
成本降低恰逢企业重新评估AI预算之际。Artificial Analysis Intelligence Index的独立测试显示,Opus 5.5在生成较短输出时使用更少token,性能超越OpenAI的GPT-6 Astra Max。Anthropic还放宽了使用限制,提高了Pro、Max、Team及Enterprise计划中的时长上限,订阅者可保存并部署速率限制重置。快速模式可为时间敏感型工作提供高达2.5倍的速度,但定价更高。
技术规格方面,该模型支持100万token的上下文窗口和12.8万token的最大输出。值得注意的是,思考功能始终保持开启且无法禁用,以确保推理一致性,这要求现有代码进行相应适配。
Claude Opus 5.5已在所有主流平台上线,包括Claude API(模型ID:claude-opus-5-5)、Amazon Bedrock、Google Cloud和Microsoft Azure。在Bedrock上,默认不保留数据并应用区域控制和企业护栏。媒体报道指出,此次发布与Anthropic筹备潜在首次公开募股(IPO)的节奏相吻合,旨在保持竞争优势。
尽管Anthropic承认基准测试的边际优势可能夸大实际差异,且在实际部署中与Fable 5.1的差距会缩小,但公司强调此次发布平衡了效率与安全。继此前呼吁放缓前沿技术发展后,Opus 5.5并未宣称实现巨大的智力跳跃,而是在提升效率和安全性方面取得实质进步。
后续模型Sonnet 5.5和Haiku 5.5计划在未来几周内发布,预计将在速度、成本和对齐性方面带来类似提升。目前,Opus 5.5作为旗舰型号,最受益於运行长期编码智能体或深度分析工作负载的企业。较低的token消耗和更快的生成速度在长时任务中将产生显著的复利效应。
市场反应迅速,许多此前暂停订阅的用户回归。开发者反馈显示,Opus 5.5在单位智能性成本上优于竞争对手,且在复杂内核优化等多任务并行处理中显著提升生产力。随着OpenAI同日发布更新,价格战正式打响。业界普遍认为,无节制消耗token的时代正在结束,能够高效、清晰且安全完成工作的工具将成为企业大规模部署的首选。