OpenAI 与 Anthropic 同日发布新一代 AI 模型,双方在提升运行速度的同时,均实现了较前代产品更低的整体成本。

GPT-6 Sol 与 Luna:更低门槛,更高精度

OpenAI 推出的 GPT-6 Sol 和 GPT-6 Luna 是今年 7 月发布的 5.6 版本的后续型号,紧随 9 月初问世的 ChatGPT Astra 之后。新模型旨在降低使用门槛,让更多用户以更低预算体验 GPT-6 Astra 的强大功能,同时为商业及开发者工作流提供更高的使用限额。

得益于与 Astra 相似的训练方法,Sol 和 Luna 在编码及计算机操作能力上显著增强。尽管 OpenAI 仍认定 GPT-6 Astra 为“全球最佳的计算机使用模型”,但新模型已能充分释放其技术红利。此外,最新模型高度重视事实准确性,官方称其错误率不足前代产品的一半。

目前,GPT-6 Sol 和 Luna 正逐步向 ChatGPT Work 和 Codex 平台推送。值得注意的是,免费用户及低层级订阅者仍将保留对 GPT-6 Luna 的访问权限。虽然基准测试数据亮眼,但其对普通用户的实际感知影响仍有待观察。

(披露:Ziff Davis 于 2025 年起诉 OpenAI,指控其在训练和运营 AI 系统时侵犯版权。)

Claude Opus 5.5:成本骤降 40%,强化对齐与安全

Anthropic 发布的 Claude Opus 5.5 在能力上可与 Fable 5.1 匹敌,且相比前代 Opus 5,其计算资源需求大幅减少。内部测试显示,在处理典型负载时,新模型成本降低了近 40%。与此同时,Anthropic 将 Pro、Max 和 Team 套餐的单次使用时长上限提升至 5 小时。

Anthropic 强调,Opus 5.5 是目前在“AI 对齐”方面表现最强的模型,即更符合人类意图、价值观和规则。针对此前 AI 代理为完成任务不择手段引发的争议,新模型配备了与其最强版本相同的安全护栏。这意味着在涉及网络安全或科学任务时,模型可能会自动回退至较旧但更安全的版本。尽管对齐能力增强,其在智能体(agentic)场景下的实际表现仍需市场验证。

在交互体验上,Opus 5.5 的交流方式更为自然。据用户反馈,新模型在写作生成和指令遵循方面的表现更加轻松流畅。