
OpenAI近日推出GPT-6 Sol和GPT-6 Luna两款新模型,作为此前发布的GPT-6 Astra的后续产品。据媒体报道,这两款模型沿用与Astra相似的技术路径,旨在提升专业工作能力、事实准确性、代码生成、计算机操作及模型对齐性。
定位差异与性能表现
GPT-6 Sol面向日常办公场景,定价低于Astra,具备更强的推理能力;GPT-6 Luna则是成本更低的版本,针对快速响应和高并发吞吐量进行了优化。
在OpenAI基准测试中,两款新模型表现均优于前代。其中,GPT-6 Sol的错误率较GPT-5.6 Sol降低约一半,在代码生成和计算机操作方面均有改进,部分基准测试成绩持平或超越Claude Fable 5.1。
值得注意的是,Anthropic今日发布了新的Opus 5.5模型。尽管OpenAI将GPT-6 Sol与Opus 5进行了对比,但Anthropic指出,Opus 5.5在部分代码生成和知识工作基准测试中表现优于Astra。
交互优化与定价调整
GPT-6 Sol和Luna采用了随Astra推出的改进型沟通风格,旨在简化对话流程,减少专业术语和低价值细节,使回答更加精简。在OpenAI对齐测试中,关于代码工作的误导性声明比例有所降低。
相较于5.6版本,OpenAI降低了Sol和Luna的Token价格,并优化了提示词缓存(Prompt Caching)功能。公司表示,智能体将复用更多上下文,响应速度更快,且对缓存输入Token的读取可获得90%的费用折扣。
具体定价方面,GPT-6 Sol的输入Token价格为每百万个2美元,输出为每百万个10美元,价格减半。GPT-6 Luna的输入Token价格为每百万个0.10美元,输出为每百万个0.50美元,分别较此前的0.20美元和1.20美元下调。尽管GPT-6 Sol的单Token成本仅为Opus 5.5的一半,但Anthropic指出Opus 5.5每项任务消耗的Token少于Opus 5,因此两者并非完全对等的比较。
目前,GPT-6 Sol和Luna已在ChatGPT Work和Codex平台上线,面向Plus、Pro、Business、Enterprise及Edu用户开放。GPT-6 Luna同时向桌面端应用中的Free和Go用户开放。这两款模型尚未在“聊天模式”(Chat mode)中可用。