OpenAI推出GPT-6 Sol和Luna,使用成本更低

阅读约 16 分钟 Tags:

OpenAI推出GPT-6 Sol和GPT-6 Luna,作为其GPT-6模型家族中成本较低的新增型号。

这两款模型已通过API提供,ChatGPT Work和Codex的推送工作正在进行中。独立测试发现,其单项任务成本显著下降,但不同基准测试中的性能提升幅度不一。

OpenAI已推出GPT-6 Sol和GPT-6 Luna,作为GPT-6 Astra更快、更便宜的替代选择;Astra仍是该公司性能最高的模型。这些发布的主要意义在于,它们降低了Token和任务执行成本,同时将Astra的部分改进带入价格更低的模型。

OpenAI表示,Sol和Luna采用与Astra相同的方法训练。该公司将旗舰模型在专业任务、编程、计算机使用、事实准确性和对齐方面的部分进展纳入这两款模型。

Sol面向复杂工作和AI智能体任务,而Luna主要用于速度和成本优先的大规模操作。两款模型均可通过OpenAI的API使用,该公司已开始在ChatGPT Work和Codex中逐步推出它们。

定价和基准测试结果

GPT-6 Sol的价格为每100万输入Token 2美元、每100万输出Token 10美元,而GPT-5.6 Sol分别为4美元和20美元。GPT-6 Luna的价格为每100万输入Token 0.10美元、每100万输出Token 0.50美元,低于其前代产品的0.20美元和1.20美元。

OpenAI还表示,在一项内部事实准确性测试中,GPT-6 Sol的错误数量约为GPT-5.6 Sol的一半。该公司称,在高推理级别下,Luna在该项指标上的表现与GPT-5.6 Sol大致相当,成本约为后者的百分之一。

在AutomationBench中,GPT-6 Sol在xhigh推理级别下获得33.2%,而Claude Opus 5在最高设置下为26.9%。OpenAI估计,Sol的单项任务成本约低11倍。GPT-6 Astra在低推理级别下获得30.3%。

Sol在DeepSWE v1.1编程基准测试中获得68.8%,Claude Fable 5为69.9%,但OpenAI估计Sol完成该任务的成本约低80%。Luna获得66.6%,OpenAI将该结果与Claude Opus 5和Fable 5在中等推理级别下的表现进行比较。

在OSWorld 2.0计算机控制基准测试中,Sol获得60.5%,Claude Opus 5在中等推理级别下为60.3%。OpenAI估计,Sol的任务成本约低80%。这些比较未纳入Anthropic在同一天推出的Claude Opus 5.5。

独立评估

独立测试平台Artificial Analysis在其专有Intelligence Index的最高档位中,给予GPT-6 Sol 48分,Luna获得37分。Claude Opus 5.5在最高档位中获得58分,并在测试时排名第一。

Artificial Analysis发现,效率是新模型的主要优势。估算的每项Intelligence Index任务成本从GPT-5.6 Sol的约1.99美元降至Sol的1.06美元;Luna的成本则从0.18美元降至0.07美元。

Sol在Coding Agent Index中比前代产品提高2分,而Luna下降2分。Artificial Analysis观察到,两款模型在部分自动化和编程测试中有所改善,但在若干涉及专业知识工作的任务中表现较弱。

早期反应

OpenAI首席执行官萨姆·奥尔特曼表示,Sol和Luna在智能水平、编程、计算机使用和其他领域均显著超过GPT-5.6一代。他还强调了其更低的Token价格和任务完成成本。

在另一篇帖子中,奥尔特曼认为,单项已完成任务的成本比Token定价更重要,并称按该指标衡量,OpenAI的新模型没有市场同类产品。这是奥尔特曼的评估,而非独立测试结论。

Artificial Analysis的观点更为克制,表示Sol和Luna推动了性价比前沿,但在整体Intelligence Index和Coding Agent Index上仍与GPT-5.6一代接近。其单项测试同时显示了提升和回退。

产品专家Peter Young表示,主观而言,Sol感觉优于GPT-5.6,但他在日常工作中更偏好Claude Opus 5.5,并将其排在Fable和Astra之前。AI创业者Matt Shumer也Sol质量较高,但表示他日常工作中仍更偏好GPT-6 Astra或Claude Fable 5.1,并预计会将Opus 5.5加入这一名单。

开发者David Kramer称赞Luna在价格、能力和可接受速度之间的组合,称其为市场上最均衡的选择之一。

总体而言,初步独立测试和用户反馈显示,Sol和Luna主要改变了使用OpenAI模型的经济性。更低成本伴随着部分任务的改进,但测试尚未显示其相较上一代实现全面性能跃升。

来源:HODL Press

TAGGED:
OpenAI推出GPT-6 Sol和Luna,使用成本更低

OpenAI推出成本更低的GPT-6 Sol和Luna,并通…

阅读约 16 分钟
欧洲央行拟修订致泰达放弃牌照的MiCA规则

欧洲央行及欧盟各国央行提议取消MiCA稳定币30%和60%银…

阅读约 8 分钟
币安将暂停格里夫纳法币交易,并下架USDT/UAH交易对

币安将于2026年9月28日停止Fiat Trade UAH…

阅读约 5 分钟
Anthropic推出更便宜、更快的Claude Opus 5.5,强化安全机制

Anthropic于2026年9月22日推出Claude O…

阅读约 14 分钟
比特币牛市周期刚刚开始;专家排除10倍暴涨

CryptoQuant首席执行官Ki Young Ju称,比…

阅读约 7 分钟