GPT-6 Sol和Luna震撼发布!价格腰斩
新智元报道 战况好激烈的一晚! 就在刚刚,GPT-6 Sol和Luna也发布了! 而就在几小时前,Opus 5.5前脚才刚发。 这次,GPT-6全家桶同时端上来GPT-6 Sol与GPT-6 Luna。 如果说Astra体现了AI智力的巅峰,那Sol和Luna则是OpenAI亲手打造的、应用于千行百业的工业级放大器。 它们完美继承了Astra在专业推理、代码编写与人类对齐上的前沿性能,代表着两个方向的实用场景。 Sol是「超级大脑」,用于破解极度复杂的代码逻辑与超长线的智能体工作流; Luna是「效率狂魔」,速度快,资源占用极低,针对一切专注型、高频吞吐的日常任务。 不仅如此,它们在API定价上,相比上一代直接腰斩50%!从此,百万级Token的消耗不再让人心惊肉跳。 奥特曼表示,GPT-6 Sol和Luna两款模型按任务定价衡量,在市场上没有竞争对手 正如OpenAI所言:「用Sol构建,用Luna扩展,向着生产环境与更广阔的未来进发。」 站在巨人Astra的肩膀上 这次,Sol和Luna是用与GPT-6 Astra相似的训练方法打造的,它们汲取了Astra在专业工作、事实准确性、代码编写、计算机视觉操作以及人类对齐上的最先进成果。 GPT-6 Sol:复杂工作流的 「 超级大脑 」 Sol的定位是处理极其困难、需要深度思考和逻辑推理的任务。 它专门为复杂的代码重构、长逻辑链的商业决策、以及需要多步规划的Agent工作流而设计。 总之,适用于那种「难啃的硬骨头」。 GPT-6 Luna:专注、神速的 「 效率狂魔 」 Luna则是为了高吞吐量、极其专注的任务而生。 比如瞬间从几百页的PDF中提取特定的发票数据,或者实时翻译海量的用户聊天记录。 Luna速度极快,成本低到几乎可以忽略不计,专为企业级批量处理任务而打造。 API价格直接「腰斩」 此前的GPT-6 Astra虽然强大,但我们日常的大部分工作,并不需要这种昂贵的模型。 GPT-6 Sol和Luna的诞生,就是让Astra的前沿智能,通过极致的成本控制,让普通人可以日常使用。 得益于在缓存和推理底座架构上的巨大改进,OpenAI成功把成本打下来了!而且,没有中间商赚差价。 相比于GPT-5.6的促销价,GPT-6 Sol和Luna的API价格整整降低了50%! 对于每100万Token,价格如下。 GPT-6 Sol (对标复杂推理) 输入价格:从4美元降至2美元! 输出价格:从20美元降至10美元! GPT-6 Luna (对标高频吞吐) 输入价格:从0.20美元降至0.10美元! 输出价格:从1.20美元降至0.50美元! 现在,用白菜价,就可以买到顶级「赛博打工人」了,额度更高,成本更低! Tibo特意强调,这次是永久降价,原来的限时价再打对折 跑分把Claude按在地上摩擦 官方博客里的跑分,几乎每一项都拿Claude做对照,而且每张图的横轴都是每任务成本。 OpenAI强调的,是「同样的分花多少钱」。 Artificial Analysis评价: GPT-6 Sol 和 Luna 将成本效率前沿推向了新高度 首先,是真实工作环境。 在 AutomationBench (商业工作流跨应用测试)中,GPT-6 Sol(xhigh级别)拿到33.2%,每任务成本0.27美元,直接超越Fable 5.1(max级别),每项任务的报告成本降低了惊人的88%! Claude Opus 5的最高分是26.9%,成本是Sol的11.1倍。 OpenAI特别指出,Fable 5.1拿了31.4%,但有约40%的任务转给了Opus 5兜底,这部分成本没有算,所以被低估了。 在 Agents' Last Exam (智能体终极考试)中,考的是55个细分行业里的长链条专业任务。 Sol在最高强度下拿到56.4%,高于Opus 5的最好成绩,每任务成本低60%。 在 事实准确性 上, Sol犯的事实错误比上一代少了一半左右,接近Astra。 Luna在高强度档追平了GPT-5.6 Sol,成本大约是后者的百分之一。 然后,重点就在编程场景。 FrontierCode 中,GPT-6 Sol相比前代实现了巨大飞跃。它追平了Fable 5.1的最高档,成本却低得多。 不仅仅是写对代码,还包括了代码风格、测试质量和对现有代码库的遵循度。 在 DeepSWE 中,考的是真实代码库里的复杂软件工程任务。 Sol的max级别得分高达68.8%!Fable 5在这项上的最高分是69.9%,虽然两者差1.1个百分点,Sol完成每项任务的成本比Claude足足低了80%! Luna在max级别下得分66.6%,直接与Opus 5和Fable 5(中等强度度)打平,但成本却狂降93%和96%。 接下来,