当地时间9月22日,OpenAI发布GPT-6系列的两款新模型GPT-6Sol和GPT-6Luna。定价是这次发布的核心:GPT-6Sol每百万输入token从4美元降到2美元、输出从20美元降到10美元;GPT-6Luna的输入从0.20美元降到0.10美元、输出从1.20美元降到0.50美元。对照的都是上一代GPT-5.6同名的两款产品。OpenAI向媒体确认,这次是永久降价而不是限时促销,没有到期日。
两款模型把GPT-6系列补成了三档:旗舰GPT-6Astra继续负责最难的任务,Sol面向编程、专业工作和复杂智能体流程,Luna面向量大、目标单一而且重复性高的活,比如提取信息、压缩文档、回答常规问题。OpenAI用的说法是,两款模型继承了Astra的训练方法,因此在推理、事实准确性、编程、计算机操作和一致性上拿到了部分进展。
规格上,两款模型都提供1.05M token的上下文窗口和最大128K的API输出,推理强度档位从none一直到max,通过Responses API支持网页搜索、文件搜索、图像生成、代码执行、计算机操作和MCP连接。缓存是被反复强调的一点:缓存命中的输入token读取折扣最高到90%,而且调整推理档位或可用工具不再让此前的缓存失效。OpenAI称这几项缓存改进让需要重新处理的提示token占比下降一半以上,这个数字是在GitHub Copilot的数十亿次请求上测出来的。
基准上,OpenAI这次没有主打原始分数,而是讲每个成功任务花多少钱。在衡量智能体跨工具办公的AutomationBench上,Sol在最高推理档拿到33.2%,每个完成任务花0.27美元;在长周期真实代码库任务的DeepSWE v1.1上,Sol最高档68.8%,Claude Fable5在同一评测里是69.9%,相差1.1个百分点,OpenAI说Sol每个任务成本低约80%。Luna在同一个评测里是66.6%,按OpenAI给的算法,每任务成本比Claude Opus5低93%、比Claude Fable5低96%。
上线节奏是分阶段的:先向ChatGPT Work和Codex的Plus、Pro、Business、Enterprise和Edu用户推送,Free和Go用户可以透过桌面应用用到Luna,标准版ChatGPT界面暂时还没有。同一周里Anthropic也发了新模型,按TechCrunch记录的时间线,Claude Opus5.5比OpenAI这场发布早约90分钟。两家不约而同把降价和长时间运行的智能体工作流绑在一起,也都把原因归到缓存与推理效率的提升上。
申请创业报道,分享创业好点子。点击此处,共同探讨创业新机遇!
