OpenAI发布GPT‑5.6 Luna和Terra 降价80% 助力企业提速降本
•1 阅读•3分钟•应用
OpenAIGPT-5.6TerraLuna
•1 阅读•3分钟•应用

定价与性能突破
OpenAI在7月30日的官方博客中公布,GPT‑5.6系列将分为三款主打模型:
- Luna:定位最高性价比,单价下降80%,每百万输入代币仅 $0.20,输出代币 $1.20。
- Terra:面向日常工作,降价20%,每百万输入代币 $2,输出代币 $12。
- Sol:保持原价,但新增 Fast 模式,在不牺牲模型能力的前提下,响应速度提升至 2.5 倍,费用为标准模式的两倍。
这些价格已同步至 ChatGPT Work、Codex 与 OpenAI API,并将在 AWS 平台同步生效。
效率提升技术
OpenAI 将本次成本下降归因于三层优化:
- 模型层改进:重新设计每一层的计算路径,使硬件利用率更高。
- 推理系统升级:通过更智能的路由和上下文管理,减少重复计算和 token 消耗。
- Agent 框架强化:让模型在工具调用时能够更好地复用已有结果,显著降低输出 token 数。
内部实验显示,Luna 在相同任务下的上下文处理能力提升 2.2 倍,输出 token 减少 8.5 倍,整体成本下降约 87%。
客户实测反馈
“Luna 的成本已低到几乎不计量,这是我们在 Replit 看到的最具性价比的模型。” — Michele Catasta, Replit AI 负责人
“Terra 在 Notion 个人助理中的延迟表现优异,质量与 GPT‑5.5 相当,却只需一半成本。” — Hoda Noorian, Notion AI
“在 Ramp 的 SWE‑Bench 基准上,Luna 的成本效率领先所有内部模型,已成为默认后台代理。” — Shaiyon Hariri, Ramp
这些案例表明,降价并未削弱模型能力,反而通过更快的响应和更低的 token 消耗,打开了高并发、长上下文等新场景。
市场影响与前景
随着企业对 AI 成本敏感度提升,OpenAI 此次定价策略有望巩固其在大型语言模型市场的领先地位。低价模型将推动更多中小企业将生成式 AI 融入日常业务,如文档自动化、客服分类、代码审查等。与此同时,Fast 模式为对时效要求极高的企业级应用提供了新的选择,进一步拉开与竞争对手的性能差距。
从长远来看,OpenAI 将继续以“效率‑能力双螺旋”的研发路线迭代,利用模型自我改进(Sol)加速下一代成本下降的循环。业界普遍预期,随着算力成本的进一步压缩,生成式 AI 的使用场景将从实验室走向真正的大规模生产。
本文是对第三方新闻源的主观解读。消息可能出现过时、不准确、歧义或错误的地方,仅供参考使用。点击此处查看消息源。