JOTO
联系我们
← AI 智库
大语言模型

OpenAI 发起 AI 价格战:GPT-5.6 Luna 降价 80%,切入低成本智能体推理市场

2026 年 7 月 30 日

OpenAI 将 GPT-5.6 Luna 模型价格大幅下调 80%,使其每百万 token 总成本降至 1.40 美元,直接对标小米、DeepSeek 等低价模型;同步调整 Terra 与 Sol 定价策略,反映厂商正从模型能力竞争转向单位智能成本与智能体部署经济性竞争。

AI price wars: OpenAI cuts GPT-5.6 Luna prices by 80% as model competition shifts toward cost

引用一位古老的绝地大师的话 ‘人工智能价格战已然开始!’

OpenAI正大幅下调其GPT-5.6前沿系列中两款模型的价格:将该系列中最小、最快的模型GPT-5.6 Luna降价80%,将中端模型GPT-5.6 Terra降价20%,同时为其旗舰模型GPT-5.6 Sol新增一种高级Fast模式。

此次降价使Luna的价格大幅接近市场上成本最低的商用模型,而此举恰发生在Anthropic发布其高性能Claude Opus 5之后数日 Anthropic发布了其高性能Claude Opus 5 其定价与Opus 4.8相同,且 谷歌推出了Gemini 3.6 Flash和Gemini 3.5 Flash-Lite——这两款竞品模型均围绕更低的推理成本、更快的执行速度以及更高效的智能体工作负载构建。

OOpenAI成功压低了谷歌的‘每单位智能成本’,并试图以速度提升吸引Anthropic用户——后者或许并不介意支付更高费用。

OpenAI表示,Luna当前价格为每百万输入token 0.20美元、每百万输出token 1.20美元,输入加输出合计价格为每百万token 1.40美元。

Terra价格为每百万输入token 2美元、每百万输出token 12美元,合计价格为每百万token 14美元。

Sol Standard版定价维持不变,仍为每百万输入token 5美元、每百万输出token 30美元。OpenAI还将推出Sol Fast模式,其价格为Standard版的两倍:每百万输入token 10美元、每百万输出token 60美元。

该公司表示,Fast模式可在不改变模型底层智能的前提下,实现最高达2.5倍的吞吐量。

OpenAI联合创始人兼首席执行官萨姆·阿尔特曼(Sam Altman)在X平台宣布此次调整为‘今日重大降价’。 ‘今日重大降价’。

VentureBeat前沿人工智能模型API定价对比

模型

输入(美元/百万)

输出(美元/百万)

总计(美元/百万)

来源

MiMo-V2.5 Flash

0.10美元

0.30美元

0.40美元

小米(Xiaomi)

deepseek-v4-flash

0.14美元

0.28美元

0.42美元

DeepSeek

deepseek-v4-pro

0.435美元

0.87美元

1.305美元

DeepSeek

GPT-5.6 Luna

0.20美元

1.20美元

1.40美元

OpenAI

MiniMax-M3

0.30美元

1.20美元

1.50美元

MiniMax

LongCat-2.0 — 限时促销

0.30美元

1.20美元

1.50美元

LongCat

Gemini 3.1 Flash-Lite

0.25美元

1.50美元

1.75美元

Google

Qwen3.7-Plus

0.40美元

1.60美元

2.00美元

阿里云

MiMo-V2.5

0.40美元

2.00美元

2.40美元

小米

Gemini 3.5 Flash-Lite

0.30美元

2.50美元

2.80美元

Google

LongCat-2.0 — 标准版

0.75美元

2.95美元

3.70美元

LongCat

MiMo-V2.5 Pro(≤256K)

1.00美元

3.00美元

4.00美元

小米

GLM-5.2

1.40美元

4.40美元

5.80美元

Z.ai

Grok 4.5

2.00美元

6.00美元

8.00美元

xAI

MiMo-V2.5 Pro(>256K)

2.00美元

6.00美元

8.00美元

小米

Gemini 3.6 Flash

1.50美元

7.50美元

9.00美元

谷歌

Qwen3.7-Max

2.50美元

7.50美元

10.00美元

阿里云

Gemini 3.5 Flash

1.50美元

9.00美元

10.50美元

谷歌

Gemini 3.1 Pro 预览版(≤200K)

2.00美元

12.00美元

14.00美元

谷歌

GPT-5.6 Terra

2.00美元

12.00美元

14.00美元

OpenAI

GPT-5.4

2.50美元

15.00美元

17.50美元

OpenAI

Kimi K3

3.00美元

15.00美元

18.00美元

月之暗面(Moonshot AI)

Gemini 3.1 Pro 预览版(>200K)

4.00美元

18.00美元

22.00美元

谷歌

Claude Opus 5

5.00美元

25.00美元

30.00美元

Anthropic

GPT-5.5

5.00美元

30.00美元

35.00美元

OpenAI

GPT-5.5 Instant(chat-latest)

5.00美元

30.00美元

35.00美元

OpenAI

Sakana Fugu Ultra(≤272K)

5.00美元

30.00美元

35.00美元

Sakana AI

GPT-5.6 Sol — 标准模式

5.00美元

30.00美元

35.00美元

OpenAI

Claude Fable 5 / Claude Mythos 5

10.00美元

50.00美元

60.00美元

Anthropic

GPT-5.6 Sol — 快速模式

10.00美元

60.00美元

70.00美元

OpenAI

价格按每百万token计。总成本按输入价格加输出价格计算。为保持各提供商之间比较的一致性,缓存输入定价被排除在外。

OpenAI将Luna调入低成本层级

最具影响的变化是Luna降价。

当OpenAI推出GPT-5.6系列时,Luna的定价为每百万输入token 1美元、每百万输出token 6美元,合计为7美元。新定价将该合计金额降至1.40美元。

这使得Luna的价格低于谷歌Gemini 3.5 Flash-Lite(每百万输入与输出token合计2.80美元),远低于Gemini 3.6 Flash(9美元)。Luna目前的价格也大幅低于OpenAI自家的GPT-5.4和Terra模型。

它并非整个市场上最便宜的模型。小米MiMo-V2.5 Flash、DeepSeek的flash模型以及若干其他API在纯token基础上仍更便宜。但此次降价使OpenAI前沿系列模型直接进入市场低成本推理层级的竞争。

OpenAI表示,GPT-5.6系列代表其前沿模型家族,其中Sol位于产品线顶端,Terra为中端层级,Luna则是最小且最快的选项。

产品线最初于2026年6月下旬发布 应美国政府要求以有限方式推出,随后逐步扩大访问范围;每个模型旨在在智能水平、延迟与成本之间提供不同的权衡。

Sol面向最复杂的、以推理为主且需代理能力的工作负载,包括高级编程、多步骤规划及工具调用系统;Terra则面向通用生产用途,要求能力与效率之间的平衡;Luna定位为高吞吐量、低延迟任务,例如摘要生成、分类、路由以及轻量级实时助手——此类场景下每次请求的成本是首要约束条件。

Terra降价以匹配谷歌Gemini 3.1 Pro定价

Terra降价20%,使其每百万token合计价格从17.50美元降至14美元。

在此价位上,Terra目前与谷歌Gemini 3.1 Pro预览版针对200,000 token或更小上下文窗口的定价持平。

它亦低于OpenAI的GPT-5.4(后者仍维持每百万输入token 2.50美元、每百万输出token 15美元的定价),以约1/13的成本提供同等智能水平,正如 Krea AI的Nic Dunz在X平台指出

此次调整扩大了OpenAI三款GPT-5.6层级之间的价差:仅按简单合计输入加输出价格计算,Luna成本仅为Terra的十分之一,而Terra成本比Sol标准版低60%。

Sol快速模式则朝相反方向调整。其每百万token合计70美元,是下表所列模型配置中最昂贵者,反映出OpenAI选择对延迟敏感型工作负载收取溢价,而非降低Sol的基础价格。

此次降价紧随谷歌低价Gemini系列发布及Anthropic的Claude Opus 5发布之后

OpenAI的定价调整仅在 Google推出其自有的低成本Gemini 3.6 Flash和Gemini 3.5 Flash-Lite之后约一周半

Google将Gemini 3.6 Flash定价为每百万输入token 1.50美元、每百万输出token 7.50美元;Gemini 3.5 Flash-Lite则定价为每百万输入token 0.30美元、每百万输出token 2.50美元。

Google将这两款模型均围绕智能体(agent)部署的经济性进行定位,主张更低的token用量、更少的推理步骤以及更少的工具调用,可降低长期运行的软件工程与知识工作类任务的总体成本。

据报道称,Gemini 3.6 Flash在Artificial Analysis指数上的输出token用量比Gemini 3.5 Flash减少17%,而在某些长周期工程工作负载上节省幅度高达65%;Gemini 3.5 Flash-Lite被定位为Google 3.5系列中速度最快的模型。

然而,根据Artificial Analysis等第三方分析机构的评估,OpenAI的模型性能优于Google的模型, Artificial Analysis甚至Luna模型的表现也优于Gemini 3.6 Flash及更早的Gemini 3.1 Pro模型,使得单位智能成本(cost-per intelligence)对OpenAI而言更具优势。

Artificial Analysis Intelligence Index July 2026 snapshot

截至2026年7月的Artificial Analysis Intelligence Index截图

AI编程初创公司 Cognition在X平台指出,GPT-5.6目前已‘位于价格/性能效率的帕累托曲线上’,并发布了一段动画:GPT-5.6系列在一张纵轴为智能水平、横轴为成本的图表上向左移动,表明该系列模型如今可在市场上提供同等最高智能水平的同时实现最低成本。

然而,竞争对手Anthropic的Claude Opus 5性能与GPT-5.6 Sol大致相当,但价格低6%。

该模型定价为每百万输入token 5美元、每百万输出token 25美元——与Opus 4.8的费率相同——但Anthropic表示,它能以约一半成本提供Fable 5这一更高价模型几乎全部的智能能力。

与OpenAI的Luna和Terra定价调整不同,Anthropic并未下调Opus API的标价;而是通过以能力更强的新模型替代Opus 4.8,在维持每百万输入加输出token合计30美元费率不变的前提下,实质降低了单位能力成本。Anthropic还新增一项可调节努力程度(effort)设置,允许开发者以推理深度换取速度与token节省。

这一区别对企业买家至关重要:OpenAI直接下调每token费率;Google则将更低价格与token用量及工具调用减少相结合;Anthropic则强调在价格不变前提下提升任务执行性能。这三种策略均瞄准同一运营指标:完成生产任务的总成本,而非单个token的标称价格。

此次时机凸显了定价如何迅速成为前沿模型提供商之间的一项竞争杠杆。OpenAI此次回应并未引入新一代模型,而是改变了近期才发布的模型的部署经济性。

市场正从模型访问转向模型经济学

这些降价表明,获取前沿级能力已不再是唯一的竞争焦点;企业接下来关注的问题是:这些模型在生产环境中运行的成本有多低、可预测性有多高。

OpenAI在纯token单价层面仍非最低价供应商。但Luna高达80%的降价显著改变了其市场定位,使其从市场中游跃升至由Google、小米(Xiaomi)、DeepSeek、MiniMax及其他厂商的小型模型所构成的定价层级。

这对高吞吐量应用尤为重要——在编码智能体、文档系统、内部搜索工具及自动化工作流等场景中,token单价的微小差异会随规模累积放大。

因此,OpenAI此次最新举措看似并非一次常规调整,而更像是对GPT-5.6系列的战略性重新定位:Sol继续保持高端选项地位,Terra进一步贴近竞品专业级系统,而Luna则成为该公司对行业日益增长的低成本模型细分市场的直接回应。

JOTO 企业落地观察

  • 对企业部署而言,Luna 降价至 1.40 美元/百万 token,使高吞吐量场景(如文档摘要、路由、内部搜索)的规模化运行成本显著降低,企业可基于明确的 token 单价做预算建模,提升 AI 基础设施成本可预测性。
  • 对智能体工程而言,OpenAI 明确将 Luna 定位为‘高吞吐、低延迟’任务载体,并强调其在编码智能体与自动化工作流中的适用性,配合 Gemini Flash 系列对工具调用与推理步数的优化,表明智能体架构正加速向‘轻量模型+高效调度’范式收敛。
  • 对 FDE 落地而言,此次调整未依赖新模型发布,而是重构已有 GPT-5.6 系列的经济性分层——Sol 保持高端推理定位、Terra 锚定专业级平衡点、Luna 主攻成本敏感型场景,为企业 AI 转型提供了按需选用、梯度升级的模型采购路径。

立即咨询 JOTO

JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询

想把这些做法用到你的业务里?

留下你的场景和痛点,我们帮你判断从哪一步开始。

联系我们
联系我们

开启企业级 AI 落地

留下你的行业、部门和当前痛点,我们会在 1 个工作日内与你联系,帮你判断适合先做什么、需要准备哪些数据、适合什么平台。

微信咨询
扫码添加,一对一沟通
JOTO 微信咨询二维码
发送邮件
jotoai@jototech.cn

填写需求单

收到你的信息后,我们将在 1 个工作日内与你取得联系。