OpenAI 上线三周降价 80%,中国模型逼出 AI 史上最猛「Token 价格战」

BiyaNews
AI 行业正式进入「够用就行,谁便宜用谁」的新阶段。

OpenAI 上线三周降价 80%,中国模型逼出 AI 史上最猛「Token 价格战」

OpenAI 在 7 月 30 日宣布大幅下调 GPT-5.6 系列两款模型的价格,距离该系列上线不过三周。CEO Sam Altman 在 X 平台发帖称「major price cuts today」,并补充表示「我们要在每个层级都提供最优的价格/智能比」。

这不是常规的产品迭代降价。GPT-5.6 系列 7 月 9 日才正式发布,三周后就对中低端型号动刀,力度之大、节奏之快,在 OpenAI 历史上从未出现过。背景很清楚:中国开源模型在 OpenRouter 平台上的美国企业 Token 用量占比,已从 2025 年上半年的 4.5%飙升到 2026 年年中的 46%峰值。OpenAI 守不住价格了。

Luna 砍 80%、Terra 砍 20%,旗舰 Sol 不动

GPT-5.6 Luna(最快、最轻的版本)输入价格从每百万 Token 1 美元降至 0.2 美元,输出从 6 美元降至 1.2 美元,综合降幅 80%。Terra(中间档)输入从 2.5 美元降至 2 美元,输出从 15 美元降至 12 美元,降幅 20%。旗舰 Sol 维持 5 美元/30 美元不变。

同时 OpenAI 为 Sol 新增了 Fast 模式,速度提升 2.5 倍,价格翻倍(输入 10 美元/输出 60 美元),替代此前的 Priority Processing。ChatGPT 应用和 Codex CLI 中的 Auto-review 功能也从 GPT-5.4 升级到 Luna,OpenAI 称这将使代理工作流的审核成本降低约 10 倍。

策略很明确:保住 Sol 的旗舰溢价不动,用中低端产品的激进降价拦截客户流失。OpenAI 在守住前沿级高端智能的同时,把中端市场份额当作防线来打。

中国模型攻入美国腹地:46%的 Token 份额

这波降价的直接导火索,是中国模型在美国企业市场的渗透速度已经超出所有人预期。

据 CNBC 7 月 7 日调查报道,自 2026 年 2 月 8 日起,中国模型在 OpenRouter 上的美国企业 Token 用量占比每周都保持在 30%以上,峰值达到 46%。DeepSeek 单家就占 OpenRouter 全平台 Token 量的 17.6%,约每周 5.13 万亿 Token,是平台上最大的单一供应商,领先于所有美国实验室。阿里的通义千问(Qwen)以 13.9%的份额排在中国厂商第二位。

价格差距是核心驱动力。DeepSeek V4 Flash 每百万输入 Token 仅收 0.14 美元,而 OpenAI 的 GPT-5.5 收 5 美元,差距高达 35 倍。AI 创业公司 Lindy 已将 100%的流量从 Claude 迁移到 DeepSeek,预计节省数百万美元。Airbnb 已确认在生产环境中使用通义千问,此事甚至引发了美国国会的问询。

OpenAI 上线三周降价 80%,中国模型逼出 AI 史上最猛「Token 价格战」

OpenRouter 的数据显示,美国企业的大量 Token 需求正在变成一种大宗商品,被路由到「够用就行」的最便宜模型上。

Kimi K3:2.8 万亿参数开源,前端代码能力登顶

月之暗面(Moonshot AI)的 Kimi K3 是这轮价格战中最具冲击力的变量。

K3 于 7 月 16 日上线 API,7 月 27 日正式开源权重。总参数量 2.8 万亿,采用 MoE 架构(896 个专家中每 Token 激活 16 个,104 亿激活参数),上下文窗口 100 万 Token。这是迄今为止最大的开源模型,比此前的纪录保持者 DeepSeek V4 Pro 的 1.6 万亿参数大了近一倍。

性能上,K3 在 LMArena 前端代码竞技场排名第一,超过 Anthropic 的旗舰 Claude Fable 5。在 Artificial Analysis 的单任务成本指数上,K3 完成一个任务花费 0.94 美元,DeepSeek V4 Pro 仅需 4 美分,而 OpenAI 旗舰 Sol 花费 1.04 美元,Anthropic 的 Claude Opus 4.8 花费 1.80 美元。

K3 的 API 定价为每百万输入 Token 3 美元、输出 15 美元,但缓存命中后输入价格降至 0.30 美元。月之暗面表示,在编程工作负载中缓存命中率超过 90%,这意味着 K3 的有效输入成本仅为每百万 Token 0.30 美元。

需求之强劲,月之暗面不得不因算力限制暂时限制新订阅和 API 接入。该公司日收入自 K3 发布以来增长约 6 倍,正寻求 500 亿美元估值,筹备港股 IPO。

OpenAI 上线三周降价 80%,中国模型逼出 AI 史上最猛「Token 价格战」

DeepSeek V4 Pro:4 美分完成一个任务

DeepSeek 是这场价格战中的另一股颠覆力量。

V4 Pro 的 API 定价为每百万输入 Token 0.435 美元、输出 0.87 美元。这一价格源于今年 5 月底的 75%促销折扣转为永久定价,此前原价为输入 1.74 美元、输出 3.48 美元。V4 Flash 更便宜:输入 0.14 美元、输出 0.28 美元。 Yahoo FinanceQuasa

直观感受一下这个差距:GPT-5.6 Sol 的输出价格是 30 美元/百万 Token,DeepSeek V4 Pro 是 0.87 美元。同样的预算,用 DeepSeek 能跑的量是 OpenAI 旗舰的 34 倍。

这解释了为什么 OpenRouter 的总 Token 吞吐量从 2025 年 4 月的每周约 5 万亿 Token 增长到 2026 年 4 月的超过 20 万亿,平台爆发式增长的主要驱动力就是中国模型带来的低价。 Towards AI

全线混战:Anthropic、Google、微软同步出招

OpenAI 的降价不是孤立事件。过去两周,几乎所有头部实验室都在价格和产品上密集调整。

Anthropic 在 7 月 24 日发布 Claude Opus 5,定价每百万输入 Token 5 美元、输出 25 美元,与前代 Opus 4.8 持平,仅为 Fable 5(10 美元/50 美元)的一半。Anthropic 将 Opus 5 定位为「每天都用、不心疼账单」的日常模型,核心卖点是接近旗舰 Fable 5 性能的同时把成本砍半。

Google 本月推出了三款新的 Gemini Flash 模型,声称其顶级 Flash 模型在单任务成本上低于 Kimi K3 和其他中国模型。微软则力推网络安全专用模型 MAI-Cyber-1-Flash,AI 负责人 Mustafa Suleyman 称其以「50%的成本实现世界领先性能」。

所有玩家的动作指向同一个结论:企业客户对 AI 支出越来越敏感,要求看到更清晰的投资回报,并开始转向更便宜的替代方案。

价格战的本质:AI Token 正在大宗商品化

这轮降价潮的底层逻辑,是 AI 推理 Token 正在从「稀缺的前沿能力」变成「可替代的计算单元」。

OpenAI 的 GPT-5.6 三档定价策略(Sol/Terra/Luna)本身就说明了问题:把模型能力分层销售,旗舰保价、中低端杀价,这是成熟产业的打法,不是技术垄断期的定价方式。OpenAI 将 Luna 定价直接插入了 DeepSeek 和 Google 低端模型的价格区间,同时 Sol 的 30 美元输出价格依然高悬。

OpenAI 把降价归功于效率提升。据 TechTimes 报道,GPT-5.6 Sol 在 Codex 环境中自主重写了自身的生产 GPU 内核和推测性解码模型,这是已知的首个 AI 模型「优化自己推理成本」的案例。OpenAI 称正在将这些效率收益传导到定价中。

但市场的解读更直接:Gartner 分析师 Arun Chandrasekaran 认为,这对买方来说是一个关键时刻——此前与前沿 AI 实验室谈判价格和商业条款是出了名的困难。

中国开源模型的崛起不仅改变了价格,也改变了整个市场结构。所谓无限制 AI 支出的时代正在让位给一个更务实的时代。对于开发者和企业来说,这是好消息。对于靠高定价维持研发投入的头部实验室来说,利润率的压缩才刚刚开始。

发布于
免责声明:市场有风险,投资需谨慎,本文不构成投资建议