
OpenAI已将旗下最亲民的旗舰模型每百万token的价格下调80%:ChatGPT 5.6 Luna的输入价格降至每百万token 20美分,输出价格降至每百万token 1.2美元。中端型号GPT 5.6 Terra降价20%,输入和输出价格分别降至2美元和12美元。OpenAI将此次降价归因于效率提升。就在此举出台一周多之前,谷歌发布了更便宜的Gemini 3.6 Flash及其姊妹型号3.5 Flash-Lite。分析师称,这标志着AI行业进入新阶段:竞争的不再只是智能的质量,还有智能的价格。
这场价格战有明确的导火索。中国开发者利用制造和成本优势,以远低于对手的价格推出了能力相差无几的模型。月之暗面的Kimi K3于7月发布,是一款开放权重的混合专家模型,据报道总参数量达2.8万亿,上下文窗口为100万token,其输入价格为每百万token 3美元,输出价格为每百万token 15美元,Terra现在的定价已低于这一水平。DeepSeek的V4 pro模型输入价格为每百万token 43.5美分,输出价格为每百万token 87美分。与OpenAI自身近期的经历相比,反差十分明显:3月发布的ChatGPT 5.4具备智能体能力,输入价格为每百万token 2.5美元,输出价格为每百万token 15美元。四个月后,Luna以约为其十三分之一的价格提供水平相当的智能。
Anthropic保持了原有定价,但将能力档位上移,停售最便宜的Opus档位,改为以同样的价格提供Claude 5.0。其最高端的Claude Fable 5输入价格为每百万token 10美元,输出价格为每百万token 50美元,与Luna相比输入价格相差50倍,反映了两者处于不同的性能档位。OpenAI的顶级模型GPT 5.6 Sol维持在5美元和30美元,而其低延迟的Fast模式定价反而更高,为10美元和60美元。
降价背后的经济账对这些实验室来说并不轻松。OpenAI的订阅业务已经处于亏损状态,公司上半年未达营收目标,并已承诺到2030年投入约6000亿美元用于算力,其中包括与甲骨文达成的3000亿美元投入。谷歌过去一年在AI基础设施上的支出约为其云业务收入的9倍。Anthropic直到最近才在年化基础上实现盈利,这得益于与xAI达成的一笔低价数据中心交易。对最畅销的模型大幅降价,意味着在效率提升或需求增长弥合差距之前,利润率还将继续收窄。
整个行业的赌注在于,更便宜的token会带来更高的总使用量,这是杰文斯悖论的一个版本:单位成本下降后,消费量上升的幅度足以推动总收入增长。包括英伟达Vera Rubin平台在内的新一代加速器,承诺将每瓦特token数提升约十倍,这可能让微薄的利润率依靠规模实现盈利。关注这一变化的分析师认为,更直接的影响体现在购买行为上:企业已在测试分层策略,将日常任务交给廉价模型,将前沿系统留给高难度推理,而不是为每一次请求都支付旗舰价格。
对客户而言,方向是明确的。自2023年初以来,前沿级token的价格已下跌约88%,随着开放权重对手持续施压,跌势还在加快。降价是否让实施降价的公司受益,仍是悬而未决的问题:价格下降并不自动意味着成本下降。
婷 翻译
Sources: AI companies are now racing to the bottom, crashing token prices and competitive models push companies to cut costs (Tom’s Hardware, Aug 3, 2026); Why OpenAI’s 80% Price Cut Could Trigger A Race To The Bottom In AI (Forbes, Jul 31, 2026); As Token Costs Plunge, Enterprise AI Providers Face A New Margin Squeeze (Forbes, Jul 28, 2026); AI Token Costs Reshape the Race (NeoTeo, Aug 2026)

