谷歌今年夏天彻底改革了其Gemini AI平台的计费方式,推出了一种更细化的定价结构,根据模型、任务和数据量而变化,这些变化意味着,除非用户主动追踪其消耗量,否则在同一支出水平下可能获得更少的响应。
新定价将成本分为几个部分。输入代币代表发送给模型的文本、图像或文件;输出代币代表模型的响应。每个Gemini模型都有不同的费率,可选功能(如更大的上下文窗口)会增加额外成本。例如,使用Google搜索进行 grounding,对于超出免费每日限额的Gemini 2.5和2.0模型,每次查询需加收每1,000次提示35美元的费用,Gemini 3模型则每1,000次提示14美元。
谷歌还重组了其消费者订阅层级。2026年7月推出的新入门级Google AI Plus,提供400GB存储空间和双倍免费层使用限额,月费7.99美元。其上的Google AI Pro月费19.99美元(原Google One AI Premium,现提供5TB存储空间),Google AI Ultra月费99.99美元起,提供20TB存储空间和Deep Think功能访问权限。Ultra内还有月费200美元的高级层级,提供额外容量。
对于开发者而言,Gemini API仍按使用量付费。Gemini 3.5 Flash每百万输入代币1.50美元,每百万输出代币9美元。Gemini 2.5 Pro分别为1.25美元和10美元。2026年7月新增的名为AlphaEvolve的代理定价SKU,在基础模型费率上加收透明的2倍附加费,使总费用恰好是底层模型价格的三倍。
计费影响很容易被低估。一万次请求,每次包含2,000个输入代币和1,000个输出代币,共消耗3,000万个代币。即使每代币费率很低,总额也会迅速累积。不必要地使用高级模型(一位分析师形容为”坐出租车而不是公交车”)会放大这种影响。
谷歌提供了多种追踪使用量的工具。计费控制台按项目和模型显示支出。使用量页面细分输入和输出代币数量。API日志提供每次请求的详细信息。建议在月度限额的50%、80%和100%设置预算警报,并按用例(聊天机器人支持、编码辅助、文档搜索)标记项目,以识别哪个功能消耗最高。
提示结构的微小改变可以带来显著节省。在一个每天处理25,000次对话、平均800个输入代币和500个输出代币的系统中,将每个提示减少25%,每月可节省数百万代币,同时不减少聊天量。将模型强度与任务复杂度匹配,使用较便宜的模型进行分类和标记,同时将高级模型保留用于复杂推理,是另一个手段。
“如果你仔细衡量、选择合适的模型并设置严格的支出警报,谷歌的AI定价是可控的,”该公司建议道。
来源:How Google’s New Gemini Rates Work and How to Track Your Usage(《连线》,2026年7月);Google Gemini Pricing(UsagePricing,2026年7月)
婷 翻译

