AI模型token价格创新低 单任务成本反升

IT时代网9月29日消息,据Chosun报道,市场研究机构 Silicon Data 数据显示,截至 8 月 31 日,反映大语言模型 token 支出的指数降至 97 美分。这是该指数去年年底首次发布以来的最低值,还不到今年夏季高点的一半。该指数把输入输出 token 比例与各模型用量计入在内,衡量的是市场上每百万 token 消耗量的加权平均价格。

价格下行的起点是厂商之间的激进定价。随着低成本开源模型的影响力扩大,OpenAI 在 7 月把 GPT-5.6 的 Terra 与 Luna 两款 API 价格分别下调 20% 和 80%,8 月又对 Sol 降价 20%。谷歌上个月推出的 Gemini 3.7 Flash,输入每百万 token 定价 0.75 美元,输出为 3.75 美元。

单价走低并没有让总支出下降。高性能推理模型在解决复杂问题时需要较长的推理过程,AI 智能体在执行任务时又会反复调用并校验模型,token 消耗量随之上扬。Anthropic 最新模型 Claude Fable 5.1 把缓存读取价格从 1 美元降到 0.25 美元,降幅为 75%,但在最高算力投入设置下,单个任务的成本反而比上一代上升 18%,达到 3.69 美元,原因是输出 token 用量增至 1.7 倍。

用量层面的扩张更为直观。谷歌 5 月的月度 token 处理量达到 3.2 千万亿,是一年前的 7 倍。有报道称,自 2023 年以来 token 价格下降超过 90%,而大模型的整体支出自去年年底以来翻了一倍。阿波罗全球管理公司首席经济学家 Torsten Sløk 把这一现象归结为杰文斯悖论:token 价格下跌带动 AI 使用范围扩大,总支出因此水涨船高。

在这一背景下,衡量 AI 成本竞争力的标尺正在移动。分析人士认为,行业关注点正从“每个 token 的价格”转向“每个任务的成本”,后者计入的是完成一项具体工作所需的全部开销。

编辑:林一舟

THE END