Token定价相差数倍 大模型行业亟待建立计量标尺

2026年07月31日 21:08
本文共计1328个字,预计阅读时长5分钟。
来源/证券时报网 责编/MoRanShiguang 墨染时光

近期,大模型API(应用程序接口)市场的价格分化引起了广泛关注,Kimi K3旗舰百万Token(词元)输出定价100元,DeepSeek V4-Pro通过架构优化将缓存命中后输入价降至0.025元,在这背后是AI服务商开始自主锚定价值、探索可持续商业化路径,全行业定价权博弈才刚刚开始。

报价的分化只是表层现象,其背后的真正博弈发生在台面之下。通过设定缓存命中率等暗箱操作,模型私自进行降智减配调整,以及对Token底层计量单位的不统一统一处理,大模型的计费机制在事后才能算清账目,致使用户无法提前知晓实际费用。全行业尚未形成统一的计量规范和账单标准。对于监管尺度、定价权分配以及用户权益保障三者的平衡方式,当前AI产业成为绕不开的核心考题。

7月,大模型API市场价差再度拉大:月之暗面发布Kimi K3,每百万Token输入20元(缓存命中2元)、输出100元,较上一代上涨2至3倍,站上国产大模型价格高位;而就在5月,DeepSeek V4-Pro已宣布将价格永久下调75%,每百万Token输入降至3元(缓存命中0.025元)、输出降至6元,成为国产大模型性价比之代表。一涨一降之间,旗舰级产品的定价落差已拉大至数倍。

为什么会出现这种分化?石科技联合创始人毛运航指出,当前大模型API市场远未成熟,所有定价本质上都在试探客户能接受的价格区间。成熟市场的定价应由算力、能源、研发成本叠加应用附加值共同决定,而眼下全行业主要锚定两条线:下限看算力租赁成本——若API售价低于直接租用算力的收益,业务便失去商业合理性;上限看模型稀缺度与实际产出价值,头部视频生成模型的定价可摸到普通文本模型的十倍以上。

这种分化并非一蹴而就。南京某AI智能体创业公司创始人张源化名亲历了Token价格变化的三个阶段2025年初MoE混合专家模型架构与量化蒸馏技术成熟全行业普降主流产品每百万Token从数十元跌至个位数但价格战也让中小厂商跌破盈亏线2025年下半年至2026年初云端GPU租金上涨高端芯片供给收缩推高硬件成本叠加Agent类应用爆发带动单次Token消耗暴涨数十倍算力供不应求倒逼厂商集体回调定价2026年5月至今市场彻底走向分化如今整个市场已分裂为两套定价哲学一派走价值定价路线锚定高端智力生产力的稀缺性做高溢价另一派走成本定价路线定位普惠AI基础设施靠规模取胜

明码标价背后

真实支出难料

模型“暗地减配降智”的现象同样存在。前述AI Infra公司创始人表示,不少服务商对原版高精度模型进行大幅压缩并部署为低精度版本,价格公示页却依然标注原版名称以及参数;业务繁忙时段甚至动态切换至低精度运行。张源向记者证实,部分厂商会在API调用中悄悄将高价位模型切换为低价位模型,用户花钱买了“头等舱”,实际坐的却是“经济舱”,却无从察觉、难以维权。

前述被访的政策研究专家对证券时报记者表示,制度建设应分步推进。短期优先建立计量口径、账单字段等基础信息披露规范,即“建指数、明规则、晒账单”,核心是“轻价格管制、重信息披露”;中长期则需划定竞争边界、建立成本基准及设立系统性预警等。

责编:陈丽湘

校对:祝甜婷

来源:深度| Token定价相差数倍!大模型行业亟待建立计量标尺 | 证券时报网

声明:本文来自证券时报网,版权归作者所有。文章内容仅代表作者独立观点,不代表爱力方立场,转载目的在于传递更多信息。如有侵权,请联系 copyright#agent.ren。
0
TAGS: []

相关图文

热门资讯