华尔街见闻援引创业邦文章称,AI 编程产品近几个月出现一个新变化:单个 Token 的推理成本在下降,但平台对用户可用额度反而更谨慎。文章认为,这并不矛盾,关键在于模型能力提升后,用户的总调用量增长更快。
智谱上架天猫卖的是调用额度
9 月 2 日,智谱在天猫开设官方旗舰店,上架 GLM Coding Plan。个人版 Lite 月付 118 元,Pro 月付 538 元,Max 月付 1078 元,对应不同积分额度。产品基于 GLM-5.3,并适配 ZCode、Claude Code、Codex 等 20 余款 Agent 工具。
文章指出,这类产品进入电商渠道,意味着 AI 使用额度正被包装成可直接购买的标准化服务,形态上更接近云服务或流量包,而不再只是面向开发者的技术接口。
多家平台开始收紧套餐
近期,多家厂商都调整了相关产品策略。Kimi 曾因算力压力暂停 C 端新用户订阅;阿里云调整 Coding Plan,Lite 套餐停止新购、续费和升级;腾讯云也上调了部分混元模型价格。
- Kimi 曾将算力优先留给已付费用户
- 阿里云下线部分低价 Coding 套餐
- 腾讯云上调部分模型输入价格
文章认为,变化背后并不是 AI 变得更贵,而是模型越强,用户越愿意把更复杂的任务交给 AI。与早期聊天式调用相比,代码生成、工具调用、持续执行等任务会显著放大 Token 消耗。
总调用量增长快于成本下降
智谱披露,随着模型架构和推理基础设施优化,其单位 Token 推理成本较年初下降 80%。但文章同时提到,Token 消耗速度增长更快,这成为当前 AI 商业化面临的现实压力。
智谱半年报显示,2026 年上半年公司营收 9.54 亿元,同比增长 399.7%。其中,MaaS 开放平台及 API 业务收入 8.25 亿元,同比增长 2735.7%,占总收入 86.5%;本地化部署收入占比则从上年同期的 84.8% 降至 13.5%。
从卖模型转向卖结果
这意味着,收入结构正从一次性项目交付转向持续性调用收费。文章据此判断,AI 公司卖的不再只是模型本身,而是模型完成任务的能力。
文章提到,智谱管理层将商业路径概括为“卖模型、卖调用、卖订阅、卖端到端任务结果”。在这一过程中,定价方式也可能从“每百万 Token 多少钱”转向“完成一个任务多少钱”。
文章还援引行业数据称,2026 年第一季度全球每周 Token 使用量升至 22.7 万亿;OpenAI 平台 Token 调用量也在数月内明显增长。核心判断是,随着 Agent 和多 Agent 应用扩展,Token 单价下降未必会带来总成本下降,反而可能推动整体使用量继续上升。
