企业AI支出管理正在加速收紧。瑞银证券分析师Karl Keirstead团队在6月23日发布的报告中称,约60%的企业已开始以某种方式限制AI开支,重点是给Token使用加设护栏。报告认为,这一变化可能短期拖慢AI收入增长,但不会改变长期需求扩张的方向。
高价模型使用被压缩
企业并没有停止使用AI,而是开始重新分配预算。随着AI Agent和代码工具普及,Token消耗从零散试用变成持续运行的成本项,CFO也开始直接关注账单。瑞银调研显示,一些公司已经缩减内部AI工具数量,或对单个用户的月度花费设置更严格限制。
模型路由成了主要手段
企业最常见的做法不是简单限额,而是模型路由。也就是把不同任务分给不同模型,只有复杂推理、关键代码和长上下文分析才调用更贵的模型。瑞银指出,这种做法让高端模型从默认选项变成更谨慎的选择,企业更在意每一美元能换来多少有效结果。
中国开源模型进入采购清单
报告提到,阿里Qwen、DeepSeek、MiniMax、智谱GLM等中国开源模型,正进入更多企业的采购和部署选项。一家大型全球银行已在本地部署Qwen,用来平衡Claude等高端模型的使用。AWS Bedrock和Azure AI Foundry也已把多款相关模型纳入可选菜单。
软件公司处在两头承压的位置
瑞银认为,云厂商和硬件层受到的冲击相对有限,因为推理需求仍会留在云上运行。软件公司则更复杂,一方面面临客户预算收紧,另一方面也有机会把自己做成“Token优化平台”。Palantir等公司已在推广模型调度和成本优化工具,试图帮助客户降低AI使用成本。
