智谱悄悄上架天猫:Token越来越便宜,为什么AI公司反而开始限量了
创业邦 · 商业与创投
原创 存薇 2026-09-05 18:10 北京 智谱卖Token,背后藏着一个反常识的AI生意 作者丨 存薇 编辑| 关雎 图源|midjourney 最近,有读者发来一条智谱的公告。 用了几个月的老套餐,要没了。 此前那个 “不限周额度”的 GLM Coding Plan ,将停止自动续订,智谱给老用户补偿两个月新套餐。 几个月前, AI 编程市场还在比谁家套餐更便宜;到了现在,大家开始比另一个东西: 你到底能用多少 Token 。 9 月 2 日,智谱正式入驻天猫,开设官方旗舰店,上架 GLM Coding Plan 。个人版 Lite 月付 118 元、 Pro 月付 538 元、 Max 月付 1078 元,分别对应不同的积分额度;产品基于 GLM-5.3 ,并适配 ZCode 、 Claude Code 、 Codex 等 20 余款主流 Agent 。 这意味着,一件过去听起来非常 “技术”的东西,开始进入电商货架: AI 的使用额度,可以像手机流量一样被直接购买。 但这里真正值得关注的,并不是 “智谱上天猫卖 Token ”这件事本身。 而是一个看起来有些反常识的变化: Token 越来越便宜了, AI 公司却开始越来越在意你用了多少 Token 。 大家都开始限量了 过去几个月, AI 行业出现了一个非常有意思的变化。 Kimi 曾因为算力压力暂停 C 端新用户订阅。 7 月 19 日,月之暗面公告称, Kimi K3 上线后请求量大幅超出预期,已经逼近现有集群承载极限,因此暂停 C 端新用户订阅,把算力优先留给已经付费的用户。 阿里云也在调整 Coding Plan 。其 Lite 套餐从 3 月 20 日起停止新购, 4 月 13 日起停止续费和升级。 腾讯云则在 3 月调整部分混元模型价格。其中, HY2.0 Instruct 输入价格从每千 Token 0.0008 元提高到 0.004505 元,涨幅超过 460% 。 AI 为什么突然不再 “ 大方 ” 了? 过去 20 年,互联网产品给人的最大经验是数字化之后,边际成本会越来越低。 手机流量就是最典型的例子 。 基站、光纤和网络基础设施建好以后,多传 1GB 数据的边际成本非常低。随着基础设施规模扩大,流量价格一路下降。 所以很多人自然会把这套逻辑套到 AI 上 , 芯片越来越强,模型越来越高效,单位 Token 的推理成本越来越低,那么 AI 应该越来越便宜。 事实上,这个判断的前半句完全正确。 智谱自己披露,随着模型架构和推理基础设施持续优化,其单位 Token 推理成本较年初下降 80% 。公司还称,目前已经实现 10 万级国产芯片规模化低成本推理。 问题在于 , Token 便宜了,但 Token 的消耗速度增长得更快。这才是今天 AI 行业真正的矛盾。 Token 不是普通的数据流量。 一枚 Token 背后,是模型推理所消耗的计算资源,是 GPU 或 AI 加速芯片、高带宽内存、网络、存储,以及数据中心里的电力和散热。 Token 更像是 AI 算力被计量、被交易的一种单位。 当模型只是陪你聊天时,一次调用可能只需要几百、几千 Token 。但当你让 AI 替你完成一个复杂任务,它的消耗就完全不同了。 从 “卖模型” 到 “卖调用” 智谱最新半年报,把这个变化写在了财务数据里。 2026 年上半年,智谱实现营收 9.54 亿元,同比增长 399.7% 。上半年,智谱 MaaS 开放平台及 API 业务收入达到 8.25 亿元,同比增长 2735.7% ,占总收入的 86.5% 。 而去年同期,这一比例只有 15.2% 。与此同时,本地化部署收入占比从 84.8% 下降到 13.5% 。 一年时间,智谱的商业模式几乎完成了一次换挡。 过去,客户买的是模型。模型部署到企业自己的服务器里,进行定制、集成和交付,一次项目往往对应一次收入。 现在,越来越多客户直接调用云端模型。调用一次,计一次费,用得越多,付得越多。这就是典型的 MaaS 生意。 而且,智谱这次的变化并不是简单的 “降价换规模”。恰恰相反,它出现了一个很有意思的组合: Token 调用量较年初增长超过 40 倍; API 平均售价提升约 101% ;单位 Token 推理成本下降 80% ; MaaS 业务毛利率提升至 24.6% 。 成本在下降,收入在增长,用户用得更多,平均售价反而还在提升。 AI 商业化可能正在摆脱最初那种简单的“价格战”。 早期模型能力不够强,平台只能通过低价甚至免费,把用户吸引进来。 但当模型开始能够真正完成代码生成、工具调用、持续执行等复杂任务后,用户购买的就不再只是 “一个模型”,而是模型替自己完成工作的能力。 这也是为什么智谱管理层把商业模式概