同一天里,智谱干了两件看似方向不同的事:一边把模型能力搬进天猫旗舰店,用「卖 Token」的方式触达普通开发者;一边把 GLM-5.3-Flash 开源出去,主打轻量、原生多模态、可私有化部署。一进一退之间,是一条「商业变现」与「生态播种」并行的清晰路线。

一、进天猫卖 Token:把模型调用变成「下单购买」

9 月 2 日,智谱正式入驻天猫开设官方旗舰店,开售 GLM Coding Plan 订阅套餐。价格梯度如下:

  • 个人版 Lite:月付 118 元,含 1 万积分;
  • 个人版 Pro:月付 538 元;
  • 个人版 Max:月付 1078 元;
  • 团队版:标准席位 598 元,支持月 / 季 / 年付。

套餐基于 GLM-5.3,适配 ZCode、Claude Code、Codex 等 20 余款 Agent 编程工具,购买即获 API 调用额度。把模型订阅放进天猫,本质是用消费电商的流量入口,降低开发者接触模型服务的门槛——不必注册企业账户、不必走商务流程,「像买一件商品一样买 Token」。

不过价格结构出现一个值得注意的变化:Pro 版从年初的 149 元涨到 538 元,约 3.6 倍。官方解释是改为「以 Token 消耗为基础的积分制」。这意味着计价逻辑变了——从「固定月费」转向「按用量计费」,重度用户的实际支出会随调用量浮动。对轻量用户可能是利好(按需付费),对高频开发者则需要重新核算成本。

二、开源 GLM-5.3-Flash:轻量多模态,瞄准私有化

在同一条时间线上,智谱开源了 GLM-5.3-Flash,定位为轻量级原生多模态模型:

  • 支持文本、图像等多种输入的统一理解与生成;
  • 强调低延迟与低成本部署;
  • 适合需要在本地或私有环境跑多模态能力的团队。

这与 GLM 系列一贯的开源策略一脉相承,也顺应了近期国产开源模型的一个明显趋势:多模态 + 小参数 + 可私有化部署正成为开源社区的重要方向。对政企、金融、医疗等「数据出不去」的场景,能在内网跑一个轻量多模态模型,比调用公有云更具吸引力。

三、一进一退,是同一盘棋

表面上看,卖 Token 是「收口」,开源 Flash 是「放手」,方向相反。但放在一起,逻辑是自洽的:

开源负责播种,电商负责收割。 GLM-5.3-Flash 开源,吸引开发者在私有环境里熟悉 GLM 生态、沉淀工作流;当天猫旗舰店把 GLM Coding Plan 摆上货架,已经被生态教育的用户,转化路径就更短。开源降低「第一次用」的门槛,电商降低「持续买」的摩擦——两者共同服务于「把开发者留在 GLM 体系内」这一目标。

这也是国产厂商在模型层面对抗闭源巨头的一种典型打法:用垂直增强 + 开源 + 免费 / 低门槛额度组合,换取开发者基数与生态黏性,再在规模化调用上变现。

四、客观看:机会与需留意之处

从积极面看,智谱这步棋有三重价值。其一,渠道下沉——天猫触达的是更广的开发者和中小团队,不局限于既有 To B 客户;其二,生态绑定——20 余款 Agent 编程工具的适配,让 GLM 嵌入开发者日常工具链;其三,私有化友好——Flash 开源呼应了企业对数据主权的刚需。

需留意的点同样明确。第一,价格透明度:积分制下「1 万积分对应多少实际调用」需要用户自己算清,否则月底账单可能超预期。第二,开源与商业版的代差:Flash 是轻量版,真正的高能力是否仍锁在付费层,决定了开源的「引流」与「留存」能否闭环。第三,竞争烈度:Qwen、DeepSeek 等同样在开源 + 低价赛道密集出招,GLM 的生态护城河还需更多差异化来证明。

总体看,智谱 9 月 2 日这波操作,是一次「商业与开源双轮驱动」的典型样本。它既向市场证明了国产模型厂商在变现路径上的成熟,也给开发者和企业提供了更多元的选型:想省事就上天猫买套餐,想自主就拉 Flash 自己部署。Agent 时代,模型公司的竞争早已不只在榜单,而在谁能把能力更顺滑地交到用户手里。