过去两年买软件都是按「席位」算钱:每人每月多少钱,用不用都照付。9 月 1 日多家媒体集中报道了一个正在发生的转变——企业软件厂商开始按「结果」收费:Zendesk 按每次问题解决收 1.5 美元,而且只有 AI 从头到尾独立解决完整个交互才计费,90% 完成转给人工的部分一分钱不收;Pegasystems 按每个完成的案件收固定费用;Salesforce Agentforce 则按会话收费并引入了 AWU(Agentic Work Unit)计量单位。但 Gartner 的数据给这股热潮泼了冷水:目前只有 19% 的买方、13% 的卖方真正采用这种模式,预计到 2031 年占比仍低于 25%。这篇教程帮你理解「结果定价」的运作机制、厂商报价清单,以及作为买家怎么谈、怎么算。
传统 按席位(per-seat):每人每月固定费用,成本可预测但和实际价值脱钩。按用量(per-usage):按 token/调用计费,用得越多付得越多,缺点正如 CIO 们抱怨的——「账单来了才知道真实成本」,GitHub Copilot 从 10 美元固定月费转向按用量计费后,重度用户单月成本预估最高可达 180 美元。新兴的 按结果(outcome-based):把「完成一件任务」当作计量单位,客户获得预算可预测性,厂商则期望随着自动化规模扩大赚得更多。
三种模式不是互斥的:很多厂商在按席位的基础上叠加结果条款(比如席位 + 性能承诺),微软 365 Copilot 就是「席位 + 按任务计量」双轨。理解了坐标系,后面算账才有基础。
按媒体披露的厂商定价(价格为公开渠道汇总口径,实际以官方报价为准):
Zendesk:每个「验证解决」工单 1.50 美元(承诺价)/ 2.00 美元(现付)。严格条件——AI 必须 100% 独立闭环解决,并且由 AI 评估系统独立确认;AI 解决 90% 转人工 10% 的不计费,垃圾邮件和例行往来不计费。HubSpot:每个解决会话 0.50 美元。Intercom(Fin):每个解决 0.99 美元。Salesforce Agentforce:每会话 2.00 美元,或用 Flex Credits(10 万积分 500 美元);2026 年 2 月起引入 AWU 计量。Microsoft Copilot Cowork:按任务分 Light/Medium/Heavy 三档,分别约 1–3 / 4–7 / 7+ 美元。
同样是「结果」,各家的定义差得很远,这正是谈判的核心战场:
① 验证解决(Zendesk):AI 解决后等 72 小时无后续追问,再让 LLM 复查是否真正解决——只有「通过检查」才计费,人工接手完成的不计费,「看似解决实则没解决」的也不计费。② 端到端闭环(Zendesk 口径):AI 独立处理 100% 的交互才计费,把「90% 自动 + 10% 人工」这种常见协作模式排除在计费之外。③ 防蹭单:垃圾消息、例行问答不计入「解决」——防止厂商用低价值流量凑单。买之前一定先问清楚:你们定义里「一次解决」的具体判定标准是什么?谁来做判定?判定可审计吗?
按结果收费不只在客服领域。网络安全公司 VerifiedThreat 的逻辑是:客户不修安全问题 → 它的智能体要投入更多监控资源、供应商成本上升,但客户账单不变;客户积极修复漏洞 → 它的成本下降,客户获得积分抵扣费用。「我们降低的整体风险越多,客户从结果定价中获得的财务收益就越大。」HP 也在为 Workforce Experience Platform 研究结果挂钩方案:传统按席位 + 围绕「减少 IT 工单数」「设备换新节省」等指标的承诺,预计 2027 年中后期才有早期用户尝到。思路可以迁移:把计费单位和「你真正关心的业务指标」绑在一起,供应商才有动力把事做成。
Gartner 副总裁分析师 Tom Coshow 的数据:目前仅 19% 的服务买方和 13% 的卖方服务协议采用基于结果的定价安排;预计到 2031 年,采用该模式的科技服务合同占比仍低于 25%。他的判断很直接:「目前结果定价的增长更多停留在炒作层面,而非现实落地。」原因在于:结果定义难以标准化、风险转移不彻底(很多「结果定价」只是换了计费单位、厂商并没有真正承担风险)、以及合同谈判复杂度上升。所以别被宣传带着走,先看清这波浪潮里哪些是真变革、哪些是换汤不换药。
顺带一提,这个趋势和我们之前讲过的 Agent 经济学一脉相承:当 Agent 开始替人类完成整件任务,「按工作收费」就成了唯一说得通的计算方式。相关背景可回看Agent 经济学:时薪计算与完成率×成本矩阵与Agent 预算护栏。
塞顿霍尔大学 CIO Paul Fisher 的提醒很实用:结果定价能让 ROI 更好衡量,但也让合同谈判更复杂——双方必须对「期望结果」有极其明确的界定。签之前过一遍这四问:
① 供应商承担风险吗?(Coshow 的核心问题:如果结果没达成、供应商只是换了个计费单位不担责,结果定价就失去意义);② 「成功结果」怎么定义、谁判定、可审计吗?;③ 初期和长期成本曲线什么样?(Zendesk 明确说初期可能低于席位价、随自动化扩大长期支出上升);④ 退出机制与治理呢?(对应智能体权限边界与审计要求)。
另外,结果定价让「模型成本」成了硬约束——按用量省下的钱会直接影响你的利润。想压住模型侧成本,可参考DeepSeek V4 分层路由与Token 计费与缓存省钱,把「低价模型处理常规、高价模型处理复杂」的路线固化进工作流。
技巧:如果你的供应商主动推「结果定价」,先小范围试点再全面铺开。选一个指标清晰、数据可审计的窄场景(比如「每周工单解决数」),跑一个月看真实账单和你内部统计是否对得上,再决定是否扩大。
注意:结果定价的「结果」若定义含糊,最容易产生计费争议。务必把「什么算一次解决」「人工介入多少不算」「谁判定」「判定依据可导出吗」写进合同附件;同时留意 AWU 这类新计量单位可能叠加在原有席位费之上,总成本未必下降。
# 结果定价快速对照表(公开口径汇总,以官方报价为准)
厂商 计量单位 参考价 计费条件
Zendesk 验证解决工单 $1.50/承诺 100% AI 闭环 + AI 评估确认
HubSpot 解决会话 $0.50 会话级解决
Intercom Fin 解决 $0.99 解决即计费
Agentforce 会话 / Flex Credits $2.00 / $500 + AWU 计量(2026.02 起)
Copilot Cowork 任务(轻/中/重) $1-3/4-7/7+ 按任务档位
# 买家四问
① 供应商承担结果风险吗? ② 结果怎么定义/判定/审计?
③ 初期 vs 长期成本曲线? ④ 治理与退出机制?