提问方式变了

2026 年 9 月 9 日至 13 日,中国国际服务贸易交易会在北京首钢园举行。据主办方介绍,本届在主题展核心区域设置了中国服务展区,集中展示 140 个服务贸易创新案例,覆盖服务贸易全部十二大领域,其中以人工智能、大模型、智能体为核心技术的案例占比接近四成。

数字本身说明不了太多。更值得记录的是提问方式的变化:一年前展台上被反复问的是它能做什么,今年被反复问的是它能不能稳定跑下去。一位与会企业技术负责人的表述很直白——AI 从技术能力走向产业生产力,最关键的跨越是从能演示走向能交付。

这句话把这一轮落地讨论的分水岭标出来了:评判标准从模型能力,转向能不能与具体场景结合并形成稳定交付。

四个具体场景

先看几个有名字的落地案例,它们比宏观判断更能说明问题。

在医疗方向,有企业展示了面向专科的垂类模型方案,通过家庭医生助手辅助基层医生开展居民健康咨询;同一展区还出现了诊室听译类设备,用多麦克风阵列配合抗噪技术分离医患对话,实时转写并自动结构化生成电子病历,定位是让医生把注意力放回诊疗本身。这类产品的价值不在模型多大,而在于把记录这件事从医生的注意力里拿走。

在旅游方向,有企业推出旅游智能操作系统,一边帮旅行社打造一个人顶一个团队的数字员工,一边为游客提供一站式智能旅行服务。这个双向设计值得注意:它同时服务供给侧和需求侧,说明其判断是先让供给侧的效率问题被解决,需求侧的体验才有基础。

在内容生产方向,有平台的定位是把策划、脚本、制作与审核分发串成一条链,已用于宣传片与动画项目。它对应的是专业服务里的一个共性痛点:创意工作本身难自动化,但创意前后的流程环节可以。

在金融方向,有银行的数字人客服已应用于部分分行的智慧柜员机,官方给出的口径是客户问题解决率达到 98%。这个数字需要标注统计范围——问题解决率的定义、样本构成与统计周期都会显著影响它,公开材料没有展开,因此更适合当作内部运营指标而非行业基准。

被反复提到的那句判断

在一场关于政务场景的讨论里,有一句话被引用的频率很高:政务领域的模型不是越有创造性越好。

这句话可以推广到所有专业服务场景。金融要的是合规与一致,医疗要的是准确与可追溯,政务要的是稳定与可审计。这些场景的共同点,是不确定的创造性带来的收益远小于它带来的风险。因此在这类场景里,模型能力的边际价值会快速递减,真正决定能不能上生产的是另外几件事:输出是否稳定、错误是否可回滚、责任是否可界定、成本是否可核算。

这也能解释为什么展会上的讨论重心从参数转向了安全、成本与稳定运行。一位与会专家的表述是,现阶段多数场景仍处在辅助执行阶段,尚未完全替代专业人员决策。这个判断比任何演示都更接近现状。

智能体在其中的位置

把上述场景串起来看,智能体在这轮服务贸易落地里扮演的角色比较具体:它不是替掉某个岗位,而是把跨系统、跨环节的流程接起来。

医疗场景里,它把问诊记录、病历生成、后续随访连起来;旅游场景里,它把行程规划、预订、支付连起来;内容生产里,它把策划、制作、分发连起来。这些工作的共同特征是环节多、系统杂、人工衔接成本高,而不是单点能力要求高。

这也意味着评价一个行业智能体,看的不应是它单次回答的质量,而是它能不能把一条链跑通、跑稳、跑得可追溯。跨系统的稳定衔接,恰恰是当前工程上最花时间的部分。

需要保留的几点谨慎

其一,展示案例与规模化收入之间还有距离。展会上的案例多为试点或首批落地,客户数量、续约率与单位经济性大多未披露,不宜用占比近四成推断整个行业的商业化成熟度。

其二,口径需要标注。类似解决率 98% 这样的运营数字,缺少统计范围说明时,跨机构比较没有意义。

其三,专业服务的责任结构尚未理顺。当一个智能体参与病历生成或投顾建议时,最终责任人仍是机构与专业人员。责任主体不变,意味着人类复核节点在可预见的阶段内不会消失,它只是从全程参与变成关键节点确认。

其四,落地成本的实际构成。展会讨论里反复提到成本,但很少展开成本结构:是推理成本、集成成本,还是流程改造与培训成本。多数情况下,后两项往往远高于前者,却最不容易被看见。

本轮展会上发布的多数方案,其定价、客户规模与运行指标目前官方及行业暂未披露更多细节,后续将持续跟进迭代动态。