9 月 8 日,一份基于百万级真实用户数据的办公 Agent 行为报告进入行业视野。报告由 LobsterAI 提供数据底座、上观新闻发布,首次把「人们到底怎么在用办公 Agent」这件事,从体感争论变成了可量化的分布曲线。结论并不温和:Agent 正在从「尝鲜工具」滑向「生产基础设施」,而使用结构高度集中。

一、算力高度集中:前 20% 用户吃掉 87.4%

报告最扎眼的一项,是算力的「二八分化」被进一步拉大——前 20% 的重度用户,消耗了全部算力的 87.4%。这意味着办公 Agent 的价值释放高度依赖一小批「会用、敢用、天天用」的核心人群,而非平均摊薄到全员。对产品方而言,真正的留存与付费拐点,大概率就藏在这 20% 里;对普通用户而言,Agent 的「门槛效应」仍然存在:会用的人越用越顺,不会用的人始终停在浅层。

二、任务变重:单次规模 5 个月涨 3.1 倍

另一组数据指向「任务复杂度」的跃升:单凭一次交互所承载的任务规模,在 5 个月内增长了 3.1 倍。这背后是 Agent 从「问答」走向「办事」——用户不再满足于「帮我写一段话」,而是「帮我把这份报表对完、把那封邮件发了、把周报整理好」。任务链条拉长、工具调用变多,单次会话消耗的 Token 自然水涨船高,也倒逼底层模型在长上下文与多步规划上持续迭代。

三、时间错位:近六成 Token 耗在「非办公时段」

报告还揭示了一个反直觉现象:近 60% 的 Token 消耗发生在传统「非办公时段」。这既可能是加班文化的投射,也更可能是 Agent 改变了工作节律——把白天的零碎指令,集中到晚上批量交给 Agent 处理,第二天直接收交付物。当 Agent 成为「异步同事」,工作与休息的边界正在被重新定义。

四、模型格局:DeepSeek V4 Flash 占比超 75%

在模型选择上,报告披露 DeepSeek V4 Flash 占比超过 75%。这并不意外:办公场景对「够用且便宜」极度敏感,Flash 价位的高性价比,使其成为大量日常 Agent 任务的首选底座。它也侧面说明,国产开源模型已在实际生产流量中占据主导,价格与可用性正在取代「参数规模」成为用户决策的硬指标。

需要客观指出的是,报告未披露全量样本口径与行业覆盖范围,上述分布更适合作为「趋势信号」而非「绝对结论」。但即便如此,它已经画出了办公 Agent 的真实轮廓:重度集中、任务变重、时间错峰、国产模型主导——Agent 的普及,正在从「有没有」转向「重不重、贵不贵、天天用不用」。