智能体要真正进入企业核心工作流,绕不开两件事:一是能直接操作真实软件环境,二是能满足受监管行业的合规要求。Anthropic 近期在 Claude Platform 上同时推进了这两步——Computer Use、Skills API 与 Files API 转为全面可用(GA),并推出全新的 Browser Use 工具;其中 Computer Use 达到 HIPAA 合规标准,意味着它可以进入医疗健康等强监管负载。

一、Computer Use 的关键跨越:一次调用,多个动作

Computer Use 的突破不在于「能操控电脑」本身,而在于工程层级的成熟度。更新后的工具允许 Claude 在单次模型调用中执行多个连续操作,显著减少任务完成所需的总调用次数与耗时。对开发者而言,这意味着长流程自动化任务的稳定性与成本同时改善——Agent 不再需要为每一个微小步骤都往返一次模型。

更值得注意的是合规属性。达到 HIPAA 合规,使 Computer Use 可用于受监管的医疗健康工作负载,这是此前多数通用桌面 Agent 难以触及的场景。当 Agent 能「操作电脑」且具备合规背书,企业才敢把它放进真实业务系统,而非停留在演示环境。

二、Browser Use:从「截图点击」到「理解网页结构」

本次发布的 Browser Use 工具,是桌面操作能力的延伸。它继承了多轮操作的优势,并引入网页结构解析能力——能够直接识别网页上特定的输入框或按钮进行交互,而不是依赖传统截图再「盲点」坐标。相比截图点击,结构解析在精确性与抗页面布局变化上更稳健,也更容易被审计与回放。

这背后是一条清晰的路线:Anthropic 希望 Claude 不只是「生成代码让人去跑」,而是能替人完成「打开网页、填表、提交、核对结果」这类跨应用的真实操作。当 Browser Use 与 Computer Use 组合,Agent 的活动半径从代码编辑器扩展到整个桌面与浏览器。

三、Skills API 与 Files API:把企业资产装进沙箱

Skills API 允许企业上传和管理专有「技能文件夹」——包含行业指令、脚本与模板,并在 Claude 的代码执行沙箱中安全运行,无需企业自行托管基础设施。这对金融、法律、制造等拥有大量内部流程知识的行业尤为关键:企业可以把沉淀的 SOP 变成可被 Agent 调用的技能,同时把数据与执行留在受控环境。

Files API 则提供稳定的文档存储,支持 PDF、表格等格式,通过 ID 在后续请求中引用,并具备自动文件过期机制;速率限制提升 5 倍,每个组织可享 1TB 专用存储。文档的持久化与高效引用,是长周期任务与企业知识处理的基础设施,解决了此前「每次请求都要重新搬运文件」的痛点。

四、客观看:能力释放,边界仍在

从产品演进看,Anthropic 正把 Agent 从「对话与代码生成」推向「操作环境 + 调用企业能力 + 处理文档」的统一体,并以合规作为进入关键行业的通行证。这是一条扎实的企业级落地路径。

但边界同样明确:Computer Use 与 Browser Use 的能力越强,对权限、审计与可观测性的要求就越高;技能在企业沙箱内运行,仍需企业自身建立调用边界与审批机制。Agent 能操作电脑,不等于企业应当把一切交给它——合规是门槛,治理才是常态。对选型者而言,这套 GA 能力的价值,最终取决于能否被纳入一套可问责的流程,而非单看演示有多炫。