2026 年 8 月 11 日,SpaceXAI(原 xAI)与 Cursor 联合推出 Grok Bot early beta——一个定位为「永远在线的 AI 队友」的数字员工产品。它与普通聊天助手的最大区别是:每只 Bot 都拥有一台专属的云计算机(独立的浏览器、文件系统与终端),可以登录你正在用的应用和网站,观察你处理工作流的过程并固化成可复用的 routine;你关掉笔记本,它照样在云端继续干活。本教程从安装、创建第一个 Bot、写出「结果导向」的任务,讲到人机交接、routine 固化与权限边界。
先搞懂:Grok Bot 和「聊天机器人」到底差在哪?
聊天机器人给你「答案」,Grok Bot 试图给你「做完的结果」。核心差异在三点:
| 对比项 | 普通 AI 聊天机器人 | Grok Bot |
|---|---|---|
| 主要输出 | 回答、建议、草稿 | 操作工具并交付成果 |
| 运行环境 | 单次对话为主 | 持续运行的云端电脑(Linux VM) |
| 网站操作 | 给步骤或只读 | 可用浏览器 + 网站登录状态点击操作 |
| 任务启动 | 用户主动提问 | 消息、排程、Slack/GitHub 事件触发 |
| 记忆 | 对话记录 | 用户 / Bot / 项目三层长期记忆 |
| 人工介入 | 另开网页自己处理 | 登录、2FA、CAPTCHA、付款时人机交接 |
Step 1:门槛确认与安装:三个订阅档位 + 桌面客户端
Grok Bot 目前处于 early beta,按订阅开放,不是人人都能直接体验:
可用订阅(任一即可):
· SuperGrok Heavy(x.com / SpaceXAI 个人档,约 $300/月)
· Cursor Ultra(cursor.com 个人顶档,约 $200/月)
· Cursor Teams Premium(团队档,约 $120/座位/月)
安装步骤:
① 打开 Grok Bot 官网下载页,选 macOS 或 Windows 客户端
(macOS 分 Apple silicon / Intel 两个安装包)
② 运行安装器,打开应用
③ 用 Cursor 账号登录(SSO 组织走常规登录流)
④ 首次启动会介绍 Bots、共享电脑与 routines,
并询问你常用哪些工具——这些回答只影响
「推荐队友」,不会主动连接或修改你的工具
注意数据设置:Grok Bot 依赖云端数据存储,使用 Legacy Privacy Mode 的账号需先在 Cursor 隐私设置中切换到受支持的数据设置,否则无法启动。
Step 2:创建第一只 Bot:给岗位起名、定职责、写清楚工作方式
在「认识一位未来队友」界面选推荐模板,或选「创建自己的 Bot」,给它三样东西:名字、一个主职责、一段工作方式描述。官方示例:
Bot 名:Piper
主职责:产品性能
工作方式描述:
- 用可观测性工具调查产品性能类问题
- 保留链接与截图,把「证据」和「假设」分开
- 先返回最高影响问题,再给简短摘要
- 绝不改动生产配置
专业建议:职责越聚焦越好——「每只聚焦的 Bot 比一只全能 Bot 能积累更有用的上下文」。上限为 50 只 Bot 与群聊之和,后续可通过 New → Create new agent 按岗位拆分。创建后在 Bot 菜单里可随时改名、改描述、置顶或隐藏(隐藏不删除工作)。
Step 3:派第一个任务:结果、来源、约束、交付物、检查点
给 Bot 的第一个任务决定体验好坏。官方推荐一个强请求包含五要素:
① 结果 Outcome:做完后应该是什么样?
② 来源 Sources:哪些应用、网站、文件、对话相关?
③ 约束 Constraints:Bot 必须避开什么?哪些动作前要问你?
④ 交付物 Deliverable:最终返回什么格式?
⑤ 检查点 Review point:做到哪一步应该停下来等你?
五分钟出结果的入门任务(无需连接器、无需登录):「把这份文档总结成五个要点;单独列出一节记录每个日期、决定与未决问题;逐条注明出处章节;不要改动源文件。」跑通后,再试真实工具任务:「打开我们的分析仪表盘,把本周新用户激活和过去四周对比,找出变化最大的一步,起草一份带图表链接的调查计划;不要改动任何仪表盘;需要登录时叫我。」
Step 4:人机交接:登录、验证码、付款这种「只有你能做」的环节
跨应用自动化最容易卡住的不是 AI 不知道怎么干活,而是 登录 / SSO / 2FA / CAPTCHA / 付款确认。Grok Bot 的处理方式是「把电脑交给你」:
交接流程:
① Bot 打开需要登录的应用并停在登录页
② 对话中打开「接管电脑(Agent Computer)」
③ 你亲自输入密码 / 验证码 / 过 CAPTCHA
④ 完成后把控制权交还 Bot,它继续跑
连接器(可选):
· 设置 → Plugins 可安装官方连接器
· 在浏览器中完成授权后,Bot 直接复用登录态
· 敏感凭据走安全表单,不会写进普通对话
登录态保存在「共享的 Grok Bot 电脑」上,其他 Bot 在适当时机也能复用同一登录会话——这正是「Bot 之间有团队感」的来源,但也意味着权限边界要提前想清楚。
Step 5:固化流程:把演示变成 routine / skill,让 Bot 从此自己跑
当某个流程稳定后,让 Bot 把它沉淀成可重复执行的能力:
两种固化方式:
① 命名偏好(轻量)
「以后每周周报都用这个格式:五条要点、
行内来源链接、最后一节叫『待决策事项』」
② Routine / Skill(重量)
演示一遍完整流程 → Bot 观察步骤 →
保存为固定工作流 → 之后按排程或事件自动执行
自动触发:
· 排程:每天 / 每小时固定整理指定来源
· 事件:新的 Slack 消息、GitHub 事件自动启动
· 互相触发:一只 Bot 完成某步后唤起另一只
官方团队成员的用法可以借鉴:Demo Bot 每天检查 X 书签挑新技术并生成 Demo;Content Bot 每小时扫工程与产品 Slack 频道产出对外分享草稿;采购 Bot 对比 Instacart 与 Amazon 的价格、数量与运费再整理购物车。共同特征是:流程重复、信息分散、需要登录、保留一个人确认的节点。
Step 6:安全边界:权限清单、三层记忆与 prompt injection 防线
Grok Bot 通过权限 + allow 清单 + block 清单 + reviewer Agent 控制行为,但把安全完全交给产品设计并不明智:
安全清单(建议逐条过):
□ 从只读、可回复、可撤销的任务开始
□ 每只 Bot 只开放完成工作真正需要的工具与数据
□ 付款、删除、大量对外发送、账号设置变更
一律保留人工确认节点
□ 避免「帮我处理所有邮件」这类范围不明的指令,
明确指定来源、动作与停止条件
□ 定期检查:登录状态、记忆内容、触发规则、执行记录
三层记忆治理:
· 用户记忆:姓名、时区、跨 Bot 通用偏好
· Bot 记忆:角色设定与互动记录
· 项目记忆:团队决策、工作惯例与项目背景
→ 错误信息一旦写进记忆会持续影响后续任务,
记得能查看、修正、删除
最大风险是权限与 prompt injection:Bot 能读信箱、用已登录网站、对外发送时,一次误判可能跨系统扩散;而网页/邮件/文档里隐藏的恶意指令(间接注入)连 NIST 都承认现有浏览器 Agent 无法完全免疫。Grok Bot 有交接与审批设计,但早期 beta 阶段,别把金流、客户个资、合同级任务直接全权交付。
常见问题速查
| 你的疑问 | 参考答案 |
|---|---|
| Grok Bot 和 Grok 聊天机器人一样吗? | 不一样。Grok 以问答生成为主;Grok Bot 有持续运行的云电脑,可登录工具、操作网页、按事件/排程执行任务 |
| 我电脑关机后任务还能跑吗? | 能。Bot 运行在持续存在的云端 Linux VM 上;只有需要本机文件或本人验证时才要求你介入 |
| 能自动登录网站吗? | 使用已建立的登录状态;遇到 SSO、2FA、CAPTCHA、付款等需要本人处理的步骤会交还控制权给你 |
| 适合直接处理付款或重要账号吗? | early beta 不建议开高风险权限。稳妥做法是让 Bot 准备购物车/付款资料,最后一步由你确认 |
| 能创建几个 Bot? | 账号上限为 50 只 Bot 与群聊之和;可按岗位持续拆分 |
| 需要另外部署服务器吗? | 不需要。云电脑、浏览器、终端都由 Grok Bot 托管,你只负责装客户端与登录 |