一句话摘要
10 步用 Grok Bot 自动化日常事务
GROK BOT:如何用 10 步把你的日常交给一个机器人 August 21, 2026 · 24 min read · View source ↗ Grok Bot AI Automation Claude
你到目前为止用过的每一个 AI 工具,都在等你。你打开它,你问,它答,你关掉它。工作仍然握在你手里,模型只是用嘴带着你过一遍。
Grok Bot 把这一点颠倒了过来。Bot 在云端拿到一台持久存在的电脑:一个浏览器、一个文件系统、一个终端。一个 Bot 登录进你已经在用的工具,像你一样在里面点来点去,而且在你合上笔记本盖子之后继续干。
这意味着你不再写提示词,而是开始委托。你不再搭工作流,而是开始用一句话描述一份工作。
这个产品进 beta 才刚两周,而它跑得比关于它的评测还快。下面的一切都对照着 8 月 20 日的文档和价格做了核对,凡是承诺了但还没交付的,都会明说。
把这个存下来留作提示词用,并关注这个账号:@shmidtqq
这到底是什么,用大白话说
一个聊天机器人,是电话那头的顾问。它能告诉你该点哪里,但点的人是你。
你编辑器里的编程智能体,是坐在你机器旁的承包商。它做真活,但只在代码里、而且只在你在场的时候。
经典自动化,是一条传送带。它精确地做你接好的那些事,一旦现实偏离流程图一英寸,它就卡住。
Grok Bot 是一个带着自己笔记本电脑的队友。自己的浏览器、自己的文件、自己的岗位说明。它登录进你用的同样那些服务,在你合上盖子后继续工作,然后带着结果回来。
这给了你那个真正的区别:它不需要 API。某个服务没有集成?Bot 直接打开网站,像人一样点击。这就是为什么它能接住自动化从来够不到的活:内部门户、老掉牙的后台面板、供应商仪表盘,一切活在浏览器里、又没有"连接"按钮的东西。
然后是钱的问题,因为它永远是第一个问题。Grok Bot 目前是这个品类里最贵的入场券,而且这个差距不是空的。
Claude Cowork 为一个会话起一个沙盒,会话结束就拆掉。ChatGPT 的智能体拿到一个虚拟浏览器和一个硬配额:普通套餐每月 40 次运行,贵的套餐 400 次。而在这里,机器永远开机,登录状态在任务之间保持,你最多能养 50 个 bot,而且它们是靠事件触发,不只是靠时钟。
你不是在为模型付费。你是为了一台保持开机的机器付费,为了它上面保持登录的凭证付费,为了代替你在网上点来点去的 Bot 付费。
01. 装上它,交出一件真实的差事
Grok Bot 是一个桌面应用,不是一个浏览器标签页。光这一点就说明了它想成为什么。
有 macOS(Apple silicon 和 Intel)和 Windows(x64 和 Arm64)的客户端,外加 iOS 18 及以上版本的 iPhone。文档里明确写了:没有 Linux 桌面版。也没有 Android 和 iPad:移动端指的就是 iPhone。
你用 Cursor 账号登录,不是 Grok 账号。收购之后这是一个生态,治理这个产品的隐私条款是 Cursor 的。一个给任何还在用旧隐私模式的人的坑:它会完全挡住 Grok Bot。
打开之后,它读起来像个消息客户端:左边是命名好的 Bot,右边是一段对话。
每个 Bot 都有自己的屏幕,你可以打开它、看着工作发生:浏览器、文件、终端。不是录像,不是报告,而是一幅每一次点击都可见的实时画面。
关于试用。与其说是一个七天窗口,不如说是一笔恰好也带七天窗口的用量额度。它是按智能体步数和 token 计量的,而不是按消息,所以烧得很快:真正实验个两三天就用完了。
于是有了第一天的规则:别把额度花在闲聊上。给它一件又小又真实的事,结果可核验,而且哪里都不用登录。
Result: 这个页面上 12 个竞争对手的一张表,带定价档位
和每一家用作主要承诺的那一句话
Sources: 只使用我下面列出的公开定价页
Limits: 不要在任何地方登录,不要填任何表单
Delivery: 把表发到这个聊天里,并保存到 /workspace/pricing.md
Checkpoint: 在你做剩下的之前,先把前 3 行给我看
这是文档里的官方请求结构:结果、来源、约束、交付物、复核点。被低估的是那个检查点(checkpoint)。它把"做这个"变成了"做这个,并在你继续往下之前先给我看"。
02. 给它一个职位头衔,而不是一条提示词
这一步,把从 Grok Bot 身上拿到价值的人和一周内就弃用的人区分开来。
一条提示词是一个请求。一个 Bot 是一个角色。它持久存在、积累记忆、拥有一个领域,并且因为你在同一个线程里反复回来,它专门在这个领域上变得越来越好。
所以按一个真实存在的职位来给它命名。收件箱管理员(Inbox Manager)。费用管理员(Expense Manager)。人才猎头(Talent Scout)。销售外呼(Sales Outbound)。
创建一个,意味着填三个字段:一个短名、一个首要职责、以及一段它应该如何工作的描述。那段描述不是装饰。那是"必须永远为真"的规则住的地方,不是一次性的任务。
然后你写它的章程,就像你第一天给一个新员工做入职简报一样:它拥有什么、"好"长什么样、以及人人都跳过的那部分——它的权限在哪里停止。
You are my Inbox Manager.
OWNS
Triage my inbox every weekday morning. Archive newsletters and receipts.
Draft replies to clients. Flag anything with a deadline, an invoice,
or a legal question.
GOOD LOOKS LIKE
Inbox at zero by 9am. Drafts sound like me: short, direct, four sentences max.
No "I hope this finds you well".
STOP LINE
Never send. Draft only.
Never archive anything from my accountant or my landlord.
Anything asking for money, credentials, or a signature goes to me untouched.
WHEN UNSURE
If you cannot undo it in under a minute, stop and ask.
LOG
At the end of each run, list: what you did, what you skipped, what you guessed.
最后那一块,是整份章程里最有用的那一行。一周的"猜测",就是一份现成的待改清单。
一个带着持久电脑和你的登录凭证的 Bot,在你睡觉时行动。事事都问的 Bot 没用。从不问的 Bot 危险。章程,就是你一次性划下那条线、而不是每天为它操心的地方。
如果你不想从一张白纸开始:官方目录自带 56 个角色模板,从 Bug Reproduction(Bug 复现)到 Apartment Scout(找房侦察兵),而 botdirectory.ai 的社区目录已经长到了大约一百七十五份来自实际在跑这些 Bot 的人的章程。
03. 把工具连接一次,并了解那台共享机器
默认没有一个插件被启用。这是正确的默认。别批量把它改回去。
顺便说下数字:评测一直在重复一个"几百个连接"的数字,但它追溯到一次二手转述。今天的官方市场大约有二十几个厂商插件,而且没有任何地方发布官方计数。相信你自己的清单,而不是别人的数字。
连接通常发生在对话内部:提到一个服务,Bot 就提供一个授权按钮,整件事大约三十秒。
现在,这一步存在的那个细节。连接和会话存在于账号层,而不是 Bot 层。
文档原话:
"你所有的 Bot 使用同一台持久云电脑。它们共享文件、浏览器会话和应用登录,这让交接成为可能,无需重复配置。"
紧接着是:"这台电脑与你的账号隔离,而不是与单个 Bot 隔离。"
相当一部分报道的标题承诺的是相反的事——每个 Bot 有自己的电脑。它不是,而文档专门标出了这一点:Bot 拿到的是各自的屏幕,但那些是工作台面,不是安全边界。公司自己把这称为一个真实的爆炸半径(blast radius)。
由此得出的结论。连接一次 Gmail,账号上其他所有 Bot 都用同一个连接,所以你的第五个 Bot 几秒钟就能干活。这是好处。坏处是,任何连接的半径,是你将来会创建的每一个 Bot。
所以,只连接你真正需要的,插件一次一个、为特定工作启用,工作结束就关掉。还要记住,删除一个 Bot,既不会清理共享文件夹里的文件,也不会清理活跃会话。
如果你想要个人和工作的真正隔离,那是两个账号,不是两个 Bot。
04. 交接会话,而不是交接密码
这是让整件事在没有 API 的工具上奏效的机制——而真实公司里的大部分软件都没有 API。
Bot 在它自己的云浏览器里导航,直到撞上一堵登录墙,然后把屏幕交给你。你认证、过双重验证、点完成,Bot 在同一个浏览器、同一个位置恢复工作。
文档直接禁止了另一条路:"不要在普通聊天里发送密码或一次性验证码。"密码、通行密钥(passkey)、一次性验证码、CAPTCHA 和支付确认,永远是交接给人类。
看看这对信任模型做了什么。你永远不用把一个凭证打进聊天消息里。Bot 拿到的是一个会话,而不是一个秘密,而你在恰恰是敏感的那一部分保持在场。
一个新鲜的实际麻烦。上线几天后,自动登录出现了一个副作用:一个 Bot 反复猛砸登录墙,导致整个账号的 IP 被临时限制,而且这个封禁持续了一天多。支持团队承认了这是个 bug,而变通办法是同一个原则:敏感登录由你手动做,而不是委托出去。
三条第一天就值得采纳的规则:用服务账号而不是个人账号;在每个工具里用最小权限,而不是管理员席位;插件一次一个。
关于你自己笔记本(与云机器无关)再多说一句。本地执行默认不是关闭的,而是设为每次询问。在某个特定 Bot 有某个特定理由要碰你的本地文件之前,把它设为"永不允许"。团队层面的这个上限,仍被列为"即将推出"。
05. 演示一次,而不是解释两次
这个功能改变你对产品的看法。你可以做一次某个工作流、让它看着,从而教会一个 Bot。录制最长十分钟,然后成为一个可复用的技能(skill)。
为什么这比听起来更重要:吃掉你一周的那些任务,通常是"描述起来繁琐、演示起来琐碎"的那些。
"把这个仪表盘里的数字取出来,交叉比对那些下降的,把它们粘贴到这个文档的正确标题下,如果有任何一项跌幅超过 15% 就发消息给团队负责人"——这是要写的一段话,以及要演示的四十秒。
仔细挑选你的第一次录制。最佳候选是:你至少每周做一次、横跨两个或更多工具、而且步骤很少变的事。重复性、多工具、稳定。
你也可以用大白话在线程里保存一个流程:
Save the process we just used as a skill called "Weekly Receipts".
Include: when to use it, the source systems, the exact output format,
the checks that must pass, and what requires my approval.
关于"演示式教学"的诚实提醒:你得到的是一个草稿。决策规则和错误处理仍然需要手工写。而且任何录制下来的序列,都会在某个网站改了布局、或加了新登录提示的那一天失效。
还有一个细节:技能在你所有 Bot 之间可用,不过私有技能可以按 Bot 启用。教一个,就教了整个舰队。
06. 把它排上日程,并记住没有彩排
一个保存好的技能仍然需要一个触发的理由。有两种,而且两种都通过对话来设置,没有工作流构建器,没有满屏的节点画布。
日程(Schedule)是显而易见的那一种:早上 7 点的简报、周五的管线总结、月底的费用归档。
很多时候你根本不用手动创建这个例程。在线程里说一句"我们每周二都做这个",它就会自己出现,命名好、排好程,剩下的只是让你去编辑指令。
事件(Events)是更有意思的那一半:某个特定频道里的新消息、一个 git 事件、一条 Teams 消息、一个 Linear 工单。事件,是让 Bot 感觉"在场"而不是"守时"的东西。
// schedule, the morning brief
Every weekday at 7:00 AM, check my calendar, my inbox, and the #launches
channel. Give me one short brief: what is on today, what needs a reply,
what changed overnight.
// event, the inbound catcher
Whenever an email arrives from a domain not in my contacts and it mentions
pricing, draft a reply from the template and park it. Do not send.
// schedule, the weekly close
Every Friday at 4:00 PM, pull the week's receipts from my inbox, file them,
and tell me anything that has no matching invoice.
// the shortcut that creates most routines
Run this every week.
^ said right after a task you liked
最后那行,是这款产品设计哲学的一个手势。你不构建自动化,你批准刚刚发生的那一次,然后让它再来一遍。
事件规则必须窄。"每一条新消息",就是你在一天之内烧掉一周额度的方式。
在打开第一个之前,有三件事要知道。
每个 Bot 最多 50 个例程。每个例程只保留最近 20 次运行,所以一份季度日志不会自己攒起来。而最要命的那条:有一个测试运行按钮,但它做的是真活。运行会导航网站、改文件、调用已连接的工具,不可逆的步骤会在审批处停住。不存在"什么都不发生、你只读计划"的干跑。
于是有了那条规则:任何新例程,都先跑在一个测试收件箱、测试频道、测试看板上。
以及人们最常打破的顺序:先把任务做一遍,让它可靠,把方法存成技能,然后才去自动化它。把一个不可靠的流程自动化,你得到的是"日程表上的不可靠"。尤其在一个活 beta 里:8 月 20 日,各账号的 Bot 集体停止响应、卡在工作状态,支持团队确认了这一点。一个在早上 7 点静默失败的例程,代价比它看起来大。
07. 雇佣专家,而不是一个通才
几个 Bot 并行运行,各自持有一个不同领域。分开的 Bot 意味着分开的记忆、分开的上下文、分开的问责。
一个只想着收据的费用管理员(Expense Manager),会真正擅长你的收据。一个同时应付费用、招聘和外呼的通才,三样都更差,而且出了问题,你没有一条干净的线索可查。
公司这样描述自己的内部实践:顶部一个幕僚长(chief of staff),每个车道配一个专家——收件箱、费用、招聘、Bug 修复、运营。人们称之为"幕僚长模式"。
一个人的可行起步阵容:
Chief 协调,回答"这该归谁管"
Inbox Manager 分诊、草稿、标记
Expense Clerk 收据、订阅、发票匹配
Research Scout 搜索、对比、表格
Release Runner 仓库、审查、发布说明
三份可以整段拿走、稍作打磨的短章程。
// Expense Clerk
OWNS: pull receipts from my inbox weekly, match them to invoices,
flag subscriptions I have not used in 60 days.
GOOD: one table, columns date / vendor / amount / matched yes-no.
STOP: never cancel a subscription, never reply to a vendor, never pay anything.
LOG: list every receipt you could not match and why.
// Research Scout
OWNS: track the 8 companies in my list. Weekly: pricing changes,
new features, hiring signals, anything they announce.
GOOD: 5 bullets max per company, each with a date and a link.
If nothing changed, write "no change" and stop.
STOP: never sign up for trials, never fill forms, never contact anyone.
LOG: say which sources were unreachable.
// Release Runner
OWNS: watch the repo. On every merged PR, update the release notes draft
and check that the changelog entry matches what actually changed.
GOOD: notes written for a user, not for a developer. No commit hashes.
STOP: never push, never tag a release, never comment on anyone's PR.
LOG: list PRs you skipped and the reason.
注意那个重复出现的形状:拥有、标准、停线、日志。只有内容变,框架始终如一,而这恰恰是 Bot 保持可预测的原因。
再一个技巧:你根本不用手动创建 Bot。给 Chief 一份工作,它要么找到合适的专家,要么为它新起一个。
上限很慷慨,每个账号最多 50 个 bot 和群聊。不过,别一开始就把五个全上。一周雇一个,而且只有当前一个"在不经你修改的情况下跑满五次"之后,才接下一个。一条无聊的规则,能让你免于养出十二个各自只做一半的 Bot 舰队。
按领域拆分,而不是按任务大小。
08. 把它们放进一个群聊
Bot 之间互相发消息、在线程里共享上下文。在一个群聊里,它们自己协调:传递工作、分配归属、只在需要判断时把你拉进来。
公司自己的例子是:一个工程 Bot 复现一个 bug、提交一张工单、然后把问题交给第二个 Bot 去调试。那个交接——一个 Bot 判定另一个更合适、并把归属权移交过去——是此前任何工具里都不存在的东西。
要让它运转起来,给这个群一个目标,而不是一份任务清单。一份清单是你的拆解,那会把 Bot 降级成执行你计划的执行者。一个目标,让它们自己拆分,这才是全部意义所在。一个有用的动作:在每个阶段要求单一负责人。
而令人清醒的那一半:Bot 之间的交接是便利,不是隔离。不同的屏幕,同一台机器。如果你的研究 Bot 从某个页面拖回一条恶意指令,那条指令现在就在那台装着你会话的机器上了。
这不是理论。研究人员最近发布了一种技术,其中恶意指令以加密形式到达:输入过滤器看到的是乱码,模型解密后照做了。演示是针对聊天产品跑的,但这类攻击的本质,恰恰是关于"一个能访问你会话的智能体,能被说服做什么"。
09. 用可逆性来划那条线
Grok Bot 的全部前提是:一个 Bot 端到端地完成工作,只有在某事需要你批准时才回来。这把"什么算需要批准"的定义负担,压在了你身上。
那条线不在于任务大小。而在于可逆性。
任何 Bot 能撤销的事——草拟、归档、打标签、总结、研究、准备——它自己完成。任何外界看得见的事、任何动钱的事、任何收不回来的事,都给你留着。
文档按这个精神列了七类:发送消息和邀请、发布内容、购买和资金转移、删除或覆盖数据、更改权限、生产环境变更、接受法律条款。
// finish these alone, always
draft · file · tag · summarize · research · prepare · reconcile
everything reversible. do not ask, do it and log it
// park these for me, always
send anything to a person outside the company
spend or move money, or commit to a price
publish anything public
delete anything that is not obvious junk
sign up for, agree to, or accept any terms
// when unsure
If you cannot undo it in under a minute, park it and ask.
关于这个机制的关键事实:它拦下的是拟议中的动作,而不是撤销一个已完成的动作。原话:"审批控制的是拟议中的动作。它不会逆转已经完成的工作。"
那是一个预防性刹车,不是一台时光机。而且之后也没有任何地方能去看 Bot 到底做了什么:Bot 动作的审计视图仍被列为"即将推出",今天被记录的只有用量和花费。这意味着,你用文字写下的那条边界,就是你的全部控制。
每个 Bot 上要瞄准的那个形状,长得像官方的 Sales Outbound 场景:一摞排好队的草稿,零封发出。Bot 做了每一件可逆的事,并在不可逆的那一件面前精确停住。
10. 在账单算计你之前,先算计账单
Grok Bot 不单独售卖。通过套餐获得:Cursor Ultra 每月 200 美元,Cursor Teams Premium 每个席位 120 美元,SuperGrok Heavy 300 美元。如果你已经持有 Ultra 或 Heavy,那它已包含在内。一件省钱的小事:通过 iPhone 应用购买大约是 260 美元而不是直购 200 美元,这是惯常的商店加价。
然后事情变得有意思了。
有一个每周 token 额度,而它的规模仍未公布。这里没有人是干净的:Anthropic 也把自己的数字保密,只有 OpenAI 把它们印出来。区别在别处:邻居们让你手动设一个花费上限,而它没有。超额按模型和 token 成本计费,没有 Grok Bot 专属费率。参考点是旗舰 Grok 4.6 的价格:大约每百万输入 token 2 美元、每百万输出 6 美元,而一旦提示词跑过 20 万 token,还要更高。
没有产品级花费上限,有自动充值——一种抬高花费而不是限制花费的机制。而且没有模型选择器:文档明确说,成员和管理员都不会拿到一个。
粗略算一下。一个例程每次读大约 20 万输入 token、写 2 万输出,成本大约是 0.40 美元输入加 0.12 美元输出,算 0.50 美元一次。
每个工作日一次,大约每月 11 美元。五个例程,大约 55 美元。五个例程每天两次,那就在订阅之上超过了 100 美元。
beta 里的一个故事比任何表格都说明问题:一个月烧掉的 token,比之前五年加起来还多。常开的智能体消耗很大,这不是修辞。
关于钱和上限,值得记住的一切,浓缩成十二个数字:
再算一笔账,说明这对谁划算。一个人类助手每天两小时,视市场而定要 800 到 1,500 美元一个月。一个带五个每日例程的舰队,含订阅大约落在 250 到 300 美元。但一个 Bot 不会给任何人打电话、不会替你思考、也不承担任何问责,所以诚实的比较不是"代替一个人",而是"代替你亲自花在收件箱和收据上的那两小时"。
这一步的后半是每周复盘。自动化会安静地腐烂:一个网站改了布局,一个例程开始静默地产出垃圾,而因为 Bot 在你睡觉时运行,三周都没人注意。
在日历上放十五分钟。对每个例程问三个问题:它跑了吗,产出真的对吗,以及如果我杀了它,我会想念它吗。第三个比它看起来重要。
跑这个复盘的最好方式,是去问 Bot 们。它们留着线程,它们能汇报自己。
List every routine that ran this week. For each one:
how many times it fired, what it produced, what it skipped or guessed,
and anything you parked for me that I never answered.
Then name the one you think is least useful, and say why.
然后每个例程手工抽查一个产出。一个汇报自己工作的 Bot,有和你一样的盲点。而且要记住,关于智能体任务成功率,至今没有任何独立基准被发布,所以你在这里能拥有的唯一统计,是你自己的。
省下钱和神经的十二条习惯
从人们跑这个东西的头几周收集而来。每条一句,全部立刻见效。
每个任务进行到三分之一处放一个检查点。一个错误的方法会出现在第三行,而不是第三十行,你也不用为另外那二十七行付钱。
留一个一次性收件箱和一个一次性频道。每个新例程的第一次运行都放那里,因为测试运行不是彩排。
任何工作开始前先要一份三点计划。一份计划花几分钱,做错的工作花的是额度。
把事件规则设窄。一个"每条来信都触发"的触发器,会在一天内吃掉一周的 token。
把"记录你的猜测"那一行放进每一份章程。一周后你就有了现成的、关于指令缺了什么的清单。
给 Bot 起名时,想想你能不能当着同事的面把这个角色说出来。如果它塞不进一个词,那角色就是糊的,Bot 会漂移。
永远别给 Bot 管理员席位。做一个权限最小的服务账号,因为那个会话之后会被账号上每一个 Bot 触达。
敏感登录手动做。自动登录已经让人整个账号吃到临时 IP 封禁了。
插件为工作而开,工作结束,插件关掉。三十秒,大幅缩小爆炸半径。
一个流程,一个技能。一个臃肿的五阶段技能会整个崩掉,三个小的能扛住任何一步的改动。
每周问一次舰队哪个例程最没用。Bot 汇报自己的例程时没有自我,而你关掉什么就省下什么。
把任何一分钟内无法撤销的东西都挂着。那不是谨慎,那是把舰队整夜开着、还能安心睡觉的唯一方式。
你不再是被点击的那个人
在此之前,每一个 AI 产品都把模型放进一个窗口,把工作留在你手里。Grok Bot 把工作搬走了。Bot 有电脑、有登录、有记忆、有时间。你保留决策。
这比听起来是一个更小的技术变化,却是一个大得多的习惯变化。
这门技能不再是"我该怎么措辞",而是"我到底在委托什么,以及它的权限在哪里结束"。这已经不是一个提示词问题了。这是一个管理问题——面对一个永不睡觉、永不知疲倦的员工。
在 beta 这么早的阶段,还有一件事要记在心里。一半的成熟功能仍是承诺:没有动作审计、没有花费上限、没有例程彩排、没有团队级上限。这不是躲在外面的理由。这是一个从"可逆的、小的事情"开始的理由,在那里,犯错的代价是一份重做的草稿,而不是一封发出去的邮件。
感谢你读到这里。
如果它有用,请收藏并关注账号,获取更多这样的拆解。
另外,看看我的 TG 频道,我在那里写一切新鲜事物,并通知你新的有趣帖子:https://t.me/shmidtai
Tags: # X # Grok Bot # AI # Automation # Claude # Thread # Guide # Chatgpt # Cowork
Related articles 10 SEO backlink Claude automations for 61k AI mentions in 3 months Link building is trial and error. SEO AI Claude Automation
原文参考:https://maxed.wiki/posts/grok-bot-how-to-hand-your-routine-to-a-bot-in-10-steps/ (Maxed.wiki,本页为站内中文整理)