← 回首頁

看板 Gossiping / Soft_Job ※ 圖文整理

[情報] SpaceXAI 工程師 Lauren Tan:多數人只用了 GrokBot 1% 的力——她自己跑 20+ agents 艦隊

作者:整理自 @0xCodez 影片(約 55 分)+附文
時間:2026-09-02 發文 · 本整理 2026-09-08
來源影片時長:約 55:04

原文推文重點(英翻中):

SpaceXAI 工程師 Lauren Tan

「99% 的人用 GrokBot,只用到它真正實力的 1%。他們只跑 1 個 agent,沒有 loop、沒有 graph。

我自己在跑一支 20+ GrokBot agents 的全自動團隊——有 Chief of Staff、有 PM、還有 20+ workers。這才是工程師的新 stack。」

一小時 workshop,從零示範怎麼組有效的 AI agent 團隊;貼文說這比一堂 $500 的 agentic 課程更有料。
Lauren Tan 於 SpaceX 舞台
▲ 講者:Lauren Tan|Software Engineer, SpaceXAI

一、這場講什麼(依逐字稿)

開場就潑冷水:AI 最好是 pair,不是外包思考;很多人為了「看起來很 AI」硬衝產能,結果花更多時間 review 亂碼。

真正主題:How do you trust your agents? 不信任 → 只能緊盯少數幾個 → 無法平行化。她把自己的旅程畫成信任曲線:從高度 in-the-loop,到今天 agents 可以 auto-merge PR(醒來已有約 20 個上 main)。

3000+ PRs in 5 months
▲ 她用貢獻圖講故事:短時間 ship 大量 PR(簡報寫「i shipped 3000+ PRs in 5 months」)——用來對比「一個人 vs 一隊 agents」的產能想像。

二、怎麼更信任你的 agents?

白板標題直接寫:how do i trust my agents more?

白話:不要只會「叫它寫」。要讓它能自己跑起來驗、把失敗模式寫進 skill(並用 evals 當 unit test)、把 repo 改成連「笨」agent 都難寫壞。

現場也提到:skills 要維護(產品會變);pstack 有 Eval Playbook;可 fork,不要盲信。

how do i trust my agents more
▲ 信任三招:verification、高品質 skills、agent-friendly 架構

三、現場 demo:用 Playwright 控 Cursor Glass

她打開內部 skill 文件 Control Glass via Playwright:用 CDP + Playwright 驅動 Cursor 開發版——點擊、輸入、讀 a11y tree、截圖、profile,還能用 --worktree 隔離平行實例,避免弄髒主 session。

她第一週做 Agents window 效能時,自己看 flame graph 很慢、agent 也亂猜。後來讓 agent 用這套自己開 DevTools、跑驗證,才真正「關閉回圈」。

Control Glass via Playwright
▲ Cursor dogfood 裡的 control-glass skill 文件

四、貼文附的「組艦隊」心法(精簡 10 步)

同一串還附了文章 Grok Bot Agents: how to automate your life in 10 Steps。整理成 PTT 能掃的版本:

  1. 裝好 → 先認識 Chief:一般用途 bot 當總窗口,先交一件 30 秒內能驗的真任務。
  2. 給職稱,不要只給 prompt:Inbox Manager / Expense / Talent Scout… 寫清楚擁有什麼、怎樣算好、什麼絕不能擅自做。
  3. 工具連一次就好:連線是帳戶層級,後面每個 bot 都能用。
  4. 登入用手交螢幕,別把密碼貼進對話:bot 拿 session,不拿密鑰。
  5. 做一次給它看:錄 workflow → 存成 skill/routine,比寫長說明快。
  6. 排程 + 觸發:每天 brief、Slack/信進來就動——不要只會手動開聊。
  7. 請專家,不要一個萬能怪:分領域記憶與責任。
  8. 丟進群組:bot 互傳、交接;給「目標」不是給「你已經拆好的 task list」。
  9. 畫核准線:以可否還原為準:可 undo 的自己做完;對外寄出 / 花錢 / 公開發布 → 停下來問你。
  10. 每週 review,狠心砍:有沒有跑?輸出對不對?關掉會不會想念?
舞台照
▲ 結尾情緒:從「你在點」變成「你在管一隊」

五、GrokBot 對非工程職

她說 GrokBot 是非工程職的「Cursor moment」:介面像 iMessage,每個 agent 像一個人,可以組隊協作。PM 能夜間工作摘要、甚至自己修 bug 再請工程 stamp——前提是架構約束夠硬(她稱 Dune architecture)。

六、一句話總結

以前 AI 是窗口裡的顧問;GrokBot 這套是把電腦、登入、記憶、時間交給 bot,你只留決策。
技能從「怎麼寫 prompt」變成「委派什麼、權限畫在哪」。

※ 原文:https://x.com/0xCodez/status/2095185610390573536
※ 附文:Grok Bot Agents 10 Steps(同作者 X article)
※ 完整英文逐字稿:見同目錄上層 transcript.txt(1025 段/約 9,257 詞)

anon: 20+ agents 聽起來威,但 review 成本呢
anon2: 所以她一直講 verification / evals
anon3: pstack + agent-friendly arch 這段比較有料
OP: 圖文整理自公開影片,非官方中譯