← 回首頁
看板 Gossiping / Soft_Job ※ 圖文整理
[情報] SpaceXAI 工程師 Lauren Tan:多數人只用了 GrokBot 1% 的力——她自己跑 20+ agents 艦隊
原文推文重點(英翻中):
SpaceXAI 工程師 Lauren Tan:
「99% 的人用 GrokBot,只用到它真正實力的 1%。他們只跑 1 個 agent,沒有 loop、沒有 graph。
我自己在跑一支 20+ GrokBot agents 的全自動團隊——有 Chief of Staff、有 PM、還有 20+ workers。這才是工程師的新 stack。」
一小時 workshop,從零示範怎麼組有效的 AI agent 團隊;貼文說這比一堂 $500 的 agentic 課程更有料。
▲ 講者:Lauren Tan|Software Engineer, SpaceXAI
一、這場講什麼(依逐字稿)
開場就潑冷水:AI 最好是 pair,不是外包思考;很多人為了「看起來很 AI」硬衝產能,結果花更多時間 review 亂碼。
真正主題:How do you trust your agents? 不信任 → 只能緊盯少數幾個 → 無法平行化。她把自己的旅程畫成信任曲線:從高度 in-the-loop,到今天 agents 可以 auto-merge PR(醒來已有約 20 個上 main)。
- 加入約 5 個月:上個月約 1000 PRs;本月不到半個月已近 800
- 不是要你無腦堆量,而是問:skills + verification + 架構設好後,能不能真的信
▲ 她用貢獻圖講故事:短時間 ship 大量 PR(簡報寫「i shipped 3000+ PRs in 5 months」)——用來對比「一個人 vs 一隊 agents」的產能想像。
二、怎麼更信任你的 agents?
白板標題直接寫:how do i trust my agents more?
- verification(旁邊註:evals!)
- high quality skills:教 agents 像真正軟體工程師一樣工作(例:
pstack)
- refactor / rewrite architecture 成 agent-friendly(註:greenfield vs brownfield)
白話:不要只會「叫它寫」。要讓它能自己跑起來驗、把失敗模式寫進 skill(並用 evals 當 unit test)、把 repo 改成連「笨」agent 都難寫壞。
現場也提到:skills 要維護(產品會變);pstack 有 Eval Playbook;可 fork,不要盲信。
▲ 信任三招:verification、高品質 skills、agent-friendly 架構
三、現場 demo:用 Playwright 控 Cursor Glass
她打開內部 skill 文件 Control Glass via Playwright:用 CDP + Playwright 驅動 Cursor 開發版——點擊、輸入、讀 a11y tree、截圖、profile,還能用 --worktree 隔離平行實例,避免弄髒主 session。
她第一週做 Agents window 效能時,自己看 flame graph 很慢、agent 也亂猜。後來讓 agent 用這套自己開 DevTools、跑驗證,才真正「關閉回圈」。
▲ Cursor dogfood 裡的 control-glass skill 文件
四、貼文附的「組艦隊」心法(精簡 10 步)
同一串還附了文章 Grok Bot Agents: how to automate your life in 10 Steps。整理成 PTT 能掃的版本:
- 裝好 → 先認識 Chief:一般用途 bot 當總窗口,先交一件 30 秒內能驗的真任務。
- 給職稱,不要只給 prompt:Inbox Manager / Expense / Talent Scout… 寫清楚擁有什麼、怎樣算好、什麼絕不能擅自做。
- 工具連一次就好:連線是帳戶層級,後面每個 bot 都能用。
- 登入用手交螢幕,別把密碼貼進對話:bot 拿 session,不拿密鑰。
- 做一次給它看:錄 workflow → 存成 skill/routine,比寫長說明快。
- 排程 + 觸發:每天 brief、Slack/信進來就動——不要只會手動開聊。
- 請專家,不要一個萬能怪:分領域記憶與責任。
- 丟進群組:bot 互傳、交接;給「目標」不是給「你已經拆好的 task list」。
- 畫核准線:以可否還原為準:可 undo 的自己做完;對外寄出 / 花錢 / 公開發布 → 停下來問你。
- 每週 review,狠心砍:有沒有跑?輸出對不對?關掉會不會想念?
▲ 結尾情緒:從「你在點」變成「你在管一隊」
五、GrokBot 對非工程職
她說 GrokBot 是非工程職的「Cursor moment」:介面像 iMessage,每個 agent 像一個人,可以組隊協作。PM 能夜間工作摘要、甚至自己修 bug 再請工程 stamp——前提是架構約束夠硬(她稱 Dune architecture)。
六、一句話總結
以前 AI 是窗口裡的顧問;GrokBot 這套是把電腦、登入、記憶、時間交給 bot,你只留決策。
技能從「怎麼寫 prompt」變成「委派什麼、權限畫在哪」。
※ 原文:https://x.com/0xCodez/status/2095185610390573536
※ 附文:Grok Bot Agents 10 Steps(同作者 X article)
※ 完整英文逐字稿:見同目錄上層 transcript.txt(1025 段/約 9,257 詞)
推 anon: 20+ agents 聽起來威,但 review 成本呢
→ anon2: 所以她一直講 verification / evals
推 anon3: pstack + agent-friendly arch 這段比較有料
→ OP: 圖文整理自公開影片,非官方中譯