人的槓桿被放大
人可以從親自執行,轉為同時經營多條工作線;但上下文切換、Review 與回饋仍會消耗注意力。
當執行能力變得近乎無限,組織的瓶頸就不再是「有沒有人做」,而是誰來定義方向、成功標準、協作規則與人類介入邊界。
核心不是多開幾個對話視窗,而是把管理方法寫進可執行的系統:目標、權限、驗收、升級與學習都必須被設計。

講者觀察,人直接盯 Agent 時,仍會遇到類似傳統管理跨度的限制;分享中以約 5–7 個作為人的直接管理上限估算。Agent 管 Agent 的意義,是把日常追蹤與協調往下移,讓人管理規則與例外,而不是管理每一步。
人可以從親自執行,轉為同時經營多條工作線;但上下文切換、Review 與回饋仍會消耗注意力。
Agent-to-Agent 可吸收大量同步成本,但如果權限、交接格式和驗收不清,錯誤也會被快速放大。
定義方向、成功標準、不可逾越的邊界,以及哪些時刻一定要停下來等人拍板。
從人逐項發任務,轉為主管 Agent 拆解目標、分派專門 Agent,再把例外送回人類。
過去同事間靠默契的幾句話,現在要轉成上下文、約束、工具權限與驗收條件。
Agent 可以管理工作流,但方向、法律責任與重大承諾仍需有清楚的人類主人。
講者把 Agent 協作拆成不同尺度:從規格到程式與上線是小圈;從 idea 到產品是中圈;從 idea 到成功數據、再依結果復盤與迭代,才是大圈。人的價值由「寫出每一項產物」轉為「設計這條生產線」。
先說清楚要達成什麼,再決定由哪些 Agent 組隊、誰負責拆解與協調。
每次交接都要有結構化輸出與獨立驗收,避免執行者自己宣布完成。
把結果回寫成能力,同時依風險、可驗證性與責任決定自動化範圍。
Agent 組織真正的複利,不是單次更快,而是每次任務都能產生可重用的能力。講者將它描述為 Skill、記憶與反思:做完後提煉方法、保存到正確層級,並讓之後的任務能被準確調用。
保留任務脈絡、決策理由、失敗模式和驗收結果,而不只是最後成品。
判斷哪一步有效、為何出錯、哪些規則可泛化,避免把偶然成功直接寫成標準。
分清個人偏好、部門做法與公司規則;設定版本、擁有者和退役條件。
讓 Agent 在正確情境找到正確 Skill,並知道衝突時哪一層規則優先。
每次失敗都要留下原因、修正方式、測試與停止條件,避免下次重走同一條錯路。
定期跨任務找共同缺陷,例如過早宣告完成、漏測手機版或反覆無效重試。
不能把「再跑一次也許會好」當成工程方法;超時、重試與偏差都要有診斷和停損。
個人 Skill 可先自行迭代;跨部門與公司級 Skill 則需要更嚴格的審核、權限與品質管理。否則工具越多,搜尋和選擇成本越高。
透過「CEO/主管 Agent」統一接收目標、拆解任務、分派角色和追蹤狀態;人類聚焦方向與高風險決定。
一個管理角色可協調多個專門 Agent;分享中的大型配置是特定案例,不是通用最佳值。
委派量放大後,不只看任務數,更要看失敗率、等待時間、例外數、重試成本與完成品質。
Skill 必須標示用途、適用情境、擁有者與版本,否則資產越多,搜尋與選擇成本越高。
當實作成本下降,產品、設計、工程、QA 不再只能串行交接。講者主張未來小團隊會需要跨職能複合型人才:能從問題一路做到可驗證結果,也能管理自己的 Agent 群。
Agent 放大的是操作者的判斷。方向差、標準模糊,規模越大只會更快製造偏差。
更有效的方式,是給真實模糊問題,觀察候選人如何定義好、委派、驗證、修正與說明取捨。
不要只數會多少工具;要看他能否把未知問題推進到安全、可用、有數據的結果。
研究、產品、設計、開發與測試可以並行展開;人的角色是維持一致目標與驗收標準。
人的品味、問題判斷與取捨是底數;方向錯誤時,規模越大只會更快放大偏差。
工作時間逐步移向定義問題、提供上下文、Review、系統設計與例外決策。
Agent 管 Agent 不是移除 QA,而是把 QA 前移並系統化:每層都要有可驗證輸出、權限最小化、觀測記錄、停止條件與人工升級點。
可自動執行,但保留完整軌跡、限額、沙盒與快速回滾。
先由獨立 Agent 測試、對照基準與攻防,再由人批准發布。
金流、法務、個資、資安、對外承諾等,必須在動作前由具權責的人拍板。
在有人盯著、情境受控時完成一次,就足以登台展示;重點是證明方向可行。
必須面對權限、異常、資料品質、責任與恢復機制,連續穩定通過後,才敢交給客戶。
模型能力之外,還要補齊上下文、工具、協作、驗證與治理,才能從 Demo 走進正式業務。
方向、最終責任與高風險拍板,不能因自動化而失去明確的人類主人。
任務在多 Agent 間流動時,必須保留決策、交接、測試、失敗與人工介入的完整軌跡。
不要一開始就追求「全公司自動」。先選一條可觀測、可回滾、價值清楚的閉環,建立治理,再逐步放大委派範圍。
例如從客服問題到修復上線,或從需求洞察到實驗結果;不要只測單一步驟生成速度。
定義品質、時效、成本、安全與使用者結果;沒有可驗收的「好」,就無法委派。
區分可自主、需通知、需事前批准與禁止自動化四類動作。
寫清楚可派給誰、怎麼拆、何時重試、何時停止、哪些例外必須升級給人。
執行 Agent 不自行宣布成功;由測試、資料或另一個角色依明確標準驗收。
每項共享 Skill 都要有擁有者、版本、測試、適用範圍、回饋與退役機制。
除了速度與成本,也追蹤決策品質、事故、Review 負荷、使用者結果,以及人是否投入更高價值問題。
從 Astra CEO Agent 的真實營運,理解任務治理、能力沉澱與人類拍板邊界。
雙人對談 · 繁體中文