AI 入門第九課
讓 AI 先規劃、再動手、最後檢查。
任務變複雜時,不要期待一次回答剛好正確。把規劃、工具、檢查與人工確認排成流程,才會穩。
視覺速記



什麼是 Agentic Workflow?
不是叫 AI「多想一下」,而是把任務安排成可檢查的步驟:先做計畫、需要時調用工具、依規則檢查結果、最後交給人決定是否採用。它解決的是流程穩定度,不是替你免責。
四個核心元件
規劃
先列出目標、步驟、要用的資料與完成標準;不直接開始產出。
工具使用
需要查資料、算數、讀檔時,交給可靠工具或資料來源,不要叫模型猜。
反思
用固定檢查表看有沒有漏資料、違反限制、沒有依據或格式錯誤。
評估
用一小組固定題目比較版本,確認改動真的變好,而非只換了說法。
不要把內部思考當驗收
看得到的計畫與檢查表才可驗收
不要要求 AI 揭露冗長的內部思考過程。請它輸出可執行的計畫、資料來源、工具選擇、完成標準與檢查清單;這些才是你和團隊能共同驗證的工作產物。
一個 Agent 還是多 Agent?
| 情況 | 建議 | 原因 |
|---|---|---|
| 任務很小、資料來源單一 | 一個 Agent + 人工確認 | 角色越多,交接與錯誤點越多。 |
| 需要查資料、整理、寫草稿 | 一個 Agent 分階段做 | 先用同一個流程與檢查表,最容易除錯。 |
| 專業角色和責任真的不同 | 才考慮多 Agent | 例如研究、法規檢查、發佈審核需要不同資料與權限。 |
| 高風險決策 | 人保留最後決策權 | 多 Agent 不是安全保證,仍可能一起犯同一種錯。 |
80 分鐘教學流程
min
選一個多步驟任務
例如每週整理競品動態、回覆表單線索、整理會議後待辦;先避開金流與不可逆操作。
min
寫可驗收計畫
列目標、資料來源、每一步輸出、工具、停止條件與人工確認點。
min
設計工具邊界
哪些資料可讀、哪些動作不可自動執行、找不到資料時如何停止。
min
加入反思與測試
建立 5 個固定測試案例,要求每次輸出前跑相同檢查表。
min
人工驗收
比對來源、檢查草稿、記錄錯誤;只有安全且穩定的步驟才考慮自動化。
跟著做:做一個不會自行發送的選題助手
第一個 Agent 不需要接 Gmail、付款或發布帳號。請準備一份你自己收集的 source-list.md,裡面放 5 至 10 條文章標題、連結與一兩句摘要;再讓 AI 只讀這份清單,交出選題草稿。
寫任務邊界
在筆記先列出:目標是選出 3 個題目;可用資料只有 source-list.md;禁止寄信、發布、刪檔、使用未提供資料;輸出是 weekly-brief.md 草稿。沒有這張任務卡,先不要叫 AI 執行。
只要求它規劃
把下方模板貼給 AI,要求先輸出 3 至 5 步計畫、每步使用哪條來源、遇到資料不足如何停下。你先審核這份計畫,再進下一步。
要求產出草稿
計畫通過後,讓它輸出 3 個選題;每個選題必須含來源標題、適合誰、為什麼值得寫、可能重複或缺資料的風險。沒有來源的選題不可列入。
跑評審回合
把草稿再貼回同一個 AI,指定它只當「檢查員」:找沒有來源、來源與結論不符、重複題目、超出任務邊界的地方。它只能列問題,不能偷偷重寫或執行外部動作。
人做最後選擇
你檢查三個來源是否真的支持結論,選定題目後才自行發布。連續 5 次都能通過同一張檢查表,才值得考慮把讀檔或排程接到 Codex、n8n 或 Make。
停止條件要先寫好
資料不足、來源互相矛盾、需要登入私人帳號、需要對外發送或涉及金流時,Agent 必須停下來標示「需要人工確認」。這不是失敗,是可靠流程的一部分。
實作案例:每週內容選題小助手
流程
讀取核准來源 → 列選題計畫 → 摘要與分類 → 用檢查表找重複、缺來源或不適合受眾的內容 → 人選出最後題目。
人工保留
品牌立場、優先順序、是否發布仍由人決定。Agent 只提供有依據、好比較的草稿。
可複製模板
驗收與課後作業
把你第 3、5 或第 6 課挑過的一個低風險流程,照這五步重做一次。先證明一個 Agent 能穩定交付,再考慮分成研究員與檢查員兩個角色。
Cheat Sheet
先規劃
把步驟、資料、工具與完成標準寫出來。
再檢查
用固定檢查表與固定題目,不靠感覺判斷。
最後才拆角色
多 Agent 是處理真實分工,不是讓流程看起來厲害。
FAQ
Agent 一定要會上網或呼叫很多工具嗎?
不一定。第一版可以只讀一份文件、產生草稿、跑檢查表;工具越少,越容易測試與除錯。
反思 Agent 能保證答案正確嗎?
不能。它只能按照檢查規則找問題。規則、資料來源與人工覆核仍然重要。
什麼時候需要多 Agent?
當角色真的有不同資料、工具、權限或驗收責任時才需要。多數新手任務先用一個 Agent 分階段完成更穩。