工作情境 · 自動化與 Agent

同一件事一直重做

做一個記得你規則的助手

01這個情境是什麼

做一個記得你規則的助手——讓那些每週重來一次的工作,不必每次重新解釋一遍。這個情境的分水嶺是「重複性」:同一件事你做過五次以上,而且每次的規則一樣,才值得做成助手。做得太早,你會把還沒穩定的錯誤流程固化下來;做得太晚,你已經浪費了幾十次重打指令的時間。

02你要做哪一件事?挑最接近你手上那件事的,右邊就是對應的方法

Prompt 設計
把一次性的指令,變成可重複、結果穩定的指令。
工作流程設計
決定哪一段自動化、哪一段留給人。
建自訂助手
自訂 GPT、Claude Project、Copilot agent 之類。
助手測試與評估
用固定題組驗證,而不是試兩次覺得不錯就上線。
助手共用
給同事用之後,問題才會真正浮現。
版本與更新管理
規則改了,助手要跟著改,而且要留紀錄。

03這個情境的方法點進任一張卡就是完整做法;下面的地圖是建議順序,不要跳步

住在這個情境的方法5 個

這裡也用得上主場在別的情境

照這個順序做推薦方法地圖

先把指令寫穩

指令不穩定就做助手,等於把不穩定放大。

決定哪一段自動化

不是整條流程都該自動化。

建出來

規則寫進系統指令,不要每次貼。

測到會壞為止

沒有測試題組的助手不能上線。

交給別人用

共用之後問題才會真的浮現。

資料端的前處理

助手常需要固定格式的輸入。

04對應角色這些職位最常做這件事

05–14整個情境怎麼運作(含流程圖)10 段:現在怎麼做、哪裡卡住、要準備什麼、AI 能介入哪一段、哪幾關不能下放、做完長什麼樣。想搞懂整件事再看;只想動手做的話,上面挑一個方法點進去就好。

05目前流程(還沒用 AI 之前)先看清楚現在怎麼做,才知道哪一段值得改

步驟與說明
1每次重打指令
同一件事每週重寫一次提示詞,寫法不同,結果自然不同。
2覺得好用就存起來
存成一段文字放在筆記軟體,用的時候複製貼上,久了忘記哪一版是最新的。
3做了一個助手
試了兩三次覺得不錯,就開始用。
4給同事用
同事貼進來的資料格式跟你不一樣,助手立刻壞掉,而且壞得很安靜。
5沒有人維護
規則改了但助手沒改,它繼續照舊規則產出,沒有人發現。

06流程困難點卡住的位置,不是「做得慢」而是「做不下去」的地方

太早自動化時機
流程還沒穩定就做成助手,等於把錯誤固化並加速。這是這個情境最貴的錯。
只測過自己的資料測試
你的輸入格式很整齊,別人的不是。助手在別人手上第一天就會遇到你沒想過的輸入。
失敗是安靜的監控
助手不會說「我不確定」,它會照樣產出一個看起來正常的結果。壞掉的助手比沒有助手危險。
沒有版本紀錄維護
改了指令但沒記錄改了什麼,出問題時無法回溯,也無法回退。

07常見錯誤與風險

把未驗證的流程固化
自動化會忠實地重複你的錯誤,而且比人做得更快更多。
助手取得過大的權限
能寫入資料庫、能發信、能刪檔案的助手,出錯的代價完全不同。權限給最小。
沒有中止條件
助手應該有明確的「遇到這種情況就停下來問人」,否則它會硬做完。
共用後的資料外洩
助手的指令裡如果寫了內部資訊,每個使用者都看得到。
使用者以為它有查證
同事會假設助手產出的東西已經被檢查過。要在輸出裡明說「這是草稿,需人工確認」。
沉默地過期
規定改了,助手不知道。它會繼續給出符合舊規則的答案,而且很有自信。

08需要準備的輸入資料備料決定成品;標「必要」的沒有就先別開始

至少五次真實的操作紀錄(必要)必要
包含輸入、你當時怎麼下指令、產出、以及你事後怎麼修。修改的部分最有價值。
固定的輸入格式(必要)必要
助手能穩定運作的前提。格式不固定就先別做助手。
測試題組(必要)必要
至少十組,含三組刻意的壞輸入(缺欄位、格式錯、超長、空白)。
權限範圍可選
助手可以讀什麼、不能碰什麼、能不能對外送出。
中止條件可選
遇到什麼情況要停下來交給人。
使用者名單與說明可選
誰會用、他們的程度、要不要教。

09AI/Agent/Tool 可以介入的位置

流程位置做什麼/怎麼做
設計階段AI把散的指令整理成結構化提示詞
讓 AI 從你過去五次的指令中,歸納出穩定的規則與可變的變數。
建置階段Agent自訂助手
把規則、輸出格式、中止條件寫進助手的系統指令,而不是每次貼在對話裡。
測試階段Tool固定題組跑測試
同一組題目每次改版都跑一遍,比對輸出差異。沒有測試題組的助手不能上線。
共用階段Agent使用說明與回報管道
附上「這個助手不做什麼」的說明,以及出錯時回報給誰。

10人工必須保留的判斷這幾件事不下放,下放了出事的是你

決定要不要自動化
流程穩定了沒有,只有做過很多次的人知道。
權限設計
給多少權限是安全決定,永遠取最小可用。
中止條件的認定
什麼情況必須停下來交給人,要寫死在助手裡。
上線放行
測試題組全過之後,仍然由人決定要不要上線。
定期回頭抽查
助手不會告訴你它開始出錯了,只有人抽查會發現。

11實際案例

Agent 測試:用一組固定題目,包含三組刻意的壞輸入

第一手拆解:Agent 測試、評估與除錯(完整拆解) →

當時的狀況:助手在自己手上運作良好,交給同事之後開始出現各種奇怪結果——原因幾乎都是輸入格式跟自己習慣的不一樣,而助手不會抱怨,它會照樣產出。

AI 做了什麼
  • 從既有的使用紀錄歸納出穩定規則與可變變數,整理成結構化的系統指令。
  • 產出測試題組草稿,包含正常輸入與刻意的壞輸入(缺欄位、格式錯、內容超長、完全空白)。
  • 在助手的輸出格式中固定加上「這是草稿,需人工確認」與「無法判定的項目」欄位。
人做了什麼
  • 設定中止條件:遇到哪些情況助手必須停下來問人,而不是硬做完。
  • 把權限設到最小——能讀不能寫,能擬稿不能發送。
  • 每次改版都跑同一組測試題並比對差異,改版後才放行。

結果:助手的失敗從「安靜地產出錯誤」變成「明說我不確定」——這是共用助手能不能被信任的分界。

待補資料:測試題組的規模與缺陷發現率的關係需依助手複雜度而定,本站不提供通用數字。

12最終輸出做完之後手上應該有這些東西

結構化系統指令
角色、任務、可用資料、禁止推測、步驟、輸出格式、中止條件。
可運作的助手
規則內建,使用者只需提供輸入。
測試題組與結果
含壞輸入,每次改版重跑。
權限與中止條件說明
這個助手能碰什麼、不能碰什麼、什麼時候會停。
使用說明與回報管道
給同事看的一頁,含「這個助手不做什麼」。
版本紀錄
改了什麼、為什麼改、誰放行。

13驗收標準全部打勾才算完成

  1. 這件事已經用同一套規則做過至少五次,流程確定穩定。
  2. 助手有明確的中止條件,遇到無法判定的情況會停下來問人。
  3. 測試題組至少十組,其中包含三組刻意的壞輸入,且全部跑過。
  4. 助手的權限是最小可用:不需要寫入就不給寫入,不需要發送就不給發送。
  5. 輸出格式固定,且包含「需人工確認」的提示與「無法判定」欄位。
  6. 系統指令中沒有寫入不該讓所有使用者看到的內部資訊。
  7. 有使用說明(含這個助手不做什麼)與出錯回報管道。
  8. 有版本紀錄,可以回溯與回退。

14流程困難點與介入點圖

下圖把摺疊區前面 9 段收成一張:輸入 → 步驟 → 困難點 → AI/Agent/Tool 介入 → 人工檢查 → 產出。紅框是這個情境最常出事的位置,綠框是不能下放的人工檢查點。

自動化與 Agent:做一個記得你規則的助手
自動化與 Agent:做一個記得你規則的助手直向流程圖。輸入是至少五次真實操作紀錄、固定輸入格式與測試題組;先由人判斷流程是否已穩定到值得自動化,再由 AI 從歷次指令歸納出穩定規則與可變變數,接著建置助手把規則與中止條件寫進系統指令,然後用固定題組含壞輸入跑測試比對輸出差異,再進入人工檢查點確認權限最小化與中止條件並放行上線,最後產出可運作助手、測試題組與版本紀錄。右側標示四個困難點:太早自動化把錯誤固化並加速、只測過自己的整齊資料、助手失敗是安靜的照樣產出看似正常的結果、規則改了助手不知道繼續用舊規則;並標示中止條件:測試題組未全數通過或權限超出最小需求時不得上線。檢查點有退回線回到建置步驟。測試不過就退回改規則INPUT / 輸入五次以上真實操作紀錄 + 固定輸入格式 + 測試題組紀錄要含「你事後怎麼修」,那段最有價值HUMAN / 人工步驟人判斷:規則穩定嗎?做過五次以上嗎?值得自動化嗎?AI / AI 介入AI 從歷次指令歸納穩定規則與可變變數AGENT / 助手接手建助手:規則、輸出格式、中止條件寫進系統指令TOOL / 工具處理固定題組跑測試(含三組壞輸入),比對輸出差異CHECKPOINT / 人工檢查人確認權限最小化 + 中止條件可運作 + 放行上線OUTPUT / 產出可運作助手 + 測試題組與結果 + 使用說明 + 版本紀RISK / 困難點太早自動化:流程沒穩定就固化,錯誤被放大且加速RISK / 困難點失敗是安靜的:助手不會說「我不確定」,除非你寫進規則RISK / 困難點只測過自己整齊的資料,同事的輸入第一天就打壞它RISK / 困難點規定改了助手不知道,繼續用舊規則而且很有自信STOP / 中止條件測試題組未全數通過,或權限超出最小需求 → 不得上線
看圖重點:第一個節點刻意是人不是 AI:判斷「這件事穩定了嗎」是整個情境的門檻,跳過它做出來的助手會忠實地重複你的錯誤,而且更快更多。第三個紅框是這裡最需要記住的一句話——助手不會說「我不確定」,除非你把這句話寫進它的規則裡。所以中止條件不是選配,是系統指令的必要欄位。
純文字流程表(手機/螢幕閱讀器建議看這張)
自動化與 Agent:做一個記得你規則的助手(純文字流程表)
類型/角色流程步驟這一步的困難點/中止條件
1Human五次以上真實操作紀錄 + 固定輸入格式 + 測試題組
紀錄要含「你事後怎麼修」,那段最有價值
2Human人判斷:規則穩定嗎?做過五次以上嗎?值得自動化嗎?
困難點/風險太早自動化:流程沒穩定就固化,錯誤被放大且加速
3AIAI 從歷次指令歸納穩定規則與可變變數
4Agent建助手:規則、輸出格式、中止條件寫進系統指令
困難點/風險失敗是安靜的:助手不會說「我不確定」,除非你寫進規則
5Tool固定題組跑測試(含三組壞輸入),比對輸出差異
困難點/風險只測過自己整齊的資料,同事的輸入第一天就打壞它
6Checkpoint人確認權限最小化 + 中止條件可運作 + 放行上線
困難點/風險規定改了助手不知道,繼續用舊規則而且很有自信
失敗與中止條件測試題組未全數通過,或權限超出最小需求 → 不得上線
7Output可運作助手 + 測試題組與結果 + 使用說明 + 版本紀錄

回流線:人確認權限最小化 + 中止條件可運作 + 放行上線 → 建助手:規則、輸出格式、中止條件寫進系統指令(測試不過就退回改規則)

Mermaid 原始碼(貼進 Mermaid Live 或 draw.io 可再編輯)
可直接複製,改成你自己的流程
flowchart TD
    in1(["<b>Human</b><br/>五次以上真實操作紀錄 + 固定輸入格式 + 測試題組<br/><small>紀錄要含「你事後怎麼修」,那段最有價值</small>"])
    s1["<b>Human</b><br/>人判斷:規則穩定嗎?做過五次以上嗎?值得自動化嗎?"]
    a1[/"<b>AI</b><br/>AI 從歷次指令歸納穩定規則與可變變數"/]
    g1[["<b>Agent</b><br/>建助手:規則、輸出格式、中止條件寫進系統指令"]]
    t1[("<b>Tool</b><br/>固定題組跑測試(含三組壞輸入),比對輸出差異")]
    c1{{"<b>Checkpoint</b><br/>人確認權限最小化 + 中止條件可運作 + 放行上線"}}
    o1(["<b>Output</b><br/>可運作助手 + 測試題組與結果 + 使用說明 + 版本紀錄"])
    r1>"<b>Risk</b><br/>太早自動化:流程沒穩定就固化,錯誤被放大且加速"]
    r3>"<b>Risk</b><br/>失敗是安靜的:助手不會說「我不確定」,除非你寫進規則"]
    r2>"<b>Risk</b><br/>只測過自己整齊的資料,同事的輸入第一天就打壞它"]
    r4>"<b>Risk</b><br/>規定改了助手不知道,繼續用舊規則而且很有自信"]
    x1[/"<b>Stop</b><br/>測試題組未全數通過,或權限超出最小需求 → 不得上線"\]

    in1 --> s1
    s1 --> a1
    a1 --> g1
    g1 --> t1
    t1 --> c1
    c1 --> o1
    s1 -.->|風險| r1
    g1 -.->|風險| r3
    t1 -.->|風險| r2
    c1 -.->|風險| r4
    c1 ==>|中止| x1
    c1 -.->|測試不過就退回改規則| g1

    classDef clsIn fill:#FFFFFF,stroke:#2C4459,stroke-width:2px,color:#141E2B
    classDef clsHuman fill:#FBFCFD,stroke:#7A8CA0,stroke-width:2px,color:#141E2B
    classDef clsAI fill:#FFF6EA,stroke:#DE9A45,stroke-width:2px,color:#141E2B
    classDef clsAgent fill:#FDEBD2,stroke:#B87A2E,stroke-width:2px,color:#141E2B
    classDef clsTool fill:#EDF2F6,stroke:#2C4459,stroke-width:2px,color:#141E2B
    classDef clsCheck fill:#E8F2EC,stroke:#3F7A5A,stroke-width:2px,color:#123024
    classDef clsOut fill:#141E2B,stroke:#141E2B,stroke-width:2px,color:#F2F6F9
    classDef clsRisk fill:#FCEFEA,stroke:#C0552F,stroke-width:2px,color:#5E2110
    classDef clsStop fill:#F7E1DB,stroke:#8E2F17,stroke-width:3px,color:#5E2110
    class in1 clsIn;
    class s1 clsHuman;
    class a1 clsAI;
    class g1 clsAgent;
    class t1 clsTool;
    class c1 clsCheck;
    class o1 clsOut;
    class r1 clsRisk;
    class r3 clsRisk;
    class r2 clsRisk;
    class r4 clsRisk;
    class x1 clsStop;
取得 AI 實戰工具與更新

之後會不定期整理:新方法、指令包(Prompt Pack)、Checklist 與模板。免費、無廣告;正式寄送前會先寄確認信,隨時可來信要求刪除。

← 全部工作情境回找方法 →