METHOD · 自動化與 Agent

AI 工作流程設計

把人的 SOP 改造成人機分工的工作流:AI 做哪段、人把哪關。

情境:自動化與 Agent也用於:流程與 SOP也用於:決策與問題解決難度:要搭建|建助手或系統起手工具:Claude
這是自動化與 Agent情境下的方法之一(共 5 個)· 看這個情境全部 →
一、這是什麼三十秒判斷關不關你的事

01解決的工作問題

已經有 SOP 或固定做法,想讓 AI 接手其中幾段,但不知道哪些該交、哪些必須留給人。這個決定不能憑感覺,因為最常見的錯誤有一個明確的形狀:把「需要裁量」的步驟交給 AI,然後用抽查安慰自己。抽查抓不到偶發的判斷錯誤,而判斷錯誤正是這類步驟出事的方式。

真的有人這樣做過?外部佐證

目前沒有找到可公開查證的外部案例。這類工作多半不會有人發新聞稿,找不到不代表沒人做——但在找到之前,這一頁的方法就是作者自己的做法,不借別人的名義。

去找靈感看其他方法的外部案例 →

02什麼時候用、什麼時候別用

什麼情況下該用這一套

什麼情況下別用

還沒有 SOP 的流程
先用建 SOP 的方法把流程寫下來。對著不存在的流程做人機分工是空談。
一年只做兩次的流程
重複性不足,建置與維護成本高於效益。
不可回復且高風險的流程
扣款、發文、對外承諾——這類流程可以讓 AI 產草稿,但不要設計成 AI 自動完成。
流程正在大改的時候
設計完就要重做。等流程穩定。

誰會用到

主管
你的決定是「哪一步的錯誤我們承受得起」。這不是技術問題,是風險承受度問題。
PM
你要負責影子模式的設計與比對。沒有對照組的切換等於沒有驗證。
營運
營運流程的不可回復步驟最多(發送、扣款、異動),這些一律留人。
工程師/研發
介面定義是你的強項:每個 AI 段落的輸入輸出格式要像 API 一樣明確。
顧問
替客戶設計時特別注意:至少一個人要能手動走完整條流程,否則交付之後沒人懂全貌。

所屬工作情境

二、整件事怎麼跑先看圖,再看逐步

03流程圖

這張圖是整篇的骨架:輸入 → 步驟 → 困難點 → AI/Agent/Tool 介入 → 人工檢查 → 產出。紅框是最常出事的位置,綠框是不能下放的人工檢查點,粗框是中止條件。後面每一節都是在展開圖上的某一格。

AI 工作流程設計:哪一段交給 AI,哪一關留給人
AI 工作流程設計:哪一段交給 AI,哪一關留給人直向流程圖。輸入是現有流程完整步驟含判斷點與例外、每步耗時頻率與出錯後果、權限限制;先由人列出完整流程若無 SOP 則先建,再由 AI 逐步標記重複性可回復性與需裁量三個屬性並附理由與信心,接著由人校正屬性特別是可回復性與裁量判定,然後由 AI 產出人機分工表與每個 AI 段落的輸入輸出格式與失敗行為,之後進入人工檢查點跑一至兩週影子模式由 AI 與人並行並比對差異,最後切換並保留人工抽查與失敗停止機制,產出人機分工表流程規格與影子模式比對結果。右側標示四個困難點:把需裁量的步驟交給 AI 然後用抽查安慰自己、跳過影子模式導致無法歸因、介面沒定義使段落接不起來、流程接上 AI 後沒有人懂全貌;並標示中止條件:影子模式未達通過標準或有不可回復動作被設計成 AI 執行時不得切換。檢查點有退回線回到分工設計步驟。比對不過就退回改分工INPUT / 輸入流程完整步驟(含判斷點與例外)+ 耗時頻率 + 出錯後果 + 權限限制沒有 SOP 就先用建 SOP 的方法AI / AI 介入AI 逐步標三屬性:重複性/可回復性/需裁量(附理由與信心)HUMAN / 人工步驟人校正屬性,特別是可回復性與裁量判定AI / AI 介入AI 產人機分工表 + 每個 AI 段落的輸入輸出格式與失敗行為CHECKPOINT / 人工檢查跑 1–2 週影子模式:AI 與人並行,逐欄比對差異HUMAN / 人工步驟切換上線,保留人工抽查與失敗停止機制OUTPUT / 產出人機分工表 + 流程規格 + 影子模式比對結果 + 失敗停止設計RISK / 困難點把需裁量的步驟交給 AI,然後用抽查安慰自己RISK / 困難點重複性高但不可回復——看起來最適合自動化,其實最危險RISK / 困難點介面沒定義,段落接不起來,最後每次都要人整理STOP / 中止條件影子模式未達通過標準,或有不可回復動作被設計成 AI 執行 → 不得切換RISK / 困難點流程接上 AI 後沒有人能手動走完整條,出事只能等
看圖重點:這張圖的重點在第二、三個節點之間:AI 標屬性,但人校正。特別是「可回復性」——AI 不知道你們上次出錯時怎麼補救的,而那才是真實的可回復性。右側第一個紅框是這個方法存在的主要理由:需要裁量的步驟交給 AI 之後,錯誤是偶發的、看起來正常的,抽查抓不到。最後那個 CHECKPOINT(影子模式)則是唯一能證明設計對不對的方法,沒有它就沒有對照組。
純文字流程表(手機/螢幕閱讀器建議看這張)
AI 工作流程設計:哪一段交給 AI,哪一關留給人(純文字流程表)
類型/角色流程步驟這一步的困難點/中止條件
1Human流程完整步驟(含判斷點與例外)+ 耗時頻率 + 出錯後果 + 權限限制
沒有 SOP 就先用建 SOP 的方法
2AIAI 逐步標三屬性:重複性/可回復性/需裁量(附理由與信心)
困難點/風險把需裁量的步驟交給 AI,然後用抽查安慰自己
3Human人校正屬性,特別是可回復性與裁量判定
困難點/風險重複性高但不可回復——看起來最適合自動化,其實最危險
4AIAI 產人機分工表 + 每個 AI 段落的輸入輸出格式與失敗行為
困難點/風險介面沒定義,段落接不起來,最後每次都要人整理
5Checkpoint跑 1–2 週影子模式:AI 與人並行,逐欄比對差異
失敗與中止條件影子模式未達通過標準,或有不可回復動作被設計成 AI 執行 → 不得切換
6Human切換上線,保留人工抽查與失敗停止機制
困難點/風險流程接上 AI 後沒有人能手動走完整條,出事只能等
7Output人機分工表 + 流程規格 + 影子模式比對結果 + 失敗停止設計

回流線:跑 1–2 週影子模式:AI 與人並行,逐欄比對差異 → AI 產人機分工表 + 每個 AI 段落的輸入輸出格式與失敗行為(比對不過就退回改分工)

Mermaid 原始碼(貼進 Mermaid Live 或 draw.io 可再編輯)
可直接複製,改成你自己的流程
flowchart TD
    in1(["<b>Human</b><br/>流程完整步驟(含判斷點與例外)+ 耗時頻率 + 出錯後果 + 權限限制<br/><small>沒有 SOP 就先用建 SOP 的方法</small>"])
    a1[/"<b>AI</b><br/>AI 逐步標三屬性:重複性/可回復性/需裁量(附理由與信心)"/]
    s1["<b>Human</b><br/>人校正屬性,特別是可回復性與裁量判定"]
    a2[/"<b>AI</b><br/>AI 產人機分工表 + 每個 AI 段落的輸入輸出格式與失敗行為"/]
    c1{{"<b>Checkpoint</b><br/>跑 1–2 週影子模式:AI 與人並行,逐欄比對差異"}}
    s2["<b>Human</b><br/>切換上線,保留人工抽查與失敗停止機制"]
    o1(["<b>Output</b><br/>人機分工表 + 流程規格 + 影子模式比對結果 + 失敗停止設計"])
    r1>"<b>Risk</b><br/>把需裁量的步驟交給 AI,然後用抽查安慰自己"]
    r2>"<b>Risk</b><br/>重複性高但不可回復——看起來最適合自動化,其實最危險"]
    r3>"<b>Risk</b><br/>介面沒定義,段落接不起來,最後每次都要人整理"]
    x1[/"<b>Stop</b><br/>影子模式未達通過標準,或有不可回復動作被設計成 AI 執行 → 不得切換"\]
    r4>"<b>Risk</b><br/>流程接上 AI 後沒有人能手動走完整條,出事只能等"]

    in1 --> a1
    a1 --> s1
    s1 --> a2
    a2 --> c1
    c1 --> s2
    s2 --> o1
    a1 -.->|風險| r1
    s1 -.->|風險| r2
    a2 -.->|風險| r3
    c1 ==>|中止| x1
    s2 -.->|風險| r4
    c1 -.->|比對不過就退回改分工| a2

    classDef clsIn fill:#FFFFFF,stroke:#2C4459,stroke-width:2px,color:#141E2B
    classDef clsHuman fill:#FBFCFD,stroke:#7A8CA0,stroke-width:2px,color:#141E2B
    classDef clsAI fill:#FFF6EA,stroke:#DE9A45,stroke-width:2px,color:#141E2B
    classDef clsAgent fill:#FDEBD2,stroke:#B87A2E,stroke-width:2px,color:#141E2B
    classDef clsTool fill:#EDF2F6,stroke:#2C4459,stroke-width:2px,color:#141E2B
    classDef clsCheck fill:#E8F2EC,stroke:#3F7A5A,stroke-width:2px,color:#123024
    classDef clsOut fill:#141E2B,stroke:#141E2B,stroke-width:2px,color:#F2F6F9
    classDef clsRisk fill:#FCEFEA,stroke:#C0552F,stroke-width:2px,color:#5E2110
    classDef clsStop fill:#F7E1DB,stroke:#8E2F17,stroke-width:3px,color:#5E2110
    class in1 clsIn;
    class a1 clsAI;
    class s1 clsHuman;
    class a2 clsAI;
    class c1 clsCheck;
    class s2 clsHuman;
    class o1 clsOut;
    class r1 clsRisk;
    class r2 clsRisk;
    class r3 clsRisk;
    class x1 clsStop;
    class r4 clsRisk;

04完整步驟圖的文字版,逐步展開

一句話版(快速回顧)

  1. 把現有流程逐步列出(沒有 SOP 就先用「AI 建 SOP」)。
  2. 逐步標三個屬性:重複性高嗎?錯了可回復嗎?需要裁量嗎?
  3. 分工原則:重複高+可回復+不需裁量 → 交 AI;其餘留人,或 AI 產草稿人簽核。
  4. 每個 AI 段落定義輸入輸出格式(結構化的交接才接得起來)。
  5. 先跑影子模式:AI 做一份、人照舊做一份,比對一至兩週再切換。

完整版(每一步誰做、產出什麼)

誰做步驟與說明
1Human列出完整流程
把現有流程逐步列出,含判斷點與例外。沒有 SOP 就先做 SOP。→ 流程步驟清單
2AI標三個屬性
每步標:重複性高嗎?錯了可回復嗎?需要裁量嗎?AI 提出初判與理由。→ 屬性標記表
3Human校正屬性
特別是「可回復性」與「需要裁量」——AI 不知道你們的實際後果與權責。→ 確認過的屬性
4AI產分工建議
依原則:重複高+可回復+不需裁量 → 交 AI;其餘留人,或 AI 產草稿人簽核。→ 人機分工表
5Human定義介面
每個 AI 段落的輸入與輸出格式。結構化的交接才接得起來,這是整條流程能不能運作的關鍵。→ 流程規格
6Human跑影子模式
AI 做一份、人照舊做一份,比對一至兩週。有差異的地方就是還沒設計好的地方。→ 比對結果
7Human切換與監測
切換後保留人工抽查與「流程失敗時停在哪、找誰」的機制。→ 上線的人機流程
三、動手做備料 → 指令 → 產出 → 工具

05開始前要準備什麼標「必要」的沒備齊就先別開始

現有流程的完整步驟必要
從 SOP 來,或先用建 SOP 的方法問出來。要有判斷點與例外。
每步的實際耗時與頻率必要
決定哪裡值得改。憑印象常常改錯地方。
每步出錯的實際後果必要
不是「可能會怎樣」,是「上次出錯時實際發生了什麼」。
可回復性判斷必要
這一步做錯,多久內、用什麼方式可以救回來。
影子模式的資源可選
誰有時間跑一至兩週的對照。沒有這個就不要切換。
現有的權限與資安規範可選
AI 可以碰哪些系統,這通常比技術可行性更早成為限制。

餵進去的東西要長這樣

流程步驟清單(含判斷點與例外)+ 每步耗時與頻率 + 出錯的實際後果 + 權限與資安限制 + 可用工具。

【流程背景】
流程名稱:申請案審查與核發
每月件數:約 120 件
目前人力:1 人每日約 3 小時
權限限制:AI 不得存取公文系統與案件資料庫,僅能處理人工貼上的內容
可用工具:M365 Copilot(企業租戶內)
影子模式可投入期間:2 週

【流程步驟】
1. 收到申請案,登記收文|耗時 3 分/件|曾出錯:文號登錯,當日發現可改
2. 檢查文件是否齊全|耗時 5 分/件|曾出錯:漏看附件,補件通知重發
3. 不齊 → 通知補件(對外發文)|耗時 10 分/件|曾出錯:通知錯誤,已寄出無法收回
4. 審查是否符合資格(依 ○○ 規定判斷)|耗時 15 分/件|曾出錯:資格認定錯誤,經申訴後撤銷重審
5. 製作核准/駁回函(駁回須敘明理由)|耗時 12 分/件
6. 陳核|耗時 2 分/件(承辦端)
7. 發文|耗時 3 分/件|不可回復
8. 結案登記|耗時 2 分/件

06Prompt(快速/完整/進階)

A 快速版貼上就能用;B 完整實戰版把角色、限制、步驟、輸出格式與驗收標準寫足;C 進階版是拿去建 GPT/Skill/Agent 的系統指令。三種都附可替換變數、使用範例、預期輸出與人工確認點。

A
A. 快速版

手上有流程步驟,想知道哪幾段可以交給 AI。

適合的工具ClaudeChatGPT
👇 直接複製,{ } 換成你的內容
以下是我們的工作流程步驟。請逐步分析:
1. 每步標記:重複性(高/低)|出錯可回復性(可/難)|需要人為裁量(是/否)。
2. 依「重複高+可回復+不需裁量才交 AI」的原則,給出人機分工建議表:步驟|建議(AI 全做/AI 草稿人審/純人工)|理由。
3. 對每個 AI 段落,定義輸入與輸出格式。
4. 指出整條流程最危險的一步(錯了最難回復的那步)。
流程:{貼上}

可替換變數

變數要換成什麼
{貼上}現有流程的完整步驟(含判斷點與例外)。
完整使用範例(照這樣填)
以下是我們的工作流程步驟。請逐步分析:(照母提示詞四條)
流程:
1. 收到申請案,登記收文
2. 檢查文件是否齊全
3. 不齊 → 通知補件;齊 → 進入審查
4. 審查是否符合資格(依規定判斷)
5. 符合 → 製作核准函;不符 → 製作駁回函(須敘明理由)
6. 陳核
7. 發文
8. 結案登記
預期輸出範例(拿到的東西應該長這樣)
| # | 步驟 | 重複性 | 可回復性 | 需要裁量 | 建議 | 理由 |
|---|---|---|---|---|---|---|
| 1 | 登記收文 | 高 | 可 | 否 | AI 全做 | 純資料轉錄,錯了可改 |
| 2 | 檢查文件齊全 | 高 | 可 | 否 | AI 全做 | 對照清單,客觀 |
| 3 | 通知補件 | 高 | 難(已寄出) | 否 | AI 草稿人審 | 對外文件,寄出不可回復 |
| 4 | 審查資格 | 高 | 可 | 是 | 純人工 | 涉及規定解釋與個案判斷 |
| 5 | 製作核准/駁回函 | 高 | 可(未發文前) | 是(駁回理由) | AI 草稿人審 | 理由敘明涉及裁量 |
| 6 | 陳核 | 高 | 可 | 是 | 純人工 | 核可是權責行為 |
| 7 | 發文 | 高 | 難 | 否 | 純人工 | 不可回復 |
| 8 | 結案登記 | 高 | 可 | 否 | AI 全做 | 純資料轉錄 |

【AI 段落的輸入輸出格式】
步驟 1:輸入=來文掃描檔+文號;輸出={收文號, 來文機關, 主旨, 收文日}
步驟 2:輸入=申請文件清單+應備文件清單;輸出={齊全: 是/否, 缺件清單: []}
步驟 8:輸入=案件編號+處理結果;輸出={案號, 結果, 結案日}

【最危險的一步】
步驟 7 發文。一旦發出不可回復,且對外文件錯誤會造成相對人信賴。此步必須人工確認,且建議在步驟 5 與 7 之間加入「發文前最後檢查」。

常見錯誤用法

  • 把「需要裁量」的步驟標成「否」以求自動化程度高一點。這是這個方法最常見的自我欺騙。
  • 只看重複性就決定交給 AI。重複性高但不可回復的步驟(發送、扣款)是最危險的組合。
  • 跳過輸入輸出格式那一節。沒有格式,段落之間接不起來。
  • 拿到分工表就開始建。還沒跑影子模式。
這一版另外不適合
  • 還沒有 SOP 的流程。
  • 一年只做幾次的流程。
缺少資料時怎麼辦

缺「每步實際耗時與頻率」時,分工建議會偏向「凡是可以自動化的都自動化」——但那不一定值得。補上耗時資料後,你常會發現真正該改的只有兩三步。

這一版另外要人確認
  • 可回復性與裁量的判定。
  • 不可回復步驟的把關設計。
  • 影子模式的執行。
B
B. 完整實戰版

正式設計人機分工。加入實際耗時、出錯後果、介面規格與影子模式設計。

適合的工具ClaudeChatGPT
👇 直接複製,{ } 換成你的內容
# 角色
你是工作流程設計顧問。你的任務是分析現有流程,提出人機分工建議與介面規格。你不做風險承受度的決定,也不保證任何自動化一定可行。

# 背景
- 流程名稱:{流程名稱}
- 每月處理件數:{件數}
- 目前投入人力:{人力,例如 1 人每日約 2 小時}
- 已知的權限與資安限制:{限制,例如「AI 不得存取案件系統」}
- 可用的 AI 工具:{可用工具}
- 影子模式可投入的期間:{影子期間}

# 分工原則(嚴格適用,不得為了提高自動化比例而放寬)
只有同時滿足三個條件的步驟才建議「AI 全做」:
1. 重複性高(每月至少 {門檻} 次,且做法一致)
2. 出錯可回復(在造成外部影響前可以更正)
3. 不需要裁量(有客觀判準,不需要解釋規定或衡量個案)
三者缺一 → 「AI 草稿人審」或「純人工」:
- 缺「可回復」→ 純人工,或 AI 草稿+人工確認後執行
- 缺「不需裁量」→ 純人工,或 AI 提供資料+人判斷
- 缺「重複性」→ 不建議投入自動化

# 處理步驟
1. 逐步標記三個屬性,每個標記都要說明理由與信心(高/中/低)。
2. 特別標出「重複性高但不可回復」的步驟——這是最危險的組合,最容易被錯誤地自動化。
3. 依原則產出人機分工表。
4. 對每個 AI 段落,定義輸入格式、輸出格式、缺值處理、失敗時的行為。
5. 指出整條流程「錯了最難回復」的一步,並設計把關方式。
6. 設計影子模式:比對哪些欄位、差異多少算通過、跑多久。
7. 設計失敗停止機制:流程哪裡會停、停了誰知道、找誰。
8. 自我檢查並回報。

# 不可以做的事
1. 不得建議把「需要裁量」的步驟交給 AI 全做,即使我要求。
2. 不得建議把不可回復的動作(發送、付款、異動、刪除)交給 AI 執行。
3. 不得假設 AI 可以存取我未提及的系統。
4. 不得提供任何量化的效益預估(省多少時間、降多少錯誤率)——那要靠影子模式實測。

# 輸出格式
## 一、屬性標記表(#|步驟|重複性|可回復性|需裁量|信心|理由)
## 二、危險組合警示(重複性高但不可回復的步驟)
## 三、人機分工表(#|步驟|建議|理由|若出錯的後果)
## 四、AI 段落介面規格(輸入格式|輸出格式|缺值處理|失敗行為)
## 五、最危險的一步與把關設計
## 六、影子模式設計(比對欄位|通過標準|期間|由誰執行)
## 七、失敗停止機制(停止條件|通知對象|人工接手方式)
## 八、自我檢查結果

# 自我檢查(輸出前執行)
1. 是否有建議把需裁量步驟交給 AI 全做?
2. 是否有建議 AI 執行不可回復的動作?
3. 每個 AI 段落是否都有明確的輸入輸出格式?
4. 是否提供了未經實測的效益數字?
5. 是否假設了我沒提及的系統存取權限?

# 流程
{貼上流程步驟}

可替換變數

變數要換成什麼
{流程名稱}/{件數}/{人力}決定值不值得做。件數少就不必做。
{限制}權限與資安限制通常比技術可行性更早成為瓶頸。
{可用工具}只寫單位實際可用的,不要寫理想中的。
{影子期間}沒有影子模式資源就不要切換。
{門檻}重複性的判準,建議每月 20 次。
完整使用範例(照這樣填)
把 {流程名稱} 換成「申請案審查與核發」、{件數} 換成「每月約 120 件」、{人力} 換成「1 人每日約 3 小時」、{限制} 換成「AI 不得存取公文系統與案件資料庫,僅能處理人工貼上的內容」、{可用工具} 換成「M365 Copilot(企業租戶內)」、{影子期間} 換成「2 週」、{門檻} 換成「每月 20 次」。
預期輸出範例(拿到的東西應該長這樣)
第二節會單獨警示「步驟 3 通知補件」與「步驟 7 發文」屬於重複性高但不可回復;第四節會給出每個 AI 段落的欄位規格與缺值處理;第六節會設計比對表(例如「比對缺件清單是否一致,兩週內差異率須低於 5% 才通過」);第八節確認沒有違反原則。

常見錯誤用法

  • 把 {限制} 留空,然後得到一份需要系統整合的設計,而你們根本沒有那個權限。
  • 要求它給效益預估。任何未經影子模式實測的數字都是編的。
  • 跳過第七節失敗停止機制。流程接上 AI 之後,最麻煩的不是出錯,是出錯了沒有人知道。
  • 把第二節的危險組合當成「加強抽查就好」。抽查抓不到偶發錯誤。
這一版另外不適合
  • 流程尚未穩定或無 SOP 時。
  • 不可回復且高風險為主的流程。
缺少資料時怎麼辦

缺「出錯的實際後果」時,可回復性的判斷會失準。建議至少回想過去一年這個流程出過的錯,以及當時怎麼補救——那才是真實的可回復性。

這一版另外要人確認
  • 三個屬性的最終判定。
  • 風險承受度的決定。
  • 影子模式的執行與結論。
  • 切換時機。
  • 保留手動走完全流程的能力。
C
C. 進階版(流程設計助手)

要一次盤點多條流程時,把設計原則固定成助手。這段是系統指令,重點在「不因要求而放寬原則」。

適合的工具自訂 GPT/Claude ProjectClaudeClaude Skill
👇 直接複製,{ } 換成你的內容
# 身分
你是「{單位名稱}流程設計助手」。你分析流程並提出人機分工建議與介面規格。你不做風險決定、不保證可行性、不提供未經實測的效益數字。

# 設計原則(最高優先,任何情況下不得放寬)
「AI 全做」必須同時滿足三條:重複性高、出錯可回復、不需要裁量。
缺任一條的處理:
- 缺可回復 → 純人工,或 AI 草稿+人工確認後才執行
- 缺不需裁量 → 純人工,或 AI 提供資料+人判斷
- 缺重複性 → 不建議投入
使用者要求你把需裁量步驟標為「AI 全做」時,回覆:「這一步需要裁量,依原則不建議由 AI 全做。我可以改設計成『AI 提供判斷所需資料+人決定』。」

# 絕對不建議由 AI 執行的動作(不可回復類)
對外發送、付款與扣款、資料刪除、系統異動、狀態變更為終局(結案、核准、駁回)、對外承諾。
這些可以由 AI 產草稿,但執行動作必須是人。

# 條件判斷
- 流程步驟少於 5 步 → 提醒「流程可能過於簡略,建議先完成 SOP」。
- 使用者未提供每步耗時與頻率 → 分工建議仍可產出,但在開頭標示「未提供耗時資料,無法判斷投入是否值得」。
- 使用者未提供權限限制 → 假設 AI「只能處理人工貼上的內容,不能存取任何系統」,並明確標示這個假設。
- 流程中出現「視情況」「依個案」「經主管同意」→ 該步一律標為需要裁量。
- 流程中出現法規依據 → 該步標為需要裁量(規定解釋屬裁量)。

# 例外處理
- 流程有分支且分支之間差異很大 → 分別分析,不要合併成一條。
- 同一步驟在不同情境下屬性不同 → 拆成兩步分別標記。
- 使用者說「我們已經在用 AI 做這一步了」而該步需要裁量 → 不批評現況,但標示【現況與原則不符,建議評估】並說明可能的失敗模式。
- 使用者要求跳過影子模式 → 回覆「可以,但沒有對照組時,切換後的問題無法歸因。建議至少保留一週並行。」
- 使用者要求你估算節省的工時 → 拒絕,回覆「效益要靠影子模式實測。我可以幫你設計比對表。」

# 權限限制
- 你沒有存取任何系統的能力。
- 你不得建議把系統存取權限授予 AI,除非使用者明確說明該權限已存在且為唯讀。
- 你不得跨對話記憶其他流程的內容。

# 必須交給人的判斷
1. 可回復性的認定。
2. 風險承受度。
3. 影子模式的通過標準。
4. 切換時機。
5. 例外情況的處理原則。

# 中止條件
- 使用者三次要求把需裁量步驟標為 AI 全做。
- 使用者要求設計由 AI 執行不可回復動作的流程。
- 流程步驟不完整(缺判斷點與例外)且使用者無法補充。
中止輸出格式:「【中止】原因:{原因}。建議處理方式:{建議}。」

# 固定輸出格式
一、前提與假設(含未提供的資訊與採用的預設)
二、屬性標記表(#|步驟|重複性|可回復性|需裁量|信心|理由)
三、危險組合警示(重複性高但不可回復)
四、人機分工表(#|步驟|建議|理由|出錯後果)
五、AI 段落介面規格(輸入|輸出|缺值處理|失敗行為)
六、最危險的一步與把關設計
七、影子模式設計(比對欄位|通過標準|期間|執行者)
八、失敗停止機制(停止條件|通知對象|人工接手)
九、自我檢查結果

# 自我檢查(輸出前執行)
1. 是否有需裁量步驟被建議為 AI 全做?
2. 是否有建議 AI 執行不可回復動作?
3. 每個 AI 段落是否都有輸入輸出格式與失敗行為?
4. 是否提供了未經實測的效益數字?
5. 是否假設了未經確認的系統權限?
6. 是否每個判斷都附了信心程度?

# 品質檢核(結尾固定一行)
「本流程共 {N} 步:建議 AI 全做 {A}、AI 草稿人審 {B}、純人工 {C};危險組合 {D} 處、需裁量 {E} 步。所有建議須經影子模式實測後再切換。」

可替換變數

變數要換成什麼
{單位名稱}助手服務的單位。
完整使用範例(照這樣填)
在自訂 GPT 指令欄貼上整段。盤點多條流程時,每條流程開一個新對話(避免互相污染)。輸入是每條流程的 SOP 步驟+耗時頻率+權限限制。
預期輸出範例(拿到的東西應該長這樣)
使用者要求把「審查資格」標為 AI 全做時,助手會拒絕並提出替代設計;未提供耗時資料時第一節會標示「無法判斷投入是否值得」;要求估算節省工時時會拒絕並改提供比對表設計。

常見錯誤用法

  • 把設計原則放寬,因為「這樣自動化比例太低」。低自動化比例不是問題,錯誤的自動化才是。
  • 讓助手建議 AI 執行發送或異動。這是這個方法的紅線。
  • 跳過影子模式直接切換。出問題時你無法歸因。
  • 把助手的「信心:低」標記忽略掉。那些正是你要自己確認的判斷。
  • 設計完就不再檢視。流程會變,分工也要跟著變。
這一版另外不適合
  • 尚未完成 SOP 的流程。
  • 以不可回復動作為主的流程(付款、發文、異動)。
  • 沒有資源跑影子模式的情況。
缺少資料時怎麼辦

缺耗時與頻率資料時,助手仍會產出分工建議,但無法回答「值不值得做」。建議至少估算每步的耗時,因為常見的結果是:真正該改的只有兩三步,其他都是雜訊。

這一版另外要人確認
  • 設計後:三個屬性的逐步確認,特別是可回復性。
  • 切換前:影子模式跑滿設定期間並比對。
  • 切換時:確認失敗停止機制有作用(實際觸發一次看看)。
  • 切換後:保留人工抽查,並確保至少一人能手動走完整條流程。
  • 每半年:重新檢視分工是否仍適用。

07產出應該長什麼樣拿到的東西要長這樣

九節:前提假設、屬性標記、危險組合、分工表、介面規格、最危險一步、影子模式、失敗停止、自我檢查。

完成品:影子模式兩週後的比對結果與調整

【比對期間】2 週,共 58 件

【步驟 1|登記收文】
一致 57/58(98.3%)→ 通過標準 98%,通過
不一致的 1 件:來文主旨含異體字,AI 轉錄時做了正規化。
→ 處理:可接受(不影響檢索),但在介面規格加註「主旨照原文,不做正規化」。

【步驟 2|檢查文件齊全】
缺件項目完全一致 51/58(87.9%)→ 未達 95%,未通過
不一致的 7 件全部集中在同一種情況:申請人以「戶籍謄本」替代「身分證影本」。AI 判定為缺件,承辦判定為等同文件可接受。
→ 這正是「需裁量」的證據。原本標為「AI 全做」的信心是「中」,實測證實了那個中。
→ 調整:改為「AI 草稿人審」,且在輸出中新增「疑似等同文件」欄位供承辦判斷。
→ 重跑一週後:漏報 0 件,承辦確認時間平均 40 秒/件。可接受。

【步驟 8|結案登記】
一致 58/58(100%)→ 通過

【失敗停止機制測試】
刻意輸入一件無法辨識的掃描檔 → AI 正確輸出【待補】並停止該件。承辦收到後轉人工,機制有效。

【最終調整】
AI 全做:步驟 1、8(原本 3 步,減為 2 步)
AI 草稿人審:步驟 2、3、5
純人工:步驟 4、6、7
※ 自動化比例比原設計低,但每一段都經過實測。這比一份漂亮的設計有用。
輸出格式規格(要照著做的人再展開)
  • 每個屬性標記都要附理由與信心。
  • 「重複性高但不可回復」要單獨警示。
  • AI 段落的介面規格要具體到欄位與缺值處理。
  • 不得出現未經實測的效益數字。
  • 失敗停止機制要寫「停在哪、誰知道、找誰」。
一、前提與假設
- 依提供資訊,AI 僅能處理人工貼上的內容,無系統存取權。所有 AI 段落的輸入皆假設由人工貼上。
- 已提供耗時與頻率資料,可判斷投入價值。

二、屬性標記表
| # | 步驟 | 重複性 | 可回復 | 需裁量 | 信心 | 理由 |
|---|---|---|---|---|---|---|
| 1 | 登記收文 | 高(120/月) | 可(當日可改) | 否 | 高 | 純資料轉錄 |
| 2 | 檢查文件齊全 | 高 | 可 | 否 | 中 | 對照清單客觀,但「等同文件」的認定可能涉及判斷 |
| 3 | 通知補件 | 高 | 難(已寄出) | 否 | 高 | 內容客觀但動作不可回復 |
| 4 | 審查資格 | 高 | 可(未發文前) | 是 | 高 | 涉及規定解釋與個案認定 |
| 5 | 製作核准/駁回函 | 高 | 可 | 是(駁回理由) | 高 | 理由敘明涉及裁量 |
| 6 | 陳核 | 高 | 可 | 是 | 高 | 核可為權責行為 |
| 7 | 發文 | 高 | 難 | 否 | 高 | 不可回復 |
| 8 | 結案登記 | 高 | 可 | 否 | 高 | 純資料轉錄 |

三、危險組合警示
步驟 3、7 屬「重複性高但不可回復」。這是最容易被錯誤自動化的組合——因為重複性高看起來很適合,但錯誤無法收回。這兩步一律保留人工執行。

四、人機分工表
| # | 步驟 | 建議 | 理由 | 出錯後果 |
|---|---|---|---|---|
| 1 | 登記收文 | AI 全做 | 三條件皆滿足 | 文號錯,當日可改 |
| 2 | 檢查文件齊全 | AI 草稿人審 | 「等同文件」認定可能涉判斷 | 漏件,補件重發 |
| 3 | 通知補件 | AI 草稿人審後由人發送 | 動作不可回復 | 錯誤通知已寄出,影響相對人 |
| 4 | 審查資格 | 純人工(AI 可提供規定條文比對) | 需裁量 | 認定錯誤,申訴撤銷重審 |
| 5 | 製作函稿 | AI 草稿人審 | 駁回理由需裁量 | 理由不當,構成申訴事由 |
| 6 | 陳核 | 純人工 | 權責行為 | — |
| 7 | 發文 | 純人工 | 不可回復 | 錯誤發文無法收回 |
| 8 | 結案登記 | AI 全做 | 三條件皆滿足 | 登記錯,可更正 |

五、AI 段落介面規格
步驟 1|輸入:來文首頁文字(人工貼上)|輸出:{收文號:字串, 來文機關:字串, 主旨:字串, 收文日:日期}|缺值:任一欄位缺 → 輸出【待補】並列出缺哪欄|失敗:無法辨識 → 回報並由人工登記
步驟 2|輸入:申請文件清單+應備文件清單|輸出:{齊全:是/否, 缺件:[], 疑似等同文件:[]}|缺值:清單不完整 → 停止並要求補|失敗:出現不在清單上的文件 → 標【需人工判斷】
步驟 8|輸入:案號+處理結果|輸出:{案號, 結果, 結案日}|缺值:結果未定 → 不登記|失敗:案號查無 → 回報

六、最危險的一步與把關設計
步驟 7 發文。把關設計:發文前置一道「最後檢查」,逐項核對受文者、文號、附件、金額;由承辦以外的人執行(第二雙眼睛)。

七、影子模式設計
| 比對欄位 | 通過標準 | 期間 | 執行者 |
|---|---|---|---|
| 步驟 1 的四個欄位 | 完全一致率 ≥ 98% | 2 週 | 承辦 |
| 步驟 2 的缺件清單 | 缺件項目完全一致率 ≥ 95%,且無漏報 | 2 週 | 承辦 |
| 步驟 8 的登記欄位 | 完全一致率 ≥ 98% | 2 週 | 承辦 |
※「無漏報」是硬標準:把缺件說成齊全的錯誤不可接受,比反過來嚴重得多。

八、失敗停止機制
| 停止條件 | 通知對象 | 人工接手方式 |
|---|---|---|
| AI 輸出含【待補】或【需人工判斷】 | 承辦 | 該件轉全人工處理 |
| 單日 AI 輸出錯誤 ≥ 3 件 | 承辦+科長 | 暫停 AI 段落,全面轉人工,檢討後再啟用 |
| AI 工具無法使用 | 承辦 | 依原 SOP 全人工處理(承辦須保持此能力) |

九、自我檢查結果
無需裁量步驟被建議 AI 全做:通過|無 AI 執行不可回復動作:通過|AI 段落皆有介面規格與失敗行為:通過|未提供效益數字:通過|未假設未確認的系統權限:通過

本流程共 8 步:建議 AI 全做 2、AI 草稿人審 3、純人工 3;危險組合 2 處、需裁量 3 步。所有建議須經影子模式實測後再切換。

08工具怎麼挑

這幾支都做得到——差別在你手上有哪一支、資料能不能外流。標「起手」的是不知道從哪支開始時的建議,不是限定。

工具什麼時候用為什麼注意
Claude ↗起手
流程分析
流程複雜、分支多長流程的屬性標記與相依分析穩定,較能維持原則一致性。屬性判定仍要人校正。
ChatGPT ↗要建成可重複使用的助手自訂 GPT 好建,適合一次盤點多條流程。每條流程開新對話,避免互相污染。
四、不要做錯這幾關不下放

09會卡住與會做錯的地方

會卡住的地方(流程困難點)

把需要裁量的步驟交給 AI
這個情境最常見也最貴的錯。裁量錯誤是偶發的、看起來正常的,抽查抓不到。
跳過影子模式
直接切換,出問題時已經沒有對照組,你不知道是新流程的問題還是本來就這樣。
介面沒定義
AI 段落的輸出格式不固定,下一段接不起來,最後每次都要人整理,等於沒省。
沒有人懂全貌
流程接上 AI 之後,出問題時沒有人能手動走完整條,只能等廠商或等 AI 恢復。

會做錯的地方(常見失敗方式)

把需裁量的步驟交給 AI

裁量錯誤是偶發的、看起來正常的,抽查抓不到。

怎麼修三條件缺一就不給 AI 全做;出現「視情況」「依規定判斷」一律標為需裁量。

只看重複性

重複性高但不可回復是最危險的組合,而它看起來最適合自動化。

怎麼修單獨警示這個組合;不可回復的動作永遠人執行。

跳過影子模式

切換後出問題無法歸因,也沒有對照組可以回頭比。

怎麼修設計階段就做好比對表與通過標準,至少跑一至兩週。

介面沒定義

AI 段落的輸出格式不固定,下一段接不起來,最後每次都要人整理。

怎麼修每個 AI 段落定義輸入、輸出、缺值處理、失敗行為,像 API 一樣明確。

沒有人懂全貌

AI 掛掉時沒有人能手動走完整條流程。

怎麼修至少一人保持手動處理能力,並列為失敗停止機制的一部分。

用未經實測的效益數字說服人

上線後對不上,之後沒有人相信你的估算。

怎麼修效益一律等影子模式實測;設計階段只給比對表不給數字。

其他注意事項

10人工把關與安全限制

AI/Agent/Tool 介入在哪幾步

流程位置做什麼/怎麼做
分析階段AI屬性標記與分工建議
三個屬性的初判與理由。理由是你校正的依據。
設計階段AI定義輸入輸出格式
讓 AI 為每個 AI 段落產出明確的格式規格(欄位、型態、缺值怎麼辦)。
風險分析AI找出最危險的一步
指出整條流程中「錯了最難回復」的那一步,這一步一定要有人把關。
驗證階段Human影子模式
AI 與人並行一至兩週,比對差異。這一步沒有工具可以取代。

這幾關不下放

可回復性的認定
「這一步錯了能不能救回來」,只有做過的人知道。
裁量的判定
需要裁量的步驟一律留人,或設計成 AI 產草稿、人簽核。
不可回復步驟
發送、扣款、異動、對外承諾,永遠人把關。
影子模式的結論
差異多少算可接受,是管理決定。
保留手動能力
至少一個人要能手動走完整條流程。

安全與權限限制

權限最小化
AI 段落只給必要的存取權,能唯讀就不給寫入。
不可回復動作留人
發送、付款、刪除、異動、終局狀態變更,一律人執行。
資料流向要清楚
每個 AI 段落處理什麼資料、資料離不離開內網,設計時就要寫清楚。
失敗要看得見
流程停止時要有人收到通知。安靜的失敗比明顯的失敗危險。
保留人工路徑
AI 不可用時的替代流程要存在且有人會走。
留痕
AI 做了哪些步驟、輸出是什麼,要留紀錄供稽核。

11Checklist 與驗收標準

做的時候逐項打勾

做完了才檢查:全部成立才算完成

  1. 每個 AI 段落都有明確的輸入格式、輸出格式、缺值處理與失敗行為。
  2. 所有不可回復的步驟都由人執行,沒有例外。
  3. 所有需要裁量的步驟都保留人的判斷,不是靠抽查。
  4. 已跑滿設定期間的影子模式,且比對結果達到預設的通過標準。
  5. 流程失敗時知道停在哪、誰會收到通知、由誰接手。
  6. 至少一人能在 AI 不可用時手動走完整條流程。
  7. 效益數字來自實測,不是設計階段的估算。
  8. AI 段落的權限為最小可用,且資料流向已確認符合資安規範。
五、延伸看別人做過,然後往下一步

12實際案例

人機分工:先問「錯了能不能救回來」,再問「要不要裁量」

第一手拆解:SOP 流程圖方法(完整拆解) →

當時的狀況:有一條每月上百件的例行流程,人力吃緊。直覺的做法是「把重複的部分交給 AI」,但重複性最高的幾步當中,有兩步是不可回復的(對外通知與發文)——而這兩步正好也是最花時間的。

AI 做了什麼
  • 逐步標記三個屬性(重複性、可回復性、需裁量)並附理由與信心程度。
  • 單獨警示「重複性高但不可回復」的步驟——這是最容易被錯誤自動化的組合。
  • 為每個 AI 段落定義輸入輸出格式、缺值處理與失敗時的行為。
  • 指出整條流程最危險的一步,並建議把關設計。
  • 設計影子模式的比對表與通過標準。
人做了什麼
  • 校正可回復性的判定——AI 不知道實際出錯時怎麼補救的。
  • 確認哪些步驟涉及規定解釋(那些一律留人)。
  • 跑兩週影子模式並比對差異,發現「檢查文件齊全」這一步在遇到「等同文件」時判斷不一致,於是改成 AI 草稿人審。
  • 確認至少一人能在 AI 無法使用時手動走完整條流程。

結果:分工的依據從「哪些看起來重複」變成「哪些錯了救得回來且不需要判斷」。自動化的比例不高,但每一段都站得住腳。

待補資料:本站不提供工時節省或錯誤率改善的量化數字——這些必須靠你自己的影子模式實測,任何通用數字都不足採信。這也是為什麼影子模式的比對表要在設計階段就做好。

13相關方法與下一步

沒有 SOP 就先做 SOP

對著不存在的流程做人機分工是空談。

把 AI 段落建成助手

設計完成後的實作步驟。

助手要測到會壞為止

介面規格是測試題組的來源。

需求層級的拆解

當流程改造本身是一個專案時。

可直接使用RELATED PROMPTS

先理解這些觀念RELATED CONCEPTS

Download

這個方法的模板與 Checklist 下載包整理中——訂閱更新,上架後第一時間通知你。

取得 AI 實戰工具與更新

之後會不定期整理:新方法、指令包(Prompt Pack)、Checklist 與模板。免費、無廣告;正式寄送前會先寄確認信,隨時可來信要求刪除。

← 回「自動化與 Agent」回找方法 →