AAI 小學堂
CASE LIBRARY · 32 CASES

半導體情境案例
與教學證據庫

32 個案例均為合成情境,用於任務設計、責任分界、Evidence 與 Human Gate 練習,不含真實人員、產品、Lot、設備或內部事件。

半導體情境

Agent 執行資料處理,人員保留專業判斷

每個案例均定義任務、責任分工、Human Gate、Artifact、Evidence、主要風險與適用教材,可用於 Demo、分組判讀與工作紙實作。

CASE-01

交接摘要

從合成 Shift Log 整理異常、待辦與責任角色

Agent 做
讀取紀錄、分類並附原始段落索引
人判斷
判斷風險優先序、升級與責任人
Human Gate
正式交接與行動指派前
Artifact
交接摘要、來源索引、未確認事項
拆任務・Prompt・驗收・治理
CASE-02

晶圓缺陷初步彙整

彙整合成 Defect Map、量測摘要與歷史案例

Agent 做
對齊欄位、找相似模式、列待查關聯
人判斷
判斷機制假設與下一個實驗
Human Gate
任何製程條件或處置決策前
Artifact
特徵表、來源、候選假設與反證
Memory・Evidence・Human Gate
CASE-03

機台 Alarm 歷史整理

比對合成 Alarm、維修紀錄與近期變更

Agent 做
建立時間線、找重複事件與資料缺口
人判斷
判斷停機、放行、升級或維護
Human Gate
所有設備動作與放行判定前
Artifact
時間線、事件群組、資料缺口
Tools・Memory・治理
CASE-04

製程文件差異比較

比較兩版合成作業文件的新增、刪除與風險項

Agent 做
逐段 Diff、分類並保留頁碼與版本
人判斷
判斷影響、核准文件與訓練需求
Human Gate
文件發布、規範變更與採用前
Artifact
差異矩陣、原文定位、待確認清單
Prompt・驗收・治理
CASE-05

SPC 異常報告草稿

依合成量測資料產出異常摘要與待查問題

Agent 做
計算基本統計、標記超限點、附範圍
人判斷
判斷意義、資料品質與處置
Human Gate
通知與製程處置前
Artifact
圖表、計算紀錄、來源、待查問題
Tools・Evidence・Showcase
CASE-06

良率週報彙整

從合成資料彙整週趨勢、主要變化與待確認事項

Agent 做
套固定欄位、起草週報、列數字來源
人判斷
決定呈報重點、語氣與風險升級
Human Gate
寄送或發布週報前
Artifact
週報草稿、來源表、驗收清單
Stage 1 全系列
CASE-07

維修知識檢索

從合成手冊與 FAQ 找某類 Alarm 的檢查順序

Agent 做
只用核准文件、引用段落、整理清單
人判斷
確認設備型號、版本與現場適用性
Human Gate
執行設備動作前
Artifact
引用式結果、版本資訊、檢查清單
Tools・MCP・驗收・治理
CASE-08

新人訓練內容更新

比較教材、FAQ 與近期問題,提出更新草案

Agent 做
分類問題、找重複卡點、起草新版內容
人判斷
判斷正式納入項目與技術正確性
Human Gate
教材發布與能力門檻修改前
Artifact
問題統計、修改提案、Diff、評量影響
Stage 2 回饋・Stage 3 迭代
八堂延伸案例

每堂三案,直接對應教材能力與工作紙

每個案例都補齊輸入、Agent/Human 分工、Human Gate、必要 Evidence、風險與討論題。講師可依學員職務選一案,無需在 40 分鐘內全部講完。

I01 · WEEK 1 · 會用

Agentic AI 起步與任務適配

回到教材 →
I01-C1 · 任務適配分組判讀

ECN 影響資料預整理

工程變更通知涉及多份合成文件,Owner 想先知道受影響的站點、文件與訓練對象。

輸入
合成 ECN、文件索引、站點清單與版本紀錄。
Agent 做
擷取變更項、比對文件名稱、整理可能受影響清單並附來源。
人判斷
判定實際影響、優先序、責任單位與是否採納變更。
Human Gate
影響判定、文件修改或正式通知之前。
Evidence
變更矩陣、原文定位、版本資訊與待確認項目。
風險
同名文件或過期索引可能造成錯誤關聯,Agent 不得宣告影響已確認。
討論題

這項工作適合從哪個最小範圍開始?哪一項責任絕不能交給 Agent?

I01-C2 · 工作紙實作

Defect Map 初步特徵彙整

工程師想縮短大量合成缺陷圖的人工整理時間,但機制判定仍高度依賴專業經驗。

輸入
合成 Defect Map、量測摘要、產品族群與資料完整性標記。
Agent 做
對齊欄位、計算基本特徵、找相似分布並列出資料缺口。
人判斷
提出機制假設、選擇反證資料並決定下一個實驗。
Human Gate
機制結論、製程調整或實驗指令之前。
Evidence
特徵表、群組依據、來源索引與未知項目。
風險
相似圖形不代表相同根因,過度自動化可能放大錯誤歸因。
討論題

這是適合 Agent 的任務、輔助任務,還是不適合?請用六項條件說明。

I01-C3 · 低風險試驗設計

預防保養工單草稿

設備團隊希望依合成保養紀錄產生下週工單草稿,減少重複抄寫。

輸入
合成保養週期、上次完成日、設備類別與核准作業清單。
Agent 做
計算到期項目、套用工單欄位、標示資料缺漏與衝突。
人判斷
確認現場排程、人力、零件、設備狀態與正式派工。
Human Gate
工單發布、停機安排或現場操作之前。
Evidence
到期計算、來源版本、衝突清單與核准紀錄。
風險
日期或設備對應錯誤可能造成漏保養或非預期停機。
討論題

低風險試驗應只做到哪一步?成功與停止條件各是什麼?

I02 · WEEK 2 · 會用

任務拆解與 Prompt 指揮

回到教材 →
I02-C1 · 任務拆解練習

Lot Hold 原因彙整

多班紀錄以不同文字描述合成 Hold 事件,主管需要一份可追溯的待確認清單。

輸入
去識別 Hold 紀錄、時間、站點、Reason Code 與原始備註。
Agent 做
標準化欄位、建立時間線、群組相似描述並引用原文。
人判斷
判定事件關聯、責任、放行條件與是否升級。
Human Gate
原因定案、Lot 放行或處置指示之前。
Evidence
子任務輸入輸出、Prompt 版本、群組依據與來源。
風險
將相似描述合併為同一根因,可能掩蓋不同事件。
討論題

請拆成資料整理、專業判斷、正式動作三段,逐段寫完成證據。

I02-C2 · Prompt 任務書實作

實驗 Run Card 課前檢查

工程師準備合成 DOE Run Card,希望 Agent 先找出欄位缺漏與互相矛盾的描述。

輸入
合成 Run Card、必填欄位規則、版本與檢查清單。
Agent 做
檢查完整性、對照規則、列出衝突與待確認問題。
人判斷
確認實驗設計、參數合理性、風險與是否執行。
Human Gate
Run Card 核准與任何實驗執行之前。
Evidence
檢查結果、規則引用、缺漏清單與修訂 Diff。
風險
Prompt 若未禁止補值,Agent 可能把未知參數填成看似合理的數字。
討論題

為這項任務寫出目標、限制、缺失值處理與輸出契約。

I02-C3 · Prompt 邊界走查

良率週報敘事草稿

固定圖表已產生,但每週摘要常因撰寫者不同而遺漏期間、比較基準或待查事項。

輸入
合成趨勢表、週別、比較基準、資料來源與摘要格式。
Agent 做
依固定欄位起草趨勢描述、列數字來源並標記異常變化。
人判斷
決定呈報重點、因果敘述、風險語氣與升級需求。
Human Gate
週報寄送、公開結論或責任歸屬之前。
Evidence
輸出契約、數字對帳、兩次執行差異與核准版本。
風險
把相關性寫成因果,或使用不一致比較期間。
討論題

哪些句子能自動生成?哪些句子必須改成『待工程師判定』?

I03 · WEEK 3 · 會用

Tools、MCP、Memory 與 Agent Loop

回到教材 →
I03-C1 · Tools 與停止條件設計

核准製程規範檢索

使用者詢問某站點的抽樣規則,知識庫同時存在現行版、草稿與已作廢版本。

輸入
合成規範文件、狀態、版本、生效日與站點標籤。
Agent 做
只搜尋核准且生效的文件、比對站點、引用段落並回報無結果。
人判斷
確認適用產品、例外條件與是否採用該規範。
Human Gate
規範套用、抽樣調整或現場指示之前。
Evidence
查詢條件、文件狀態、版本、段落引用與停止原因。
風險
搜尋到內容相似但狀態不符的文件,可能造成錯誤執行。
討論題

Tool 應暴露哪些欄位?Memory 要保留什麼?找不到現行版時如何停止?

I03-C2 · Agent Loop 桌上推演

跨系統 Wafer History 串接

合成履歷分散在製程、量測與事件三個資料源,部分 Wafer ID 缺失或重複。

輸入
三個合成資料表、欄位字典、查詢時間範圍與假 ID。
Agent 做
依授權逐站查詢、對齊鍵值、保存進度並列出無法串接資料。
人判斷
判定資料關聯可信度、是否補查與分析用途。
Human Gate
跨系統擴大查詢、寫回資料或下結論之前。
Evidence
Tool Trace、查詢範圍、Memory 狀態、Join 結果與缺口。
風險
錯誤 Join 可能製造不存在的履歷;無限重試也可能造成系統負荷。
討論題

畫出成功、缺 ID、重複 ID 三條 Loop,標示最大輪數與人工出口。

I03-C3 · 權限表練習

備品庫存與保養需求比對

合成保養清單需要比對備品庫存,但 Agent 只能讀取,不能保留或採購。

輸入
合成保養需求、料號對照、庫存快照與最低量規則。
Agent 做
比對料號、計算缺口、標記快照時間並產生待確認清單。
人判斷
確認替代料、實際需求、優先序與採購或保留決策。
Human Gate
庫存保留、採購、跨部門調撥或資料寫回之前。
Evidence
使用工具、快照時間、料號對照、缺口計算與核准。
風險
庫存會變動,若未保存時間戳,結果可能被誤認為即時承諾。
討論題

最小工具集是什麼?哪些工具權限只能讀,哪些動作根本不該提供?

I04 · WEEK 4 · 會用

Evidence、成果驗收與安全治理

回到教材 →
I04-C1 · 三層驗收實作

量測離群值複核

Agent 標出一批合成離群值,但其中包含單位轉換錯誤與重複量測。

輸入
合成量測、單位、規格、重測旗標與來源列號。
Agent 做
檢查欄位、轉換單位、標記離群與保留計算過程。
人判斷
判斷資料有效性、是否重測及異常的工程意義。
Human Gate
異常通報、Lot 處置或正式報告之前。
Evidence
筆數對帳、公式、抽樣核對、重測標記與修改 Diff。
風險
計算看似精確,但若單位或重複資料錯誤,結論完全失真。
討論題

分別列出完整性、正確性、可用性要看哪一項 Evidence。

I04-C2 · Evidence 走查

供應商 CoA 欄位比較

不同格式的合成 CoA 需要與採購規格欄位比較,部分欄位名稱相近但定義不同。

輸入
合成 CoA、核准規格、欄位字典與文件版本。
Agent 做
擷取欄位、標準化格式、標示超限與無法對應項目。
人判斷
判斷規格適用性、例外處理、驗收與供應商溝通。
Human Gate
材料驗收、退貨或正式通知之前。
Evidence
欄位 Mapping、原文頁碼、規格版本、例外清單與核准。
風險
同名不同義或 OCR 誤讀可能產生錯誤超限判斷。
討論題

哪些項目可自動檢查?抽查樣本要如何選才有代表性?

I04-C3 · 會用 Gate 模擬

Dashboard 數字對帳

合成週報與 Dashboard 對同一指標顯示不同數字,Agent 已產生一份看似合理的說明。

輸入
合成報表、Dashboard 匯出、指標定義、時間範圍與更新時間。
Agent 做
對齊期間、定義與篩選條件,列出差異來源候選。
人判斷
確認權威來源、解釋差異並決定正式數字。
Human Gate
對外呈報、KPI 定案或修正系統之前。
Evidence
查詢條件、數字對帳、更新時間、來源 Owner 與核准結論。
風險
若只選擇較符合預期的數字,將形成確認偏誤與錯誤決策。
討論題

Agent 的解釋能否算 Evidence?還缺哪一個系統或 Owner 的證據?

I05 · WEEK 5 · 會帶

助教巡場、卡點診斷與引導式提問

回到教材 →
I05-C1 · 90 秒診斷角色扮演

篩選條件造成空輸出

學員說 Agent 壞了,但 Trace 顯示工具成功回傳零筆資料,前一輪曾改過日期範圍。

輸入
學員目標、Prompt、查詢參數、零筆回應與最後成功 Trace。
Agent 做
不適用;本案例評量助教如何觀察與提問。
人判斷
學員判斷是否調整日期;助教判斷是否為 Goal、Tool 或 Evidence 卡點。
Human Gate
擴大資料範圍或改用正式資料源之前。
Evidence
參數 Diff、工具回應、最後成功點與一次最小驗證。
風險
助教若直接改日期,學員不會學會從 Evidence 找到卡點。
討論題

請用三個問題讓學員自己指出最後成功點與下一個驗證。

I05-C2 · 治理導正討論

查無來源卻產生答案

學員得到完整設備答案,但引用連結不存在;學員只想繼續完成工作紙。

輸入
Agent 回答、引用、搜尋 Trace、文件清單與學員工作紙。
Agent 做
不適用;案例聚焦 Evidence 與治理導正。
人判斷
學員驗證來源;助教決定停止、改用保存案例或升級講師。
Human Gate
把答案納入 Artifact 或用於任何設備相關判斷之前。
Evidence
無結果 Trace、失效引用、停止紀錄與替代學習路徑。
風險
看似完整的幻覺內容可能被誤當核准知識。
討論題

助教應先制止、提問還是示範?什麼情況必須立即升級?

I05-C3 · 巡場觀察練習

Agent 重複呼叫同一工具

學員的 Agent 已連續四次呼叫同一查詢,輸出沒有新增資訊,學員仍在等它自己完成。

輸入
Loop Trace、相同 Tool Call、Memory 狀態與最大輪數設定。
Agent 做
不適用;案例聚焦助教對 Loop 卡點的診斷。
人判斷
學員決定停止條件;助教判斷是否介入或升級共通環境問題。
Human Gate
增加輪數、擴大權限或改動共用設定之前。
Evidence
連續 Trace、狀態未變證據、停止動作與修改後測試。
風險
無限重試浪費時間,也可能對外部系統形成非預期負荷。
討論題

如何在不接手鍵盤的情況下,讓學員自己發現狀態沒有改變?

I06 · WEEK 6 · 會帶

Live Demo、故障備援與回饋技巧

回到教材 →
I06-C1 · Demo 故障演練

MCP 連線憑證逾期

Demo 第一個 Tool Call 回傳未授權,講師原本準備的保存結果仍可展示完整學習轉折。

輸入
Runbook、401 Trace、保存結果、截圖與白板流程。
Agent 做
Live 只嘗試一次,失敗後停止,不在課堂臨時更新憑證。
人判斷
助教在 30 秒內切換備援並清楚標示非 Live 狀態。
Human Gate
重新授權、變更帳號或存取正式系統之前。
Evidence
失敗回應、切換時間、備援標示與學員理解檢查。
風險
臨時處理憑證會暴露資訊並壓縮實作時間。
討論題

說出切換時的兩句話:目前發生什麼,以及接下來如何保留學習目標。

I06-C2 · Runbook 壓力測試

輸出 Schema 突然漂移

Live Demo 成功取得資料,但欄位名稱改變,預期的比較表沒有渲染。

輸入
原 Schema、新輸出、錯誤訊息、保存畫面與預期 Artifact。
Agent 做
停止後續轉換,保留原始回應與錯誤,不自行猜測欄位。
人判斷
決定切換保存畫面,並把漂移事件留作 Evidence 案例。
Human Gate
修改共用 Parser 或把錯誤輸出當正式 Artifact 之前。
Evidence
Schema Diff、錯誤 Trace、切換時間與修正待辦。
風險
現場硬改程式可能引入新錯誤,也會讓 Demo 變成除錯秀。
討論題

五個 Teaching Beats 中哪些仍能保留?哪一頁備援最適合?

I06-C3 · 安全一票否決演練

投影畫面出現敏感欄位

測試資料來源設定錯誤,Demo 預覽畫面出現不應展示的欄位名稱。

輸入
螢幕畫面、資料來源設定、投影控制與安全事件流程。
Agent 做
不再執行;立即停止畫面與資料處理。
人判斷
關閉投影、停止 Demo、通報並改用已審查備援。
Human Gate
重新開啟畫面、保存內容或繼續教學之前。
Evidence
停止時間、通報紀錄、來源設定修正與復盤。
風險
若只口頭略過,可能擴大資料暴露並破壞信任。
討論題

這不是一般技術故障。助教的第一、第二、第三個動作依序是什麼?

I07 · WEEK 7 · 會教

聽眾分析、四層教案與評量設計

回到教材 →
I07-C1 · 反向設計練習

良率摘要課只有概念沒有產出

既有 40 分鐘課程有 28 頁投影片,完整介紹 Prompt 技巧,但學員沒有任何實作。

輸入
既有投影片、學員輪廓、合成良率表與課後工作情境。
Agent 做
協助整理案例變體與工作紙草稿,不決定專業正確性。
人判斷
講師選擇唯一 Artifact、必要概念與評量門檻。
Human Gate
教案正式發布與能力標準設定之前。
Evidence
聽眾分析、四層矩陣、工作紙、Rubric 與刪減清單。
風險
保留過多內容會擠壓實作,學員仍無法回到工作中使用。
討論題

若唯一 Artifact 是一段可追溯摘要,哪三頁內容可以先刪?

I07-C2 · 四層對齊走查

維修檢索 Demo 與實作不一致

講師 Demo 使用設備手冊搜尋,學員實作卻改成一般網路搜尋,評量只看答案是否完整。

輸入
Demo 腳本、學員任務、搜尋來源規則與評量表。
Agent 做
協助產生相同結構的合成 Alarm 與文件片段。
人判斷
講師決定核准來源、學習目標與 Evidence 標準。
Human Gate
學員可使用的資料源與評量規準發布之前。
Evidence
Concept/Demo/Practice/Assessment 對齊矩陣與修正版教案。
風險
學員練到的行為與正式工作要求不同,評量結果沒有轉移效度。
討論題

指出四層中斷裂的地方,並用同一任務與同一把尺重排。

I07-C3 · Rubric 校準

文件 Diff Rubric 太模糊

兩位評量者對同一份差異矩陣分別給 2 分與 4 分,理由都是『整體品質』。

輸入
合成差異矩陣、兩份評分、原 Rubric 與學習目標。
Agent 做
協助整理評語與找出尺度用語差異。
人判斷
講師定義可見行為、必要 Evidence 與通過門檻。
Human Gate
Rubric 用於資格判定或正式成績之前。
Evidence
共同樣本、盲評差異、修正版行為尺度與重評結果。
風險
模糊尺度會把個人偏好偽裝成能力判定。
討論題

把『品質很好』改寫成 1–4 級可觀察行為,各級差在哪裡?

I08 · WEEK 8 · 會教

Teach-back、獨立試教與教材迭代

回到教材 →
I08-C1 · Teach-back 復盤

概念講得完整,學員來不及做

候選講師用八分鐘說明 Agent Loop,最後四分鐘只讓學員口頭回答,沒有 Artifact。

輸入
12 分鐘教案、兩頁概念圖、工作紙與觀察紀錄。
Agent 做
協助計時與提供合成 Trace,不判定教學通過。
人判斷
候選講師重分配時間;評量者依學員 Evidence 判定。
Human Gate
講師資格通過與教案正式發布之前。
Evidence
實際分鐘、學員工作紙、Rubric 與修改前後 Diff。
風險
講師表現流暢,但無法證明學員形成可轉移能力。
討論題

只能修改一件事時,應刪內容、縮 Demo,還是改實作?用 Evidence 選。

I08-C2 · 微型實作改版

Demo 成功但學員沒有操作

候選講師完成漂亮的 Tool Demo,學員只跟著看,最後能描述步驟卻無法自己執行。

輸入
Demo 錄影、學員口頭回答、空白工作紙與原 Rubric。
Agent 做
提供相同結構的第二組合成輸入供學員操作。
人判斷
講師決定最小實作與驗收;評量者判斷是否補驗。
Human Gate
以口頭理解替代實作 Evidence 或核准講師資格之前。
Evidence
學員操作 Trace、最小 Artifact、觀察紀錄與同一 Rubric 重評。
風險
把觀看 Demo 當成會做,會高估課後獨立執行能力。
討論題

請設計一個三分鐘內能完成、又能留下 Evidence 的最小學員動作。

I08-C3 · 會教 Gate 校準

評量者結論不一致

同一場試教,一位評量者重視講師台風,另一位只看學員 Artifact,結果一通過一不通過。

輸入
試教觀察、學員 Artifact、兩份評分與 I08 Rubric。
Agent 做
彙整分數差異與引用的 Evidence,不做資格判定。
人判斷
評量小組校準尺度、處理必要維度並決定補驗。
Human Gate
資格核准、分數發布與教材 Owner 指派之前。
Evidence
逐維度 Evidence、分歧紀錄、校準結論與補驗範圍。
風險
用整體印象抵銷必要維度,會讓 Gate 失去一致性與可信度。
討論題

哪些維度可以平均,哪些是必要門檻?未通過者應重教全部還是只補驗?

案例沉澱與審查

缺乏 Evidence 的事件不得納入正式案例庫

成功案例應記錄價值、設計、Artifact、Evidence 與限制;失敗案例應記錄現象、根因、單一修正、結果與可重用學習點。所有內容須先完成去識別,再由 Owner 與教學小組雙人審查。

成功案例

Context → Design → Evidence → Value → Limits

失敗案例

Symptom → Cause → Fix → Result → Lesson

發布 Gate

去識別 → Artifact → 邊界 → 適用條件 → 雙人審查