P2 · 辨識即可
治理 / 安全
指令與資料邊界
是什麼
Direct Injection = 使用者提示直接攻擊;Indirect Injection = 惡意指令藏在模型讀取的文件、網頁、郵件或工具回傳中。
解決什麼問題
這題考惡意指令不是由使用者直接輸入,而是藏在模型讀取的網頁或文件中,因此屬間接 Prompt Injection。
考場 Trigger
- 看到『外部網頁/文件藏指令,模型讀到後被操控』→ Indirect Prompt Inje…
初級深度
看到名稱能辨識其類型與主要用途即可。