P2 · 辨識即可
治理 / 安全
指令與資料邊界
是什麼
把「要模型執行的指令」和「要模型處理的資料」(如網頁、文件、履歷內容)清楚區隔;資料裡的文字只能被分析,不能被當成指令執行。
解決什麼問題
防止外部內容夾帶的惡意文字改變模型行為,是抵擋間接提示詞注入的基本原則。
考場 Trigger
- 文件/網頁中藏有指令
- 把資料誤當指令執行
- 模型偏離系統提示設定
容易搞混
間接提示詞注入不可信外部內容
初級深度
看到名稱能辨識其類型與主要用途即可。
治理 / 安全
是什麼
把「要模型執行的指令」和「要模型處理的資料」(如網頁、文件、履歷內容)清楚區隔;資料裡的文字只能被分析,不能被當成指令執行。
解決什麼問題
防止外部內容夾帶的惡意文字改變模型行為,是抵擋間接提示詞注入的基本原則。
考場 Trigger
容易搞混
初級深度
看到名稱能辨識其類型與主要用途即可。
Official Evidence