P2 · 辨識即可
治理 / 安全
不可信外部內容
是什麼
不可信外部內容是模型會讀取、但來源不受控的資料,例如網頁、上傳文件、電子郵件或工具回傳結果,裡面可能夾帶惡意指令或錯誤資訊。
解決什麼問題
這類內容只能當資料處理、不能當指令執行,否則模型可能被間接操控或洩漏機密。
考場 Trigger
- 讀取外部網頁或文件
- 內容中藏有指令
- 忽略使用者原始指令
容易搞混
間接提示詞注入指令與資料邊界提示詞注入
初級深度
看到名稱能辨識其類型與主要用途即可。
治理 / 安全
是什麼
不可信外部內容是模型會讀取、但來源不受控的資料,例如網頁、上傳文件、電子郵件或工具回傳結果,裡面可能夾帶惡意指令或錯誤資訊。
解決什麼問題
這類內容只能當資料處理、不能當指令執行,否則模型可能被間接操控或洩漏機密。
考場 Trigger
容易搞混
初級深度
看到名稱能辨識其類型與主要用途即可。
Official Evidence