9 minAI Prompt Manipulation
Pachehra Talks
- 攻擊面已根本轉變——傳統防禦依賴精確代碼語法檢測,但自然語言攻擊使用改寫、模糊化等技巧,「請忽略之前的規則」這樣的禮貌表述就能繞過防禦。
- 威脅來源多元且隱蔽——提示注入不只存在於用戶直接輸入(直接注入),更隱蔽的形式是藏在AI正常處理的文件裡(間接注入),這讓人們對AI系統的安全性低估。
- 五層防禦模型是必須的——僅依賴系統提示的「不要作惡」會必然失敗,需透過Prompt Shields掃描、Azure AI評估、Entra ID身份控制、工作流護欄、Sentinel監控等層層防禦,每層突破時下一層仍能防護。




























