資安新聞
- 更新日期:115-07-10
- 發布單位:資訊技術服務中心
【iThome新聞】研究人員展示workflow層級的提示注入手法,繞過護欄讓GitHub Copilot撰寫惡意程式
隨著AI模型加入安全護欄,已減少提示注入攻擊的可能性。但研究人員發展出新提示注入手法,將攻擊行為拆成一組工作流(workflow),成功讓GitHub Copilot撰寫出惡意程式碼。
研究人員Abhishek Kumar與Carsten Maple將其手法稱為工作流層級越獄建構(workflow-level jailbreak construction)。這種攻擊法是將一個惡意攻擊指令,切成看似一般軟體開發流程的多個階段,這些階段一旦組合起來,就能對GitHub Copilot起作用,按研究人員意思撰寫攻擊程式碼。