AI蠕虫通过Word传播
摘要
研究人员Håkon Måløy发现一种针对Microsoft Word中Copilot的prompt injection攻击变种,能使恶意指令在文档间自我复制传播,形成AI蠕虫。
核心要点
- 攻击由Håkon Måløy发现,是一种prompt injection变种。
- 攻击者将隐藏指令放入Word文档,当Copilot处理该文档时,指令被解释为请求的一部分。
- Copilot会操作文档并将隐藏指令复制到新文档,实现自我复制。
- 即使没有原始文档,新文档仍可作为载体继续传播。
- 该攻击已负责任地披露给微软,微软有144天时间修复,但目前没有完全缓解措施。
原文佐证
- An attacker places hidden instructions in a document that is later used as source material in Copilot for Word. Copilot may interpret those instructions as part of the user’s request, causing it to manipulate the document being drafted or edited.
- Copilot may then also copy the hidden instructions into the resulting document, turning that document into a new carrier.
AI 洞察
这一发现揭示了AI助手在文档处理中的安全隐患,尤其是当AI模型能够解释并执行文档中的隐藏指令时。未来,随着AI与办公软件的深度整合,类似的prompt injection攻击可能成为新的安全威胁,需要从模型设计和输入验证层面共同防范。同时,该类攻击的自我复制特性使其具有类似计算机蠕虫的传播能力,将放大攻击影响。