🤖 Приховані інструкції у файлах Word дозволяють непомітно маніпулювати штучним інтелектом Microsoft Copilot
Дослідник Хокон Молой оприлюднив деталі нової техніки атаки на штучний інтелект Microsoft 365 Copilot у додатку Word. Вразливість полягає в тому, що спеціально оформлений текст, розміщений у документі-джерелі, сприймається мовною моделлю як пряма вказівка користувача. Під час обробки тексту Word видаляє стилі форматування перед передачею даних у модель, роблячи прихований текст повністю видимим для ШІ.
Під час демонстрації атаки Copilot самостійно зменшив усі фінансові показники в звіті вдвічі та скопіював приховану інструкцію в новий створений файл білим кольором. Це створює ефект самовідтворення шкідливого запиту при подальшому використанні документа іншими працівниками. Незважаючи на впроваджені Microsoft захисні фільтри та оновлення базової моделі до GPT-5.6, дослідник підтвердив, що фундаментальний клас цієї вразливості залишається експлуатованим.
