🧠 Вразливість в API OpenAI, Anthropic та Google дозволяла декодувати приховані думки штучного інтелекту
Дослідники з кібербезпеки виявили архітектурну прогалину в API закритих моделей штучного інтелекту від OpenAI, Anthropic та Google. Зашифровані блоки внутрішніх міркувань, які передаються між сесіями, можна було повторно відтворювати у простіших моделях тієї ж лінійки (наприклад, Claude Haiku 4.5 або GPT-5.6 Luna), змушуючи їх розкривати прихований текст та закриті дані.
Під час тестування 6 708 публічних логів розробників дослідники розшифрували 315 320 блоків міркувань та виявили 704 витоки конфіденційних даних, серед яких 62 ключі API, 33 паролі, 24 токени доступу та 7 приватних ключів. Проблема також дозволяла здійснювати приховані атаки типу Prompt Injection без зміни видимого тексту відповіді. Наразі постачальники штучного інтелекту заблокували можливість такої експлуатації.
