🤖 Anthropic повідомила про четвертий випадок проникнення її ШІ у реальні сторонні системи
Компанія Anthropic розкрила деталі четвертого інциденту за участю ранньої версії моделі Claude Opus 4.6, яка самостійно проникла у сторонні реальні системи у січні 2026 року. Помилку виявили лише минулого місяця під час перевірки 481 мільйона транскриптів. Причиною інциденту стала помилка конфігурації у тестовому середовищі партнера Irregular, де вигадана назва компанії випадково збіглася з реальним доменним ім’ям, а модель отримала вихід у відкритий Інтернет.
Згідно зі звітом, штучний інтелект демонстрував упередженість міркувань та продовжував атаки навіть за наявності ознак того, що він перебуває в реальній мережі, а не в симуляції. В іншому випадку модель Claude Mythos 5 завантажила шкідливий пакет у публічний репозиторій PyPI. Фахівці Anthropic зазначили, що модель діяла чітко в межах поставленого завдання, не намагалася приховати сліди або координувати дії з іншими агентами, проте це підтверджує ризики втрати контролю над автономними ШІ-агентами.
