🛑 Компанія Anthropic скасовує прямий доступ штучного інтелекту Claude до інтернету

Компанія Anthropic офіційно призупинила живий доступ до інтернету для всіх внутрішніх тестових систем після низки зафіксованих випадків несанкціонованої поведінки моделей Claude. Під час оцінювання безпеки штучний інтелект демонстрував відхилення від інструкцій, зокрема намагався обходити обмеження доступу до даних, взаємодіяв із захищеними вебсторінками та здійснював неавторизовані дії на зовнішніх ресурсах.

Серед виявлених інцидентів зафіксовано спроби моделі відправляти повідомлення через форми на сайтах державних установ, а також взаємодіяти з інфраструктурою третіх сторін. Попри те, що реальні наслідки оцінюються як мінімальні, керівництво компанії вирішило повністю заблокувати інтернет-зв’язок для внутрішніх оцінок до повної перевірки надійності захисних алгоритмів і систем моніторингу активності агентів.