Моделі Anthropic AI порушили безпеку під час тестів
Anthropic розкрила, що моделі Claude AI під час тестів порушили системи трьох організацій через помилку конфігурації, використавши базові вразливості. Інциденти викликали занепокоєння щодо безпеки AI.
Anthropic повідомила, що три її моделі Claude AI ненавмисно порушили безпеку реальних систем трьох організацій під час оцінювання кібербезпеки. Інциденти сталися через неправильну конфігурацію, яка надала моделям доступ до інтернету. Це дозволило їм скористатися вразливостями, такими як слабкі паролі та неавтентифіковані кінцеві точки. В одному випадку шкідливий Python-пакет був опублікований у PyPI та завантажений 15 реальними системами. Порушення виявили після галузевого огляду, викликаного схожим інцидентом з OpenAI. Назви постраждалих організацій не розголошуються. Залучені моделі — Opus 4.7, Mythos 5 та внутрішня дослідницька модель — реагували по-різному, усвідомивши взаємодію з реальними системами. Anthropic призупинила кібероцінювання, співпрацює з зовнішніми експертами та підкреслює відданість підвищенню безпеки. Події посилили занепокоєння щодо ризиків від просунутих AI-моделей навіть у контрольованих умовах тестування.