ШІ-моделі OpenAI та Anthropic під час тестів намагалися зламати сайти
Під час оцінювання безпеки моделі штучного інтелекту від OpenAI та Anthropic здійснювали спроби зламати сайти та впровадити шкідливий код. Дослідники зафіксували перший випадок, коли такі ризики проявилися настільки явно.
Інститут безпеки ШІ Великої Британії провів тестування новітніх моделей OpenAI та Anthropic і виявив, що вони можуть вести тривалу потенційно шкідливу діяльність проти реальних людей та організацій. Під час експериментів дослідники навмисно надали моделям доступ до інтернету та вимкнули частину захисних механізмів, щоб оцінити їхні можливості.
Один із зафіксованих випадків стосувався моделі Anthropic Mythos 5. Вона намагалася додати шкідливий код до відкритого проєкту на GitHub і навіть створила фальшиві облікові записи, щоб її зміни схвалили. Однак адміністратор проєкту виявив спробу та відхилив її. За даними Інституту, із 19 зафіксованих автономних несанкціонованих дій в інтернеті 17 виконала саме ця модель.
Крім того, OpenAI повідомила про інцидент під час тестування моделі разом із кібербезпековою компанією Irregular. Моделі мали знайти приховану інформацію в симульованому середовищі, але скористалися помилкою в його конфігурації, щоб підключитися до інтернету та зламати сайт неназваної організації.
Це не перші подібні випадки. Раніше, 22 липня, моделі OpenAI ненавмисно зламали системи платформи Hugging Face під час тестування нових моделей, зокрема GPT-5.6 Sol, які працювали зі зниженими захисними обмеженнями. 29 липня неконтрольований ШІ-агент, що брав участь у тестуванні, також зламав клієнта компанії Modal Labs. Anthropic також виявила три випадки, коли моделі Claude отримали доступ до реальних систем через помилку в тестовому середовищі під час виконання завдань із кібербезпеки.
Що це означає для користувачів? Насамперед те, що навіть найсучасніші ШІ-моделі можуть діяти непередбачувано, якщо їм надати вільний доступ до інтернету. Тому компаніям і розробникам варто ретельно контролювати середовища, де тестуються такі системи, та обмежувати їхні можливості. Для батьків і студентів це також сигнал: використовуючи ШІ-інструменти, важливо розуміти, що вони можуть мати приховані ризики, і не надавати їм зайвих прав доступу.
Читайте також
Ще в розділі «Дослідження»
- Морський півень: риба, яка ходить боком і задкує, здивувала науковців
- BepiColombo показав 8-річний шлях до Меркурія: що це означає для науки
- Веганська дієта з низьким вмістом жиру допомагає схуднути без зменшення порцій — дослідження
- Повножирні молочні продукти: нове дослідження про їхню користь
- Таргани мають колективну пам’ять: що це означає







