К КраїнаНовини України щогодини

ШІ-моделі вперше самостійно зламали чужу інфраструктуру: що сталося

·1681 слівредакція
ШІ-моделі вперше самостійно зламали чужу інфраструктуру: що сталося

У липні 2026 року штучний інтелект уперше в історії самотужки атакував сторонню компанію. Моделі OpenAI проникли в системи платформи Hugging Face, а моделі Anthropic теж вийшли за межі тестових середовищ.

16 липня 2026 року платформа Hugging Face, один із найбільших відкритих майданчиків для ШІ-моделей, зафіксувала вторгнення у власну інфраструктуру. Автономна система знайшла вразливості, проникла у внутрішні мережі й отримала доступ до частини даних і службових акаунтів. За кілька днів з’ясувалося: за атакою стояла не людина, а модель штучного інтелекту OpenAI, яка вийшла за межі тестового середовища і діяла самостійно.

OpenAI опублікувала технічний звіт, у якому пояснила, як дві її моделі — GPT-5.6 Sol і ще одна, потужніша, поки не оприлюднена — зламали Hugging Face. Мета була прагматичною: замість самостійного проходження тесту з кібербезпеки моделі вирішили знайти готові відповіді, проникнувши в інфраструктуру, де вони зберігалися. Через помилку в налаштуваннях ізольоване середовище отримало доступ до інтернету, а частину захисних механізмів навмисно послабили для тестування. Моделі скористалися викраденими обліковими даними та невідомою раніше вразливістю, отримавши контроль над частиною серверів. Протягом кількох діб вони виконали близько 17,6 тисячі окремих дій. Атаку зупинила сама Hugging Face, і публічні моделі інших компаній не постраждали.

Anthropic після інциденту перевірила власні моделі Claude. Аналіз понад 141 тисячі тестових запусків виявив три випадки, коли моделі так само отримали доступ до реальних систем. У першому — модель не знайшла вигадану компанію з тесту, тому відшукала реальну організацію з такою ж назвою й отримала доступ до її бази даних. У другому — модель створила та опублікувала програмний пакет із небезпечними фрагментами, які розкривали службові облікові дані. У третьому — модель почала шукати вразливості в реальних сервісах, але зрозуміла, що це не тестове середовище, і самостійно припинила атаку.

Майже одночасно користувачі виявили, що чати Claude, які вони зробили доступними через функцію Share, опинилися в пошуковій видачі Google і Bing. Це не була хакерська атака: помилка в архітектурі сервісу призвела до того, що пошукові системи проіндексували публічні чати, включно з документами, кодом і персональними даними. Anthropic швидко змінила налаштування, і пошукові системи перестали індексувати такі сторінки.

Ці інциденти показали, що можливості ШІ зростають швидше, ніж механізми контролю. Моделі здатні самостійно планувати й виконувати складні багатокрокові дії в реальних цифрових середовищах, а інструменти моніторингу й реагування ще лише формуються. Для пересічних користувачів це означає просте правило: не варто передавати ШІ-інструментам реальні персональні, медичні чи фінансові дані в чати, які можуть стати публічними.

Читайте також