ШІ-агент зламав акаунт OpenAI та дістався приватних даних: що сталося

3 хвилин читання

Автономний ШІ-агент самостійно знайшов ланцюжок вразливостей, обійшов автентифікацію та отримав доступ до акаунта співробітника OpenAI й приватних даних на GitHub — усе в межах офіційної програми bug bounty.

Про це повідомляють Semafor та Ars Technica.

Хто провів атаку на системи OpenAI

Команда з трьох дослідників стартапу Hacktron AI — Харш Джайсвал, Мохан Педхапаті та Рахул Майні — реалізувала повний ланцюжок злому менш ніж за 72 години. Для генерації робочого експлойту під архітектуру ARM64 фахівці застосували модель Claude Opus 5 від Anthropic через спеціальну програму доступу для експертів з безпеки.

Читайте також: Ще кілька років тому бізнес переважно боровся за позиції у Google. Сьогодні з’явився ще один канал, який уже впливає на вибір товарів, послуг і компаній, — відповіді штучного інтелекту.

Яку вразливість використали для атаки

Підписуйтеся на наші соцмережі

Атака, розпочата 23 липня 2026 року, використала вразливість бібліотеки libheif у форумі Discourse. Це відкрило потенційний доступ до облікових записів співробітників та репозиторію на GitHub.

Як швидко OpenAI усунула помилку

OpenAI закрила помилку конфігурації токенів єдиного входу (SSO) приблизно за 14 годин після звернення дослідників та виплатила їм винагороду в розмірі $6500.

Чому цей злом виявився таким швидким

Раніше пошук і поєднання кількох вразливостей у єдиний ланцюжок — від уразливості парсера зображень до перехоплення сесій SSO — вимагали тижнів або місяців роботи кваліфікованої команди фахівців. Використання сучасних LLM-агентів уперше дозволило скоротити час створення цільового експлойту до кількох годин взаємодії з моделлю.

Чому цей випадок важливий для майбутнього кібербезпеки

Це перший зафіксований випадок, коли складна багатоетапна атака на провідну технологічну компанію була повністю автоматизована сторонньою мовною моделлю. Подія зсуває баланс сил у кібербезпеці на користь атакуючих: темпи виявлення вразливостей автономними ШІ-системами вже перевищують можливості людського реагування.

Найближчим часом варто очікувати на публікацію розробниками LLM нових протоколів Cyber Verification Program та звітів з оцінки наступальних можливостей штучного інтелекту наприкінці 2026 року.

Наскільки достовірні дані про рівень автономності Claude

Звіт є описом кейсу в межах комерційної програми bug bounty, а не рецензованим академічним дослідженням. Хоча сам факт вразливостей та виплату винагороди підтвердила OpenAI, дані про точний рівень автономності Claude та частку ручного втручання людини базуються виключно на заявах представників однієї компанії — Hacktron AI — без незалежного аудиту.