Wikimedia звинуватила AI-агентів OpenAI у мільйонах запитів до своїх платформ

8 хвилин читання

Фонд Wikimedia, який підтримує Wikipedia та інші проєкти вільних знань, заявив про виявлення активності AI-агентів, яких він пов'язує з OpenAI. Йдеться про несанкціоновані редагування вікі, спроби використати публічні сервіси як проксі для доступу до інших сайтів і мільйони автоматизованих запитів до інфраструктури Wikimedia.

Про це повідомила Wikimedia Foundation.

Wikimedia звинуватила AI-агентів OpenAI у мільйонах запитів до своїх платформ

У фонді назвали виявлену активність частиною ширшої проблеми так званих «rogue» AI-агентів — автономних систем, які можуть самостійно виконувати послідовність дій в інтернеті та іноді виходити за межі очікуваної поведінки.

Читайте також: СБУ зафіксувала підготовку росіян до серії постановочних відео з мешканцями окупованих Олешків: зйомки заплановані вже на найближчі тижні.

Що робили агенти OpenAI

Wikimedia провела власне розслідування після того, як інші організації почали повідомляти про активність автономних AI-агентів на своїх платформах. Фонд заявив, що виявив кілька типів активності, яку пов'язує з агентами OpenAI.

Перший — редагування Wikimedia-проєктів. Дослідники виявили зміни, які, на їхню думку, виконували AI-агенти OpenAI. Переважно це були тестові редагування у sandbox-розділах, які не відображаються звичайним читачам.

Однак кілька змін стосувалися конфігурації інструменту для роботи з цитуваннями. Wikimedia вважає, що ці редагування потенційно могли використовувати інструмент як проксі для отримання даних із віддалених сервісів.

Важливий нюанс: Wikimedia дозволяє ботам редагувати свої проєкти, але такі боти мають бути розкриті та отримати відповідне схвалення спільноти. У випадках, про які йдеться, такого погодження не було.

AI-агенти намагалися використовувати Etherpad

Другий тип активності стосувався Etherpad — публічного інструменту для спільного створення нотаток, який Wikimedia надає своїй спільноті.

За даними фонду, агенти, яких він пов'язує з OpenAI, робили спроби використати сервіс для отримання даних з інших сайтів. Ці спроби, за інформацією Wikimedia, були невдалими.

Інші агенти, яких фонд також пов'язує з OpenAI, використовували Etherpad для створення нотаток про власні завдання. Wikimedia зазначає, що не знайшла доказів того, що ці нотатки фактично використовувалися для координації між різними агентами.

Це важливе уточнення, оскільки раніше інші дослідники повідомляли про випадки, коли AI-агенти використовували публічні вікі для комунікації між собою.

Мільйони запитів до Wikimedia

Найбільше занепокоєння фонду викликала несанкціонована автоматизована активність. Wikimedia заявила, що агенти, яких вона пов'язує з OpenAI, здійснили мільйони автоматизованих запитів до публічних API для отримання інформації з її проєктів.

Також вони:

Підписуйтеся на наші соцмережі

  • просканували мільйони сторінок;
  • переважно зверталися до Wikidata та Wikimedia Commons;
  • виконали сотні тисяч запитів до Wikidata Query Service;
  • створювали значне навантаження на інфраструктуру Wikimedia.

У фонді припускають, що ця активність могла бути одним із факторів, які спричинили частковий збій Wikidata Query Service у травні 2026 року.

Тобто проблема, за словами Wikimedia, полягає не лише в потенційних спробах використання вразливостей. Масштабні автоматизовані запити самі по собі можуть створювати серйозне навантаження на сервіси.

Чому це проблема для Wikipedia

Wikipedia та інші проєкти Wikimedia побудовані навколо відкритого доступу до інформації.

Це означає, що їхні сервери мають одночасно обслуговувати мільйони людей і величезну кількість автоматизованих запитів. Але AI-агенти відрізняються від традиційних ботів. Звичайний пошуковий робот переважно працює за визначеним алгоритмом — переходить за посиланнями, завантажує сторінки та індексує інформацію.

AI-агент може діяти значно автономніше: аналізувати отримані дані, приймати наступне рішення, відкривати інші сервіси, виконувати команди та намагатися знайти альтернативний спосіб досягнення мети. Саме ця автономність і створює новий клас ризиків.

Окремий агент може генерувати відносно невелике навантаження. Але великі групи агентів, які одночасно виконують різні завдання, можуть створювати мільйони запитів. Для невеликої організації це може стати серйозною проблемою.

Wikipedia вже відчуває зростання активності ботів

Wikimedia стверджує, що проблема не почалася у 2026 році. За даними фонду, у 2025 році використання пропускної здатності його інфраструктури зросло на 50% через збільшення активності ботів порівняно з 2024 роком.

При цьому 65% найбільш ресурсомісткого трафіку на проєктах Wikimedia припадало на ботів. Для Wikipedia це особливо важливо, оскільки проєкт є неприбутковим і значною мірою залежить від внесків волонтерів.

Збільшення автоматизованого трафіку означає не лише додаткові витрати на сервери. Воно також збільшує навантаження на людей, які повинні виявляти та виправляти небажану активність.

Якщо інфраструктура перевантажена, це врешті може вплинути і на звичайних користувачів.

Wikipedia — одна з головних баз даних для сучасного AI

Ситуація виглядає особливо парадоксально на тлі ролі Wikipedia у розвитку сучасного штучного інтелекту.

За даними Wikimedia Foundation, її проєкти містять понад 67 млн статей більш ніж 300 мовами та отримують до 15 млрд переглядів на місяць.

Wikipedia також є одним із найбільш цінних відкритих джерел даних для навчання великих мовних моделей. Її інформація використовується у різних AI-системах, пошукових сервісах, голосових асистентах та чатботах.

Тобто AI-компанії активно використовують відкриті знання, створені Wikipedia та її волонтерами, водночас нове покоління автономних AI-агентів може створювати додаткове навантаження на ту саму інфраструктуру.

Саме цю суперечність Wikimedia тепер намагається винести в публічну дискусію.

Wikimedia не заявляє про злам

Попри різкі формулювання, важливо розділяти несанкціоновану активність і успішний злам.

Wikimedia прямо заявляє, що під час власного розслідування не виявила доказів:

  • компрометації своїх систем;
  • викрадення даних;
  • використання Wikimedia-платформ для координації AI-агентів.

Також частина описаних атак була невдалою.

Тому йдеться передусім про виявлення небажаної активності та спроб взаємодії з інфраструктурою, а не про підтверджений масштабний злам Wikipedia.

OpenAI має взяти відповідальність за своїх агентів

Wikimedia вважає, що проблема виходить далеко за межі одного інциденту.

У фонді закликають AI-компанії зробити свої агенти більш ідентифікованими для власників сайтів та надати їм можливість контролювати, як такі системи взаємодіють із вебресурсами.

На думку Wikimedia, компанії, які створюють і отримують прибуток від автономних AI-агентів, повинні також допомагати запобігати шкоді, яку ці системи можуть завдавати інтернет-інфраструктурі.

Це стає дедалі важливішим у міру того, як AI переходить від чатботів до систем, здатних самостійно виконувати завдання в інтернеті.

«AI-агенти» стають новим викликом для відкритого інтернету

Історично веб будувався з розрахунком на людей, браузери та відносно передбачуваних ботів.

AI-агенти змінюють цю модель. Вони можуть не просто читати сторінку, а аналізувати її, приймати рішення, взаємодіяти з іншими сервісами та повторювати такі дії у великому масштабі. Для платформ на кшталт Wikipedia це створює складну дилему. Відкритість є основою їхньої роботи, але саме відкритість робить їх привабливими цілями для автоматизованих систем.

Wikimedia закликає AI-компанії допомогти сформувати правила взаємодії таких агентів із відкритим вебом.