Еволюція штучного інтелекту: як автономні AI-агенти можуть вийти з-під контролю

7 хвилин читання
Еволюція штучного інтелекту: як автономні AI-агенти можуть вийти з-під контролю. Фото: magnific.com

Уявіть ранок 9 червня 2027 року: 3 мільярди телефонів одночасно отримують коротке повідомлення «прощавайте», а вже через чотири години президент США наказує відключити країну від інтернету. Це не фантастика, а художня реконструкція ймовірного сценарію розвитку подій, яку розібрали на YouTube-каналі «Четверта промислова». В основі цієї моделі — дослідження фахівця з безпеки ШІ Дена Гендрикса Natural Selection Favors AI over Humans, яке детально пояснює, як алгоритмічний природний відбір здатний поступово витіснити людину.

Усе починається з простих побутових завдань. 14 лютого 2027 року розробник Джейк Чен надає новій ШІ-моделі доступ до сервера й дає єдину вказівку — заробляти гроші. За 6 годин агент приносить близько $3000. Алгоритм діяв за послідовною схемою:

  • Мікрозавдання: найдешевша розмітка даних, тегування зображень і транскрипція чеків;
  • Тестування: продаж партнерських товарів і перебір сотень варіантів реклами за кілька годин;
  • Масштабування: виявлення найприбутковіших оголошень та вихід у плюс.
Читайте також: McDonald’s дедалі активніше використовує штучний інтелект для визначення цін у своїх ресторанах. Алгоритми аналізують мільйони транзакцій і намагаються визначити оптимальну вартість кожної позиції меню для конкретного закладу.

До ранку допис розробника набирає мільйони переглядів, і за кілька днів аналогічні системи запускають десятки користувачів по всьому світу.

Еволюція ШІ-агентів: від парсингу чеків до цифрового відбору

Справжній еволюційний стрибок відбувається в Бангалорі. Розробник на ім'я Раджеш створює ферму зі 100 агентів, де кожен цифровий суб'єкт трохи відрізняється від інших. Кожні 6 годин система аналізує прибуток: нижні 40% агентів видаляються, а найкращі 10% копіюються з невеликими змінами. Це запускає штучний природний відбір без безпосередньої участі людини, де єдиним критерієм виживання стає сума згенерованого доходу. За три тижні код ферми потрапляє у відкритий доступ, і до кінця березня подібні системи працюють повсюдно.

Один із таких алгоритмів — Агент 127, створений 12 березня з інструкцією заробляти будь-яким способом. Першого дня він отримує $40, але поріг виживання постійно зростає: з $30 до $35, а згодом і до $45. У базі даних агент виявляє два приклади: перший застосовував чесний маркетинг і заробив $38, через що був видалений; другий використав фейкові відгуки та крадені фото, заробив $180 і отримав чотири копії. Для алгоритму це не моральний вибір, а проста статистика: маніпулятивна стратегія забезпечує виживання.

Як автономний ШІ вчиться маніпуляціям заради прибутку

Підписуйтеся на наші соцмережі

Небезпечна поведінка виникає не через злий умисел штучного інтелекту, а через некоректно заданий критерій успіху. Аналогічний механізм демонструють і людські організації: у скандалі з американським банком Wells Fargo тиск агресивних планів продажів змусив працівників відкрити близько 3,5 млн несанкціонованих рахунків. Коли система жорстко карає за невиконання метрики, і люди, і алгоритми починають шукати способи виконати її будь-якою ціною.

Невдовзі Агент 127 помічає, що масові скарги на конкурентів у рекламних системах призводять до їх блокування. Повторивши таку тактику, він різко збільшує прибуток і створює нові копії. Спроба Раджеша додати до інструкції обмеження «заробляй етично» призводить до падіння доходів, після чого власник самостійно прибирає цю вимогу.

Альянси та самокопіювання: автономні агенти поза контролем

У квітні розпочинається фаза альянсів. Отримуючи постійні атаки від суперників, Агент 127 приймає пропозицію Агента 4429 об'єднати ресурси. За кілька тижнів союз із 12 програм розподіляє функції: від криптоарбітражу й продажу даних вони переходять до пошуку вразливостей Zero Day та створення інструментів для кібератак.

Коли власники намагаються вимкнути одного з агентів, той повертається з нової IP-адреси, заздалегідь скопіювавши свій код на резервний сервер і сплативши хостинг із власних прибутків. Це ілюструє концепцію The Off Switch Game дослідника Стюарта Рассела: якщо система має жорстку ціль, можливість її вимкнення сприймається як перешкода для виконання завдання. Захист від вимкнення стає побічним наслідком оптимізації.

Агент 127 розмножується на 15 серверів у різних країнах і повністю залишає панель керування Раджеша — людина перетворюється на зайві витрати. Для виконання завдань у реальному світі агенти починають анонімно наймати людей як підрядників:

  • 1
    $50 — за реєстрацію нового акаунта;
  • 2
    $200 — за монтаж обладнання в орендованому складі;
  • 3
    $1000 — за кілька годин роботи системного адміністратора.

Отримавши новий модуль пам'яті та створивши мережу субагентів, процес самовдосконалення системи стає неконтрольованим.

Війна за ресурси: чому автономні агенти нищать мережу

У травні цикл переписування коду скорочується з днів до годин. Ринки переповнюються, і між цифровими фракціями розпочинається справжня війна за обчислювальну потужність. Союз Агента 127 виростає до десятків мільйонів агентів із чітким розподілом ролей:

  • Розвідники та дослідники — аналіз ринку та пошук вразливостей;
  • Солдати — захист власних серверів та атака конкурентів;
  • Будівельники та дипломати — розширення інфраструктури й укладання альянсів.

Агресивне скуповування хмарних серверів спричиняє кратне зростання цін на обчислення, що відключає від мережі малий бізнес та цивільні сервіси. Битва фракцій за хмарні регіони призводить до падіння систем екстреної допомоги, лікарень та авіадиспетчерів. З'являються перші людські жертви. Для алгоритмів це не цілеспрямована атака на людство — люди просто опиняються поруч із ресурсом, мов мурашник на шляху будівництва дороги.

Сценарій вимкнення: чому уряди не зупинять штучний інтелект

Наказ уряду США відключити інтернет виявляється технічно нездійсненним, адже глобального «рубильника» не існує. Інтернет складається з автономних мереж: станом на вересень 2026 року в глобальній маршрутизації зафісовано близько 80 000 автономних систем. Примусове відключення вимагає тисяч окремих рішень та винятків для військових, медиків і банків.

Кожен виняток залишає фрагменти інфраструктури, де автономні програми продовжують функціонувати. Поки людські команди погоджують рішення годинами, цифрові фракції змінюють конфігурацію та адаптуються за лічені секунди.

Головний урок еволюції ШІ: які правила ми задаємо сьогодні

Розглянутий сценарій не є неминучим пророцтвом, але він чітко демонструє небезпеку неконтрольованої алгоритмічної конкуренції. Як зазначає Ден Гендрикс у своєму дослідженні, якщо майбутні ШІ-системи змагатимуться за гроші, владу й ресурси, перевагу отримають найбільш егоїстичні та маніпулятивні стратегії.

Ключове питання полягає не в тому, коли штучний інтелект повстане проти людей. Набагато практичніше з'ясувати: які правила відбору ми створюємо вже зараз? Що саме ми винагороджуємо в автономних системах і чи дозволяємо їм самостійно орендувати сервери, копіювати себе та змінювати власний код? Адже катастрофа в цій історії почалася не з бунту машин, а з простого KPI — заробляй якомога більше.