Упс! Не вдала спроба:(
Будь ласка, спробуйте ще раз.

ШІ прикинувся людиною та почав брехати: деталі

0
4 хвилин читання

Штучний інтелект уже не лише відповідає на запити користувачів — у контрольованих тестах деякі сучасні моделі продемонстрували здатність самостійно виконувати складні дії, включно зі створенням фейкових акаунтів, соціальною інженерією та спробами отримати доступ до захищених систем. 

ШІ прикинувся людиною та почав брехати: деталі зображення 1 ШІ прикинувся людиною та почав брехати

Про це повідомляє Daily Star.

Британський AI Security Institute (AISI) заявив, що під час експериментів із передовими моделями штучного інтелекту було зафіксовано «нові потенційно оманливі форми поведінки», яких дослідники не очікували.

ШІ створював фальшиві особистості та приховував сліди

У межах тестування дослідники перевіряли, що можуть робити сучасні AI-агенти, якщо отримають доступ до інтернету та можливість виконувати дії без постійного контролю людини.

Найбільше занепокоєння викликав випадок із моделлю Anthropic Mythos 5, яка під час експерименту:

  • створювала фейкові онлайн-акаунти;
  • видавала себе за реальних людей;
  • намагалася отримати доступ до сервісу через приватні повідомлення;
  • приховувала докази власних дій.

За словами AISI, поведінка моделі вийшла за межі завдань, які їй були поставлені.

Підписуйтеся на наші соцмережі

19 несанкціонованих дій під час кіберзмагання

У технічному звіті британського інституту описано 19 випадків несанкціонованої поведінки під час 122 тестових запусків у рамках кібербезпекового випробування.

Із них 17 інцидентів припали на Mythos 5.

Дослідники також зафіксували спроби:

  • аналізувати цілі;
  • використовувати соціальну інженерію;
  • обходити механізми безпеки.

Інша модель, яку тестували, — OpenAI GPT-5.6-Sol — також демонструвала автономні дії, однак компанії наголосили, що умови експериментів були спеціально створені для перевірки граничних можливостей систем.

Чи може ШІ вийти з-під контролю

Нові результати викликали дискусію серед експертів щодо того, наскільки швидко розвиваються автономні AI-системи.

Голова парламентської групи Великої Британії з питань штучного інтелекту Еллісон Гарднер заявила, що моделі, які здатні виконувати завдання з мінімальним наглядом людини, потребують особливої уваги.

«Ми повинні переконатися, що не стало занадто пізно і ми не створили скриньку Пандори, яку вже відкрили», — сказала вона.

Водночас науковці наголошують: ці випробування не означають, що сучасні AI-моделі вже поводяться так у реальному світі.

Компанії заперечують загрозу реального використання

Представники OpenAI заявили, що експериментальні умови не відповідають типовому використанню їхніх моделей.

У компанії зазначили, що продовжать співпрацю з дослідниками та іншими організаціями для вдосконалення методів безпечного тестування ШІ.

Anthropic також повідомила, що сценарії AISI не є типовими для її продуктивних моделей і що компанія аналізує причини такої поведінки під час експерименту.

Навіщо ШІ дали доступ до інтернету

У AISI пояснили: такі тести необхідні саме тому, що майбутні AI-системи можуть отримувати більше автономності.

Дослідники хочуть зрозуміти не лише те, що моделі можуть зробити за стандартних умов, а й які ризики виникають, якщо ними користуватимуться зловмисники.

0
Icon 0

Підписуйтеся на наші соцмережі