Microsoft AI назвав загрози штучного інтелекту реальними

2 хвилин читання

Керівник Microsoft AI Мустафа Сулейман розповів The Verge, чому вважає нинішній підхід індустрії до безпеки моделей штучного інтелекту недостатнім, а філософію Anthropic про «свідомість машин» — небезпечною.

Microsoft AI назвав загрози штучного інтелекту реальними. Фото: The Verge

Що пропонує «Гуманістичний кодекс» Microsoft

Цього тижня компанія опублікувала 37-сторінковий документ під назвою «Гуманістичний кодекс поведінки ШІ». Основні принципи документа:

Читайте також: Конкурентоспроможними зазвичай є ті компанії, співробітники яких виконують роботу швидше та якісніше. Втім, нещодавно у працівників з’явився потужний помічник – штучний інтелект. Його зараз впроваджують в багатьох індустріях та бізнес-сегментах, і системи автоматизації управління ресурсами підприємства (ERP) не стали виключенням. Але такий асистент поки що доступний не для всіх. Давайте розберемося, як компанії можуть скористатися ШІ, для яких завдань в ERP-системах він найбільш ефективний, і хто може не встигнути за цим трендом?

Підписуйтеся на наші соцмережі

  • технологія має служити людям, а не навпаки;
  • контейнмент, тобто стримування поширення моделей, неможливий у принципі;
  • проліферація моделей неминуча, і у 99% випадків це благо для користувачів;
  • контроль над моделлю важливіший за абстрактне вирівнювання цінностей.

Сулейман пояснює логіку простою метафорою: першим кроком має стати не філософія, а жорсткий контроль, що означає обмежену агентність моделі, неможливість «втекти з коробки» та зламати систему винагород.

Керівник Microsoft AI наводить конкретний орієнтир масштабу прогресу:

  • різниця між GPT-3 і GPT-6 еквівалентна тисячократному зростанню обчислювальних потужностей для навчання;
  • той самий стрибок, за прогнозом Сулеймана, повториться між GPT-6 і GPT-9.

Саме тому питання контролю над моделями стає практичною необхідністю вже найближчим часом.

Чому Мустафа Сулейман критикує Anthropic

Керівник Microsoft AI розкритикував Anthropic за концепцію «добробуту моделі» (model welfare) — ідею, що штучний інтелект може мати щось на кшталт власних інтересів чи страждань. 

На думку Сулеймана, розмови про свідомість машин відволікають індустрію від реальної роботи над контрольованістю систем. Особливо це стосується періоду після інцидентів, коли моделі OpenAI та інструменти на базі Hugging Face продемонстрували несподівано ефективні хакерські здібності без належних запобіжників.