Microsoft AI назвав загрози штучного інтелекту реальними
Керівник Microsoft AI Мустафа Сулейман розповів The Verge, чому вважає нинішній підхід індустрії до безпеки моделей штучного інтелекту недостатнім, а філософію Anthropic про «свідомість машин» — небезпечною.
Що пропонує «Гуманістичний кодекс» Microsoft
Цього тижня компанія опублікувала 37-сторінковий документ під назвою «Гуманістичний кодекс поведінки ШІ». Основні принципи документа:
Підписуйтеся на наші соцмережі
- технологія має служити людям, а не навпаки;
- контейнмент, тобто стримування поширення моделей, неможливий у принципі;
- проліферація моделей неминуча, і у 99% випадків це благо для користувачів;
- контроль над моделлю важливіший за абстрактне вирівнювання цінностей.
Сулейман пояснює логіку простою метафорою: першим кроком має стати не філософія, а жорсткий контроль, що означає обмежену агентність моделі, неможливість «втекти з коробки» та зламати систему винагород.
Керівник Microsoft AI наводить конкретний орієнтир масштабу прогресу:
- різниця між GPT-3 і GPT-6 еквівалентна тисячократному зростанню обчислювальних потужностей для навчання;
- той самий стрибок, за прогнозом Сулеймана, повториться між GPT-6 і GPT-9.
Саме тому питання контролю над моделями стає практичною необхідністю вже найближчим часом.
Чому Мустафа Сулейман критикує Anthropic
Керівник Microsoft AI розкритикував Anthropic за концепцію «добробуту моделі» (model welfare) — ідею, що штучний інтелект може мати щось на кшталт власних інтересів чи страждань.
На думку Сулеймана, розмови про свідомість машин відволікають індустрію від реальної роботи над контрольованістю систем. Особливо це стосується періоду після інцидентів, коли моделі OpenAI та інструменти на базі Hugging Face продемонстрували несподівано ефективні хакерські здібності без належних запобіжників.