Михайло Федоров про суверенну LLM-модель для України

2 хвилин читання

4 листопада відбувся WINWIN Summit 2025. Представники держави, бізнесу, суспільства та партнери з різних країн об'єдналися для обговорення питань цифровізації України, укладення партнерств та прем'єрного ознайомлення зі стратегією цифрового розвитку інновацій України WINWIN до 2030 року.

SPEKA взяла ексклюзивне бліцінтерв'ю у Михайла Федорова, першого віцепремʼєр-міністра України — міністра цифрової трансформації України. Він розповів про українську LLM-модель: як працюватиме, донавчатиметься та відрізнятиме фейки від правдивої інформації.

Михайло Федоров ексклюзивно для SPEKA розповів як працюватиме українська LLM та як відрізнятиме дезінформацію від правди. Фото: Мінцифри

На IT-арена 2025 ви анонсували, що один із ключових векторів розвитку — створення суверенної LLM-моделі. Які кроки вже зроблені та що вкладаєте у це поняття?

Підписуйтеся на наші соцмережі

Читайте також: Генеративний пошук поступово змінює те, як люди знаходять бренди, порівнюють рішення і приймають рішення про покупку. Масштаб зсуву вже вимірний: аналіз 2,3 млрд користувацьких сесій за 2024-2025 роки показав, що трафік з AI-чатів зріс на 796% за два роки, а конвертується він на рівні 14,2% проти 2,8% у Google – приблизно в п'ять разів ефективніше. Одночасно 60% пошуків у традиційних системах завершуються взагалі без кліку: користувачеві вистачає AI-відповіді. В Україні 85% людей користуються штучним інтелектом постійно або час від часу, а 12% – щодня, що порівнянно з показником США.

Суверенна LLM-модель для України — це якраз те, що ми зараз робимо з «Київстаром». Ми вже зробили всі організаційні речі, обрали технічні рішення, працюємо над моделлю, яка добре розумітиме український контекст і її можна буде використовувати для державних та бізнесових продуктів. Вона буде добре розуміти історію України, розмовлятиме українською, добре знатиме наш локальний контекст. Це гарна зброя проти російської пропаганди, тому що ми зможемо правдиво відповідати на будь-які питання щодо нашої ідентичності.

Ця LLM-модель буде постійно оновлюватись, донавчатись у процесі?

У неї буде відкритий код, ми зробимо її доступною для всіх, її будуть всі розвивати. Модель будуть використовувати в університетах, ми зараз навчаємо її на контенті з бібліотек, які ми зібрали через уряд.

Надалі вона буде постійно оновлюватися. Плюс ми її будемо розгортати на інфраструктурі, яку ми також зараз будуємо — AI Factory, тому це така екосистема. Це позитивно вплине на ринок кадрів, тому що університети долучатимуться до цієї програми. Тобто ціль — розвивати спільноту.

Багато російської дезінформації подається під виглядом новин. Як LLM-модель фільтруватиме це, щоб навчатися на правдивих даних, а не на дезінформації?

Для цього є комітет етики, який працює на базі нашої групи. Його завдання — сформувати правила, як навчати та як зробити, щоб це було об'єктивно, щоб не було перегинів у той чи інший бік тощо.