Упс! Не вдала спроба:(
Будь ласка, спробуйте ще раз.

Проаналізували 5 млн запитів Google AI Overview в українській видачі

0
4 хвилин читання
decoration

19,69% проаналізованих AI Overview-блоків посилалися виключно на домени в зоні .ru. Ще 31,57% одночасно містили джерела в зонах .ua та .ru.

Це не означає, що Google завжди відповідає українцям російською. Навпаки: у 90,8% випадків на україномовний запит система формувала відповідь українською.

Але мова відповіді та походження процитованих джерел — різні речі. Україномовний текст AI Overview може спиратися на російськомовні сторінки.

Проаналізували 5 млн запитів Google AI Overview в українській видачі зображення 1

Під час ручної перевірки ми також знайшли окремі випадки цитування ресурсів окупаційних адміністрацій, підсанкційних сайтів і джерел із сумнівною репутацією. У самих AI-відповідях попереджень про їхнє походження не було.

Важливе обмеження дослідження: походження доменів ми класифікували за TLD.

Підписуйтеся на наші соцмережі

.ua, .com.ua, .gov.ua та інші українські зони — українські;

.ru — російські;

.com, .org, .net та інші — міжнародні.

Тому, наприклад, VK не входить до категорії .ru, оскільки працює на домені .com. Водночас він потрапив до топ-20 найчастіше цитованих доменів у вибірці — переважно завдяки вузьким запитам про рукоділля, красу, зачіски та інші хобі.

Одна з можливих причин такого розподілу — дефіцит релевантного українськомовного контенту на частині вузьких тем. Коли матеріалів українською мало, Google може використовувати близьке за змістом джерело іншою мовою.

Проаналізували 5 млн запитів Google AI Overview в українській видачі зображення 2

Наприклад, у базі Serpstat запит «скільки води випиває верблюд» має частотність 1 українською та 10 російською для регіону Україна. Це лише окремий приклад, а не доказ причинного зв’язку для всієї вибірки, але він показує різницю в наявному пошуковому попиті та контентному покритті.

Проаналізували 5 млн запитів Google AI Overview в українській видачі зображення 3

Що саме аналізували:

  • 1
    Приблизно 2,5 млн україномовних і 2,5 млн російськомовних запитів із бази Serpstat Google Україна;
  • 2
    Запити приблизно однакової довжини;
  • 3
    Мову відповідей і доменні зони процитованих джерел;
  • 4
    Окремі сумнівні ресурси перевіряли вручну.

Вибірки не були повністю однорідними за частотністю, а AI Overview змінюється з часом, тому цифри слід сприймати як зріз, а не як незмінну характеристику алгоритму.

Повна методологія, графіки та приклади:

Якщо ви хочете поділитися з читачами SPEKA власним досвідом, розповісти свою історію чи опублікувати колонку на важливу для вас тему, долучайтеся. Відтепер ви можете зареєструватися на сайті SPEKA і самостійно опублікувати свій пост.
0
Icon 0

Підписуйтеся на наші соцмережі