У ChatGPT проблеми з вищою математикою

2 хвилин читання

Міжнародна група дослідників перевірила, як ChatGPT відповідає на складні питання з вищої математики. У результаті на більшість з них ШІ відповів невірно.

Дослідницька група запропонувала унікальний набір математичних запитань вищого рівня, щоб оцінити, чи має ChatGPT також навички проходження тестів і вирішення математичних проблем. Вони створили більш складну систему тестування, яка дозволила оцінити реальні можливості ШІ

Набір питань GHOSTS включав запитання з підручника з математики для університетів, пропонував заповнити порожні перевірочні запитання, ставив складні задачі та просив ChatGPT інтегрувати константи в рівняння, виконувати більше стандартних аналізів для вищих навчальних закладів і дати визначення певним математичним поняттям. 

На прохання пояснити, як він отримав свої відповіді, ChatGPT часто наводив нестандартні аргументи — навіть коли він отримував правильну відповідь, він робив це виходячи за межі стандартної практики.

Читайте також: Генеративний пошук поступово змінює те, як люди знаходять бренди, порівнюють рішення і приймають рішення про покупку. Масштаб зсуву вже вимірний: аналіз 2,3 млрд користувацьких сесій за 2024-2025 роки показав, що трафік з AI-чатів зріс на 796% за два роки, а конвертується він на рівні 14,2% проти 2,8% у Google – приблизно в п'ять разів ефективніше. Одночасно 60% пошуків у традиційних системах завершуються взагалі без кліку: користувачеві вистачає AI-відповіді. В Україні 85% людей користуються штучним інтелектом постійно або час від часу, а 12% – щодня, що порівнянно з показником США.

Як зазначає Лія Генріксон, професор цифрових медіа в Університеті Квінсленда, ChatGPT легко проходить лише тести, які спираються на факти, і у цьому ШІ певно виграє у людської пам’яті.