Як Claude маркує текст, згенерований ШІ: пояснення

4 хвилин читання

Чатбот Claude залишає у текстах невидимий «підпис», за яким пізніше можна перевірити, чи писав відповідь ШІ. Anthropic говорить, що система побудована на технології SynthID від Google DeepMind, яку вже використовують для картинок від Google і OpenAI, пише Android Authority.

Прихований підпис Claude: як Anthropic мітить ШІ-тексти. Фото: Reuters 

Як працює маркування ШІ-тексту в Claude

  • Читач підпису від штучного інтелекту не помітить: у відповіді немає жодних дивних символів, зайвих слів чи прихованих значків. 
  • І що важливо, за цим слідом не можна вирахувати конкретну людину, чат чи компанію.
  • Сам текст від цього теж не змінюється. Claude пише так само, як і раніше. Anthropic пояснює це просто. 
  • Модель складає відповідь слово за словом і часто має кілька однаково підходящих варіантів. У фразі «Погода сьогодні була холодною і…» наступним словом може бути «похмурою» або «сірою». 
  • Для сенсу різниці немає. Саме на таких моментах Claude і залишає свою мітку: він робить вибір не зовсім випадково, а за особливим правилом. 
  • Так по всьому тексту складається візерунок, який видно лише тому, у кого є спеціальний ключ. 
  • Anthropic обіцяє незабаром дати всім охочим інструмент для перевірки тексту, згенерованого ШІ. 
Читайте також: OpenAI планує залучити щонайменше $30 млрд нового фінансування після того, як компанія відклала вихід на біржу. За даними Bloomberg, стартап, який розробив ChatGPT, може отримати оцінку близько $1,4 трлн — без урахування коштів, залучених у новому раунді.

Схожу ставку на обережність компанія робить давно, ми вже розбирали стратегію Anthropic.

Підписуйтеся на наші соцмережі

Коли Claude не маркує свій текст 

Anthropic одразу чесно попереджає: чарівної кнопки «людина чи ШІ» не буде. Ключ відповідає лише на одне питання: наскільки ймовірно, що частину тексту написав саме Claude. 

Він не доводить, що автор — людина. І не бачить текстів від ChatGPT, Gemini чи будь-якого іншого чатбота, бо там свої правила.

Є ще три великих «але». По-перше, на коротких повідомленнях підпис майже не читається, бо там просто замало слів. 

По-друге, він зникає у фактах: у реченні «Найвідоміша робота Ньютона називалась Principia…» правильне закінчення лише одне — «Mathematica». Вибору немає, отже, і мітки теж. 

По-третє, підпис не працює на коді: там кожен символ на своєму місці, і випадковість неможлива. Якщо ж ви попросите Claude вичитати ваш власний текст, слід з'явиться тільки у правках, тобто в комах, граматиці, дрібних змінах.

Це важливо, бо Claude уже давно вийшов за межі звичайного чату. Anthropic підключила його до 15 сервісів: від Booking до Spotify. 

А нещодавно один зловмисник зламав 14 компаній через Claude Code, майже не пишучи власного коду. На такому коді, за словами самої Anthropic, підпис не спрацював би.

Як маркування тексту в Claude вплине на українців 

  • Інструмент перевірки Anthropic ще не відкрила, тож самостійно з'ясувати, чи писав відповідь Claude, не вийде. 
  • Коли API з'явиться, ним найшвидше почнуть користуватися редакції, викладачі та компанії, що замовляють тексти у фрилансерів. 
  • Тим, хто просто редагує свої тексти через Claude, хвилюватися немає про що: підпис ляже лише на правки, а не на весь текст. 
  • А от повністю згенеровані статті, листи чи довгі дописи у соцмережах після запуску перевірки виявити стане набагато простіше.