Як Claude маркує текст, згенерований ШІ: пояснення
Чатбот Claude залишає у текстах невидимий «підпис», за яким пізніше можна перевірити, чи писав відповідь ШІ. Anthropic говорить, що система побудована на технології SynthID від Google DeepMind, яку вже використовують для картинок від Google і OpenAI, пише Android Authority.
Як працює маркування ШІ-тексту в Claude
- Читач підпису від штучного інтелекту не помітить: у відповіді немає жодних дивних символів, зайвих слів чи прихованих значків.
- І що важливо, за цим слідом не можна вирахувати конкретну людину, чат чи компанію.
- Сам текст від цього теж не змінюється. Claude пише так само, як і раніше. Anthropic пояснює це просто.
- Модель складає відповідь слово за словом і часто має кілька однаково підходящих варіантів. У фразі «Погода сьогодні була холодною і…» наступним словом може бути «похмурою» або «сірою».
- Для сенсу різниці немає. Саме на таких моментах Claude і залишає свою мітку: він робить вибір не зовсім випадково, а за особливим правилом.
- Так по всьому тексту складається візерунок, який видно лише тому, у кого є спеціальний ключ.
- Anthropic обіцяє незабаром дати всім охочим інструмент для перевірки тексту, згенерованого ШІ.
Схожу ставку на обережність компанія робить давно, ми вже розбирали стратегію Anthropic.
Підписуйтеся на наші соцмережі
Коли Claude не маркує свій текст
Anthropic одразу чесно попереджає: чарівної кнопки «людина чи ШІ» не буде. Ключ відповідає лише на одне питання: наскільки ймовірно, що частину тексту написав саме Claude.
Він не доводить, що автор — людина. І не бачить текстів від ChatGPT, Gemini чи будь-якого іншого чатбота, бо там свої правила.
Є ще три великих «але». По-перше, на коротких повідомленнях підпис майже не читається, бо там просто замало слів.
По-друге, він зникає у фактах: у реченні «Найвідоміша робота Ньютона називалась Principia…» правильне закінчення лише одне — «Mathematica». Вибору немає, отже, і мітки теж.
По-третє, підпис не працює на коді: там кожен символ на своєму місці, і випадковість неможлива. Якщо ж ви попросите Claude вичитати ваш власний текст, слід з'явиться тільки у правках, тобто в комах, граматиці, дрібних змінах.
Це важливо, бо Claude уже давно вийшов за межі звичайного чату. Anthropic підключила його до 15 сервісів: від Booking до Spotify.
А нещодавно один зловмисник зламав 14 компаній через Claude Code, майже не пишучи власного коду. На такому коді, за словами самої Anthropic, підпис не спрацював би.
Як маркування тексту в Claude вплине на українців
- Інструмент перевірки Anthropic ще не відкрила, тож самостійно з'ясувати, чи писав відповідь Claude, не вийде.
- Коли API з'явиться, ним найшвидше почнуть користуватися редакції, викладачі та компанії, що замовляють тексти у фрилансерів.
- Тим, хто просто редагує свої тексти через Claude, хвилюватися немає про що: підпис ляже лише на правки, а не на весь текст.
- А от повністю згенеровані статті, листи чи довгі дописи у соцмережах після запуску перевірки виявити стане набагато простіше.