Упс! Не вдала спроба:(
Будь ласка, спробуйте ще раз.

Anthropic заблокувала 9 пропагандистських мереж і спроби створити біозброю

Підписатися на нас
0
5 хвилин читання

Anthropic оприлюднила третій звіт про зловживання своїми моделями, і вперше відкрито визнала: для найновіших версій Claude гарантії безпеки більше не абсолютні.

Anthropic заблокувала 9 пропагандистських мереж і спроби створити біозброю зображення 1 Anthropic заблокувала 9 пропагандистських мереж

Повідомляє Euronews: у період із грудня 2025 по серпень 2026 року дослідники компанії зафіксували спроби зловживань із боку продавців шпигунського програмного забезпечення, політично мотивованих осіб і груп, пов'язаних із державними структурами. 

Запит на вірус чикунгунья: що просили у Claude

Серед задокументованих випадків, запит, у якому Claude просили допомогти скласти заявку на наукове фінансування. Йшлося про так зване gain-of-function-дослідження вірусу чикунгунья: генетична модифікація, що мала зробити вірус стійкішим до імунної відповіді та підвищити його заразність.

Чикунгунья передається через укус комарів і спричиняє тяжкий больовий синдром і гарячку. Anthropic заблокувала запит, але зазначила: подібні дослідження можуть мати і легітимну мету, розробку вакцин, і саме це ускладнює автоматичну фільтрацію.

Компанія підкреслила, що її старші моделі, Claude Opus 4 і Claude Sonnet 4.5, знаходилися «значно нижче порогу, за яким могли б суттєво допомогти досвідченому користувачеві у проведенні небезпечних біологічних досліджень».

Підписуйтеся на наші соцмережі

Для них достатньо було базових фільтрів, орієнтованих на те, щоб не давати новачкам доступу до відомих рецептур біозброї.

Але нові моделі здатні виконувати складні наукові завдання, і тут стара логіка не працює.

Для сьогоднішніх моделей, здатних допомагати з широким спектром складних наукових задач, доказів більше не достатньо, і ми не можемо давати ті самі запевнення.
Звіт Anthropic

Тому в Claude Fable 5 компанія запровадила суттєво жорсткіші обмеження на запити у сфері так зваю подвійного використання біологічних досліджень.

Дев'ять пропагандистських мереж із Росії, Ірану та Туреччини

Окрім біологічної загрози, звіт фіксує дев'ять задокументованих кампаній впливу. Групи з Росії, Ірану, Туреччини, а також із Перської затоки, Південної Азії, Африки та Європи створювали сотні фейкових акаунтів у соціальних мережах, які виглядали як звичайні користувачі.

Протягом тижня ці акаунти розповсюджували скоординовані повідомлення, що просували одну й ту саму політичну позицію. Ключове спостереження Anthropic: платформи соціальних мереж зазвичай виявляють такі операції вже після того, як публікації почали циркулювати. Натомість компанія може помітити їх у Claude ще на етапі підготовки, і саме це дає перевагу у протидії.

Відставка дослідника і визнання меж безпеки нових моделей

Звіт опублікований через два дні після того, як дослідник Anthropic Джейкоб Кокзон оголосив про свою відставку. У своїй заяві він написав, що компанія та її головний конкурент OpenAI «мчать просто до самовдосконалюваного суперінтелекту, ризикуючи нашими життями».

Кокзон також попередив, що частина його колишніх колег вважає: ШІ може становити загрозу для людського життя ще до кінця десятиліття. Anthropic не коментувала ці слова прямо, але публікація звіту саме в цей момент виглядає як спроба продемонструвати прозорість.

Джон Тікстун, доцент кафедри інформатики Корнельського університету, звертає увагу на структурну проблему: компанії на кшталт Anthropic та OpenAI фактично змушені «виносити ціннісні судження в масштабах суспільства без жодного демократичного чи дорадчого нагляду».

Anthropic, своєю чергою, закликала уряди та конкурентів стежити за подібними патернами на власних платформах і поділилася матеріалами з відповідними державними органами та галузевими партнерами. Компанія готується до первинного публічного розміщення акцій цієї осені, і відкритість щодо загроз може бути частиною стратегії довіри до бренду.

Що це означає для України

Серед дев'яти задокументованих пропагандистських операцій зазначені країни, що безпосередньо пов'язані з інформаційним тиском на Україну, зокрема Росія та Іран.

Виявлені Anthropic механізми, координовані мережі фейкових акаунтів, побудовані за допомогою моделей ШІ — це саме ті інструменти, що активно застосовуються у дезінформаційних кампаніях проти українського суспільства. Здатність компанії виявляти такі операції до їхнього запуску потенційно дозволяє раніше попереджати платформи і державні структури.

Для українських фахівців із кібербезпеки і медіаграмотності звіт Anthropic — це не лише академічний документ: він описує реальні тактики, що вже застосовуються у регіоні. Окремо варто стежити за розвитком регуляторної дискусії в ЄС щодо нагляду за моделями ШІ подвійного використання, Україна, що прагне до євроінтеграції, рухатиметься у фарватері цих норм.

0
Icon 0

Підписуйтеся на наші соцмережі