Claude намагалися використати для біозброї: Anthropic заблокувала небезпечні запити

Anthropic виявила кілька випадків, коли її ШІ-моделі використовували для роботи, яка могла сприяти створенню біологічної зброї. Компанія заблокувала пов’язані з цим акаунти та посилила захист Claude, оскільки вважає біологічні зловживання одним із найсерйозніших ризиків сучасного ШІ.

У новому звіті компанія описала п’ять випадків потенційно небезпечного використання Claude у біологічних дослідженнях. В Anthropic наголошують, що провести межу між законною науковою роботою та підготовкою біологічної зброї іноді надзвичайно складно.

Причина в тому, що одні й ті самі знання можуть використовуватися як для створення вакцин і лікування хвороб, так і для підвищення небезпечності патогенів. Саме тому компанія оцінює не лише окремі запити користувача, а й загальний контекст його роботи.

В одному з описаних випадків платформа-посередник обходила регіональні обмеження та надавала доступ до моделей вірусологам, які працювали над дослідженнями вірусу чикунгунья з посиленням його властивостей. Коли частину запитів блокували, їх намагалися перенаправляти до моделей із менш суворими обмеженнями.

В іншому випадку дослідник у країні, де Claude офіційно не підтримується, протягом кількох тижнів використовував модель для планування експериментів з адаптації пташиного грипу до ссавців. Anthropic заявила, що її системи безпеки обмежили доступ такого користувача до потужніших моделей.

Компанія підкреслює, що не стверджує, ніби в усіх цих випадках люди безпосередньо намагалися створити біологічну зброю. Однак характер і сукупність запитів у частині епізодів були достатньо небезпечними, щоб припинити доступ до моделей.

Загалом звіт охоплює зловживання Claude з грудня 2025-го до серпня 2026 року. Anthropic виявляла використання ШІ для кібершпигунства, стеження, інформаційних операцій, шахрайства, розроблення звичайних озброєнь та потенційно небезпечних біологічних досліджень.

Окремо компанія описала пов’язану з Росією кібершпигунську операцію. За оцінкою Anthropic, її учасники автоматизували частину атак за допомогою Claude та цілилися, зокрема, в українські державні структури, військових, дипломатів і компанії з виробництва дронів.

У ще шести випадках Claude використовували для робіт, пов’язаних зі звичайним озброєнням. Йшлося про програмне забезпечення для керованих ракет, роїв дронів, систем наведення, радіоелектронної боротьби та закупівель товарів подвійного призначення для військових потреб.

Anthropic заявила, що після виявлення таких операцій блокувала відповідні акаунти, створювала нові системи виявлення небезпечних запитів та передавала інформацію правоохоронним органам і технологічним партнерам, коли це було необхідно.

У компанії також визнають, що можливості нових моделей у біології швидко зростають. Якщо старі версії Claude були недостатньо потужними, щоб суттєво допомогти досвідченому фахівцю в небезпечних біологічних дослідженнях, то щодо найновіших систем Anthropic уже не дає такої гарантії.

Саме тому нові моделі отримують жорсткіші обмеження на запити, пов’язані з потенційно небезпечними біологічними експериментами. Компанія вважає, що без таких запобіжників можливості передових ШІ-систем у майбутньому можуть створювати катастрофічні ризики.



🌟 Читайте «Експерт» у своєму смартфоні — додайте нас в Google Discover

Від player

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *