Штучний інтелект заблокував п’ять спроб розробити біологічну зброю
Штучний інтелект заблокував п’ять спроб розробити біологічну зброю

Штучний інтелект заблокував п’ять спроб розробити біологічну зброю

Штучний інтелект Claude від компанії Anthropic п’ять разів заблокував запити, пов’язані з біологічними дослідженнями, які потенційно могли вести до розробки зброї масового ураження. Всі випадки зафіксовано між груднем 2025-го та серпнем 2026 року — і жодного разу компанія не змогла остаточно довести злий умисел дослідників.

Виявити небезпечні запити вдалося підрозділу аналізу загроз Anthropic. Саме він підсвічує головну проблему сучасного ШІ в науці: чим потужніші моделі, тим складніше розрізнити легітимне дослідження і проєкт подвійного призначення. У біології ця межа розмита особливо сильно — ті самі знання можуть рятувати людей за допомогою вакцин або вбивати їх за допомогою патогенів.

Один із задокументованих епізодів стосувався вірусу чикунгунья: Claude відмовився допомогти з підготовкою заявки на фінансування дослідження зі зміною властивостей збудника. Додаткову настороженість у компанії викликало те, що передбачувана робота була пов’язана з військовою науковою установою. Після відмови дослідники спробували продовжити роботу через посередницькі платформи, які перенаправляли заблоковані запити до інших ШІ з менш суворими обмеженнями.

В іншому випадку дослідник кілька тижнів використовував Claude для роботи з високопатогенним пташиним грипом — планування експериментів, аналізу даних, інтерпретації результатів. Системи безпеки не допустили роботи з найпотужнішими моделями на найчутливіших задачах, тому частину роботи було виконано на слабших версіях. Ще три виявлені епізоди були пов’язані з ортопоксвірусами, токсинами та сполуками на основі тваринних ядів.

Керівник напряму аналізу загроз Anthropic Джейкоб Кляйн пояснює складність ситуації так: потенційно небезпечна робота зовні може нічим не відрізнятися від звичайного наукового проєкту. Водночас надмірна блокування шкодить легітимній науці — дослідники вакцин чи ліків нерідко вимушені вивчати саме небезпечні властивості патогенів.

У серпні 2026 року Anthropic вдосконалила біологічні фільтри: кількість помилкових переключень на слабші моделі при безпечних запитах скоротилася приблизно на 85%, тоді як жорсткі обмеження для потенційно небезпечних задач збереглися. Акаунти, пов’язані з підозрілою активністю та спробами обходу захисту, заблоковано, а дані про всі виявлені випадки передано державним структурам і іншим розробникам ШІ.

Доказів того, що Claude справді був використаний для створення біологічної зброї або що виявлені проєкти призвели до появи небезпечних агентів, наразі немає. Проте Anthropic вважає сам факт можливості суттєво прискорити подібні дослідження достатньою підставою для посилення контролю — і паралельно розробляє окремі механізми доступу для перевірених наукових організацій.

Источник материала
loader
loader