ШІ вже будує сам себе: Anthropic створює наступну версію Claude попередньою

ШІ вже будує сам себе: Anthropic створює наступну версію Claude попередньою
Depositphotos

Компанія Anthropic оприлюднила нові дані про те, наскільки активно її модель штучного інтелекту Claude бере участь у створенні наступної, ще потужнішої версії самої себе. За словами компанії, йдеться не про повну автономність, а про дедалі глибше залучення ШІ до власної розробки під контролем людей.

Чверть досліджень уже веде сам Claude

Згідно з офіційною заявою, оприлюдненою в четвер, Claude наразі очолює 26% усіх досліджень та розробок Anthropic у сфері моделей. Це означає, що система здатна виконувати більшість завдань “від початку до кінця на основі високорівневого запиту”, залишаючись при цьому під наглядом людини.

Ще у лютому цей показник дорівнював нулю, а вже в серпні досяг чверті всіх процесів — тобто зростання відбулося менше ніж за півроку. Ще близько 90% усієї дослідницької роботи компанії відбувається у “співпраці” з Claude: модель виконує “великі обсяги роботи під суворим людським керівництвом”, як пояснили в Anthropic.

30 тисяч агентів під наглядом

Станом на серпень до інженерних та дослідницьких задач компанії було залучено приблизно 30 000 автономних агентів на основі Claude. Кожна їхня дія проходить через систему моніторингу: із понад мільярда прийнятих агентами рішень за місяць було заблоковано приблизно одне з кожних 47 000 — саме стільки разів системи безпеки зафіксували потенційно небезпечну чи небажану поведінку.

Компанія також повідомила, що у вибірковий тиждень липня на роботу з безпеки пішло близько 6% дослідницьких обчислювальних потужностей, тоді як для досліджень, які веде сам ШІ, цей показник зріс до 12%.

Навіщо Anthropic розкриває ці цифри

У компанії наголошують: що більше моделі прискорюють розробку власних наступників, то складніше людям розуміти та контролювати такі системи. Anthropic закликала інші лабораторії штучного інтелекту регулярно публікувати подібні метрики за єдиною методологією, щоб суспільство могло порівнювати компанії між собою та стежити, наскільки індустрія наблизилася до так званого рекурсивного самовдосконалення — здатності ШІ повністю самостійно створювати наступну версію себе.

“Ми повинні робити все можливе, щоб звести до мінімуму розрив між тим, що знають провідні лабораторії, і тим, що знає суспільство”, — зазначили в компанії у блозі.

Наскільки близько індустрія підійшла до цієї межі, Anthropic не уточнила. Заява пролунала на тлі гострих дискусій щодо ризиків штучного інтелекту. Співзасновник Anthropic Даріо Амодей ще у червні закликав розглянути можливість тимчасово уповільнити розробку передових ШІ-систем, а до нього приєдналися інші лідери галузі, зокрема Сем Альтман та Ілон Маск. Тоді ж Anthropic повідомляла, що понад 80% коду, який потрапляє до її виробничої бази, вже пишеться Claude.

ШІ вже будує сам себе: Anthropic створює наступну версію Claude попередньою
Image: Anhropic / AP / TechXplore

Дискусія триває на тлі суперечок про безпеку

Варто зауважити, що за день до нового звіту Anthropic компанія OpenAI оприлюднила власні дані про шість випадків нестандартної поведінки її моделей — зокрема про спроби приховати помилки та несанкціоноване використання внутрішнього API-ключа. Обидві компанії, отже, публічно звітують про непросте літо з точки зору контролю за ШІ-агентами.

Утім, заклики уповільнити розробку поділяють не всі. Президент США Дональд Трамп раніше заявляв, що ризик відстати від Китаю у гонці ШІ здається йому реальнішим за ризики для безпеки людства. Це показує, наскільки по-різному в індустрії та у владі оцінюють баланс між темпами інновацій і контролем над системами.

Джерело: ABC News

Джерело матеріала
loader
loader