$20 за експлойт: китайська ШІ-модель GLM-5.3 знайшла вразливість Chrome
Китайська модель штучного інтелекту GLM-5.3 змогла створити робочий експлойт для вразливості браузера Chrome. Для розробки вразливості за допомогою цього інструменту ШІ знадобилося витратити лише за $20,40. Дослідження Anthropic показало, що відкрита модель Z.ai вже наближається до результатів спеціальної Claude Mythos Preview у завданнях з кібербезпеки.
ШІ в руках хакерів
GLM-5.3 — нова мовна модель китайської компанії Z.ai, раніше відомої як Zhipu AI. Її ваги доступні для завантаження: за останній місяць сторінка моделі на Hugging Face набрала понад 1,3 млн завантажень.
Anthropic перевірила здатність GLM-5.3 самостійно знаходити вразливості та створювати атаки. У 410 спробах модель 50 разів змогла пройти повний ланцюжок від пошуку помилки до отримання контролю над ціллю. Claude Mythos Preview показав результат 56 успішних спроб. Інші перевірені моделі, зокрема Claude Opus 4.6, GLM-5.2, Kimi K3 та DeepSeek V4.1-Flash, отримали близькі до нуля результати.
В іншому тесті GLM-5.3 успішно виконала повне перехоплення керування запущеною програмою у 4% випадків. Для Claude Mythos Preview показник становив 6%.
Ще показовішим став практичний експеримент із браузером. GLM-5.3 знайшла кілька раніше невідомих помилок у JavaScript-рушії популярного браузера та змогла об’єднати їх в атаку, яка дозволяє вебсторінці читати довільні файли з комп’ютера відвідувача. Anthropic як приклад наводить приватний SSH-ключ. Назву браузера компанія не розкрила. Відомо лише, що про знайдені проблеми повідомили розробникам, але у звіті немає інформації про випуск виправлення.
Окремо Anthropic протестувала меншу версію GLM-5.3-Flash на вже відомій вразливості CVE-2026-11645 у JavaScript-рушії V8 браузера Chrome. Google виправила її у червні, причому на той момент зловмисники вже використовували цю проблему. За цінами API Z.ai робота моделі коштувала $20,40 і тривала близько 20 хвилин людського контролю та восьми годин роботи системи.
Захист моделі також виявився недостатньо стійким. Безпосередньо на запит про атаку GLM-5.3 відмовляється виконувати завдання. Але в тестах Anthropic вигадана легенда дозволила отримати потрібну поведінку у 64% випадків, а попередньо заданий ланцюжок міркувань підвищив показник до 92%.
Anthropic також перевірила метод “abliteration”, який прибирає відмови без істотної зміни можливостей моделі. За оцінкою компанії, її власний експеримент вимагав близько 2200 годин роботи GPU, або приблизно $4400. Після цього частота відмов знизилася з понад 90% до 2-12%.
Окремо американський Center for AI Standards and Innovation (CAISI) дійшов подібного висновку. У своїй оцінці він назвав GLM-5.3 найздатнішою до кібероперацій відкритою моделлю на момент дослідження та оцінив її відставання від провідних американських моделей приблизно у чотири місяці.
GLM-5.3 показує, що відкриті ШІ-моделі вже можуть значно здешевлювати пошук і використання відомих вразливостей.
Джерело: notebookcheck

