Дослідники назвали нові слова й фрази, які можуть видавати текст, написаний ШІ
Дослідники назвали нові слова й фрази, які можуть видавати текст, написаний ШІ

Дослідники назвали нові слова й фрази, які можуть видавати текст, написаний ШІ

Сучасні моделі штучного інтелекту відмовляються від частини відомих мовних ознак, за якими раніше можна було запідозрити текст, згенерований ШІ. Водночас у них з'являються нові характерні слова та фрази

Дослідники компанії Graphite виявили майже 13 тисяч слів і фраз, які у текстах чатботів трапляються приблизно вдвічі частіше, ніж у людських текстах.

Для дослідження команда взяла 10 тисяч текстів, написаних до появи ChatGPT. Їх надали ШІ-моделям із завданням створити короткі перекази та переписати ці матеріали. Це дозволило порівняти тексти людей і штучного інтелекту на однакові теми.

У Claude Opus 5.5 однією з характерних ознак стало слово «dependable» («надійний»). Воно траплялося щонайменше у 23 рази частіше, ніж у текстах людей.

Також модель часто пояснювала, чому певна деталь є важливою або важливішою за іншу. Фрази «this matters» та «why X matters» у її текстах зустрічалися відповідно у 116 та 92 рази частіше, ніж у людських матеріалах.

Модель Astra від OpenAI вирізнялася використанням фрази «another dimension» — «інший вимір» предмета розмови. Вона також часто пом'якшувала твердження за допомогою конструкцій «may provide» та «can provide», які означають, що певна дія може дати конкретну перевагу. Такі формулювання використовувалися у текстах моделі більш ніж у 100 разів частіше, ніж людьми.

Водночас деякі відомі кліше ШІ справді стали використовуватися рідше. Зокрема, дослідження Arena.ai показало, що Claude Opus 5.5 почав використовувати довгі тире на 95% менше. Graphite оцінює це скорочення у 99%.

Разом із цим змінився синтаксис: речення стали коротшими, а формулювання — простішими.

Astra використовує довгі тире на 88% рідше, ніж люди, а Gemini 3.1 Pro майже повністю від них відмовилася.

Попри зміну характерних ознак, у Graphite зазначають, що їхня кількість залишається значною.

«Моделі можуть позбутися найвідоміших маркерів, але натомість з'являються інші. Кожна — має власні особливості», — зазначив головний директор Graphite з питань ШІ Грег Драк.

За його словами, лабораторії можуть мати менше контролю над особливостями моделей, ніж очікували, оскільки йдеться про системи з мільярдами параметрів, які неможливо перевірити в усіх можливих ситуаціях.

Источник материала
loader
loader