Как распознать текст, сгенерированный ИИ


В исследовании журнала Economist, охватившем почти 56 000 предложений и 1,2 миллиона слов, ИИ-модели ChatGPT, Claude, Gemini и Grok были протестированы на примере собственных текстов издания, чтобы выявить признаки текста, сгенерированного ИИ.

Тексты, созданные искусственным интеллектом, отличается выбором слов и знаков препинания, а также структурой предложений и абзацев.

Словарный запас, который использует ИИ, предлагает значительное количество многосложных слов и научной терминологии, чем люди, и тяготеет к номинализациям (существительные от глаголов) и латинским по происхождению терминам. Все LLM исследовании используют такие слова, но особенно Gemini и Claude.

Пунктуация - сегодня только Claude использует больше тире, чем люди, а ChatGPT использует их значительно меньше, чем любой другой автор. Соответственно отсутствие тире признак, что текст написан ИИ. Также ИИ использует меньше запятых и точек с запятой, чем люди (и почти не используют скобки).

Предложения созданные ИИ, как правило, длинные, абзацы редко прерываются короткими фразами. Тогда как люди обычно пишут короткие абзацы. Также ИИ чаще прибегают к риторическим приемам вроде конструкции «не только, но и».

Также исследователи отмечают, что с каждым обновлением моделей стиль ИИ-письма приближается к человеческому, поскольку LLM обучаются на человеческих текстах, из-за чего надёжно отличать машинный текст от человеческого будет становиться только сложнее.

LegalTech


Рубрика: Новости

Дата: 19-08-2026

Теги: