Как распознать текст, сгенерированный ИИ
В исследовании журнала Economist, охватившем почти 56 000 предложений и 1,2 миллиона слов, ИИ-модели ChatGPT, Claude, Gemini и Grok были протестированы на примере собственных текстов издания, чтобы выявить признаки текста, сгенерированного ИИ.
Тексты, созданные искусственным интеллектом, отличается выбором слов и знаков препинания, а также структурой предложений и абзацев.
Словарный запас, который использует ИИ, предлагает значительное количество многосложных слов и научной терминологии, чем люди, и тяготеет к номинализациям (существительные от глаголов) и латинским по происхождению терминам. Все LLM исследовании используют такие слова, но особенно Gemini и Claude.
Пунктуация - сегодня только Claude использует больше тире, чем люди, а ChatGPT использует их значительно меньше, чем любой другой автор. Соответственно отсутствие тире признак, что текст написан ИИ. Также ИИ использует меньше запятых и точек с запятой, чем люди (и почти не используют скобки).
Предложения созданные ИИ, как правило, длинные, абзацы редко прерываются короткими фразами. Тогда как люди обычно пишут короткие абзацы. Также ИИ чаще прибегают к риторическим приемам вроде конструкции «не только, но и».
Также исследователи отмечают, что с каждым обновлением моделей стиль ИИ-письма приближается к человеческому, поскольку LLM обучаются на человеческих текстах, из-за чего надёжно отличать машинный текст от человеческого будет становиться только сложнее.
Рубрика: Новости
Дата: 19-08-2026
Теги: