Флагманские языковые модели по-прежнему оставляют тысячи языковых следов, несмотря на годы настройки естественного стиля. Маркетинговая фирма Graphite сравнила тексты моделей с 10 тысячами статей людей и насчитала 13 тысяч фраз, которые встречаются в текстах ИИ минимум вдвое чаще. Модель Claude Opus 5.5 употребляет фразу "this matters" в 116 раз чаще людей. Для бизнеса это меняет проверку черновиков ИИ перед публикацией.
Как Graphite измерила привычки моделей
Graphite построила сравнение на 10 тысячах статей, вышедших до выпуска ChatGPT, и использовала их как контрольную группу человеческих текстов. Затем исследователи попросили разные модели переписать эти статьи по кратким изложениям, чтобы снизить влияние исходного текста. Имея парные выборки людей и каждой модели, команда подсчитала частоту слов и структуру предложений. Маркером считалась фраза минимум вдвое более частая в текстах ИИ, чем у людей. По этому порогу у флагманских моделей набралось 13 тысяч таких фраз.
Каждая версия модели показала собственный перекос словаря. Opus 5.5 употребляет "dependable" в 23 раза чаще людей и предпочитает оборот "is more than an X, it is a Y", отказавшись от более старого "it is not X, it is Y". Модель OpenAI Astra опирается на "another dimension" и осторожные глаголы вроде "may provide" или "can provide" выгоду. Ее главный сигнал — уточняющие обороты "not simply X" и "rather than relying on X", которые встречаются более чем в 100 раз чаще, чем в человеческой прозе. В сравнение пунктуации также вошла Gemini 3.1 Pro.
Исследование вышло после неоднократных заявлений отрасли о более естественном стиле. Anthropic сообщила, что Opus 5.5 общается естественнее прежних моделей, а ранние пользователи назвали ее тексты яснее и легче для чтения. OpenAI заявила, что версии GPT-6 Sol и Luna дадут больше ясности, меньше жаргона и меньше странных оборотов. Директор по ИИ Graphite Грег Друк сказал, что модели Claude со временем приближаются к человеческому распределению слов, а модели GPT отдаляются от него. Старые сигналы вроде тире и "delve" в текущих текстах в основном исчезли.
Что устойчивые маркеры означают для бизнеса
Компании, публикующие черновики с помощью ИИ, получают практичный фильтр качества из этих списков. Редакторы могут искать "this matters", "why X matters", "another dimension" и уточняющие обороты перед выпуском, прежде всего в маркетинге, базах знаний и продающих материалах. Метод масштабируется, поскольку опирается на подсчет частот, а не на субъективный вкус. Небольшие команды получают быструю первую проверку без дополнительного софта, а крупные редакции могут встроить фразы в проверки стиля и согласование.
У тех же сигналов есть ограничения, которые стоит учесть покупателям. Graphite отмечает, что известные маркеры убирают, но появляются новые, поэтому любой фиксированный список нужно обновлять под каждую версию модели. Примером сдвига служит тире: Opus 5.5 использует его на 99% реже, чем Opus 5, Astra — на 88% реже человеческих текстов, а Gemini 3.1 Pro почти полностью исключила его из текстов. Друк объясняет устойчивость гигантским размером моделей с миллиардами параметров и конечным числом тестов, из-за чего часть шаблонов ускользает. Совпадение фраз само по себе не доказывает авторство или ошибку в фактах.
Полезным маркером станут следующие обновления моделей и независимые пересчеты тех же сигналов. Если "dependable", "this matters" и "not simply X" резко снизятся без роста заменяющих фраз, разрыв сократится. Если общее число маркеров останется около 13 тысяч с другими лидерами, выявление сохранится как подвижная цель. Тогда командам контента стоит считать проверку стиля регулярной работой, привязанной к версиям моделей.
