Исследование более чем 500 000 запросов к ChatGPT показало: больше трети взаимодействий с чат-ботом связаны с генерацией художественных текстов — прозы, поэзии, фанфиков, эротики или ролевых сценариев. Данные взяты из публичного набора WildChat, который проанализировали исследователи Школы информации Вашингтонского университета. Результат важен потому, что противоречит представлению, укрепившемуся после нескольких издательских скандалов: будто у читателей нет интереса к текстам, написанным машиной.

Больше трети запросов к ChatGPT — генерация художественных текстов, показало исследование

Что показал анализ WildChat

Исследователи выяснили, что подавляющее большинство запросов на генерацию прозы исходит от небольшой группы активных пользователей, которые создают и правят истории с навязчивой регулярностью. В одном случае пользователь тысячи раз за несколько месяцев просил ChatGPT выдавать версии одного и того же фанфика по миру аниме-игры Doki Doki Literature Club. Даже с поправкой на интенсивное использование исследователи оценивают долю пользователей чат-ботов, занятых генерацией прозы, в 7 процентов. У набора есть ограничения: запросы анонимизированы, поэтому демографические данные собрать невозможно, а участники должны были согласиться на публикацию своих запросов. В OpenAI заявили WIRED, что WildChat не является репрезентативной выборкой всех пользователей ChatGPT, а отдельное исследование OpenAI и Национального бюро экономических исследований 2025 года оценивает долю запросов, связанных с прозой, в 1,4 процента — правда, эта цифра не учитывает ролевые сценарии.

Мелани Уолш, доцент Вашингтонского университета и соавтор работы, говорит: пользователи знают, что истории созданы моделью, и это их не смущает — более того, в этом, судя по всему, и состоит значительная часть привлекательности. Механика отличается от обычного чтения. Пользователь набрасывает концепцию — например, эльфийский воин сражается с королевой амазонок и захватывает её трон — а модель заполняет пробелы, уводя сюжет в неожиданные стороны. Петра Ферраз де Новаэс, 36-летняя инженер-программист из Бразилии, запускает открытые модели на своём компьютере через программу SillyTavern и за одну сессию переключается между несколькими фэнтезийными мирами, включая Star Wars, Pokémon и Mass Effect. Она говорит, что её привлекает непредсказуемость: то, что называют галлюцинациями модели, в этом случае часто и есть желаемый результат.

Исследование выходит на фоне череды издательских скандалов вокруг подозрений в использовании ИИ профессиональными авторами. Один издатель отменил контракт на книгу за 2 млн долларов, другой снял роман с полок, читатели заподозрили, что отмеченный наградой рассказ написан ИИ. Во всех этих случаях подразумевалось, что никто не хочет читать сгенерированные машиной истории и что использование ИИ обесценивает литературу. Уолш и её коллеги утверждают, что шум отвлёк внимание от того, как в действительности ведут себя читатели, и от того, что это говорит о спросе на ИИ-прозу. Объяснение спроса у них практическое: модели не осуждают, выдают истории мгновенно и практически неисчерпаемы, а это подходит тем, кто хочет быстро перебирать варианты или сам управлять действием, а не принимать решения автора.

Что это значит для бизнеса

Для компаний, которые разрабатывают или покупают ИИ-инструменты, практическое следствие в том, что проза и ролевые сценарии — не маргинальная нагрузка, а массовый потребительский сценарий, причём устроенный иначе, чем поиск или суммаризация. Это длинные сессии, многократные итерации и высокая чувствительность к «характеру» модели, а значит, меняются требования к поставщику: память внутри сессии, терпимость к повторной генерации одной и той же сцены, отсутствие избыточных отказов. Небольшая студия может запускать открытые модели локально, как это делает Новаэс, и держать расходы и правила контента в своих руках; крупная компания, подключающая облачный API, наследует правила модерации провайдера и не может настраивать их под каждого пользователя. Та же механика работает в учебных симуляциях и ролевых тренингах, где сотрудники отрабатывают переговоры или разговоры с клиентами.

Новость не означает, что ИИ-проза стала массовым рынком в масштабе заголовочной цифры. Две оценки различаются на порядок: больше трети взаимодействий в WildChat против 1,4 процента запросов в исследовании OpenAI и NBER, и разрыв объясняется отчасти методологией, отчасти тем, что считать прозой. В WildChat непропорционально представлены люди, готовые публиковать свои запросы; цифра OpenAI не включает ролевые сценарии, и компания не смогла подтвердить, учитывает ли она эротику. Бизнесу, оценивающему этот сегмент, стоит спросить у поставщика, какие именно нагрузки охватывают данные об использовании, как считаются сессии и входят ли в них ролевые и взрослые сценарии или они отфильтрованы. Исследователи также отмечают, что нынешние модели плохо справляются с изощрённой прозой, сложными характерами и стилистическими украшениями, лучше работают с проторёнными сюжетными арками и штампами и не удерживают связное повествование на объёме книги.

Следить стоит за тем, сократится ли разрыв в оценках по мере улучшения измерений: если независимые наборы данных и телеметрия провайдеров сойдутся на близкой доле трафика, приходящегося на прозу и ролевые сценарии, значит, это устойчивая потребительская категория, а не артефакт одного публичного набора. Второй сигнал — поведение продуктов: начнут ли выпуски моделей рекламировать память сессии, постоянство персонажей и низкую частоту отказов как главные возможности. Это подтвердило бы, что поставщики видят в этой аудитории платящий рынок. Для бизнеса это означало бы, что те же возможности придут в корпоративные инструменты для обучения, симуляций и агентов, работающих с клиентами.