Препринт-сервер arXiv ограничил загрузки двумя работами в месяц после получения 40 363 статей в сентябре 2026 года, что почти вдвое больше 20 569 в сентябре 2024 года. Ограничение стало ответом на слабые, дробленые и плотные ИИ-статьи, из-за которых за месяц поступило почти 9 000 обращений в поддержку. Для бизнеса это важно, поскольку канал отслеживания исследований в области ИИ становится трудночитаемым.
Почему arXiv ограничил загрузки двумя в месяц
О новом лимите на прошлой неделе сообщила Kat Boboris в публикации, которую обсуждали на Hacker News, указав на стремительный рост подач. Ежемесячные загрузки в категории cs. AI выросли более чем в шесть раз с января 2024 года по сентябрь 2026 года. Для сравнения, в сентябре 2016 года сервер получил лишь 9 869 работ. Модераторы фиксируют больше узких статей и дробление одной работы на мелкие части, а также поток малоценных текстов, которые легко создавать с помощью ИИ.
В мае была введена годичная блокировка за непроверенный ИИ-контент, а в октябре 2025 года для обзорных и позиционных статей потребовали поддержку рецензентов перед публикацией в arXiv. Оба формата требуют меньше усилий, чем полноценное исследование. Некоммерческий статус сервера снижает стимулы принудительно загонять читателей на сайт или требовать вход, в отличие от коммерческих платформ. Его RSS-ленты пока остаются удобными для мониторинга, хотя Reddit планирует закрыть RSS-ленты в следующем месяце.
Нагрузка сосредоточена в исследованиях, связанных с ИИ, которые из нишевой темы превратились в политический и экономический маркер и затмили другие категории. ИИ работает в масштабе как при сборе данных из сети, так и при создании огромного потока заявок, что порождает логистический кризис и кризис качества. Соотношение сигнала и шума ухудшается, поскольку правдоподобные разделы скрывают разрыв между утверждениями и доказательствами. Поэтому появилось направление исследований, измеряющее и сдерживающее снижение качества.
Что SciSlopBench дает исследовательским командам
Коллаборация Seoul National University и University of Minnesota предлагает определять научный мусор как разрывы между утверждениями, доказательствами, цитатами и структурой. Бенчмарк SciSlopBench включает 390 ИИ-статей, каждая из которых сопоставлена со статьей человека по схожей задаче и типу вклада. Он правильно выявил ИИ-статью в 85,9% пар, превзойдя обычные детекторы ИИ-текста. Для компаний это переносит проверку с уровня отдельных фрагментов на логику всей работы.
Сопутствующий фреймворк SciSlopHarness находит и исправляет такие разрывы, сохраняя исходные доказательства, отклоняя неподтвержденные добавления и переупорядочивая утверждения под имеющиеся данные. Он сократил оставшийся разрыв между ИИ и человеком на 63% относительно сильнейшего базового метода правок без эталонных текстов человека. Обычные правки оставляют остаточный мусор, а прямые указания учесть мусор ведут к накрутке метрики. Небольшие команды получают живое демо для проверки статей, а крупные R and D-структуры могут встроить шесть проверок в процесс рецензирования.
Шесть метрик охватывают перекрестные ссылки между разделами, макроповторы, граф аргументов, изоляцию цитат, раскрытие метода рисунками и разрыв доказательств. Датасет объединяет 143 работы из FARS с человеческими статьями ведущих конференций по близкой теме и еще 247 пар из конкурса Agents4Science 2025 года. Качество измеряют метрики PairAcc и AUROC, а детекцию приводят при фиксированной 5% доле ложных срабатываний на статьях человека. Собственная статья авторов набрала в демо умеренные 40 из 100, что показывает: инструмент выявляет слабости, а не выдает знак качества.
