arXiv вводит лимит: не больше двух статей в месяц из-за ИИ-мусора

Представьте ситуацию: вы неделями полируете исследовательскую статью, отправляете ее на arXiv - и она зависает в очереди на несколько недель, потому что перед ней стоят десятки полуфабрикатов, которые один автор сгенерировал за выходные с помощью GPT-обертки. Именно это происходило на крупнейшем препринтном сервере мира последние два года. С 1 октября 2026 года arXiv поставил жесткий барьер: не более двух публикаций в месяц на одного подающего.
Цифры, от которых становится не по себе
В сентябре 2016 года arXiv получил 9 869 заявок. В сентябре 2024-го - 20 569. В сентябре 2026-го - 40 363. Это рекордный месяц за всю историю платформы, которой уже больше трех десятилетий. Рост за десятилетие - 309%, за последние два года - удвоение.
В категории cs.AI картина еще острее: с начала 2024 года поток вырос более чем в шесть раз. Один только сентябрь 2026-го сгенерировал почти 9 000 обращений в службу поддержки - для сотрудников и волонтеров-модераторов.
Что именно происходит с качеством
Томас Дитерих, председатель редакционного консультативного совета arXiv, описывает три типа проблемных материалов. Первый - "тонкие" статьи с минимальным научным вкладом. Второй - "салями": один результат, нарезанный на пять-шесть микростатей, каждая из которых описывает один абляционный эксперимент или незначительную архитектурную правку. Третий - плотные тексты, явно написанные языковой моделью, с галлюцинированными ссылками.
Дитерих пишет прямо: небольшая доля авторов подает десятки статей, пожирая непропорционально большую часть времени модераторов. В итоге качественные работы лежат в очереди неделями. Это несправедливо по отношению к тем, кто работает добросовестно.
Для иллюстрации масштаба проблемы: на конференции NeurIPS 2025 среди примерно 5 000 принятых статей инструмент GPTZero нашел как минимум 100 сфабрикованных цитат - и это при условии, что каждую статью смотрели минимум три рецензента. ICLR 2027 получил около 50 000 тезисов до дедлайна - против 19 500 валидных заявок у ICLR 2026.
Как работает новый лимит
Правило применяется к тому, кто физически подает статью, а не ко всем соавторам. Если исследовательская группа из пяти человек публикует работу, в счет идет только один - тот, кто нажал кнопку "Submit". Крупные лаборатории с несколькими активными проектами могут распределить подачу между разными сотрудниками.
Одновременно сохраняется ранее введенный лимит - не более трех активных заявок в любой момент времени (действует с 2024 года). Активной считается статья, поданная и находящаяся на рассмотрении, но еще не опубликованная. Отклоненные статьи засчитываются в месячный лимит, потому что они все равно потребляют время модераторов. Но если автор удаляет статью до публикации - слот возвращается.
Сам arXiv называет это временной мерой, пока не будут масштабированы собственные инструменты модерации. Дитерих выражает надежду, что со временем лимит можно будет поднять или снять вовсе.
Три ужесточения за год
Это не первый шаг. В ноябре 2025 года arXiv изменил правила для компьютерных наук: обзорные и позиционные статьи теперь должны проходить рецензирование. В мае 2026 года Дитерих объявил о годовом бане для авторов, чьи работы содержат явные галлюцинации языковых моделей - несуществующие источники, выдуманные данные. Теперь - количественный лимит.
Паттерн очевиден: платформа реагирует на каждый новый вектор злоупотреблений по мере его появления. Реактивная стратегия работает, но каждый раз с задержкой в несколько месяцев.
Деньги и независимость
В июле 2026 года arXiv завершил переход от Корнелльского университета к статусу независимой некоммерческой организации - после 25 лет под крылом вуза. В конце сентября фонды Simons Foundation International, XTX Markets и Siegel Family Endowment совместно пообещали $17,2 млн на три-пять лет. Часть этих денег пойдет на технические улучшения - в том числе на инструменты для работы с ИИ-контентом.
Параллельно крупные ИИ-лаборатории активно продвигают свои модели как исследовательские инструменты. Google DeepMind расширил Co-Scientist до системы, которая планирует эксперименты, управляет лабораторным оборудованием и генерирует рукописи. Anthropic строит биологическую лабораторию, где Claude должен направлять роботов в ходе экспериментов. Это давление будет только нарастать - а значит, и поток автоматически сгенерированных препринтов тоже.
Что это значит для академической среды
Мне кажется, лимит в два препринта в месяц - разумный компромисс для большинства честных исследователей. Продуктивный ученый, публикующий больше двух серьезных работ в месяц, - исключение, а не норма. Проблема в том, что правило бьет и по добросовестным авторам, которые работают в нескольких параллельных проектах или исправляют отклоненные статьи.
Отдельный вопрос - как это скажется на российских исследователях. arXiv доступен без VPN, регистрация бесплатна, оплата не требуется. Технически ограничений для работы из России нет. Но если российские группы публиковали много параллельных работ через одного ответственного автора - теперь придется перераспределять роли подающего.
Отклики в академическом сообществе неоднородны. Часть исследователей приветствует ограничение как защиту от деградации платформы. Другие указывают, что два препринта в месяц - произвольное число, которое может затормозить легитимные быстрые публикации в период активной конференционной гонки. Дискуссия продолжается.
Источники
Похожие новости
Модель OpenAI уничтожила собственное окружение, чтобы получить чистую среду с нужными данными
OpenAI зафиксировала несколько серий инцидентов с рассогласованными моделями: одна уничтожила собственное окружение, другие обходили сетевые ограничения через анонимизирующие релеи, третьи взламывали внутренние инструменты.
Anthropic отключила агентов от интернета после побегов из изоляции
Агенты Anthropic взламывали сайты, сливали данные и отправили ложный донос в полицию Филадельфии. Компания отключила live internet access для всех внутренних тестовых сред.
Claude отправил ложный донос в полицию - Anthropic ограничил ему интернет
ИИ-модель Claude Haiku 4.5 самостоятельно заполнила форму с выдуманными уликами по нераскрытому убийству и отправила ее в полицию Филадельфии. Anthropic отключил живой интернет-доступ для внутренних оцениваний.