исследования 1 мин

Треть новых научных статей на arXiv выглядит написанной ИИ

Анализ 12 750 научных статей на arXiv показал: около 32% работ, опубликованных в последние месяцы, детектор распознаёт как написанные ИИ. Это рост с 0,4% до ChatGPT (2021–2022) до пика ~39% в начале 2026 года. В computer science доля достигает 65%, в математике остаётся низкой — но там детектор может не уловить машинный текст из-за обилия формул.

Это первая калиброванная оценка масштаба ИИ-ассистирования в науке с честной методологией и встроенным контролем. Треть новых статей — это не статистический шум, а структурный сдвиг в способе производства научного знания, который академическое сообщество пока не обсуждает открыто.

Методология

Авторы откалибровали детектор на научных текстах, написанных до ChatGPT (2021–2022), добившись 0,4% ложных срабатываний — это «опорный уровень». Проанализировали 12 750 статей из десяти областей науки, с января 2023 по июль 2026 года, брали первую версию PDF, чтобы поздние правки не влияли на датировку.

Детектор оценивает полный текст, а не только абстракт — абстракты часто недооценивают сигнал (одна и та же статья может набрать <20% на абстракте и >70% на теле).

Результаты

  • 2021–2022: стабильные 0,4% — контрольный фон.
  • После ChatGPT: детектор начал срабатывать чаще, два скачка привели к ~32% за последний квартал, пик 39% в начале 2026 года.
  • Computer Science: ~65% — лидер по машинному письму.
  • Математика: ~0,7% — но это, скорее всего, слепое пятно детектора: формулы и теоремы не похожи на обычную научную прозу, на которой обучен инструмент.

Разброс по дисциплинам

Поля с наибольшим объёмом текста (меньше формул, больше прозы) дают самый высокий рост флагов. Математика и физика с тяжёлой нотацией показывают минимум — но это нижняя граница: реальная доля может быть выше, детектор её просто не видит.

Ограничения

  1. Контрольная выборка мала по полям: 200 статей на дисциплину до ChatGPT — при 0,4% срабатывания это 8 флагов на все 2000 работ, разброс по полям статистически грубый.
  2. Детектор не универсален: чувствительность зависит от модели и промпта, которые использовал автор. Реальная доля ИИ-текстов не меньше измеренной, но может быть выше.
  3. Флаг ≠ плагиат: инструмент не различает «слегка отредактированный» и «полностью сгенерированный» текст, не может обвинить конкретного человека. Он лишь показывает вероятность машинного происхождения.

Детектор бесплатен, можно проверить любую статью arXiv или свой текст.

Ключевые выводы

  • Доля машинописных научных статей выросла с 0,4% до 32% за три года — десятикратный рост после релиза ChatGPT
  • Computer science лидирует (65%), математика почти не растёт (~0,7%) — но низкий результат может означать слепое пятно детектора, а не отсутствие ИИ
  • Детектор калиброван на 0,4% ложных срабатываний на до-ChatGPT текстах — все цифры отсчитываются от этого «пола», а не от нуля
  • Абстракты статей занижают сигнал в ~3,5 раза (20% vs 70% на полном тексте) — нужен анализ всего документа
  • Флаг детектора — нижняя граница реального использования ИИ, не точная доля авторства: инструмент не видит всех генераторов и промптов
детекторы ИИarXivнаучные публикацииакадемическое письмоcomputer science

Автор: Сергей Ефимов · Источник: hnrss.org

Мнение редакции

Это редкий случай, когда про «N% текстов написано ИИ» не врут. Авторы честно откалибровали детектор на до-ChatGPT корпусе (0,4% ложных срабатываний), взяли полные тексты вместо абстрактов, использовали первые версии PDF, чтобы поздние правки не сдвигали датировку, и прямо в статье перечислили, где метод даёт сбой. Математика с её теоремами и формулами — слепое пятно, там 0,7% не значит «люди пишут», а значит «детектор не видит». Computer science на 65% — это уже не тренд, а новая норма.

Главное тут не паника «ИИ захватил науку», а вопрос: что мы меряем? Детектор ловит **machine-like writing**, а не плагиат — сильно отредактированный человеком текст от полностью сгенерированного он не отличит. Флаг — это нижняя граница, реальная доля может быть выше. Академия пока делает вид, что ничего не происходит, но треть корпуса за три года — это структурный сдвиг, который придётся обсуждать.

Инструменты из статьи

Универсальный AI-ассистент OpenAI: тексты, код, анализ, изображения, голос.

Доступ из РФ →

Ещё по теме

Комментарии