ProofreaderPro.ai
ИИ-редактирование и корректура

Аудит галлюцинированных цитат: проверки перед подачей рукописи

Аудит галлюцинированных цитат выявляет фальшивые ссылки, генерируемые ИИ, до подачи. Указание частоты 1 из 277 в PubMed, рабочий процесс с четырьмя базами данных и бесплатные инструменты, которые отмечают такие случаи.

Lisa|Jul 11, 2026|11 мин. чтения
Аудит галлюцинированных цитат: проверки перед подачей рукописи - ProofreaderPro.ai Blog

Предаудит галлюцинированных цитат перед подачей рукописи теперь отделяет чистый экран рабочего стола от флажка, связанного с соблюдением научной добросовестности, и как раз это стало измеряться количественно. Максим Топаз и команда из Columbia, которые проверили 2,5 млн биомедицинских статей, индексированных в PubMed Central, обнаружили то, чего мы все тайно опасались. Число поддельных ссылок, включаемых в рецензируемые биомедицинские журнальные публикации, резко выросло — именно тогда, когда инструменты генеративного ИИ стали частью типового рабочего процесса подготовки текстов у исследователя. Одна из каждых 277 статей, процитированных в первые семь недель 2026 года, содержит по меньшей мере одну ссылку, которую нельзя найти нигде в PubMed, Crossref, OpenAlex или Google Scholar. Два года назад доля составляла 1 из 2 828. Мы наблюдаем 12-кратный рост вероятности того, что фальшивые ссылки окажутся в литературе: наибольший всплеск начинается точно по расписанию — в середине 2024 года.

Аудит Топаза — самая «чистая» из доступных нам оценок, но он не единственный. ArXiv объявил о годовом запрете на подачу для авторов, которые публикуют работы с однозначными ошибками, сгенерированными ИИ, включая галлюцинированные цитаты. Анализ GPTZero 4 841 принятых статей NeurIPS 2025 выявил минимум 100 подтверждённых галлюцинированных цитат в 53 работах после того, как их проверили три-пять экспертов-рецензентов. Исследование Deakin University по ссылкам, сгенерированным GPT-4o, показало, что 56% были либо фальшивыми, либо содержали ошибки, а 64% фальшивых ссылок были «упакованы» с DOI, который указывает на реальную, но не связанную с заявленным контекстом статью — именно этот вариант труднее всего выявлять.

Хорошая новость заключается в том, что предаудит галлюцинированных цитат перед подачей занимает от 20 минут до двух часов в зависимости от размера списка литературы и обнаруживает почти все такие ошибки ещё до того, как их увидит редактор или рецензент. Это и есть пост-аудит. Мы рассматриваем, как именно в 2026 году выглядят галлюцинированные цитаты, описываем рабочий процесс проверки по четырём базам данных, даём пошаговый чек-лист перед подачей, перечисляем инструменты, которые автоматизируют эту работу, и объясняем, что делать, если вы обнаружили такую цитату в рукописи, которая уже находится на рецензировании.

Что такое аудит галлюцинированных цитат?

Аудит галлюцинированных цитат — это проверка перед подачей, которая сверяет каждую ссылку в вашей рукописи с PubMed, Crossref, OpenAlex и Google Scholar, чтобы до того, как редактор или рецензент увидят материал, обнаружить вымышленные либо несоответствующие цитаты. Время выполнения зависит от размера вашего списка литературы: обычно это от 20 минут до двух часов, и обнаруживается почти все подобные ошибки. Это важно, потому что в первые семь недель 2026 года одна из 277 статей, индексированных в PubMed, процитировала по меньшей мере одну ссылку, которая отсутствует где бы то ни было в этих четырёх базах данных — это в 12 раз больше по сравнению с долей 1 из 2 828 в 2023 году.

Почему галлюцинированные цитаты теперь стали проблемой скрининга

Примерно во второй половине 2024 года редакторы начинают замечать галлюцинированные ссылки на своих технических экранах. К середине 2026 года все ведущие медицинские журналы и журналы наук о жизни включают проверку существования ссылок в свои внутренние процедуры допроверки перед рецензированием или в рекомендации рецензентам. Письмо The Lancet, опубликовавшее аудит Топаза, было, среди прочего, публичным обязательством укрепить собственный «входной контроль» журнала.

Операционная причина важности такова: галлюцинированная цитата больше не воспринимается как небрежная ошибка. Её рассматривают как флажок по вопросу научной добросовестности. Переход от «авторы неверно указали год» к «авторы не читали этот источник, потому что он не существует» невелик — и редакторы уже обучены это делать. В большинстве журналов достаточно одной ошибки в списке из 60 позиций, чтобы отклонить рукопись; в самых строгих (The Lancet, BMJ и несколько изданий Nature Portfolio) это может привести к направлению в офис по научной добросовестности при учреждении.

Политика arXiv выражает тот же тезис более жёстко. Любой автор, подающий работу с галлюцинированной ссылкой, может быть заблокирован в arXiv на год. После такого запрета каждая следующая подача в arXiv должна пройти рецензирование в авторитетном издательском пространстве до того, как arXiv примет работу. Это постоянная асимметрия репутационных рисков, основанная на одной непроверенной цитате. Проблема «fake citation pubmed» — это не только проблема PubMed.

Как на самом деле выглядят галлюцинированные цитаты

Большинство авторов представляют галлюцинированную цитату как очевидно сломанную: искажённое название, несуществующее название журнала, год, установленный в будущем. Такие случаи существуют — и это самая лёгкая треть проблем. Сложнее 70% случаев: они выглядят правдоподобно и проходят быструю визуальную проверку.

Мы наблюдаем четыре повторяющихся сценария.

Сценарий 1: реальные авторы, реальный журнал, правдоподобное название, но такой статьи нет. Модель собирает ссылку из данных обучения, которые научили её понимать, какие авторы публикуются где и по каким темам. На выходе получается ссылка, читающаяся как настоящая. DOI, если он присутствует, либо не разрешается, либо разрешается на другую статью.

Сценарий 2: реальная статья, но неверный автор или неверный год. Модель знала, что статья существует, но сопоставила неверное поле метаданных. Ссылка проходит поиск по названию в Google Scholar, но проваливает запрос DOI. Это часто и самый трудный для обнаружения вариант, поскольку процитированное утверждение может на самом деле присутствовать в реальной статье (но под другим автором или годом).

Сценарий 3: реальный DOI, но не связанная статья. Находка исследования Deakin. Модель сформировала правдоподобно выглядящую ссылку и присоединила DOI, который разрешается, но указывает на совершенно другой фрагмент исследований. Визуальная проверка иллюстрирует, что DOI настоящий, однако проблема становится очевидной только после чтения статьи, на которую ведёт ссылка. Это вариант «64%».

Сценарий 4: цепочки «искажённых фраз» вокруг цитаты. Cabanac Problematic Paper Screener отметил более 19 000 статей, содержащих «пытки» формулировок, сгенерированных программами для перефразирования, — часто сгруппированных вокруг придуманных цитат. «Joined Together States» вместо United States, «bosom peril» вместо breast cancer, «kidney disappointment» вместо kidney failure. Если текст вокруг цитаты читается как «отмытый» перефразированием, то вероятность того, что и сама цитата галлюцинирована, выше. Наше примечание о перефразировании, где сохраняются цитаты, описывает разрыв в технике, который и приводит к Сценарию 4. Сценарий 4 коррелирует с Сценариями 1–3, но не является независимым от них.

Именно эти сценарии объясняют, почему одной проверки по одной базе недостаточно. Поиск в Google Scholar только по названию пропускает Сценарии 2 и 3. Проверка Crossref только по DOI пропускает Сценарий 1. Рабочий процесс с четырьмя базами данных существует потому, что каждая из них ловит отдельный тип сбоя.

Как проверять ИИ-цитаты: рабочий процесс с четырьмя базами данных

Мы определяем галлюцинированную ссылку как такую, которая не присутствует ни в одной из PubMed, Crossref, OpenAlex или Google Scholar. Для наших аудитов перед подачей мы опираемся на эти четыре источника, потому что каждый из них закрывает «дыры» трёх остальных.

PubMed. Лучшая полнота покрытия биомедицинской и клинической литературы. Если у одной из ссылок есть PMID, используйте поиск по PMID. В противном случае найдите ссылку по названию и фамилии первого автора. PubMed отклонит многие реальные, но неверно оформленные цитаты, которые Crossref принимает.

Crossref. Лучшая полнота покрытия DOI во всех областях. Ищите ссылку по DOI с помощью этого запроса doi.crossref.org или через их публичный API по адресу api.crossref.org/works/[DOI]. Если запрос не работает — это определённо галлюцинация. Если работает — проверьте название, авторов и год.

OpenAlex. Самое широкое покрытие, бесплатное, и оно находит ссылки, которые не охватываются PubMed и Crossref (гуманитарные науки, конференционные материалы по computer science, региональные журналы). Ищите ссылку по названию и убедитесь, что авторы указаны верно. OpenAlex полезен ещё и потому, что показывает ссылки, существующие как препринты, но ещё не как публикации с DOI.

Google Scholar. Используйте его в конце: это самая широкая по покрытию, но наименее точная проверка. Ссылка, которая не появляется ни в PubMed, ни в Crossref, ни в OpenAlex, ни в Google Scholar, функционально почти наверняка является галлюцинированной. Ссылка, которая появляется только в Google Scholar, но отсутствует во всех структурированных базах, вызывает подозрение: она может существовать (серые источники, диссертация, материалы конференции без DOI), но перед подачей её цитирование требует ручной проверки.

Вручную этот рабочий процесс занимает примерно одну минуту на одну ссылку. Статья на 60 ссылок — это час работы. Систематический обзор на 200 ссылок ближе к трём часам. Аудит утомителен, но механистичен — поэтому он является естественной целью для автоматизации; инструменты рассматриваются в следующем после этого разделе.

Проверьте список литературы перед подачей

Наш корректор в один проход сверяет каждую ссылку с PubMed, Crossref, OpenAlex и Google Scholar, отмечает вымышленные источники и экспортирует аккуратный отчет.

Попробовать бесплатно

Аудит перед подачей: пошагово

Воспроизводимый чек-лист, который мы используем для каждой рукописи, где при подготовке материала мог быть задействован инструмент генеративного ИИ. Восемь шагов — и ни один не требует платного инструмента.

1. Извлеките список литературы в плоском формате. Экспортируйте из менеджера ссылок (Zotero, Mendeley, EndNote, Paperpile) в BibTeX или RIS. Если рукопись набиралась в Word без менеджера, вставьте список литературы в файл обычного текста. Пронумеруйте каждую запись. Эти номера нужны, чтобы отслеживать, какие ссылки уже были проверены.

2. Отметьте любую ссылку, название которой вам не знакомо. Если нельзя представить себе статью, то почти наверняка вы её не читали. Галлюцинированные ссылки имеют самый высокий риск быть ложными — для максимальной тщательности отметьте их.

3. Разрешите (проверьте) каждый DOI. Вставьте каждый DOI в https://doi.org/[DOI]. Если DOI не разрешается, ссылка галлюцинирована. Если разрешается — сравните название статьи-назначения и авторов с тем, что указано в вашей цитате. Несоответствия — это галлюцинации по Сценарию 3.

4. Проверьте каждую ссылку без DOI в PubMed или Crossref. Поиск по названию плюс фамилия первого автора. Если статья существует — сохраните для себя PMID или DOI. Если статьи нет ни в одной из двух баз, переходите к шагу 5.

5. Сверьте «эскалированные» ссылки в OpenAlex и Google Scholar. Если ссылка не проходит проверки в Crossref и PubMed, решающими становятся проверки в OpenAlex и Google Scholar. Неудача во всех четырёх базах данных — это ваше доказательство того, что ссылка галлюцинирована. Если ссылка появляется только в Google Scholar, изучите источник по ссылке вручную.

6. Для препринтов проверьте и сам препринт, и любую опубликованную версию. Распространённый сценарий середины 2024 года и далее: модель цитирует реальный препринт, но придумывает фиктивную журнальную публикацию той же работы. Явно проверьте arXiv, bioRxiv, medRxiv и SSRN на наличие любой ссылки на препринт.

7. Сверьте утверждение в тексте с источником. Откройте саму статью и проверьте, что она поддерживает именно то конкретное утверждение, ради которого вы её цитируете, как минимум в 10% ваших ссылок (или во всех — в случае систематического обзора). Уровень ошибок 56% в исследовании Deakin включает случаи по Сценарию 2: статья, на которую ссылаются, существует, но не подтверждает заявленное утверждение.

8. Зафиксируйте результаты аудита. Сохраните журнал аудита (какие именно ссылки были проверены, по каким базам и в какую дату). Если журнал запросит это во время рецензирования — у вас будут доказательства. Если рецензент оспорит конкретную цитату, вы сможете указать шаг проверки.

Затраты на проведение аудита составляют два часа. Стоимость пропуска — если вас поймают — варьируется от отклонения на техническом скрининге до запрета в arXiv. Запустите аудит.

Инструменты, которые автоматизируют аудит

Все восемь шагов можно выполнить вручную. Но с инструментами вы сделаете это быстрее.

Публичный API Crossref. Бесплатно, без регистрации. Конечная точка api.crossref.org/works/[DOI] возвращает JSON с каноническим названием, авторами и годом. Скрипт на Python объёмом 20 строк, который проходит по вашему списку ссылок и вызывает эту конечную точку, обнаруживает Сценарии 1 и 3 за секунды на одну ссылку. Это минимально возможная автоматизация и обычно достаточно для статьи со 60 ссылками.

Scite (scite.ai). Проверяет ссылки и сообщает, подтверждали ли последующие работы исходное исследование поддерживающе или противоречиво. Лучше всего ловит Сценарий 2 (реальная статья, неверное утверждение), чем другие инструменты, потому что «входит» именно в содержание. Имеется бесплатный тариф; платная версия необходима для полной интеграции.

Problematic Paper Screener (Cabanac, Labbe, Magazinov). Бесплатный, открытый, в основном это скрининг после публикации, но его детекторы полезны перед подачей для Сценария 4. Поиск по dbrech.irit.fr/pls/apex/f?p=9999:1. Удобен для подтверждения того, что текст вокруг ваших цитат не был «отмыт» перефразированием до уровня, при котором он начинает выглядеть как выход «paper-mill».

Проверки ссылок, встроенные в менеджеры ссылок. Если Zotero видит галлюцинированную ссылку, функция «Find Available PDF» не сработает. Аналогичный эффект даёт функция Mendeley, которая заполняет метаданные. Это не специально предназначенная проверка галлюцинаций, но она помогает выявить самые простые проблемы, когда вы используете менеджер ссылок в обычном режиме.

Наш proofreader. Наш ИИ-корректор работает так: за один проход запускает аудит по четырём базам данных, подсвечивает галлюцинированные и несоответствующие ссылки и экспортирует чистый журнал, который вы можете сохранить вместе с рукописью. Мы предоставляем этот инструмент как часть более широкой линейки инструментов ИИ-проверки для научных статей, включая сопутствующие процессы: грамматика, форматирование цитат и отслеживаемые изменения — всё это идёт вместе с аккуратным аудитом ссылок.

Для отдельной проверки перед полным вычитыванием наш бесплатный проверщик цитирований с ИИ выполняет ту же проверку наличия по Crossref, Semantic Scholar и другим открытым реестрам для любого вставленного списка литературы, прямо в браузере и без регистрации.

В большинстве случаев скрипт по API Crossref и ручной список эскалаций помогут поймать 90% проблем для большинства авторов. Инструменты оправдывают себя для систематических обзоров, для исследовательских групп с большим числом подач и в случаях, когда цена единственной пропущенной галлюцинации высока (подача в The Lancet или NEJM, повторная публикация в arXiv после предыдущего флага).

Что делать, если вы нашли галлюцинированную цитату

Вы её обнаружите. По нашему опыту, почти в каждом списке ссылок, где «касались» LLM, есть как минимум одна. В зависимости от стадии вашей рукописи у вас есть два варианта.

Перед подачей. Самый простой случай. Удалите ссылку или замените её на реальную ссылку, которая действительно поддерживает утверждение, либо перепишите соседнее предложение так, чтобы неподтверждённое утверждение было убрано. Зафиксируйте изменение в журнале аудита.

На этапе рецензирования. Уведомьте ответственного редактора письменно как можно раньше, как только вы подтвердили наличие галлюцинации. Приложите исправленный список ссылок и объяснение: что вы обнаружили, как вы это обнаружили, и что вы сделали, чтобы проверить оставшиеся ссылки. Редакторы гораздо лучше реагируют на авторов, которые сами исправляются, чем на авторов, пойманных рецензентом.

Принято, но ещё не опубликовано. Сразу свяжитесь с редактором производства. Большинство издателей примет позднюю коррекцию на этапе верстки, если она подаётся как самокоррекция добросовестности, а не как обычное редакционное правление.

Опубликовано. Свяжитесь с журналом и запросите erratum; в серьёзных случаях — corrigendum. Если галлюцинированная ссылка поддерживает существенное утверждение в статье, исправление может потребовать распространения на само утверждение. Это путь, которого больше всего хочется избежать — и именно такой путь предотвращает аудит.

Заявление об использовании ИИ в вашей рукописи, если вы применяли любые ИИ-инструменты, которые могли затронуть список ссылок, например перефразировщики или генераторы цитат. Также можно раскрыть в сопроводительном письме, что вы провели аудит и сделали самокоррекцию. Это звучит как профессиональная практика, а не как тревожный сигнал.

Часто задаваемые вопросы

В: Насколько распространены галлюцинированные цитаты в 2026 году?

Колумбийский анализ (Topaz et al, Lancet 2026) показал, что одна из 277 статей, индексируемых в PubMed и опубликованных в первые семь недель 2026 года, содержала как минимум одну ссылку. Это в 12 раз больше по сравнению с долей 1 из 2 828 в 2023 году. Тренд растёт. На конференциях с более строгим рецензированием анализ GPTZero по NeurIPS 2025 выявил минимум 100 галлюцинированных цитат в 53 из 4 841 принятых работ — около 1% конференции.

В: Почему вариант с DOI (64%) сложнее всего поймать?

Когда LLM галлюцинирует ссылку, иногда она подставляет реальный DOI из данных обучения, который ведёт на другую статью, а не на ту, что была процитирована. DOI разрешается, другая статья существует, и при быстром визуальном просмотре кажется, что всё в порядке. Лишь после перехода по ссылке на указанную статью становится понятно, что название, авторы или даже содержание цитируемого источника не соответствуют заявленной ссылке. Исследование Deakin показывает, что это было верно для 64% вымышленных цитат, сгенерированных с помощью GPT-4o. Просто проверка разрешения DOI недостаточна — она должна дополняться верификацией того, что ссылка ведёт именно к тому источнику, который заявлен в цитате.

В: Действительно ли arXiv запретит мне подачу на год за галлюцинированную цитату?

Да, когда небрежность однозначна. Thomas Dietterich анонсирует майскую политику arXiv 2026, направленную на случаи, когда авторы вставили вывод LLM, не проверив его; это привело к галлюцинированным ссылкам, оставшемуся тексту-заглушке чат-бота или данным. ArXiv прямо указал, что подлинно оспариваемые или пограничные случаи не входят в область действия политики. После истечения запрета все будущие подачи в arXiv должны сначала пройти рецензирование в авторитетном месте, прежде чем arXiv повторно примет их.

В: Могу ли я просто прогнать мой список ссылок через ChatGPT или Claude для проверки?

Нет. Та же модель, которая галлюцинировала ссылку, может также галлюцинировать и проверку. Мы видели, как LLM уверенно «подтверждала», что сделанные DOI валидны. Проверка должна выполняться по внешним структурированным базам данных (PubMed, Crossref, OpenAlex, Google Scholar), где есть авторитетные метаданные, а не на основании другого LLM.

В: Что если ссылка встречается только в Google Scholar?

Ссылка, которая появляется в Google Scholar, но отсутствует ни в PubMed, ни в Crossref, ни в OpenAlex, выглядит скорее подозрительной, чем подтверждённо галлюцинированной. Некоторые реальные источники (диссертация, материалы конференции без DOI, рабочий документ, региональный журнал) могут появляться в Google Scholar без покрытия структурированной базой. Изучите источник по ссылке вручную. Если вы можете открыть статью и подтвердить утверждение, то ссылка реальна, но недоиндексирована; цитируйте её с уверенностью. Если открыть источник невозможно или ссылка не работает, считайте это галлюцинацией и удалите или замените ссылку.

Корректор для проверки ссылок при подаче в журнал

Аудит ссылок на вымышленные цитирования в один проход с проверкой в PubMed, Crossref, OpenAlex и Google Scholar, с возможностью загрузки журнала верификации для ваших записей.

Lisa - Author at ProofreaderPro.ai
LisaCMO

Лиза получила диплом PhD по лингвистике от NYU, и ей всегда было любопытно, как компьютеры могут использовать прикладную лингвистику для понимания и общения на человеческом языке, а также для помощи в редактировании написанного человеком контента. В настоящее время она является директором по маркетингу в ProofreaderPro, где руководит маркетингом через рекламу, социальные сети, электронную почту и офлайн-каналы.

Продолжить чтение

Проверьте DOCX с отслеживанием изменений в 2026 году - ProofreaderPro.ai Blog
AI проверка и редактирование11 мин. чтения

Проверьте DOCX с отслеживанием изменений в 2026 году

DOCX-корректор с реальными отслеживаемыми изменениями должен быть «родным» для Word. Как вернуть правки, которые можно просматривать, в ваш .docx, а не в перепечатанную копию.

Jul 12, 2026
Процесс — это новое «доказательство»: исправления с фиксацией лучше детекторов - ProofreaderPro.ai Blog
AI проверка и редактирование11 мин. чтения

Процесс — это новое «доказательство»: исправления с фиксацией лучше детекторов

Исправления с фиксацией и ИИ в академической работе: почему суды, журналы и университеты теперь доверяют истории вашего черновика больше, чем баллам детекторов, когда нужно отстоять авторство.

Jul 11, 2026
Как вычитать и отредактировать LaTeX-статью в Overleaf (не нарушая математику) - ProofreaderPro.ai Blog
AI проверка и редактирование9 мин. чтения

Как вычитать и отредактировать LaTeX-статью в Overleaf (не нарушая математику)

Практический рабочий процесс для вычитки LaTeX-работ и проектов в Overleaf с помощью AI. Что нужно копировать, а что лучше оставить как есть, стратегия разбиения на фрагменты, возврат правок и работа с формулами без разрушения ваших уравнений.

May 26, 2026

Попробуйте ИИ-корректор бесплатно

Начните бесплатно
Proofreader Pro AI
Усовершенствуйте ваше исследование с ProofreaderPro.ai, ведущим в мире редактором на базе искусственного интеллекта, адаптированным для академических текстов.
ProofreaderProAI, Greenleaf Ave, Staten Island, 10310 New York
Бесплатные инструменты
Удалитель длинного тиреСчетчик словПроверка грамматикиГенератор цитатПроверка читаемостиAI очиститель текстаПроверка страдательного залогаКонвертер в Title CaseРасширитель сокращенийПроверка формальности
Все бесплатные инструменты
© 2026 ProofreaderPro.ai. Ведущий академический корректор, редактор и гуманизатор. Сделано с ❤️ и лингвистически правильный синтаксис 🌳s