9 из 10 научных биомедицинских статей к концу 2025 года написаны с участием ИИ

К концу 2025 года 89% биомедицинских статей в открытом доступе несут следы редактирования или написания с помощью больших языковых моделей. Это оценка, полученная международной группой исследователей, разработавшей новый статистический метод, который впервые позволяет измерить не нижнюю границу использования LLM — как все предыдущие подходы, — а близкую к реальной долю текстов, затронутых ИИ. Метод применили к 1 194 287 полнотекстовым статьям из базы PubMed Central, опубликованным с 2017 по 2025 год. В основе метода лежит анализ частоты 379 служебных и стилевых слов — таких как these, potential, delves, — чья встречаемость резко выросла после появления ChatGPT в конце 2022 года. Для каждого маркерного слова строился контрфактический тренд: линейная регрессия на данных за 2018–2022 годы экстраполировалась на 2023–2025 годы, а отклонение реальной частоты от прогнозной давало оценку доли текстов, прошедших через LLM. Исследователи отбирали оптимальное по размеру подмножество слов, при котором расчётная доля оказывалась максимальной, а стандартная ошибка не превышала 2,5 процентных пункта. Валидация на симулированных данных — 100 000 документов в год с реалистичными параметрами — показала, что ошибка метода не превышает 2 процентных пункта во всём диапазоне возможных значений. Приведение всех разделов статьи к единой длине в 255 слов дало самую высокую оценку для обсуждения — 68% в декабре 2025 года, почти столько же для аннотаций — 67%. Методы оказались наименее затронуты — 32%, причём внутри этого раздела ИИ-редактирование распределено неравномерно: оценка по полному тексту методов составила 54%. Разрыв объясняется тем, что авторы чаще прибегают к LLM для интерпретации результатов, а не для описания процедур.


Источник: IXBT — https://www.ixbt.com/news/2026/09/18/436687-9-iz-10-naucnyx-biomedicinskix-statei-k-koncu-2025-goda-napisany-s-ucastiem-ii.html

Комментарии