Электронная почта давно умеет отправлять подозрительные письма в папку со спамом. Теперь учёные решили применить похожий принцип к научным публикациям — и обнаружили масштаб проблемы, который трудно списать на несколько нерадивых авторов.
Созданная исследователями система искусственного интеллекта проверила около 2,6 миллиона научных работ о раке, опубликованных с 1999 по 2024 год.
Более 250 тысяч из них оказались похожи по языку и структуре на статьи, ранее отозванные из-за подозрений в фабрикации. Это почти каждая десятая работа в проверенном массиве.
Однако это не означает, что все отмеченные публикации уже доказанно являются подделками. Алгоритм работает именно как спам-фильтр: он выделяет подозрительные тексты, после чего каждый случай должны проверять люди.
Научные статьи производят почти на конвейере