Ведущие учёные по ИИ попались на выдуманных ИИ цитатах

Post Thumbnail

Когда престижная конференция по ИИ сама становится жертвой галлюцинаций нейросетей, ирония зашкаливает. GPTZero просканировал все 4841 работу, принятую на Conference on Neural Information Processing Systems в декабре в Сан-Диего. И обнаружил 100 подтверждённых фальшивых цитат в 51 статье. Причём речь идёт о ведущих умах индустрии искусственного интеллекта.

Публикация на NeurIPS – это достижение, достойное резюме в мире исследований ИИ. Логично предположить, что именно эти эксперты могли бы использовать нейросети для катастрофически скучной задачи оформления ссылок. И похоже, так и произошло. Правда, с оговорками: 100 галлюцинаций на 51 работу статистически незначимо. В каждой статье 10 цитат, так что из 10 тысяч ссылок это статистический ноль.

Важно понимать, что неточная цитата не обесценивает само исследование. А каждая работа проходит рецензирование несколькими экспертами, которых инструктируют выявлять галлюцинации.

Но фальшивая цитата – это не пустяк. Для исследователей ссылки – своего рода валюта. Когда искусственный интеллект их выдумывает, это размывает их ценность и подрывает доверие ко всей системе научного цитирования. Похоже, это напоминание о том, что даже ведущие умы не застрахованы от соблазна автоматизации там, где она может навредить.

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?