Сотрудники ИИ-компаний “отравляют” обучение нейросетей

Post Thumbnail

Проект с говорящим названием Poison Fountain предлагает владельцам сайтов кормить ботов ИИ специально испорченными данными. Цель откровенная – превратить многомиллиардные разработки в неадекватные системы которые выдают бред. И самое интересное, что по данным издания The Register, за этим стоят сотрудники крупных американских компаний разрабатывающих ИИ.

Представьте себе картину. Люди которые днём пишут код для обучения нейросетей, вечером саботируют собственную индустрию. Проект стартовал на прошлой неделе, и инсайдер предупреждает, что ситуация обостряется так как общественность в целом не осознаёт. На сайте активисты прямо ссылаются на Джеффри Хинтона, одного из крёстных отцов современного ИИ который теперь стал его громким критиком. «Мы согласны что машинный интеллект представляет угрозу для человеческого вида», пишут они без обиняков.

А вот тут начинается техническая часть. Весь успех современного ИИ построен на огромных массивах данных из интернета. Испортьте данные – и вы испортите ИИ, логика такая. Проект предоставляет ссылки на отравленные датасеты которые владельцы сайтов могут спрятать в коде своих страниц. Эти ссылки обеспечивают практически бесконечный поток испорченных тренировочных данных. Это код с логическими ошибками и багами способными повредить большие языковые модели.

Инсайдер проекта объяснил изданию The Register что атаки отравлением компрометируют когнитивную целостность модели. И добавил фразу которая звучит как приговор – нет иного способа остановить прогресс этой технологии теперь когда она распространилась по всему миру.

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?