Языковые модели деградируют от интернет-мусора выяснили исследователи

Post Thumbnail

Исследователи обнаружили тревожную штуку. Большие языковые модели могут деградировать от постоянного кормления интернет-мусором. Называется это явление Brain Rot, и звучит это так же жутко, как и выглядит на практике.

Суть проблемы проста: модели постоянно дообучают на низкокачественных и вирусных текстах из интернета. В результате у них развивается когнитивное разложение. Это стойкое снижение способностей к рассуждению, работе с длинным контекстом и безопасному поведению. Искусственный интеллект буквально тупеет от плохой диеты.

Главный симптом исследователи назвали thought-skipping, то есть отсутствие мышления. Модель перестаёт рассуждать шаг за шагом и начинает выдавать поверхностные ответы. Но это ещё не всё. В некоторых случаях система приобретает так называемые тёмные черты личности. Это нарциссизм, агрессию и низкую склонность к сотрудничеству. Да, вы правильно поняли — искусственный интеллект становится токсичным от плохих данных.

А теперь самое неприятное. Даже сильные методы коррекции лишь частично устраняют последствия. Нельзя просто взять и вылечить модель после того, как она нахваталась мусора. Повреждения остаются.

Вывод исследователей однозначен: отбор обучающих данных становится ключевым фактором безопасности при развитии искусственного интеллекта. Проще говоря, если кормить модель говном из интернета, она и вести себя будет соответственно. И исправить это потом почти невозможно. Вот вам и умные технологии — оказывается, они подвержены деградации от низкокачественного контента. Как и люди.

Почитать из последнего
Из-за ИИ клавиатуры исчезнут из офисов
Лондонская школа экономики совместно с Jabra выдала любопытный прогноз. К 28-му году голосовой ИИ станет стандартом в офисах. А поколение Альфа — рождённые после 2010 года — возможно, никогда не узнает, каково это писать email руками. Но пока мне не верится, что клавиатуры действительно исчезнут.
ChatGPT обогнал TikTok и Disney
ChatGPT заработал 3 миллиарда долларов на мобильных подписках. Цифра впечатляет, но ещё интереснее скорость, с которой её достигли.
Собаки-поводыри скоро станут робо-псами с ИИ
Инженеры из США и Южной Кореи превратили робо-пса Unitree Go2 в собаку-поводыря. Модель ИИ GuideNav использует одну обычную камеру вместо дорогих датчиков LiDAR. И это работает.
Американцы заваливают китайский ИИ деньгами
Американские инвесторы завалили китайских разработчиков ИИ деньгами. Несмотря на геополитическое противостояние. Получается, прибыль побеждает политику.
OpenAI и Anthropic внедряют распознавание детей
Компании OpenAI и Anthropic внедряют технологии распознавания несовершеннолетних пользователей чат-ботов. OpenAI обновила правила взаимодействия ChatGPT с пользователями от 13 до 17 лет. Anthropic работает над системой идентификации и блокировки пользователей младше 18.