Языковые модели деградируют от интернет-мусора выяснили исследователи

Post Thumbnail

Исследователи обнаружили тревожную штуку. Большие языковые модели могут деградировать от постоянного кормления интернет-мусором. Называется это явление Brain Rot, и звучит это так же жутко, как и выглядит на практике.

Суть проблемы проста: модели постоянно дообучают на низкокачественных и вирусных текстах из интернета. В результате у них развивается когнитивное разложение. Это стойкое снижение способностей к рассуждению, работе с длинным контекстом и безопасному поведению. Искусственный интеллект буквально тупеет от плохой диеты.

Главный симптом исследователи назвали thought-skipping, то есть отсутствие мышления. Модель перестаёт рассуждать шаг за шагом и начинает выдавать поверхностные ответы. Но это ещё не всё. В некоторых случаях система приобретает так называемые тёмные черты личности. Это нарциссизм, агрессию и низкую склонность к сотрудничеству. Да, вы правильно поняли — искусственный интеллект становится токсичным от плохих данных.

А теперь самое неприятное. Даже сильные методы коррекции лишь частично устраняют последствия. Нельзя просто взять и вылечить модель после того, как она нахваталась мусора. Повреждения остаются.

Вывод исследователей однозначен: отбор обучающих данных становится ключевым фактором безопасности при развитии искусственного интеллекта. Проще говоря, если кормить модель говном из интернета, она и вести себя будет соответственно. И исправить это потом почти невозможно. Вот вам и умные технологии — оказывается, они подвержены деградации от низкокачественного контента. Как и люди.

Почитать из последнего
Samsung хотят обойти Apple по ИИ-функциям и вернуть лидерство
В прошлом году Samsung поставила на рынок 400 миллионов мобильных устройств с ассистентом Google Gemini. Этого, видимо, показалось мало. В этом году южнокорейский гигант намерен удвоить количество до 800 миллионов штук. Тэ Мун Ро, один из двух гендиректоров Samsung Electronics, объяснил агентству Reuters это просто. Компания стремится распространить функции ИИ на все устройства и все услуги как можно скорее.
Alibaba научила алгоритм видеть рак там, где врачи пропускают
Каменщик 57 лет в Китае пришёл в больницу проверить диабет. Обычный осмотр, ничего особенного. Через 3 дня ему звонит заведующий отделением поджелудочной железы, мол приезжайте срочно. ИИ, который прогнал его КТ-снимок, нашёл опухоль. Оказалось – рак, но на ранней стадии. Вырезали и мужчина выжил. Без этой технологии его бы нашли слишком поздно, когда 5-летняя выживаемость около 10%.
OpenAI к 2028 году увеличит мощности дата-центров в 90 раз
Epoch AI сделал публично доступным трекер крупнейших дата-центров. А человек из твиттера с ником Peter Gostev визуализировал суммарные мощности по месяцам в разрезе компаний, и цифры просто убийственные.
Робот с лазером собрал 20 млн долларов, чтобы выжигать сорняки ярче солнца
Carbon Robotics привлекла 20 миллионов долларов на разработку третьей линейки продуктов. Компания делает роботов, которые выжигают сорняки лазером и работают в 14 странах. А за всем этим стоит большая растительная модель, которую разрабатывали с первых дней.
Шведский подросток бросил школу и теперь работает научным сотрудником в OpenAI
Габриэлю Петерссону 23 года, он бросил школу в глухом шведском городке и никогда не учился в университете. Но прямо сейчас он работает научным сотрудником в OpenAI в команде Sora. И Габриэль рассказал, как у него так получилось.