Post Thumbnail

Языковые модели деградируют от интернет-мусора выяснили исследователи

Исследователи обнаружили тревожную штуку. Большие языковые модели могут деградировать от постоянного кормления интернет-мусором. Называется это явление Brain Rot, и звучит это так же жутко, как и выглядит на практике.

Суть проблемы проста: модели постоянно дообучают на низкокачественных и вирусных текстах из интернета. В результате у них развивается когнитивное разложение. Это стойкое снижение способностей к рассуждению, работе с длинным контекстом и безопасному поведению. Искусственный интеллект буквально тупеет от плохой диеты.

Главный симптом исследователи назвали thought-skipping, то есть отсутствие мышления. Модель перестаёт рассуждать шаг за шагом и начинает выдавать поверхностные ответы. Но это ещё не всё. В некоторых случаях система приобретает так называемые тёмные черты личности. Это нарциссизм, агрессию и низкую склонность к сотрудничеству. Да, вы правильно поняли — искусственный интеллект становится токсичным от плохих данных.

А теперь самое неприятное. Даже сильные методы коррекции лишь частично устраняют последствия. Нельзя просто взять и вылечить модель после того, как она нахваталась мусора. Повреждения остаются.

Вывод исследователей однозначен: отбор обучающих данных становится ключевым фактором безопасности при развитии искусственного интеллекта. Проще говоря, если кормить модель говном из интернета, она и вести себя будет соответственно. И исправить это потом почти невозможно. Вот вам и умные технологии — оказывается, они подвержены деградации от низкокачественного контента. Как и люди.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
19% старшеклассников в США имели романтические отношения с чатботами

Исследователи в США в новом отчёте о влиянии искусственного интеллекта на школьную жизнь выяснили интересное. Оказывается, целых 19% старшеклассников уже имели романтические отношения с чатботом или знают кого-то, кто имел. Вдумайтесь в эту цифру.

Камеры на головах рабочих обучают ИИ понимать физический труд

Стартап Turing Labs придумал, как обучать искусственный интеллект видеть и понимать мир. Нацепить камеры GoPro на головы фрилансеров и заставить их работать. Звучит как издевательство? Возможно. Но метод, похоже, работает.

OpenAI нанимает банкиров по 150 долларов в час чтобы заменить их ИИ

OpenAI решили научить искусственный интеллект заменять банкиров, и знаете, как они это делают? Нанимают тех самых банкиров, чтобы они обучили нейросеть своей же работе. Ирония ситуации зашкаливает.

YouTube запустил функцию поиска дипфейков с вашим лицом и голосом

Знаете, что смешно? Пока 1 компании запихивают искусственный интеллект во всё подряд, другие вдруг спохватились и начали с ним бороться. YouTube только что запустил функцию «Определение сходства» – инструмент, который ищет дипфейки с вашим лицом и голосом.

Amazon станет первой IT-корпорацией с собственной атомной электростанцией

Amazon решили не мелочиться и замахнулись на атомную электростанцию для своих дата-центров для искусственного интеллекта. Компания приобрела в США крупный дата-центр, который будет питаться напрямую от парка из 12 малых модульных реакторов X-energy Xe-100 общей мощностью 960 мегаватт.