Отец обучения с подкреплением предрек конец эры больших языковых моделей

Post Thumbnail

Ричард Саттон — это 1 из отцов обучения с подкреплением и лауреат премии Тьюринга. Так вот он заявил, что эпоха больших языковых моделей подходит к концу. Дальше, по его мнению, наступает эра опыта. И вот почему он так считает.

По его мнению, большие языковые модели — это тупик. Настоящий интеллект должен учиться на опыте, а не на данных. А современные нейросети — это только имитация интеллекта. Они не имеют опыта, не совершают действий и не получают обратной связи от реальности. Поэтому они не способны к настоящему познанию.

По мнению Саттона, человечество создаёт новую форму жизни, основанную на проектировании, а не биологическом размножении. А мы становимся свидетелями перехода от мира, где всё копируется, к миру, где всё проектируется.

Живые существа — это репликаторы, а искусственный интеллект — проектировщики, объясняет он. Мы можем создать системы, которые будут создавать другие системы, и всё это путём конструирования, а не копирования. По его словам, это новый этап эволюции Вселенной.

Получается, что Саттон смотрит на текущий бум больших языковых моделей как на временное явление. Настоящий прорыв, по его мнению, случится тогда, когда системы искусственного интеллекта начнут учиться через взаимодействие с реальностью, получая обратную связь от своих действий. Не через поглощение терабайтов текста, а через настоящий опыт. Как это делают живые существа.

Вот вам и взгляд 1 из основоположников современного машинного обучения на будущее технологии. Получается, большие языковые модели — это не финал, а всего лишь промежуточный этап.

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?