Учёные обнаружили у ИИ новый феномен — «эффект тренировки в помещении»

Post Thumbnail

Исследователи из Массачусетского технологического института (MIT) и других научных центров совершили неожиданное открытие в области обучения искусственного интеллекта, которое противоречит общепринятым подходам к тренировке ИИ-агентов.

Учёные обнаружили феномен, названный ими «эффектом тренировки в помещении» (indoor training effect). Вопреки традиционному мнению, что симулированная среда обучения должна максимально точно соответствовать реальным условиям работы, исследование показало: тренировка в полностью отличающейся, более предсказуемой среде может привести к лучшим результатам.

«Если мы учимся играть в теннис в закрытом помещении, где нет шума, мы можем легче освоить различные удары. Затем, перейдя в более шумную среду, например, на ветреный корт, у нас может быть более высокая вероятность хорошей игры, чем если бы мы начали обучение в ветреных условиях», – объясняет Серена Боно, научный сотрудник MIT Media Lab и ведущий автор исследования.

Для проверки своей теории исследователи использовали игры Atari, модифицированные для включения элемента непредсказуемости. В частности, они экспериментировали с игрой Pac-Man, изменяя вероятности движения призраков. Результаты оказались неожиданными: ИИ-агент, обученный в версии игры без шума, показывал лучшие результаты в «шумной» среде, чем агент, тренировавшийся в условиях с помехами.

Это открытие особенно важно для развития домашней робототехники. Традиционно считалось, что робот, обученный выполнять бытовые задачи на фабрике, может неэффективно работать на кухне пользователя из-за различий в среде. Новое исследование предлагает принципиально иной подход к решению этой проблемы.

«Это совершенно новый взгляд на проблему. Вместо того чтобы пытаться сделать тренировочную среду максимально похожей на тестовую, мы можем создавать симулированные среды, где ИИ-агент учится даже лучше», – отмечает соавтор исследования Спандан Мадан, аспирант Гарвардского университета.

Почитать из последнего
Инженеры ИИ-компаний тайком используют Claude вместо своего ИИ
Корпорации вливают миллиарды в собственные разработки ИИ и пиарят их на каждом углу. А собственные инженеры втихаря пользуются продуктом конкурентов. Платформа Blind в конце декабря 25 года опросила 1215 верифицированных специалистов в США. И результаты получились убийственные. Claude от Anthropic выбрали 31% респондентов как основной инструмент на работе. Оставив позади ChatGPT с 19%, Gemini с 15% и GitHub Copilot с 14%.
Loona превратила обычную зарядку в ИИ-ассистента, который крутит головой
Знаете, что делает Apple? Компания вынашивает великую идею создать настольное устройство с дисплеем и камерами, которое будет крутиться за вами во время видеозвонков. Вынашивает, обдумывает, разрабатывает. А пока гигант думает, стартап Loona просто взял и сделал это на коленке. Причём использовав тот же iPhone.
Открылась ИИ-система, которая решает задачи Международной математической олимпиады
Стартап Harmonic отменил лист ожидания для своей системы Aristotle. И теперь любой может зарегистрироваться и сразу получить доступ к API. Aristotle — это система автоматического доказательства теорем. Которая в июле 25 года решила 5 из 6 задач Международной математической олимпиады, показав результат на уровне золотой медали. В отличие от аналогов OpenAI и Google DeepMind, которые достигли того же уровня, но остаются закрытыми, Aristotle стал первым публично доступным ИИ такого класса с формальной верификацией.
Программисты либо обесценятся в 10 раз, либо станут в 10 раз ценнее
Django — это очень популярный бесплатный фреймворк с открытым исходным кодом для языка Python. И вот 1 из создателей Django Саймон Уиллисон, озвучил интересные мысли.
Ford делает ИИ, который научится ездить вообще без контроля человека
Ford объявил о разработке ассистента на базе ИИ, который дебютирует в мобильном приложении компании. А потом в 27 году переедет в автомобили. Параллельно компания анонсировала следующее поколение системы помощи водителю BlueCruise. Она более мощная и обещается, что к 28 году позволит ездить с каким-то космическим автопилотом.