Post Thumbnail

Google и Кембридж научили ИИ мыслить картинками вместо текста

Учёные из Google и Кембриджа представили принципиально новый подход к работе искусственного интеллекта, названный «Visual Planning». Особенность этой технологии в том, что модель мыслит не текстом, а образами. Что гораздо ближе к естественному мышлению человека, особенно при решении пространственных и математических задач.

Исследователи опубликовали статью под названием «Visual Planning: Let’s Think Only with Images», где описали процесс обучения модели прохождению лабиринтов с использованием только визуального мышления, без текстовых рассуждений. Этот подход имитирует способность людей думать схемами и картинками при решении сложных задач. Ссылка в описании. 

Обучение модели проходило в два этапа. Сначала ей показывали множество изображений лабиринтов и учили предсказывать любой возможный следующий шаг. Например, если на картинке агент находится в клетке B, модель должна сгенерировать новое изображение, где агент перемещается в одну из доступных соседних клеток.

На втором этапе исследователи применили обучение с подкреплением. Модель получала положительное вознаграждение за правильный шаг, нулевое — за неправильный, и отрицательное — за недопустимое действие. Таким образом, постепенно она научилась выбирать оптимальные пути через лабиринт. Опираясь только на визуальные образы.

Результаты превзошли ожидания! Visual Planning превосходит даже такую продвинутую модель как Gemini два и пять Pro think в полтора-два раза по эффективности решения задач, требующих пространственного мышления. Я в приятном шоке!

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

NVIDIA не могла продать ИИ-чипы, пока не появился OpenAI

Глава NVIDIA Дженсен Хуанг поделился интересной историей, которая сегодня выглядит как судьбоносный момент в развитии современных технологий.

Pudu Robotics выпустила CC1 Pro — робот убирает 8000 м² за цикл

Компания Pudu Robotics представила новое поколение автономных уборочных систем — CC1 Pro. Который поднимает стандарты чистоты в крупных коммерческих объектах на принципиально новый уровень.

Boston Dynamics выпустила Orbit 5.0 — ИИ сократил проверки на 70%

Вышло крутое обновление Orbit 5.0 для платформы управления роботами Spot от Boston Dynamics. Которое кардинально меняет подход к промышленной аналитике и мониторингу! Система теперь позволяет централизованно контролировать целые парки роботов на множестве объектов, предоставляя операторам детальную аналитику в реальном времени.

Абу-Даби потратит $2.5 млрд на город с ИИ-управлением к 2027 году

Представьте город, где искусственный интеллект заботится о каждом аспекте вашей жизни. Это не фантастика, а ближайшее будущее Абу-Даби! Компании BOLD Technologies и My Aion разрабатывают единую платформу Aion Sentia. Которая возьмёт под контроль все городские системы — от транспорта до здравоохранения и образования.

4 китайских инженера провезли 80 ТБ данных ИИ в рюкзаках в Малайзию

Невероятная технологическая одиссея разворачивается прямо сейчас! Китайские инженеры нашли поразительно аналоговый способ обойти цифровые ограничения. Представьте: 4 сотрудника китайского искусственного интеллект-стартапа летят из Пекина в Куала-Лумпур. И каждый несёт в рюкзаке по 15 жёстких дисков! В общей сложности — 80 терабайт данных для обучения нейросетей.