Post Thumbnail

Новейшая модель Claude 3.7 Sonnet штурмует мир Pokémon

Компания Anthropic, один из лидеров в области искусственного интеллекта, представила необычный подход к тестированию своей новейшей модели Claude 3.7 Sonnet, использовав для этого культовую игру Pokémon Red для Game Boy.

Согласно информации, опубликованной в официальном блоге компании 24 февраля, исследователи оснастили модель базовой памятью, возможностью обработки пиксельного ввода с экрана и функциональными вызовами для нажатия кнопок и навигации. Это позволило ИИ непрерывно играть в Pokémon без дополнительной помощи.

Ключевым преимуществом Claude 3.7 Sonnet является функция «расширенного мышления» (extended thinking), аналогичная возможностям OpenAI o3-mini и DeepSeek R1. Эта технология позволяет модели «рассуждать» при решении сложных задач, применяя дополнительные вычислительные ресурсы и затрачивая больше времени на анализ.

Результаты эксперимента оказались впечатляющими. В то время как предыдущая версия модели, Claude 3.0 Sonnet, не смогла даже покинуть стартовый дом в городе Паллет-Таун, где начинается игра, Claude 3.7 Sonnet успешно сразился с тремя гимлидерами (лидерами покемон-стадионов) и получил их значки.

Для достижения этих результатов ИИ выполнил 35 000 игровых действий, чтобы добраться до последнего гимлидера Лейтенанта Сёрджа. Однако точные данные о вычислительной мощности и времени, затраченных на прохождение игры, компания не раскрыла.

Хотя Pokémon Red может считаться скорее развлекательным бенчмарком, использование игр для тестирования ИИ имеет давнюю традицию в исследовательском сообществе. За последние месяцы появился ряд новых приложений и платформ для проверки игровых способностей ИИ-моделей на различных играх – от Street Fighter до Pictionary.

Этот эксперимент демонстрирует растущую способность моделей искусственного интеллекта ориентироваться в сложных интерактивных средах, понимать правила и стратегически планировать действия для достижения долгосрочных целей – навыки, имеющие широкое практическое применение за пределами игровой индустрии.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

ИИ в промышленности: умные каски, инспекторы на 4-х ногах, двойники

Аналитический отчет McKinsey Global Institute говорит, что внедрение решений на базе искусственного интеллекта способно увеличить добавленную стоимость в глобальной промышленности на семь триллионов долларов уже к тридцатому году.  

ИИ в криминалистике: предсказания преступлений, роботы-патрульные

Согласно данным Международной ассоциации криминалистов, внедрение технологий искусственного интеллекта повышает эффективность раскрытия сложных преступлений на тридцать-сорок процентов. Давайте разберёмся, как это происходит.

ИИ в медицине: прорывы, о которых молчат врачи

Трансформация медицины с помощью искусственного интеллекта — это не просто технологический скачок. А фундаментальное изменение подхода к лечению и диагностике заболеваний. Исследования показывают, что глобальный рынок искусственного интеллекта в здравоохранении вырастет до ста сорока пяти миллиардов долларов к тридцатому году. Для понимания роста - в двадцать четвертом году этот рынок составлял тридцать миллиардов долларов. То есть это рост почти в пять раз за шесть лет! Давайте разберемся, что стоит за этими цифрами.

YouTube предлагает бесплатную музыку от ИИ

YouTube запускает революционную функцию, позволяющую креаторам создавать уникальную инструментальную музыку с помощью искусственного интеллекта для своих видео. Об этом компания сообщила в обновлении на своем канале Creator Insider.

США готовы оштрафовать TSMC на $1 млрд за сотрудничество с Huawei

Крупнейшему в мире производителю микросхем Taiwan Semiconductor Manufacturing Company (TSMC) грозит штраф в размере $1 млрд или более по итогам расследования о нарушении экспортного контроля США. Причиной стало обнаружение чипов компании в AI-процессорах Huawei, сообщает Reuters.