Google выпустил первую локальную модель Gemini Robotics On-Device

Post Thumbnail

Компания Google представила крутейшую модель Gemini Robotics On-Device. Это 1 в мире решение, объединяющее компьютерное зрение, языковое понимание и физические действия в едином локальном пакете. Которое освобождает роботов от постоянной зависимости от облачных вычислений!

Уникальность новой модели заключается в её универсальности. Она работает как с гуманоидными платформами, так и с промышленными 2-рукими манипуляторами. Впечатляет и способность системы выполнять сложнейшие 2-ручные операции. От манипуляций с мелкими предметами до сборки конструкций и переноса объектов.

Отлично работает и эффективность обучения. Модели достаточно всего 100 демонстраций для освоения новых действий! При этом изначально система тренировалась только на датасете ALOHA с человеческими инструкциями. Но смогла перенести знания на разнообразные робототехнические платформы.

Google одновременно выпустила SDK Gemini Robotics. Это набор инструментов для разработчиков, позволяющий кастомизировать модель под специфические задачи.

Полностью автономная работа для роботов открывает огромные возможности для применения в условиях нестабильной связи. Или при задачах, требующих минимальной задержки отклика. И это может быть стартом новой эры по-настоящему самостоятельных роботов!

Почитать из последнего
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.