Post Thumbnail

OpenAI представил ИИ-агента Operator

OpenAI представила Operator – агента на базе GPT-4 o, способного выполнять онлайн-задачи в браузере. Агент работает через специальный интерфейс. Где пользователь видит окно браузера и может контролировать действия ассистента.

Operator использует Computer-Using Agent, комбинирующий визуальные возможности GPT-4 o с продвинутым мышлением. Через обучение с подкреплением. Computer-Using Agent достиг 38,1% успеха на тесте OSWorld. И 87% на WebVoyager, превзойдя предыдущие модели.

Агент работает на удаленном сервере через зашифрованное соединение. Пользователь может перехватывать управление для ввода капчи или платежных данных. У Operator есть набор инструкций для хранения пользовательских предпочтений. Вы можете ввести любой запрос и даже с фото. И ассистент начнет поиск в браузере — можно поручить заказ еды, бронь столика, покупку билетов, вызов такси и многое другое. Также Operator показывает мини-экран со всем, что он делает в реальном времени.

OpenAI делает большой упор на безопасность системы и устойчивость к атакам. Весь процесс мониторится отдельной моделью, которая может вызвать остановку выполнения, если что-то не так. Кроме этого, некоторые подозрительные ситуации будут отправляться на ручную проверку.

Сервис доступен Pro-пользователям в США, через несколько недель будет добавлен в Plus-подписку. И API для разработчиков. Хотя Anthropic и Google показывали похожие демонстрации раньше, OpenAI первой запустила потребительский продукт, несмотря на убыточность Pro-подписки. Остается надеяться, что когда Operator научится делать покупки самостоятельно, он не начнет заказывать подарки себе на день активации.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
Китайский гуманоид Bumi стоит как iPhone 17 Pro Max

Китайский стартап Noetix Robotics представил человекообразного робота Bumi, который стоит как iPhone 17 Pro Max в Китае. Цена — 9998 юаней. Это примерно 1370 долларов.

Reddit поймал Perplexity на краже контента

Я раньше рассказывал, что компания Reddit подала иск против искусственного интеллекта-поисковика Perplexity. Reddit обвиняет Perplexity в "промышленном" сборе контента. Но теперь есть факты и Reddit показал, как поймала ответчика в ловушку.

OpenAI разрабатывает инструмент для генерации музыки

Компания OpenAI разрабатывает инструмент для генерации музыки на основе текстовых и аудио-промптов. Об этом сообщает The Information со ссылкой на источники. Такой инструмент можно было бы использовать для добавления музыки к существующим видео или для добавления гитарного аккомпанемента к вокальной дорожке.

Amazon превращает курьеров в киборгов с умными очками на ИИ

Amazon решил превратить своих курьеров в киборгов. Нет, серьёзно – компания анонсировала умные очки с искусственным интеллектом для доставщиков. Идея, по словам гиганта e-commerce, в том, чтобы освободить водителям руки. И избавить их от необходимости постоянно переключать взгляд между телефоном, посылкой и окружающим пространством.

OpenAI добавит камео персонажей в Sora

Компания OpenAI опубликовала дорожную карту развития Sora, и знаете что? Похоже, компания наконец-то осознала, что генерация видео – это не просто технологическая демонстрация. А инструмент, которым людям нужно реально пользоваться. Билл Пиблс, глава проекта, анонсировал целый набор обновлений, и некоторые из них действительно интересны.