Post Thumbnail

OpenAI представил ИИ-агента Operator

OpenAI представила Operator — агента на базе GPT-4 o, способного выполнять онлайн-задачи в браузере. Агент работает через специальный интерфейс. Где пользователь видит окно браузера и может контролировать действия ассистента.

Operator использует Computer-Using Agent, комбинирующий визуальные возможности GPT-4 o с продвинутым мышлением. Через обучение с подкреплением. Computer-Using Agent достиг 38,1% успеха на тесте OSWorld. И 87% на WebVoyager, превзойдя предыдущие модели.

Агент работает на удаленном сервере через зашифрованное соединение. Пользователь может перехватывать управление для ввода капчи или платежных данных. У Operator есть набор инструкций для хранения пользовательских предпочтений. Вы можете ввести любой запрос и даже с фото. И ассистент начнет поиск в браузере — можно поручить заказ еды, бронь столика, покупку билетов, вызов такси и многое другое. Также Operator показывает мини-экран со всем, что он делает в реальном времени.

OpenAI делает большой упор на безопасность системы и устойчивость к атакам. Весь процесс мониторится отдельной моделью, которая может вызвать остановку выполнения, если что-то не так. Кроме этого, некоторые подозрительные ситуации будут отправляться на ручную проверку.

Сервис доступен Pro-пользователям в США, через несколько недель будет добавлен в Plus-подписку. И API для разработчиков. Хотя Anthropic и Google показывали похожие демонстрации раньше, OpenAI первой запустила потребительский продукт, несмотря на убыточность Pro-подписки. Остается надеяться, что когда Operator научится делать покупки самостоятельно, он не начнет заказывать подарки себе на день активации.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.

Latest News

Dongfeng внедряет роботов Walker S ростом 1.7м с 41 сервоприводом

Dongfeng Motor объединяет силы с Ubtech Robotics, чтобы интегрировать инновационных роботов Walker S в производственные линии. Эти технологические чудеса ростом 1 метр и 70 сантиметров готовы трансформировать традиционные процессы сборки автомобилей. Генеральный менеджер Dongfeng Motor подчеркивает, что внедрение искусственного интеллекта в этих роботах значительно повысит качество проверки и сборки компонентов.

Аспирант MIT сократил реставрацию картин с 230 часов до 3.5 часов

Аспирант MIT Алекс Качкин разработал крутой метод реставрации картин с помощью искусственного интеллекта. Сокращающий время работы с многих месяцев до нескольких часов. В качестве демонстрации он восстановил работу неизвестного нидерландского мастера 15 века, серьезно пострадавшую от времени.

ИИ-протез из Канады анализирует объекты и решает, как их взять

Искусственный интеллект дарит протезам самостоятельность! Ученые из Мемориального университета Ньюфаундленда создали революционный протез руки, который буквально "думает" сам. В отличие от традиционных моделей, требующих считывания сигналов мышц через датчики, новое устройство полностью автономно.

DeepSeek упаковал движок для LLM в 1200 строк Python кода

Команда DeepSeek представила nano-vLLM. Это легковесный и компактный движок для запуска крупных языковых моделей. Который может изменить представление об эффективности кода. Удивительно, но весь функционал уместился всего в 1200 строк Python-кода! Это настоящий технологический минимализм в мире искусственного интеллекта. Традиционные движки вроде этого, при всей их мощности, часто страдают от перегруженной кодовой базы. Что делает их модификацию настоящим испытанием для разработчиков. Nano-vLLM решает эту проблему, предлагая простой, но мощный инструмент без лишней сложности. Код открыт.

Провал роботакси Tesla: 11 нарушений ПДД за первые дни из 20 машин

Мечта о роботакси сталкивается с суровой реальностью! Тесла запустила публичные испытания беспилотных такси в Остине, но результаты оказались далеки от обещанного технологического чуда. За первые дни тестирования зафиксировано минимум 11 серьезных нарушений правил дорожного движения. И это при том, что на дороги вышло всего 20 автомобилей, отобранных для ограниченного круга блогеров. Филип Купман, профессор Университета Карнеги-Меллон и эксперт по автономным технологиям, не скрывает удивления: "Это ужасно быстро для появления такого количества видео с нестабильным вождением".