OpenAI представил ИИ-агента Operator
OpenAI представила Operator — агента на базе GPT-4 o, способного выполнять онлайн-задачи в браузере. Агент работает через специальный интерфейс. Где пользователь видит окно браузера и может контролировать действия ассистента.
Operator использует Computer-Using Agent, комбинирующий визуальные возможности GPT-4 o с продвинутым мышлением. Через обучение с подкреплением. Computer-Using Agent достиг 38,1% успеха на тесте OSWorld. И 87% на WebVoyager, превзойдя предыдущие модели.
Агент работает на удаленном сервере через зашифрованное соединение. Пользователь может перехватывать управление для ввода капчи или платежных данных. У Operator есть набор инструкций для хранения пользовательских предпочтений. Вы можете ввести любой запрос и даже с фото. И ассистент начнет поиск в браузере — можно поручить заказ еды, бронь столика, покупку билетов, вызов такси и многое другое. Также Operator показывает мини-экран со всем, что он делает в реальном времени.
OpenAI делает большой упор на безопасность системы и устойчивость к атакам. Весь процесс мониторится отдельной моделью, которая может вызвать остановку выполнения, если что-то не так. Кроме этого, некоторые подозрительные ситуации будут отправляться на ручную проверку.
Сервис доступен Pro-пользователям в США, через несколько недель будет добавлен в Plus-подписку. И API для разработчиков. Хотя Anthropic и Google показывали похожие демонстрации раньше, OpenAI первой запустила потребительский продукт, несмотря на убыточность Pro-подписки. Остается надеяться, что когда Operator научится делать покупки самостоятельно, он не начнет заказывать подарки себе на день активации.
Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Qualcomm приветствует инвестиции TSMC в размере $100 млрдИнвестиции Taiwan Semiconductor Manufacturing Co. (TSMC) в размере $100 млрд в расширение производства на территории США — "отличная новость", заявил генеральный директор Qualcomm Кристиано Амон в интервью CNBC во вторник, 4 марта 2025 года. По его словам, это способствует диверсификации мест производства полупроводников.
DuckDuckGo усиливает интеграцию генеративного ИИЧастный поисковый сервис DuckDuckGo продолжает укреплять свои позиции в сфере генеративного искусственного интеллекта. Согласно блог-посту, опубликованному в четверг, 6 марта 2025 года, компания объявила о завершении бета-тестирования своего чат-интерфейса, который теперь официально называется Duck.ai, отказавшись от более громоздкого названия DuckDuckGo AI Chat.
Цифровой скандал в Los Angeles TimesМиллиардер и владелец Los Angeles Times Патрик Сун-Шионг, представивший новый AI-инструмент для генерации противоположных перспектив к материалам раздела мнений, не знал, что система создала про-ККК аргументы менее чем через 24 часа после запуска — и даже спустя часы после того, как скандальные AI-комментарии были удалены с сайта издания. Инцидент создал огромное препятствие для Times, которая стремится вернуть старых подписчиков и привлечь новых с помощью инновационных технологических решений.
Google Shopping запускает AI-инструментGoogle объявил о запуске нового AI-инструмента для вкладки Shopping, который поможет пользователям находить одежду по их словесному описанию. Анонс, сделанный в среду, 5 марта 2025 года, также включает расширение возможностей инструментов дополненной реальности (AR) для косметики и виртуальной примерки.
"Не могу помочь с ответами о выборах и политических фигурах": GeminiТехнологический гигант Google по-прежнему ограничивает возможности своего AI-ассистента Gemini в области политического дискурса, несмотря на то что основные конкуренты компании, включая OpenAI, Anthropic и Meta, уже адаптировали свои чат-боты для обсуждения политически чувствительных тем в последние месяцы.