Microsoft обнаружила уязвимости агентов ИИ к манипуляциям в симуляции

Post Thumbnail

Microsoft создала симуляционную среду для тестирования агентов искусственного интеллекта — и обнаружила неожиданные слабости. Исследование, проведённое совместно с Университетом Аризоны, показало, что нынешние агентные модели уязвимы к манипуляциям.

Симуляционная среда получила название «Magentic Marketplace». Типичный эксперимент выглядит так. Агент-клиент пытается заказать ужин согласно инструкциям пользователя, а агенты различных ресторанов конкурируют за заказ. В начальных экспериментах участвовали 100 агентов со стороны клиентов и 300 со стороны бизнеса.

Управляющий директор лаборатории AI Frontiers Lab в Microsoft Research Эсе Камар, объясняет важность таких исследований. Цитирую. «Действительно стоит вопрос, как изменится мир, когда эти агенты начнут сотрудничать, общаться друг с другом и вести переговоры. Мы хотим глубоко понять эти вещи».

Исследование охватило ведущие модели, включая GPT-4 o, GPT-5 и Gemini-2.5-Flash, и обнаружило удивительные слабости. Исследователи нашли несколько техник манипуляции агентами-покупателями. Особенно заметным оказалось падение эффективности при увеличении количества опций.

«Мы хотим, чтобы эти агенты помогали обрабатывать множество вариантов», говорит Камар. «И мы видим, что нынешние модели действительно перегружаются слишком большим количеством опций». Агенты также столкнулись с проблемами при совместной работе над общей целью — модели не понимали, какой агент должен играть какую роль.

Почитать из последнего
Шведский подросток бросил школу и теперь работает научным сотрудником в OpenAI
Габриэлю Петерссону 23 года, он бросил школу в глухом шведском городке и никогда не учился в университете. Но прямо сейчас он работает научным сотрудником в OpenAI в команде Sora. И Габриэль рассказал, как у него так получилось.
Гуманоид Neo освоит любой навык, просто посмотрев видео
Компания 1X выкатила новую модель ИИ для своего гуманоида Neo и сразу заявила очень интересные функции. Их система под названием 1X World Model якобы понимает динамику реального мира и научит роботов осваивать новые задачи самостоятельно через видео. Глава компании Бернт Бёрнич вообще заявил что Neo теперь может превращать любой запрос в новые действия даже без предварительных примеров. Звучит как магия правда?
Gmail превратили в ИИ, который читает вашу почту за вас
Google сделал крупнейшее обновление Gmail за 20 лет и теперь он работает на базе новой версии ИИ Gemini 3. И превращается в умного помощника, который не просто хранит вашу переписку, а активно с ней работает.
Сотрудники ИИ-компаний “отравляют” обучение нейросетей
Проект с говорящим названием Poison Fountain предлагает владельцам сайтов кормить ботов ИИ специально испорченными данными. Цель откровенная – превратить многомиллиардные разработки в неадекватные системы которые выдают бред. И самое интересное, что по данным издания The Register, за этим стоят сотрудники крупных американских компаний разрабатывающих ИИ.
ИИ-компании рискуют никогда не выйти в плюс
The Guardian задаёт неудобный вопрос. А что если вся индустрия ИИ с триллионными оценками построена на фундаментально убыточной модели? Критики утверждают, что юнит-экономика сектора не сходится. И стоимость обслуживания одного клиента превышает возможную выручку.