Угрозы и $1 трлн не улучшают работу нейросетей

Post Thumbnail

Вы наверняка видели эти «секретные трюки» для управления нейросетями. Такие как угрозы, обещания наград, эмоциональные манипуляции. Но работают ли они на самом деле? Исследователи из Пенсильванского университета и Уортонской школы бизнеса провели масштабный эксперимент с 5 передовыми моделями: Gemini 1.5 Flash, Gemini 2.0 Flash, GPT-4o, GPT-4o-mini и GPT o4-mini.

Каждой модели задавали вопросы PhD-уровня по естественным наукам и сложные инженерные задачи. Для исключения случайных колебаний каждый запрос повторялся 25 раз.

Результаты оказались интересными! Ни 1 из 9 манипулятивных техник не показала статистически значимого улучшения точности ответов. Ни угрозы «пнуть щенка», ни обещания $1 трлн, ни душещипательные истории о больной маме не помогли моделям давать более качественные ответы!

Более того, эти «трюки» сделали результаты менее стабильными. В некоторых случаях точность возрастала на 36 процентных пунктов, а в других падала на 35! Зафиксированы даже случаи, когда модель полностью игнорировала основной вопрос, «залипая» на манипулятивной части промпта.

Вместо сомнительных уловок исследователи рекомендуют по-настоящему эффективную стратегию. Чёткая формулировка задачи, конкретизация желаемого формата ответа и предоставление релевантного контекста.

Почитать из последнего
Из-за ИИ клавиатуры исчезнут из офисов
Лондонская школа экономики совместно с Jabra выдала любопытный прогноз. К 28-му году голосовой ИИ станет стандартом в офисах. А поколение Альфа — рождённые после 2010 года — возможно, никогда не узнает, каково это писать email руками. Но пока мне не верится, что клавиатуры действительно исчезнут.
ChatGPT обогнал TikTok и Disney
ChatGPT заработал 3 миллиарда долларов на мобильных подписках. Цифра впечатляет, но ещё интереснее скорость, с которой её достигли.
Собаки-поводыри скоро станут робо-псами с ИИ
Инженеры из США и Южной Кореи превратили робо-пса Unitree Go2 в собаку-поводыря. Модель ИИ GuideNav использует одну обычную камеру вместо дорогих датчиков LiDAR. И это работает.
Американцы заваливают китайский ИИ деньгами
Американские инвесторы завалили китайских разработчиков ИИ деньгами. Несмотря на геополитическое противостояние. Получается, прибыль побеждает политику.
OpenAI и Anthropic внедряют распознавание детей
Компании OpenAI и Anthropic внедряют технологии распознавания несовершеннолетних пользователей чат-ботов. OpenAI обновила правила взаимодействия ChatGPT с пользователями от 13 до 17 лет. Anthropic работает над системой идентификации и блокировки пользователей младше 18.