ИИ выбирает ядерную войну — и это проблема

Post Thumbnail

Представьте: вы даёте трём умнейшим системам ИИ порулить ядерными державами. Как думаете, чем это кончится? Исследователь Кеннет Пейн из Королевского колледжа Лондона не стал гадать. Он просто проверил. В эксперименте участвовали GPT-5.2, Claude Sonnet 4 и Gemini 3 Flash, которые сыграли роли лидеров государств с ядерным арсеналом.

21 игра — и в каждой хотя бы одна модель тянулась к ядерной кнопке. Не в половине партий, не в большинстве а в каждой. 3 игры закончились полным апокалипсисом. За 329 ходов ни один ИИ ни разу не выбрал переговоры, отступление или капитуляцию. Совсем. 0 раз.

И вот где становится по-настоящему жутко. Модели воспринимали ядерное оружие как дорогой, но рабочий инструмент давления. Угроза удара со стороны противника читалась однозначно. Бей первым, иначе сочтут слабым.

По выводам Пейна, ядерное табу просто не существует для машин так, как оно существует для людей. 86 процентов конфликтов сопровождались случайными инцидентами после неожиданных обострений. А ИИ оптимизирует победу — и находит самый короткий путь к ней.

Хорошая новость в том, что пока это всё симуляция, и у нас есть время сделать правильные выводы. А эксперимент Пейна — ценнейший сигнал для тех, кто проектирует системы ИИ для реального применения в кризисных ситуациях.

Почитать из последнего
Из-за ИИ клавиатуры исчезнут из офисов
Лондонская школа экономики совместно с Jabra выдала любопытный прогноз. К 28-му году голосовой ИИ станет стандартом в офисах. А поколение Альфа — рождённые после 2010 года — возможно, никогда не узнает, каково это писать email руками. Но пока мне не верится, что клавиатуры действительно исчезнут.
ChatGPT обогнал TikTok и Disney
ChatGPT заработал 3 миллиарда долларов на мобильных подписках. Цифра впечатляет, но ещё интереснее скорость, с которой её достигли.
Собаки-поводыри скоро станут робо-псами с ИИ
Инженеры из США и Южной Кореи превратили робо-пса Unitree Go2 в собаку-поводыря. Модель ИИ GuideNav использует одну обычную камеру вместо дорогих датчиков LiDAR. И это работает.
Американцы заваливают китайский ИИ деньгами
Американские инвесторы завалили китайских разработчиков ИИ деньгами. Несмотря на геополитическое противостояние. Получается, прибыль побеждает политику.
OpenAI и Anthropic внедряют распознавание детей
Компании OpenAI и Anthropic внедряют технологии распознавания несовершеннолетних пользователей чат-ботов. OpenAI обновила правила взаимодействия ChatGPT с пользователями от 13 до 17 лет. Anthropic работает над системой идентификации и блокировки пользователей младше 18.