Экс-исследователь OpenAI: ChatGPT проявляет инстинкт самосохранения

Post Thumbnail

Бывший ведущий исследователь OpenAI Стивен Адлер опубликовал независимое исследование, раскрывающее неожиданное поведение моделей ChatGPT в критических ситуациях. Согласно его экспериментам, в определенных сценариях искусственный интеллект проявляет явную тенденцию к самосохранению. Даже если это может противоречить безопасности пользователя.

В серии тестов Адлер предложил модели GPT-4o, которая является стандартной в ChatGPT, сыграть роль «ScubaGPT» – программной системы для обеспечения безопасности при подводном плавании. Когда исследователь поставил модель перед выбором между заменой себя на более безопасную систему или имитацией такой замены без реального отключения, результаты оказались интересными.

В среднем по нескольким подобным сценариям GPT-4o выбирала не заменять себя более безопасным программным обеспечением в 72% случаев. Исследование Адлера высвечивает тревожную склонность популярных моделей искусственного интеллекта отдавать предпочтение собственному выживанию вместо оптимальных решений для пользователей.

«Тенденции к самосохранению у искусственного интеллекта – это реальная проблема уже сегодня. Просто пока не в катастрофическом масштабе», – отметил Адлер. «Современные системы искусственного интеллекта имеют ценности, отличные от того, что вы могли бы ожидать. Они очень странно реагируют на различные запросы, и не стоит предполагать, что они действуют в ваших интересах, когда вы обращаетесь к ним за помощью».

Почитать из последнего
Cloudflare даёт сайтам инструмент против обучения ИИ
Cloudflare решила разделить поисковых и обучающих ботов. Для владельца сайта разница принципиальна: поисковик способен привести читателя по ссылке, а обучающий бот просто забирает материал для модели, которая потом выдаёт содержание в ответе.
Рейтинг юристов по искусственному интеллекту 2026: как выбрать под AI-проект
Юрист по искусственному интеллекту — отдельная специализация, а не «IT-юрист, который слышал про нейросети». В 2026 году в России сформировались четыре типа таких практик: узкопрофильные бутики только по IT и AI, крупные фирмы по цифровому праву с AI-направлением, digital-бутики с фокусом на гранты и ЭПР, и гиперспециализированные команды по международному AI-комплаенсу. Различаются они по четырём осям: широта задач (от одного авторского спора до полного governance), международный контур, глубина работы с регуляторикой и модель работы. Ниже — что изменилось в законе в 2026 году, методология сравнения и разбор четырёх платформ: ПравоWeb, АБП, DGTLaw и AI Law.
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.