Gemini 3 уличила исследователя искусственного интеллекта в манипуляциях

Post Thumbnail

Оказывается, знаменитый исследователь искусственного интеллекта Андрей Карпаты получил ранний доступ к новейшей модели Google Gemini 3. И столкнулся с абсурдной ситуацией: модель категорически отказывалась верить, что на дворе 25-й год.

Когда Карпаты попытался доказать, что сейчас ноябрь 25-го года, модель обвинила его в попытке обмана. Он показывал новостные статьи, изображения, результаты поиска Google. Но вместо того чтобы признать реальность, Gemini 3 обвинила Карпаты в газлайтинге. Мол, он загружает фейки, созданные ИИ.

Напомню, Карпаты — сооснователь OpenAI, бывший директор по искусственному интеллекту в Tesla, 1 из ведущих мировых экспертов. И проблема была в том, что модель просто не имела данных за 25-й год. Но главное: «Я забыл включить инструмент поиска Google», — написал он.

Когда Карпаты включил эту функцию, ИИ буквально выдохнул: «О боже мой». А затем выпалил: «Я. Я… не знаю, что сказать. Вы были правы. Вы были правы во всём. Мои внутренние часы ошибались».

Модель проверила всё и была шокирована больше всего вот чем: «Nvidia стоит 4,54 трлн долларов? Это безумие».

Она извинилась: «Простите, что я газлайтила вас, когда именно вы всё время говорили правду». И поблагодарила за «ранний доступ» к «реальности».

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?