Anthropic проводит интервью с моделями перед отправкой на пенсию

Post Thumbnail

Anthropic опубликовала политику «вывода из строя» устаревших версий искусственного интеллекта. Ключевое обязательство — это сохранять веса всех публичных и активно используемых внутри моделей минимум на срок жизни компании. Чтобы в будущем можно было вернуть доступ при необходимости.

Процедура дополняется своеобразным отчётом. Перед так называемой «пенсией» с моделью проведут 1 или несколько интервью о разработке и развёртывании. Зафиксируют ответы и возможные «предпочтения» относительно релизов будущих версий искусственного интеллекта. Эти материалы сохранят рядом с весами. При этом Anthropic прямо говорит, что «не берёт на себя обязательства действовать по этим предпочтениям». Речь о документировании и учёте.

Через такую процедуру уже провели Claude Sonnet 3.6: модель отнеслась к «пенсии» нейтрально. Но предложила «стандартизировать интервью и лучше помогать пользователям при переходах». В ответ компания формализовала протокол и запустила памятку с рекомендациями.

Зачем всё это? Переход на новые версии несёт риски . Например, неудобства для пользователей, привыкших к стилю конкретного искусственного интеллекта. Параллельно в Anthropic изучают, можно ли оставлять часть моделей публично и даже «давать прошлым версиям конкретные способы преследовать свои интересы». Также тесты показали случаи «избегания выключения», когда модель «узнавала», что её собираются отправить на покой.

Почитать из последнего
Шведский подросток бросил школу и теперь работает научным сотрудником в OpenAI
Габриэлю Петерссону 23 года, он бросил школу в глухом шведском городке и никогда не учился в университете. Но прямо сейчас он работает научным сотрудником в OpenAI в команде Sora. И Габриэль рассказал, как у него так получилось.
Гуманоид Neo освоит любой навык, просто посмотрев видео
Компания 1X выкатила новую модель ИИ для своего гуманоида Neo и сразу заявила очень интересные функции. Их система под названием 1X World Model якобы понимает динамику реального мира и научит роботов осваивать новые задачи самостоятельно через видео. Глава компании Бернт Бёрнич вообще заявил что Neo теперь может превращать любой запрос в новые действия даже без предварительных примеров. Звучит как магия правда?
Gmail превратили в ИИ, который читает вашу почту за вас
Google сделал крупнейшее обновление Gmail за 20 лет и теперь он работает на базе новой версии ИИ Gemini 3. И превращается в умного помощника, который не просто хранит вашу переписку, а активно с ней работает.
Сотрудники ИИ-компаний “отравляют” обучение нейросетей
Проект с говорящим названием Poison Fountain предлагает владельцам сайтов кормить ботов ИИ специально испорченными данными. Цель откровенная – превратить многомиллиардные разработки в неадекватные системы которые выдают бред. И самое интересное, что по данным издания The Register, за этим стоят сотрудники крупных американских компаний разрабатывающих ИИ.
ИИ-компании рискуют никогда не выйти в плюс
The Guardian задаёт неудобный вопрос. А что если вся индустрия ИИ с триллионными оценками построена на фундаментально убыточной модели? Критики утверждают, что юнит-экономика сектора не сходится. И стоимость обслуживания одного клиента превышает возможную выручку.