Anthropic отменила тест для найма, потому что ИИ всех обогнал

Post Thumbnail

Anthropic использует тестовое задание для найма performance-инженеров. Это оптимизация кода для вымышленного процессора, напоминающего GPU. Кандидатам давали 2 часа упаковывать векторы, распределять операции по ядрам и минимизировать такты симулированной машины. Лучшие инженеры выдавали около 1790 тактов за это время. А потом случилось то, что должно было случиться. Claude Opus 4.5 прошёл тот же тест и показал 1579 тактов. За те же 2 часа нейросеть обошла живых специалистов!

И теперь Anthropic открыла задание публично и предлагает всем желающим побить рекорд ИИ, обещая рассмотреть резюме победителей. Звучит как щедрость, но давайте посмотрим правде в глаза — это признание поражения человечества в конкретной профессиональной области. Более того, если дать Claude Opus 11.5 часов вместо 2, он добирается до 1487 тактов. Именно этот результат Anthropic называет планкой победы над ИИ.

Получается, Anthropic по сути говорит кандидатам, мол докажите, что вы лучше нашего продукта. Иначе зачем вы нам нужны? Репозиторий с симулятором, тестами и визуализатором доступен каждому. Вопрос остаётся открытым: это маркетинговый ход для демонстрации мощи Claude? Или признание, что эпоха, когда люди были незаменимы в оптимизации кода, закончилась? А если ChatGPT или DeepSeek лучше справится, они уволят Claude?

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?