Claude Opus 4 решил баг за 2 часа, над которым программист бился 4 года
Программист с 30-летним опытом в C++ и прошлым на позиции Staff Engineer в FAANG рассказал на Реддит, как искусственный интеллект Claude Opus 4 версии решил его “белого кита”. Это баг, с которым он боролся 4 года. Обычно этот разработчик сам помогает коллегам с трудными задачами, решая проблемы, над которыми они бились неделями. Но в этот раз роли поменялись.
Проблема возникла после масштабного рефакторинга, затронувшего 60000 строк кода. Хотя изменения исправили много проблем, они создали баг в граничном случае при использовании определённого шейдера. За эти годы программист потратил около 200 часов на поиски решения, периодически возвращаясь к проблеме.
Наконец, он решил попробовать Claude Code на Opus, предоставив нейросети доступ как к старому, так и к новому коду. За пару часов работы и около 30 промптов с 1 перезапуском искусственный интеллект нашёл причину бага: в старой архитектуре функциональность работала лишь случайно, из-за совпадения, а при рефакторинге этот момент не учли.
Важно отметить, что разработчик ранее пробовал использовать GPT 4.1, Gemini 2.5 и Claude 3.7, но только Opus 4 версии смог решить проблему. Получается, нейросеть превзошла элитного специалиста в решении специфической технической проблемы, требующей глубокого понимания сложного кодового контекста и архитектурных нюансов.
Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Угрозы и $1 трлн не улучшают работу нейросетейВы наверняка видели эти "секретные трюки" для управления нейросетями. Такие как угрозы, обещания наград, эмоциональные манипуляции. Но работают ли они на самом деле? Исследователи из Пенсильванского университета и Уортонской школы бизнеса провели масштабный эксперимент с 5 передовыми моделями: Gemini 1.5 Flash, Gemini 2.0 Flash, GPT-4o, GPT-4o-mini и GPT o4-mini.
Anthropic интегрировал Opus 4.1 в Claude Code и облачные платформыAnthropic выпустил Claude Opus 4.1. Это не просто очередной апдейт, а существенное улучшение кодинговых способностей и агентского функционала. Что особенно радует — новая версия интегрирована не только в классический интерфейс Claude, но и в инструмент Claude Code. А также доступна через API, Amazon Bedrock и Google Cloud Vertex AI.
Samsung ищет замену Google Gemini для Galaxy S26Samsung Electronics, 1 из ведущих производителей мобильных устройств, активно ищет альтернативы Google Gemini для своей будущей линейки Galaxy S26. Компания ведёт переговоры с OpenAI и Perplexity, стремясь расширить экосистему искусственного интеллекта в своих устройствах.
Как языковые модели передают знания через случайные числаВы когда-нибудь задумывались, могут ли числа хранить знания? Учёные обнаружили удивительное явление. Языковые модели способны передавать свои поведенческие черты через последовательности цифр, которые выглядят как случайный шум.