Post Thumbnail

Claude Opus 4 решил баг за 2 часа, над которым программист бился 4 года

Программист с 30-летним опытом в C++ и прошлым на позиции Staff Engineer в FAANG рассказал на Реддит, как искусственный интеллект Claude Opus 4 версии решил его “белого кита”. Это баг, с которым он боролся 4 года. Обычно этот разработчик сам помогает коллегам с трудными задачами, решая проблемы, над которыми они бились неделями. Но в этот раз роли поменялись.

Проблема возникла после масштабного рефакторинга, затронувшего 60000 строк кода. Хотя изменения исправили много проблем, они создали баг в граничном случае при использовании определённого шейдера. За эти годы программист потратил около 200 часов на поиски решения, периодически возвращаясь к проблеме.

Наконец, он решил попробовать Claude Code на Opus, предоставив нейросети доступ как к старому, так и к новому коду. За пару часов работы и около 30 промптов с 1 перезапуском искусственный интеллект нашёл причину бага: в старой архитектуре функциональность работала лишь случайно, из-за совпадения, а при рефакторинге этот момент не учли.

Важно отметить, что разработчик ранее пробовал использовать GPT 4.1, Gemini 2.5 и Claude 3.7, но только Opus 4 версии смог решить проблему. Получается, нейросеть превзошла элитного специалиста в решении специфической технической проблемы, требующей глубокого понимания сложного кодового контекста и архитектурных нюансов.

Автор: AIvengo
5 лет я работаю с машинным обучением и искусственным интеллектом. И эта сфера не перестает меня удивлять, восхищать и интересовать.
Latest News
ИИ-чатботы генерируют контент, усугубляющий расстройства питания

Совместное исследование Стэнфордского университета и Центра демократии и технологий показало тревожную картину. Чат-боты с искусственным интеллектом представляют серьёзный риск для людей с расстройствами пищевого поведения. Учёные предупреждают, что нейросети раздают вредные советы о диетах. Предлагают способы скрыть расстройство и генерируют "вдохновляющий контент для похудения", который усугубляет проблему.

OpenAGI выпустил модель Lux, которая обгоняет Google и OpenAI

Стартап OpenAGI выпустил модель Lux для управления компьютером и заявляет, что это прорыв. По бенчмаркам модель на целое поколение обгоняет аналоги от Google, OpenAI и Anthropic. Кроме того, она работает быстрее. Примерно 1 секунда на шаг вместо 3 секунд у конкурентов. И в 10 раз дешевле по стоимости обработки 1 токена.

Альтман объявил красную тревогу в OpenAI из-за успехов Google

Сэм Альтман объявил в OpenAI «красный уровень тревоги», и это не просто корпоративная драма. Это признание, что лидер рынка почувствовал дыхание конкурентов сзади. Согласно внутренней служебной записке, он мобилизует дополнительные ресурсы на улучшение ChatGPT в условиях растущей угрозы со стороны Google.

Пользователи тратят больше времени с Gemini, чем с ChatGPT

OpenAI всё ещё лидирует по числу пользователей, но люди начинают проводить больше времени с конкурентами. И это создаёт серьёзную проблему.

Компании возвращают 5% уволенных из-за провала внедрения ИИ

Многие компании начали возвращать уволенных из-за искусственного интеллекта сотрудников. Аналитическая компания Visier изучила данные о занятости 2,5 миллионов сотрудников из 142 компаний по всему миру. Около 5% уволенных сотрудников впоследствии вернулись к предыдущему работодателю. Этот показатель оставался стабильным несколько лет, но недавно начал расти.