Нейросети генерируют код с проблемами намного чаще людей-программистов

Post Thumbnail

Платформа AI-ревью кода CodeRabbit опубликовала отчёт State of AI vs Human Code Generation. И вот вам суровая правда. Ассистенты на ИИ стали массовым инструментом, но сгенерированный ими код содержит в среднем в 1,5 раза больше проблем, чем человеческий. Исследование основано на анализе 470 реальных pull request’ов из открытых проектов на GitHub. 320 с участием искусственного интеллекта и 150 написанных только людьми.

Проблемы затрагивают все ключевые категории качества. Логические ошибки и проблемы с корректностью встречаются на 75% чаще. Это ошибки в бизнес-логике, неверные конфигурации и небезопасные ветвления. Уязвимости безопасности появляются в 1,5-2 раза чаще, особенно некорректная работа с паролями и небезопасный доступ к объектам. Читаемость кода страдает втрое сильнее из-за проблем с именованием и форматированием.

Причина часто в том, что ИИ не дают контекст конкретного проекта. Ему недоступны бизнес-правила, архитектурные ограничения, принятые в команде паттерны. Без этой информации модель генерирует код, который выглядит корректным, но не учитывает специфику репозитория.

Самый большой разрыв — в производительности: неэффективные операции ввода-вывода встречаются в коде от искусственного интеллекта почти в 8 раз чаще. 8 раз, Карл!

Почитать из последнего
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.
Claude объединил чат и Cowork в единую среду
Ещё недавно в Claude приходилось выбирать режим: быстрый вопрос - в чат, работа посложнее - в Cowork. Теперь Anthropic убирает эту границу: Claude Cowork и обычный чат объединяются.
Дженсен Хуанг не увидел смысла в новых законах для ИИ
Глава Nvidia Дженсен Хуанг призвал не замедлять развитие ИИ ради безопасности и заявил, что проблему нужно решать прежде всего инженерными методами. Выступая на Dreamforce, он сказал, что новые законы и правила не нужны: по его мнению, компании сами должны выпускать продукт только тогда, когда уверены в его безопасности, а рынок уже создаёт для этого необходимые стимулы.
OpenAI и Anthropic захотели притормозить ИИ, но не сошлись в деталях
Крупнейшие игроки рынка ИИ заговорили о паузе, однако внутри компаний тут же всплыл неудобный вопрос: кого пускать к секретам разработчиков?