Новая модель Seed-Coder-8B от ByteDance превосходит более крупных конкурентов

Post Thumbnail

Компания ByteDance, известная как создатель TikTok, выпустила новую языковую модель для программирования под названием Seed-Coder-8B. Это небольшая модель, которая показывает потрясающие результаты в задачах, связанных с кодом. Превосходя даже некоторые гораздо более крупные решения, включая Claude Sonnet 3.7 и o1-mini.

Модель вышла в 3 версиях: базовая, инструктивная и модель с рассуждениями. При этом она имеет контекстное окно в 32000 токенов.

Что делает эту модель особенной — прежде всего, подход к сбору и обработке данных. ByteDance использовали методику, похожую на подход компании DeepSeek, но значительно усовершенствованную. Вместо множества ручных фильтров для очистки исходных данных они создали единый фильтр на основе искусственного интеллекта.

Для этого китайские разработчики специально обучили небольшую модель оценивать качество кода по таким параметрам, как читабельность, модульность, ясность и возможность повторного использования. Затем эту модель применили ко всему набору данных, отбрасывая наиболее проблемные файлы. Таким образом удалось избавиться примерно от 10% исходного набора данных, что представляло собой, по сути, просто мусор.

Специальные фильтры на основе искусственного интеллекта оценивали код из GitHub и других веб-источников, отсеивая низкокачественные примеры. Таким образом разработчики отфильтровали данные объёмом примерно в 2.3 триллиона токенов.

Результат впечатляет! Seed-Coder превосходит аналоги с открытым исходным кодом своего размера на всех тестах, включая генерацию, автодополнение и рассуждения. А в некоторых случаях даже более крупные модели. При этом модели полностью открыты для использования и исследования.

Думаю, именно высокая специализация позволяет достичь превосходных результатов в конкретной области при сохранении компактного размера. Что открывает путь к множеству узкоспециализированных моделей вместо единой универсальной.
Технический отчет, репозиторий и веса модели Seed-Coder-8B — в описании.

Почитать из последнего
Cloudflare даёт сайтам инструмент против обучения ИИ
Cloudflare решила разделить поисковых и обучающих ботов. Для владельца сайта разница принципиальна: поисковик способен привести читателя по ссылке, а обучающий бот просто забирает материал для модели, которая потом выдаёт содержание в ответе.
Рейтинг юристов по искусственному интеллекту 2026: как выбрать под AI-проект
Юрист по искусственному интеллекту — отдельная специализация, а не «IT-юрист, который слышал про нейросети». В 2026 году в России сформировались четыре типа таких практик: узкопрофильные бутики только по IT и AI, крупные фирмы по цифровому праву с AI-направлением, digital-бутики с фокусом на гранты и ЭПР, и гиперспециализированные команды по международному AI-комплаенсу. Различаются они по четырём осям: широта задач (от одного авторского спора до полного governance), международный контур, глубина работы с регуляторикой и модель работы. Ниже — что изменилось в законе в 2026 году, методология сравнения и разбор четырёх платформ: ПравоWeb, АБП, DGTLaw и AI Law.
В Siri обнаружили поддержку сторонних языковых моделей
Apple оставила в iOS 27 и macOS Golden Gate механизмы, которые позволяют подключать к Siri сторонние большие языковые модели. Датамайнер pdfu проверил их на практике и смог связать ассистента с Claude от Anthropic, а серверную модель Siri заменить на GPT-5.6 Terra от OpenAI.
Музыку российских звёзд нашли в открытых датасетах
ИИ учится на миллионах файлов, и иногда в этих массивах обнаруживается контент, который никто не разрешал использовать. Теперь в открытых датасетах для обучения нейросетей нашли тысячи фрагментов музыкального контента российских исполнителей.
Microsoft заставила ИИ просить разрешения на опасные действия
Microsoft предупреждает: Copilot Cowork может ошибиться, неверно понять инструкцию или среагировать на скрытую вредоносную команду. Ответственность за действия остаётся за пользователем, особенно при работе с деньгами и данными.