Новая модель Seed-Coder-8B от ByteDance превосходит более крупных конкурентов

Post Thumbnail

Компания ByteDance, известная как создатель TikTok, выпустила новую языковую модель для программирования под названием Seed-Coder-8B. Это небольшая модель, которая показывает потрясающие результаты в задачах, связанных с кодом. Превосходя даже некоторые гораздо более крупные решения, включая Claude Sonnet 3.7 и o1-mini.

Модель вышла в 3 версиях: базовая, инструктивная и модель с рассуждениями. При этом она имеет контекстное окно в 32000 токенов.

Что делает эту модель особенной — прежде всего, подход к сбору и обработке данных. ByteDance использовали методику, похожую на подход компании DeepSeek, но значительно усовершенствованную. Вместо множества ручных фильтров для очистки исходных данных они создали единый фильтр на основе искусственного интеллекта.

Для этого китайские разработчики специально обучили небольшую модель оценивать качество кода по таким параметрам, как читабельность, модульность, ясность и возможность повторного использования. Затем эту модель применили ко всему набору данных, отбрасывая наиболее проблемные файлы. Таким образом удалось избавиться примерно от 10% исходного набора данных, что представляло собой, по сути, просто мусор.

Специальные фильтры на основе искусственного интеллекта оценивали код из GitHub и других веб-источников, отсеивая низкокачественные примеры. Таким образом разработчики отфильтровали данные объёмом примерно в 2.3 триллиона токенов.

Результат впечатляет! Seed-Coder превосходит аналоги с открытым исходным кодом своего размера на всех тестах, включая генерацию, автодополнение и рассуждения. А в некоторых случаях даже более крупные модели. При этом модели полностью открыты для использования и исследования.

Думаю, именно высокая специализация позволяет достичь превосходных результатов в конкретной области при сохранении компактного размера. Что открывает путь к множеству узкоспециализированных моделей вместо единой универсальной.
Технический отчет, репозиторий и веса модели Seed-Coder-8B — в описании.

Почитать из последнего
OpenAI готовит IPO, но Альтмана это раздражает
Основатель OpenAI Сэм Альтман признался, что его абсолютно не прельщает идея быть главой публичной компании. И это на фоне подготовки OpenAI к 1 из крупнейших IPO в истории.
Нейросети загрязняют планету в тысячи раз меньше чем люди
Вот вам парадокс, который разорвёт мозг всем борцам за экологию и против ИИ одновременно. Пока все пишут про то, как нейросети жрут электричество и убивают планету, учёные взяли и посчитали реальные цифры. И знаете что? Оказалось, что искусственный интеллект оставляет углеродный след в сотни и тысячи раз меньше, чем живые писатели и художники.
Samsung засунет искусственный интеллект Gemini в холодильники
Samsung решила, что обычные холодильники — это прошлый век, и на выставке CES представит обновлённую линейку кухонной техники со встроенным ИИ Google Gemini. Да-да, теперь нейросеть будет жить прямо в вашем холодильнике.
Claude Opus 4.5 побил рекорд автономности, но работает через раз
Организация METR, которая тестирует способности нейросетей, зафиксировала рекорд у Claude Opus 4.5 от Anthropic. Модель может автономно работать над задачами длительностью почти 5 часов. 4 часа 49 минут, если точно. Это в 1,5 раза дольше, чем у предыдущего лидера GPT-5.1 от OpenAI, который держался на отметке 2 часа 53 минуты.
ИИ с лицом Аристотеля рассуждает о смысле жизни
Помните, как Стив Джобс мечтал засунуть Аристотеля в компьютер и задавать ему вопросы? Мейкер Никодем Бартник решил проверить, реально ли это. И собрал роботизированную голову, которая отвечает так, будто древнегреческий философ только что вернулся из прошлого.