Post Thumbnail

Nouveau modèle Seed-Coder-8B de ByteDance surpasse des concurrents plus grands

ByteDance, connue comme le créateur de TikTok, a lancé un nouveau modèle de langage pour la programmation appelé Seed-Coder-8B. C’est un petit modèle qui montre des résultats étonnants dans les tâches liées au code. Il surpasse même certaines solutions beaucoup plus grandes, y compris Claude Sonnet 3.7 et o1-mini.

Le modèle est sorti en 3 versions : basique, instructive et un modèle avec raisonnement. Il dispose d’une fenêtre contextuelle de 32 000 tokens.

Ce qui rend ce modèle spécial, c’est avant tout l’approche de la collecte et du traitement des données. ByteDance a utilisé une technique similaire à l’approche de la société DeepSeek, mais considérablement améliorée. Au lieu de multiples filtres manuels pour nettoyer les données sources, ils ont créé un filtre unique basé sur l’intelligence artificielle.

Pour cela, les développeurs chinois ont spécifiquement formé un petit modèle pour évaluer la qualité du code selon des paramètres tels que la lisibilité, la modularité, la clarté et la réutilisabilité. Ensuite, ce modèle a été appliqué à l’ensemble de données, écartant les fichiers les plus problématiques. Cela a permis de se débarrasser d’environ 10% de l’ensemble de données initial, qui était essentiellement juste des déchets.

Des filtres spéciaux basés sur l’intelligence artificielle ont évalué le code de GitHub et d’autres sources web, filtrant les exemples de faible qualité. Ainsi, les développeurs ont filtré des données d’un volume d’environ 2,3 billions de tokens.

Le résultat est impressionnant ! Seed-Coder surpasse les analogues open source de sa taille sur tous les tests, y compris la génération, l’autocomplétion et le raisonnement. Et dans certains cas, même des modèles plus grands. En même temps, les modèles sont complètement ouverts pour l’utilisation et la recherche.

Je pense que c’est précisément la haute spécialisation qui permet d’obtenir des résultats supérieurs dans un domaine spécifique tout en conservant une taille compacte. Cela ouvre la voie à une multitude de modèles hautement spécialisés au lieu d’un seul universel. Le rapport technique, le dépôt et les poids du modèle Seed-Coder-8B sont dans la description.

Auteur: AIvengo
Depuis 5 ans, je travaille dans l'apprentissage automatique et l'intelligence artificielle. Et ce domaine ne cesse de m'étonner, de m'inspirer et de m'intéresser.

Latest News

Robot-sphère chinois RT-G pesant 150 kg atteint 35 km/h

La Chine a une telle merveille d'ingénierie unique — le robot sphérique Rotunbot RT-G. Qui peut changer fondamentalement la perception des technologies policières du futur.

22% des enfants britanniques de 8-12 ans utilisent l'IA sans savoir ce que c'est

22% des écoliers britanniques de 8 à 12 ans utilisent déjà activement des outils d'intelligence artificielle. Bien que la plupart d'entre eux n'aient même jamais entendu le terme "intelligence artificielle générative". Ce sont des données d'une étude de l'Institut Alan Turing et de la Lego Foundation.

Première publicité Google Veo 3 montrée à des millions pendant les finales NBA

Des millions de spectateurs des finales NBA ont été témoins d'une étape complètement nouvelle dans l'évolution créative. Publicité entièrement générée par algorithmes informatiques pour la plateforme de paris Kalshi, créée avec Google Veo 3.

La plateforme chinoise QiMeng crée des processeurs au niveau Intel 486 et Arm

Les scientifiques chinois ont développé une nouvelle plateforme IA capable de concevoir indépendamment des processeurs au niveau d'experts humains. Des chercheurs du Laboratoire d'État pour le développement de processeurs et du Centre de recherche de logiciels intelligents ont présenté un projet open-source appelé QiMeng.

Meta AI transforme les chats privés avec l'IA en posts publics sans connaissance

L'app Meta AI s'est avérée être une vraie catastrophe pour la confidentialité des utilisateurs. Transformant leurs conversations privées avec l'intelligence artificielle en contenu public. Imaginez un film d'horreur moderne : tout votre historique de requêtes est devenu accessible publiquement, et vous ne soupçonniez même rien.