Le consortium de recherche allemand dévoile le modèle d'IA open-source Soofi
L'Association allemande pour l'intelligence artificielle a officiellement lancé Soofi S30B-A3B, un nouveau modèle de langage large open source. Cette étape marque une avancée majeure pour l'infrastructure souveraine européenne en matière d'IA et dynamise le secteur open source en mettant l'accent sur des performances élevées et une efficacité accrue.
Soofi S30B-A3B se distingue par une architecture innovante qui équilibre efficacité et puissance. En utilisant une conception de Mélange d'Experts (MoE) combinée à des couches Mamba-2 et des couches d'attention standard, le modèle compte 31,6 milliards de paramètres mais n'en active qu'environ 3,2 milliards par jeton. Cette approche réduit considérablement les coûts de calcul, offrant des vitesses comparables à celles de modèles plus petits tout en maintenant un débit élevé. Il gère notamment des contextes longs (jusqu'à 40 000 jetons) avec un débit de génération huit fois supérieur à celui des modèles denses traditionnels, garantissant ainsi une stabilité même lorsque la longueur du contexte augmente.

L'entraînement a priorisé la maîtrise de la langue allemande. Sur plus de 27 billions de jetons, l'équipe a augmenté la proportion de données allemandes de 7,2 % à 15,3 %, en intégrant diverses sources telles que Wikipédia, les actualités et des documents techniques. Cette stratégie assure des performances exceptionnelles dans des tâches complexes en langue allemande.
Les benchmarks confirment la position de leader de Soofi S30B-A3B parmi les modèles open source en anglais et en allemand, surpassant OLMo332B et Apertus70B. Il excelle dans la génération de code, le raisonnement professionnel et la connaissance régionale. Cependant, l'équipe note qu'il existe des marges d'amélioration dans l'extraction de contextes ultra-longs et le raisonnement mathématique en allemand.

Entraîné sur le Cloud IA industriel de Deutsche Telekom à Munich, en utilisant 512 GPU Nvidia B200, ce projet fait partie de l'initiative européenne IPCEI-CIS. Alimenté entièrement par des énergies renouvelables, les poids du modèle, le code d'évaluation et les listes de données seront progressivement mis en open source. Cette transparence soutient les applications industrielles européennes, et l'équipe recherche actuellement des partenaires industriels pour explorer des utilisations dans la documentation technique et la génération de code.
Article connexe
L'estimation de 6,4 milliards de dollars de Toyota consacrée à la robotique place l'IA physique sous les projecteurs
Toyota Motor prévoit que le déploiement de l’automatisation dans ses installations de fabrication, ses filiales et ses principaux fournisseurs pourrait nécessiter environ 400 000 robots et une dépense annuelle d’environ 1 000 milliards de yens (6,4 m
Meta Open-Sources 30B-Parameter Muse Glimmer for Local AI Agent on Consumer Hardware
Le 10 août, Meta a lancé Muse Glimmer, un modèle open source conçu pour autonomiser les agents IA locaux sur le matériel grand public, marquant une étape clé de sa stratégie « Superintelligence Personnelle ». Avec 30 milliards de paramètres, ce modèl
GPT-5.6 pourrait être lancé la semaine prochaine, en mettant l’accent sur des capacités opérationnelles de niveau agent
Le paysage concurrentiel de l’intelligence artificielle s’intensifie rapidement. Les récentes fuites concernant les mises à jour des tests ont placé le nouveau modèle phare, GPT-5.6, sous les projecteurs. Le consensus du marché suggère un lancement o
Recommandations de sujets spéciaux liés
commentaires (0)
L'Association allemande pour l'intelligence artificielle a officiellement lancé Soofi S30B-A3B, un nouveau modèle de langage large open source. Cette étape marque une avancée majeure pour l'infrastructure souveraine européenne en matière d'IA et dynamise le secteur open source en mettant l'accent sur des performances élevées et une efficacité accrue.
Soofi S30B-A3B se distingue par une architecture innovante qui équilibre efficacité et puissance. En utilisant une conception de Mélange d'Experts (MoE) combinée à des couches Mamba-2 et des couches d'attention standard, le modèle compte 31,6 milliards de paramètres mais n'en active qu'environ 3,2 milliards par jeton. Cette approche réduit considérablement les coûts de calcul, offrant des vitesses comparables à celles de modèles plus petits tout en maintenant un débit élevé. Il gère notamment des contextes longs (jusqu'à 40 000 jetons) avec un débit de génération huit fois supérieur à celui des modèles denses traditionnels, garantissant ainsi une stabilité même lorsque la longueur du contexte augmente.

L'entraînement a priorisé la maîtrise de la langue allemande. Sur plus de 27 billions de jetons, l'équipe a augmenté la proportion de données allemandes de 7,2 % à 15,3 %, en intégrant diverses sources telles que Wikipédia, les actualités et des documents techniques. Cette stratégie assure des performances exceptionnelles dans des tâches complexes en langue allemande.
Les benchmarks confirment la position de leader de Soofi S30B-A3B parmi les modèles open source en anglais et en allemand, surpassant OLMo332B et Apertus70B. Il excelle dans la génération de code, le raisonnement professionnel et la connaissance régionale. Cependant, l'équipe note qu'il existe des marges d'amélioration dans l'extraction de contextes ultra-longs et le raisonnement mathématique en allemand.

Entraîné sur le Cloud IA industriel de Deutsche Telekom à Munich, en utilisant 512 GPU Nvidia B200, ce projet fait partie de l'initiative européenne IPCEI-CIS. Alimenté entièrement par des énergies renouvelables, les poids du modèle, le code d'évaluation et les listes de données seront progressivement mis en open source. Cette transparence soutient les applications industrielles européennes, et l'équipe recherche actuellement des partenaires industriels pour explorer des utilisations dans la documentation technique et la génération de code.
L'estimation de 6,4 milliards de dollars de Toyota consacrée à la robotique place l'IA physique sous les projecteurs
Toyota Motor prévoit que le déploiement de l’automatisation dans ses installations de fabrication, ses filiales et ses principaux fournisseurs pourrait nécessiter environ 400 000 robots et une dépense annuelle d’environ 1 000 milliards de yens (6,4 m
Meta Open-Sources 30B-Parameter Muse Glimmer for Local AI Agent on Consumer Hardware
Le 10 août, Meta a lancé Muse Glimmer, un modèle open source conçu pour autonomiser les agents IA locaux sur le matériel grand public, marquant une étape clé de sa stratégie « Superintelligence Personnelle ». Avec 30 milliards de paramètres, ce modèl
GPT-5.6 pourrait être lancé la semaine prochaine, en mettant l’accent sur des capacités opérationnelles de niveau agent
Le paysage concurrentiel de l’intelligence artificielle s’intensifie rapidement. Les récentes fuites concernant les mises à jour des tests ont placé le nouveau modèle phare, GPT-5.6, sous les projecteurs. Le consensus du marché suggère un lancement o





Maison






