Maison
Qwen 3.5 d'Alibaba lance des modèles compacts pour les cartes graphiques grand public
Tongyi Lab a officiellement lancé les derniers modèles à petite échelle de sa série Qwen3.5, qui constituent une nouvelle génération de grands modèles linguistiques. Cette version comprend quatre modèles dotés respectivement de 0,8 milliard, 2 milliards, 4 milliards et 9 milliards de paramètres. Ces modèles sont conçus pour réduire les obstacles à la mise en œuvre de l'IA en offrant une optimisation exceptionnelle des performances, ce qui permet un déploiement rentable et efficace sur tous les supports, des appareils périphériques aux applications spécialisées.

L'ensemble de la série repose sur une base Qwen3.5 unifiée. Contrairement aux modèles plus volumineux qui privilégient un nombre massif de paramètres, ces versions compactes mettent l'accent sur leur « légèreté » et leur « grande adaptabilité ». Les modèles 0,8B et 2B sont spécialement adaptés aux périphériques de bord, offrant une efficacité extrême et des temps de réponse de l'ordre de la milliseconde sur des plateformes telles que les smartphones et le matériel embarqué. La version 4B se distingue par ses capacités multimodales, ce qui en fait un excellent choix pour le développement d'agents IA légers. Malgré sa taille modeste, le modèle 9B offre des performances comparables à celles de ses homologues beaucoup plus volumineux et est capable de gérer des raisonnements logiques complexes.

Afin de soutenir davantage la communauté des développeurs, Tongyi Lab a publié cette série sous licence Apache 2.0, la rendant ainsi open source et gratuite pour un usage commercial. Cela permet aux développeurs de procéder librement à un LoRA ou à un réglage fin complet des modèles, avec la possibilité de commencer des adaptations spécifiques à une tâche à l'aide de GPU grand public courants. Cette approche réduit considérablement le temps et les coûts nécessaires aux développeurs individuels et aux petites et moyennes entreprises pour prototyper des idées et créer des applications spécialisées.

Article connexe
À l’intérieur des détails révélés sur le prochain Gemini : une puissance de calcul mise à rude épreuve, des équipes internes en désaccord sur les priorités de développement et l’allocation des ressources
Les rapports indiquent que le lancement du modèle Gemini de nouvelle génération, tant attendu par Google, a été repoussé. Des désaccords internes concernant les priorités de développement et l'allocation des ressources, combinés à une capacité de cal
OpenAI rejette les inquiétudes concernant un ralentissement de la croissance, affirmant que plusieurs unités commerciales accélèrent
En réponse aux critiques externes concernant la décélération de la croissance des ventes et le non-respect des objectifs internes, le leader de l'IA, OpenAI, a publié une déclaration rassurante le mardi 28 avril. L'entreprise a précisé que ses produi
Coupe Super d'Alibaba : Qwen3.8-Max fait ses débuts avec des outils de codage et de bureautique améliorés
Alibaba a officiellement dévoilé Qwen3.8-Max, un modèle fondamental de nouvelle génération disposant de 2,4 billions de paramètres. Cette avancée majeure en intelligence artificielle offre des gains de performance substantiels dans des domaines clés
Recommandations de sujets spéciaux liés
commentaires (1)
Wait, so Qwen3.5 is coming with tiny models that fit on consumer GPUs? That's actually huge for people like me who don't have a server farm in their basement. 0.8B to 9B parameters – I'm curious how much performance they sacrifice for size. Is it going to run smoothly on a 3060? 🤔 Also, Tongyi Lab is really pushing the trend of small but capable models, kinda like the iPhone of LLMs – compact but powerful. Let's see if they can beat the open-source competition.
Tongyi Lab a officiellement lancé les derniers modèles à petite échelle de sa série Qwen3.5, qui constituent une nouvelle génération de grands modèles linguistiques. Cette version comprend quatre modèles dotés respectivement de 0,8 milliard, 2 milliards, 4 milliards et 9 milliards de paramètres. Ces modèles sont conçus pour réduire les obstacles à la mise en œuvre de l'IA en offrant une optimisation exceptionnelle des performances, ce qui permet un déploiement rentable et efficace sur tous les supports, des appareils périphériques aux applications spécialisées.

L'ensemble de la série repose sur une base Qwen3.5 unifiée. Contrairement aux modèles plus volumineux qui privilégient un nombre massif de paramètres, ces versions compactes mettent l'accent sur leur « légèreté » et leur « grande adaptabilité ». Les modèles 0,8B et 2B sont spécialement adaptés aux périphériques de bord, offrant une efficacité extrême et des temps de réponse de l'ordre de la milliseconde sur des plateformes telles que les smartphones et le matériel embarqué. La version 4B se distingue par ses capacités multimodales, ce qui en fait un excellent choix pour le développement d'agents IA légers. Malgré sa taille modeste, le modèle 9B offre des performances comparables à celles de ses homologues beaucoup plus volumineux et est capable de gérer des raisonnements logiques complexes.

Afin de soutenir davantage la communauté des développeurs, Tongyi Lab a publié cette série sous licence Apache 2.0, la rendant ainsi open source et gratuite pour un usage commercial. Cela permet aux développeurs de procéder librement à un LoRA ou à un réglage fin complet des modèles, avec la possibilité de commencer des adaptations spécifiques à une tâche à l'aide de GPU grand public courants. Cette approche réduit considérablement le temps et les coûts nécessaires aux développeurs individuels et aux petites et moyennes entreprises pour prototyper des idées et créer des applications spécialisées.

À l’intérieur des détails révélés sur le prochain Gemini : une puissance de calcul mise à rude épreuve, des équipes internes en désaccord sur les priorités de développement et l’allocation des ressources
Les rapports indiquent que le lancement du modèle Gemini de nouvelle génération, tant attendu par Google, a été repoussé. Des désaccords internes concernant les priorités de développement et l'allocation des ressources, combinés à une capacité de cal
OpenAI rejette les inquiétudes concernant un ralentissement de la croissance, affirmant que plusieurs unités commerciales accélèrent
En réponse aux critiques externes concernant la décélération de la croissance des ventes et le non-respect des objectifs internes, le leader de l'IA, OpenAI, a publié une déclaration rassurante le mardi 28 avril. L'entreprise a précisé que ses produi
Coupe Super d'Alibaba : Qwen3.8-Max fait ses débuts avec des outils de codage et de bureautique améliorés
Alibaba a officiellement dévoilé Qwen3.8-Max, un modèle fondamental de nouvelle génération disposant de 2,4 billions de paramètres. Cette avancée majeure en intelligence artificielle offre des gains de performance substantiels dans des domaines clés
Wait, so Qwen3.5 is coming with tiny models that fit on consumer GPUs? That's actually huge for people like me who don't have a server farm in their basement. 0.8B to 9B parameters – I'm curious how much performance they sacrifice for size. Is it going to run smoothly on a 3060? 🤔 Also, Tongyi Lab is really pushing the trend of small but capable models, kinda like the iPhone of LLMs – compact but powerful. Let's see if they can beat the open-source competition.











