Maison
Comment faire évoluer les grands modèles : la stratégie de Yang Zhilin présentée lors de la GTC concernant l'efficacité des tokens et les clusters d'agents

La clé pour aborder la seconde moitié de l'ère des grands modèles ne réside plus simplement dans l'augmentation de la puissance de calcul, mais dans une refonte fondamentale de l'architecture sous-jacente.
Lors de la conférence NVIDIA GTC 2026 qui s'est tenue le 18 mars, Yang Zhilin, fondateur de Moonshot AI, a prononcé un discours très attendu. Il s'agissait de sa première présentation publique complète de la feuille de route technique sous-jacente au modèle Kimi K2.5 , offrant une nouvelle perspective sur l'évolution des grands modèles à l'ère « post-scaling ».
Yang Zhilin a déclaré que pour dépasser les limites actuelles de l'intelligence, une restructuration complète des technologies clés telles que les optimiseurs, les mécanismes d'attention et les connexions résiduelles est essentielle. Il a présenté l'évolution de Kimi selon trois dimensions synergiques :
Efficacité des tokens : éliminer le gaspillage de ressources pour atteindre un rapport calcul/performance encore plus extrême.
Contexte long : approfondir en permanence l'avantage de Kimi en matière de mémoire de contexte long pour traiter des informations à très grande échelle.
Groupe d'agents : l'intelligence évolue, passant d'agents individuels à des « groupes numériques » générés dynamiquement.
Selon Yang Zhilin, la mise à l'échelle consiste désormais à rechercher des effets d'échelle en matière d'efficacité, de mémoire et de collaboration automatisée. Multiplier les gains issus de ces trois dimensions pourrait ouvrir la voie à des niveaux d'intelligence bien au-delà des capacités actuelles.
Selon des annonces précédentes, le modèle Kimi K2.5 lancé début janvier démontre déjà cette capacité « polyvalente ». En tant que modèle open source le plus puissant de Moonshot AI à ce jour, il dispose d’une architecture multimodale native, atteint des performances de pointe (SOTA) en compréhension du code et visuelle, et prend en charge une commutation flexible entre les modes « pensant » et « non pensant » pour s’adapter précisément aux tâches basées sur des agents.
À mesure que l'approche technologique de Moonshot AI se précise, la compétition entre les grands modèles se déplace du « nombre de paramètres » vers la « densité d'intelligence ». Les clusters d'agents émergeant comme une forme potentielle ultime de l'intelligence future, la question de savoir si Kimi peut réaliser une percée dans le cadre de la « multiplication tridimensionnelle » de Yang Zhilin est devenue un enjeu central pour l'industrie.
Article connexe
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés
Conformité des véhicules autonomes en Californie : une nouvelle ère marquée par les amendes, les zones de géolocalisation et 1 million de miles
Guident exploite une navette AuveTech dans le sud de la Floride, gérant un parcours de quatre miles à West Palm Beach et un parcours d’un mile à Boca Raton grâce à sa technologie de surveillance à dis
Recommandations de sujets spéciaux liés
commentaires (0)

La clé pour aborder la seconde moitié de l'ère des grands modèles ne réside plus simplement dans l'augmentation de la puissance de calcul, mais dans une refonte fondamentale de l'architecture sous-jacente.
Lors de la conférence NVIDIA GTC 2026 qui s'est tenue le 18 mars, Yang Zhilin, fondateur de Moonshot AI, a prononcé un discours très attendu. Il s'agissait de sa première présentation publique complète de la feuille de route technique sous-jacente au modèle
Yang Zhilin a déclaré que pour dépasser les limites actuelles de l'intelligence, une restructuration complète des technologies clés telles que les optimiseurs, les mécanismes d'attention et les connexions résiduelles est essentielle. Il a présenté l'évolution de Kimi selon trois dimensions synergiques :
Efficacité des tokens : éliminer le gaspillage de ressources pour atteindre un rapport calcul/performance encore plus extrême.
Contexte long : approfondir en permanence l'avantage de Kimi en matière de mémoire de contexte long pour traiter des informations à très grande échelle.
Groupe d'agents : l'intelligence évolue, passant d'agents individuels à des « groupes numériques » générés dynamiquement.
Selon Yang Zhilin, la mise à l'échelle consiste désormais à rechercher des effets d'échelle en matière d'efficacité, de mémoire et de collaboration automatisée. Multiplier les gains issus de ces trois dimensions pourrait ouvrir la voie à des niveaux d'intelligence bien au-delà des capacités actuelles.
Selon des annonces précédentes, le modèle Kimi K2.5 lancé début janvier démontre déjà cette capacité « polyvalente ». En tant que modèle open source le plus puissant de Moonshot AI à ce jour, il dispose d’une architecture multimodale native, atteint des performances de pointe (SOTA) en compréhension du code et visuelle, et prend en charge une commutation flexible entre les modes « pensant » et « non pensant » pour s’adapter précisément aux tâches basées sur des agents.
À mesure que l'approche technologique de Moonshot AI se précise, la compétition entre les grands modèles se déplace du « nombre de paramètres » vers la « densité d'intelligence ». Les clusters d'agents émergeant comme une forme potentielle ultime de l'intelligence future, la question de savoir si
PDG de DeepMind, Hassabis : Je dors six heures par jour et je me sens généralement plein d’énergie vers 1 h du matin.
Fortune a récemment publié une interview avec Demis Hassabis, PDG de Google DeepMind, révélant son approche non conventionnelle du repos et de la productivité. Hassabis a divulgué qu’il dort très peu, structurant ses heures d’éveil en deux blocs de t
OpenAI et Anthropic se disputent des parts de marché malgré des résultats en deçà des attentes
Bien que des informations récentes laissent entendre qu’OpenAI n’aurait pas atteint ses objectifs de chiffre d’affaires, ce qui a pesé sur les valeurs technologiques ce mardi, les investisseurs privés











