option
Maison
Flash info
Contenu
AlbertJones
AlbertJones
21 mai 2026

Zhipu AI et ses partenaires ont mis en œuvre l’architecture de réseau ZCube dans leur environnement de production de codage GLM-5.1, réalisant ainsi une avancée au niveau du système. La nouvelle architecture a réduit les dépenses d’investissement en commutateurs et modules optiques de 33 %, augmenté la capacité de traitement des GPU de 15 % et diminué le temps d’attente pour la première étape du processus de calcul de 40,6 %. Elle résout les goulets d’étranglement structurels rencontrés dans l’inference sur de grands modèles en remplaçant les conceptions hiérarchiques traditionnelles par une interconnexion basée sur un graphe bipartite plat, ce qui permet un équilibrage parfait de la charge de travail.

Zhipu AI et ses partenaires ont mis en œuvre l’architecture de réseau ZCube dans leur environnement de production de codage GLM-5.1, réalisant ainsi une avancée au niveau du système. La nouvelle architecture a réduit les dépenses d’investissement en commutateurs et modules optiques de 33 %, augmenté la capacité de traitement des GPU de 15 % et diminué le temps d’attente pour la première étape du processus de calcul de 40,6 %. Elle résout les goulets d’étranglement structurels rencontrés dans l’inference sur de grands modèles en remplaçant les conceptions hiérarchiques traditionnelles par une interconnexion basée sur un graphe bipartite plat, ce qui permet un équilibrage parfait de la charge de travail. Zhipu AI et ses partenaires ont mis en œuvre l’architecture de réseau ZCube dans leur environnement de production de codage GLM-5.1, réalisant ainsi une avancée au niveau du système. La nouvelle architecture a réduit les dépenses d’investissement en commutateurs et modules optiques de 33 %, augmenté la capacité de traitement des GPU de 15 % et diminué le temps d’attente pour la première étape du processus de calcul de 40,6 %. Elle résout les goulets d’étranglement structurels rencontrés dans l’inference sur de grands modèles en remplaçant les conceptions hiérarchiques traditionnelles par une interconnexion basée sur un graphe bipartite plat, ce qui permet un équilibrage parfait de la charge de travail.
commentaires (0)
0/300
OR