Maison
Google Cloud dévoile deux puces d'intelligence artificielle conçues pour concurrencer Nvidia

Mercredi, Google Cloud a annoncé que sa huitième génération de puces AI personnalisées, appelées unités de traitement des tenseurs (TPU), serait divisée en deux types. L’une de ces puces, la TPU 8t, est conçue pour l’entraînement des modèles, tandis que l’autre, la TPU 8i, vise l’inference.
L’inference désigne l’utilisation continue des modèles, c’est-à-dire ce qui se produit après que les utilisateurs ont soumis leurs requêtes.
Comme on pouvait s’y attendre, Google met en avant d’impressionnantes améliorations de performances pour ces nouvelles TPU par rapport aux générations précédentes : un entraînement des modèles AI jusqu’à 3 fois plus rapide, une performance 80 % supérieure par dollar, et la possibilité de connecter plus d’un million de TPU dans un seul cluster. Le résultat devrait être une puissance de calcul considérablement plus élevée avec beaucoup moins d’énergie – et donc des coûts plus bas pour les clients – que les versions précédentes. Ces puces sont appelées TPU et non GPU, car les puces à faible consommation personnalisées par Google étaient initialement nommées Tensor.
Cependant, les puces de Google ne représentent pas pour l’instant un véritable défi pour l’avenir d’Nvidia. Comme d’autres grands fournisseurs de services cloud tels que Microsoft et Amazon, Google utilise ces puces pour compléter, et non remplacer entièrement, les systèmes basés sur Nvidia qu’il propose dans son infrastructure. En fait, Google promet que son cloud intégrera la dernière puce d’Nvidia, Vera Rubin, plus tard cette année.
À un moment donné, les géants du cloud qui développent leurs propres puces AI – y compris Amazon, Microsoft et Google – pourraient devenir moins dépendants d’Nvidia à mesure que les entreprises transfèrent leurs workloads AI sur leur cloud et adaptent leurs applications à ces nouvelles puces.
Néanmoins, parier contre Nvidia aujourd’hui n’est pas une stratégie rentable. Comme l’a plaisanté Patrick Moore, un analyste reconnu du marché des puces sur X, il avait prédit en 2016 que les TPU de Google pourraient causer des problèmes à Nvidia (et à Intel) lorsque le géant des recherches a lancé sa première TPU. Aujourd’hui, la valeur boursière d’Nvidia approche les 5 billions de dollars, ce qui signifie que cette prédiction n’a pas vraiment résisté au temps.
Si le plan d’Nvidia se réalise, la croissance de Google en tant que fournisseur de services cloud AI pourrait même générer plus de business pour le fabricant de puces, et non moins – même si de nombreux workloads fonctionnent sur les propres puces de Google.
En fait, Google a également annoncé qu’il avait convenu de collaborer avec Nvidia pour développer des technologies de réseau informatique afin d’améliorer encore l’efficacité des systèmes basés sur Nvidia dans son cloud. Plus précisément, les deux géants technologiques collaborent pour perfectionner la technologie de réseau basée sur logiciels appelée Falcon, qui a été créée et mise sous licence libre par Google en 2023 au sein du projet Open Compute Project, l’organisation regroupant les initiatives open source dans le domaine du matériel informatique des data centers.
Article connexe
Google déploie un système de détection des faux appels pour se prémunir contre les escroqueries par usurpation d'identité via des « deepfakes » générés par l'IA
Google a annoncé mardi que le système Android allait déployer une fonctionnalité de détection des faux appels afin de protéger les utilisateurs contre les escroqueries par usurpation d’identité utilis
Frontier AI Labs refuse de dévoiler ses stratégies de confinement des modèles indésirables
Des recherches récentes indiquent que très peu de grands laboratoires spécialisés dans l’IA ont publié ou présenté des plans d’intervention en cas de défaillance. Un plan d’intervention définit les pr
Google dévoile des lunettes connectées à commande vocale lors de l'IO 2026, emboîtant le pas à la stratégie de Meta
Google fait un retour stratégique sur le marché des lunettes connectées.Lors de la conférence Google I/O qui s’est tenue mardi, le géant de la technologie a dévoilé un partenariat avec Warby Parker et
Recommandations de sujets spéciaux liés
commentaires (0)

Mercredi, Google Cloud a annoncé que sa huitième génération de puces AI personnalisées, appelées unités de traitement des tenseurs (TPU), serait divisée en deux types. L’une de ces puces, la TPU 8t, est conçue pour l’entraînement des modèles, tandis que l’autre, la TPU 8i, vise l’inference.
L’inference désigne l’utilisation continue des modèles, c’est-à-dire ce qui se produit après que les utilisateurs ont soumis leurs requêtes.
Comme on pouvait s’y attendre, Google met en avant d’impressionnantes améliorations de performances pour ces nouvelles TPU par rapport aux générations précédentes : un entraînement des modèles AI jusqu’à 3 fois plus rapide, une performance 80 % supérieure par dollar, et la possibilité de connecter plus d’un million de TPU dans un seul cluster. Le résultat devrait être une puissance de calcul considérablement plus élevée avec beaucoup moins d’énergie – et donc des coûts plus bas pour les clients – que les versions précédentes. Ces puces sont appelées TPU et non GPU, car les puces à faible consommation personnalisées par Google étaient initialement nommées Tensor.
Cependant, les puces de Google ne représentent pas pour l’instant un véritable défi pour l’avenir d’Nvidia. Comme d’autres grands fournisseurs de services cloud tels que Microsoft et Amazon, Google utilise ces puces pour compléter, et non remplacer entièrement, les systèmes basés sur Nvidia qu’il propose dans son infrastructure. En fait, Google promet que son cloud intégrera la dernière puce d’Nvidia, Vera Rubin, plus tard cette année.
À un moment donné, les géants du cloud qui développent leurs propres puces AI – y compris Amazon, Microsoft et Google – pourraient devenir moins dépendants d’Nvidia à mesure que les entreprises transfèrent leurs workloads AI sur leur cloud et adaptent leurs applications à ces nouvelles puces.
Néanmoins, parier contre Nvidia aujourd’hui n’est pas une stratégie rentable. Comme l’a plaisanté Patrick Moore, un analyste reconnu du marché des puces sur X, il avait prédit en 2016 que les TPU de Google pourraient causer des problèmes à Nvidia (et à Intel) lorsque le géant des recherches a lancé sa première TPU. Aujourd’hui, la valeur boursière d’Nvidia approche les 5 billions de dollars, ce qui signifie que cette prédiction n’a pas vraiment résisté au temps.
Si le plan d’Nvidia se réalise, la croissance de Google en tant que fournisseur de services cloud AI pourrait même générer plus de business pour le fabricant de puces, et non moins – même si de nombreux workloads fonctionnent sur les propres puces de Google.
En fait, Google a également annoncé qu’il avait convenu de collaborer avec Nvidia pour développer des technologies de réseau informatique afin d’améliorer encore l’efficacité des systèmes basés sur Nvidia dans son cloud. Plus précisément, les deux géants technologiques collaborent pour perfectionner la technologie de réseau basée sur logiciels appelée Falcon, qui a été créée et mise sous licence libre par Google en 2023 au sein du projet Open Compute Project, l’organisation regroupant les initiatives open source dans le domaine du matériel informatique des data centers.
Google déploie un système de détection des faux appels pour se prémunir contre les escroqueries par usurpation d'identité via des « deepfakes » générés par l'IA
Google a annoncé mardi que le système Android allait déployer une fonctionnalité de détection des faux appels afin de protéger les utilisateurs contre les escroqueries par usurpation d’identité utilis
Frontier AI Labs refuse de dévoiler ses stratégies de confinement des modèles indésirables
Des recherches récentes indiquent que très peu de grands laboratoires spécialisés dans l’IA ont publié ou présenté des plans d’intervention en cas de défaillance. Un plan d’intervention définit les pr
Google dévoile des lunettes connectées à commande vocale lors de l'IO 2026, emboîtant le pas à la stratégie de Meta
Google fait un retour stratégique sur le marché des lunettes connectées.Lors de la conférence Google I/O qui s’est tenue mardi, le géant de la technologie a dévoilé un partenariat avec Warby Parker et











