Gemma 2 désormais accessible aux chercheurs, aux développeurs

L'IA a le pouvoir de relever certains des défis les plus difficiles auxquels nous sommes confrontés aujourd'hui, mais seulement si tout le monde peut accéder aux outils pour l'utiliser. C'est pourquoi nous avons commencé l'année en introduisant Gemma, un ensemble de modèles ouverts légers et de pointe, conçus à partir de la même technologie qui alimente nos modèles Gemini. Depuis, nous avons élargi la famille Gemma avec CodeGemma, RecurrentGemma et PaliGemma, chacun adapté à différentes tâches d'IA et facilement accessible grâce à des partenariats avec des entreprises comme Hugging Face, NVIDIA et Ollama.
Maintenant, nous sommes ravis d'annoncer la sortie mondiale de Gemma 2 pour les chercheurs et les développeurs. Disponible en tailles de 9 milliards (9B) et 27 milliards (27B) de paramètres, Gemma 2 offre des performances et une efficacité supérieures par rapport à son prédécesseur, avec des améliorations significatives en matière de sécurité. La version 27B est une véritable puissance, rivalisant avec des modèles plus de deux fois plus grands, et elle peut fonctionner sur un seul GPU Tensor Core NVIDIA H100 ou un hôte TPU, réduisant ainsi les coûts de déploiement. C'est plutôt cool que nous ayons rendu les hautes performances accessibles sans se ruiner, non ?
Un nouveau standard pour l'efficacité et la performance dans les modèles ouverts
Nous avons mis beaucoup d'efforts dans la refonte de l'architecture de Gemma 2, visant des performances et une efficacité de premier ordre. Voici ce qui le distingue :
- Performances exceptionnelles : Avec 27B, Gemma 2 est le leader de sa catégorie, rivalisant même avec des modèles plus de deux fois plus grands. La version 9B brille également, surpassant Llama 3 8B et d'autres modèles ouverts de sa catégorie. Pour tous les détails croustillants, consultez le rapport technique.
- Efficacité et économies inégalées : Le Gemma 2 27B fonctionne sans problème en pleine précision sur un seul hôte TPU Google Cloud, un GPU Tensor Core NVIDIA A100 80GB ou un GPU Tensor Core NVIDIA H100, ce qui permet de réduire les coûts sans sacrifier les performances. Cela rend les déploiements d'IA plus accessibles et économiques.
- Inférence ultra-rapide sur divers matériels : Gemma 2 est conçu pour fonctionner rapidement sur tout, des ordinateurs portables de jeu aux ordinateurs de bureau haut de gamme en passant par les configurations cloud. Vous pouvez le tester en pleine précision dans Google AI Studio, l'exécuter localement avec la version quantifiée sur Gemma.cpp sur votre CPU, ou l'essayer sur votre ordinateur personnel avec un NVIDIA RTX ou GeForce RTX via Hugging Face Transformers.
Conçu pour les développeurs et les chercheurs
Gemma 2 n'est pas seulement plus puissant ; il est également conçu pour s'intégrer parfaitement à vos flux de travail :
- Ouvert et accessible : Comme les modèles Gemma originaux, Gemma 2 est livré avec une licence favorable aux usages commerciaux, permettant aux développeurs et aux chercheurs de partager et de monétiser leurs créations.
- Large compatibilité avec les frameworks : Vous pouvez facilement intégrer Gemma 2 à vos outils et flux de travail préférés, grâce à sa compatibilité avec les principaux frameworks d'IA comme Hugging Face Transformers, et JAX, PyTorch, et TensorFlow via le natif Keras 3.0, vLLM, Gemma.cpp, Llama.cpp, et Ollama. Il est également optimisé avec NVIDIA TensorRT-LLM pour l'infrastructure accélérée NVIDIA ou en tant que microservice d'inférence NVIDIA NIM, avec une optimisation pour NVIDIA NeMo à venir. Vous pouvez commencer à ajuster aujourd'hui avec Keras et Hugging Face, et nous travaillons sur des options d'ajustement plus efficaces en termes de paramètres.
- Déploiement sans effort : À partir du mois prochain, les clients Google Cloud pourront facilement déployer et gérer Gemma 2 sur Vertex AI.
Plongez dans le nouveau Gemma Cookbook, rempli d'exemples pratiques et de recettes pour vous aider à construire vos propres applications et à ajuster Gemma 2 pour des tâches spécifiques. Apprenez à utiliser Gemma avec vos outils préférés, y compris pour des tâches comme la génération augmentée par récupération.
Développement responsable de l'IA
Nous nous engageons à aider les développeurs et les chercheurs à construire et déployer l'IA de manière responsable. Notre Responsible Generative AI Toolkit fait partie de cet effort. Le comparateur LLM récemment mis en open-source aide à réaliser des évaluations détaillées des modèles de langage. À partir d'aujourd'hui, vous pouvez utiliser la bibliothèque Python associée pour effectuer des évaluations comparatives avec votre modèle et vos données, et visualiser les résultats dans l'application. Nous travaillons également à la mise en open-source de notre technologie de filigrane textuel, SynthID, pour les modèles Gemma.
Lors de la formation de Gemma 2, nous avons suivi nos processus internes rigoureux de sécurité, en filtrant les données de pré-entraînement et en effectuant des tests et évaluations approfondis contre une large gamme de métriques pour identifier et atténuer les biais et risques potentiels. Nous partageons nos résultats sur les benchmarks publics liés à la sécurité et aux préjudices représentationnels.
Projets construits avec Gemma
Notre premier lancement de Gemma a suscité plus de 10 millions de téléchargements et de nombreux projets incroyables. Par exemple, Navarasa a utilisé Gemma pour développer un modèle célébrant la diversité linguistique de l'Inde.
Avec Gemma 2, les développeurs peuvent entreprendre des projets encore plus ambitieux, repoussant les limites de ce qui est possible en IA. Nous continuerons à explorer de nouvelles architectures et à développer des variantes spécialisées de Gemma pour relever une gamme plus large de tâches et de défis en IA. Nous nous préparons également à lancer un modèle Gemma 2 de 2,6 milliards de paramètres, conçu pour équilibrer une accessibilité légère avec des performances puissantes. Vous pouvez en savoir plus à ce sujet dans le rapport technique.
Pour commencer
Gemma 2 est maintenant disponible dans Google AI Studio, vous pouvez donc tester toutes ses capacités à 27B sans aucune exigence matérielle. Vous pouvez également télécharger les poids du modèle Gemma 2 depuis Kaggle et Hugging Face Models, avec Vertex AI Model Garden à venir bientôt.
Pour soutenir la recherche et le développement, Gemma 2 est disponible gratuitement via Kaggle ou via un niveau gratuit pour les notebooks Colab. Les nouveaux clients Google Cloud peuvent être éligibles à 300 $ de crédits. Les chercheurs académiques peuvent postuler au programme de recherche académique Gemma 2 pour obtenir des crédits Google Cloud afin d'accélérer leurs recherches avec Gemma 2. Les candidatures sont ouvertes jusqu'au 9 août.
Article connexe
Warner Music acquiert l'entreprise de démarrage Sureel AI spécialisée dans l'attribution par intelligence artificielle
Warner Music Group (WMG) a confirmé mercredi qu’elle acquiert Sureel AI, une startup spécialisée dans l’attribution par intelligence artificielle. La technologie propriétaire de Sureel génère une « ADN IA » pour les titres musicaux, en décomposant ce
Amazon présente Alexa pour les achats tout en reléguant Rufus au second plan
Amazon a lancé Alexa for Shopping, fusionnant son chatbot de shopping Rufus avec Alexa+ sur l’application, le site web et les appareils Echo Show.L’assistant répond aux requêtes sur les produits, compare les articles, suit les prix et prend en charg
Microsoft, Azure et les technologies d'IA luttent contre les risques d'incendies de forêt en Californie
Microsoft investit dans la détection des feux de forêt grâce à l'IA ; Juan Lavista Ferres, vice-président corporatif et responsable scientifique des données, évoque les stratégies visant à atténuer le
Recommandations de sujets spéciaux liés
commentaires (64)
As a student working on my first NLP project, having access to lightweight open models like Gemma 2 feels like a game-changer! 🙌 Finally something that won't require supercomputing resources. Curious if the training datasets will be equally accessible though? Still, excited to experiment with this! 🤖
Gemma 2가 개발자들에게 공개되었다니 기대되네요! 경량 모델이라서 스타트업이나 개인 개발자도 활용하기 좋을 것 같아요. 근데 진짜 빨리 써보고 싶은데 한국어 지원은 언제될까요? ㄷㄷ
Wow, Gemma 2 sounds like a game-changer for researchers! Open models like this could spark some wild innovations. Anyone else excited to see what devs cook up with this? 🚀
Gemma 2 é uma revolução para pesquisadores! É tão acessível e fácil de usar. O único ponto negativo é a curva de aprendizado para iniciantes. Mas, uma vez que você pega o jeito, é incrível! 🚀

L'IA a le pouvoir de relever certains des défis les plus difficiles auxquels nous sommes confrontés aujourd'hui, mais seulement si tout le monde peut accéder aux outils pour l'utiliser. C'est pourquoi nous avons commencé l'année en introduisant Gemma, un ensemble de modèles ouverts légers et de pointe, conçus à partir de la même technologie qui alimente nos modèles Gemini. Depuis, nous avons élargi la famille Gemma avec CodeGemma, RecurrentGemma et PaliGemma, chacun adapté à différentes tâches d'IA et facilement accessible grâce à des partenariats avec des entreprises comme Hugging Face, NVIDIA et Ollama.
Maintenant, nous sommes ravis d'annoncer la sortie mondiale de Gemma 2 pour les chercheurs et les développeurs. Disponible en tailles de 9 milliards (9B) et 27 milliards (27B) de paramètres, Gemma 2 offre des performances et une efficacité supérieures par rapport à son prédécesseur, avec des améliorations significatives en matière de sécurité. La version 27B est une véritable puissance, rivalisant avec des modèles plus de deux fois plus grands, et elle peut fonctionner sur un seul GPU Tensor Core NVIDIA H100 ou un hôte TPU, réduisant ainsi les coûts de déploiement. C'est plutôt cool que nous ayons rendu les hautes performances accessibles sans se ruiner, non ?
Un nouveau standard pour l'efficacité et la performance dans les modèles ouverts
Nous avons mis beaucoup d'efforts dans la refonte de l'architecture de Gemma 2, visant des performances et une efficacité de premier ordre. Voici ce qui le distingue :
- Performances exceptionnelles : Avec 27B, Gemma 2 est le leader de sa catégorie, rivalisant même avec des modèles plus de deux fois plus grands. La version 9B brille également, surpassant Llama 3 8B et d'autres modèles ouverts de sa catégorie. Pour tous les détails croustillants, consultez le rapport technique.
- Efficacité et économies inégalées : Le Gemma 2 27B fonctionne sans problème en pleine précision sur un seul hôte TPU Google Cloud, un GPU Tensor Core NVIDIA A100 80GB ou un GPU Tensor Core NVIDIA H100, ce qui permet de réduire les coûts sans sacrifier les performances. Cela rend les déploiements d'IA plus accessibles et économiques.
- Inférence ultra-rapide sur divers matériels : Gemma 2 est conçu pour fonctionner rapidement sur tout, des ordinateurs portables de jeu aux ordinateurs de bureau haut de gamme en passant par les configurations cloud. Vous pouvez le tester en pleine précision dans Google AI Studio, l'exécuter localement avec la version quantifiée sur Gemma.cpp sur votre CPU, ou l'essayer sur votre ordinateur personnel avec un NVIDIA RTX ou GeForce RTX via Hugging Face Transformers.
Conçu pour les développeurs et les chercheurs
Gemma 2 n'est pas seulement plus puissant ; il est également conçu pour s'intégrer parfaitement à vos flux de travail :
- Ouvert et accessible : Comme les modèles Gemma originaux, Gemma 2 est livré avec une licence favorable aux usages commerciaux, permettant aux développeurs et aux chercheurs de partager et de monétiser leurs créations.
- Large compatibilité avec les frameworks : Vous pouvez facilement intégrer Gemma 2 à vos outils et flux de travail préférés, grâce à sa compatibilité avec les principaux frameworks d'IA comme Hugging Face Transformers, et JAX, PyTorch, et TensorFlow via le natif Keras 3.0, vLLM, Gemma.cpp, Llama.cpp, et Ollama. Il est également optimisé avec NVIDIA TensorRT-LLM pour l'infrastructure accélérée NVIDIA ou en tant que microservice d'inférence NVIDIA NIM, avec une optimisation pour NVIDIA NeMo à venir. Vous pouvez commencer à ajuster aujourd'hui avec Keras et Hugging Face, et nous travaillons sur des options d'ajustement plus efficaces en termes de paramètres.
- Déploiement sans effort : À partir du mois prochain, les clients Google Cloud pourront facilement déployer et gérer Gemma 2 sur Vertex AI.
Plongez dans le nouveau Gemma Cookbook, rempli d'exemples pratiques et de recettes pour vous aider à construire vos propres applications et à ajuster Gemma 2 pour des tâches spécifiques. Apprenez à utiliser Gemma avec vos outils préférés, y compris pour des tâches comme la génération augmentée par récupération.
Développement responsable de l'IA
Nous nous engageons à aider les développeurs et les chercheurs à construire et déployer l'IA de manière responsable. Notre Responsible Generative AI Toolkit fait partie de cet effort. Le comparateur LLM récemment mis en open-source aide à réaliser des évaluations détaillées des modèles de langage. À partir d'aujourd'hui, vous pouvez utiliser la bibliothèque Python associée pour effectuer des évaluations comparatives avec votre modèle et vos données, et visualiser les résultats dans l'application. Nous travaillons également à la mise en open-source de notre technologie de filigrane textuel, SynthID, pour les modèles Gemma.
Lors de la formation de Gemma 2, nous avons suivi nos processus internes rigoureux de sécurité, en filtrant les données de pré-entraînement et en effectuant des tests et évaluations approfondis contre une large gamme de métriques pour identifier et atténuer les biais et risques potentiels. Nous partageons nos résultats sur les benchmarks publics liés à la sécurité et aux préjudices représentationnels.
Projets construits avec Gemma
Notre premier lancement de Gemma a suscité plus de 10 millions de téléchargements et de nombreux projets incroyables. Par exemple, Navarasa a utilisé Gemma pour développer un modèle célébrant la diversité linguistique de l'Inde.
Avec Gemma 2, les développeurs peuvent entreprendre des projets encore plus ambitieux, repoussant les limites de ce qui est possible en IA. Nous continuerons à explorer de nouvelles architectures et à développer des variantes spécialisées de Gemma pour relever une gamme plus large de tâches et de défis en IA. Nous nous préparons également à lancer un modèle Gemma 2 de 2,6 milliards de paramètres, conçu pour équilibrer une accessibilité légère avec des performances puissantes. Vous pouvez en savoir plus à ce sujet dans le rapport technique.
Pour commencer
Gemma 2 est maintenant disponible dans Google AI Studio, vous pouvez donc tester toutes ses capacités à 27B sans aucune exigence matérielle. Vous pouvez également télécharger les poids du modèle Gemma 2 depuis Kaggle et Hugging Face Models, avec Vertex AI Model Garden à venir bientôt.
Pour soutenir la recherche et le développement, Gemma 2 est disponible gratuitement via Kaggle ou via un niveau gratuit pour les notebooks Colab. Les nouveaux clients Google Cloud peuvent être éligibles à 300 $ de crédits. Les chercheurs académiques peuvent postuler au programme de recherche académique Gemma 2 pour obtenir des crédits Google Cloud afin d'accélérer leurs recherches avec Gemma 2. Les candidatures sont ouvertes jusqu'au 9 août.
Warner Music acquiert l'entreprise de démarrage Sureel AI spécialisée dans l'attribution par intelligence artificielle
Warner Music Group (WMG) a confirmé mercredi qu’elle acquiert Sureel AI, une startup spécialisée dans l’attribution par intelligence artificielle. La technologie propriétaire de Sureel génère une « ADN IA » pour les titres musicaux, en décomposant ce
Microsoft, Azure et les technologies d'IA luttent contre les risques d'incendies de forêt en Californie
Microsoft investit dans la détection des feux de forêt grâce à l'IA ; Juan Lavista Ferres, vice-président corporatif et responsable scientifique des données, évoque les stratégies visant à atténuer le
As a student working on my first NLP project, having access to lightweight open models like Gemma 2 feels like a game-changer! 🙌 Finally something that won't require supercomputing resources. Curious if the training datasets will be equally accessible though? Still, excited to experiment with this! 🤖
Gemma 2가 개발자들에게 공개되었다니 기대되네요! 경량 모델이라서 스타트업이나 개인 개발자도 활용하기 좋을 것 같아요. 근데 진짜 빨리 써보고 싶은데 한국어 지원은 언제될까요? ㄷㄷ
Wow, Gemma 2 sounds like a game-changer for researchers! Open models like this could spark some wild innovations. Anyone else excited to see what devs cook up with this? 🚀
Gemma 2 é uma revolução para pesquisadores! É tão acessível e fácil de usar. O único ponto negativo é a curva de aprendizado para iniciantes. Mas, uma vez que você pega o jeito, é incrível! 🚀





Maison






