Google Gemma
Gemma est la famille de modèles d'IA légers et ouverts de Google, construits à partir de la même recherche et de la même technologie que Gemini.
Aperçu
It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.
Plongée profonde
Annoncé en février 2024, Gemma donne à Google une entrée dans la course aux modèles à poids ouvert aux côtés de Llama et Mistral de Meta. Les modèles sont livrés en petites tailles, la première version est disponible en versions de paramètres 2B et 7B, avec des poids que vous pouvez télécharger et exécuter localement, contrairement au Gemini fermé et API uniquement. Google distribue à la fois des variantes de base (pré-entraînées) et des variantes optimisées pour les instructions sous une licence permissive qui autorise une utilisation commerciale. La famille s'est rapidement élargie : CodeGemma pour la programmation, PaliGemma pour les tâches de langage visuel, RecurrentGemma pour de longues séquences efficaces et Gemma 2 (et versions ultérieures) avec des performances plus élevées dans des tailles telles que 9B et 27B. Gemma est conçu pour fonctionner correctement avec les outils populaires, Hugging Face, Keras, PyTorch, JAX et Ollama, ce qui en fait un choix pratique pour les déploiements sur site, sensibles à la confidentialité ou soucieux des coûts.
Aperçu technique
Gemma utilise une architecture Transformer uniquement par décodeur et réutilise les techniques de la recherche Gemini, y compris un vaste tokeniseur de vocabulaire (environ 256 000 jetons) et une formation distillée à partir de modèles d'enseignants plus grands de la génération Gemma 2. La distillation des connaissances permet à un petit modèle d'étudiant d'imiter un modèle beaucoup plus grand, obtenant ainsi une qualité élevée pour une taille modeste. « Open-weight » signifie que les paramètres entraînés sont téléchargeables afin que vous puissiez les affiner et les auto-héberger, bien que les données d'entraînement et le pipeline complet ne soient pas entièrement open source.
Impact stratégique
Stratégie du fournisseur
Les feuilles de route des fournisseurs influencent les fonctionnalités que votre équipe peut ensuite créer.
Coût et budget
Les conditions commerciales et les options de déploiement affectent les coûts et les risques à long terme.
Risques et sécurité
Les incitations des entreprises façonnent les défauts des produits, la posture de sécurité et l’ouverture.
L'avenir de Google Gemma
Attendez-vous à ce que Google continue de publier des variantes de Gemma adaptées à des modalités et des tâches spécifiques, à la vision, au code, aux mathématiques et à l'utilisation sur l'appareil, tout en réduisant l'empreinte nécessaire pour les exécuter. Alors que les modèles ouverts réduisent l'écart avec les systèmes frontières, Gemma positionne Google pour gagner l'esprit des développeurs et gagner en puissance et en déploiements privés où les données ne peuvent pas quitter le bâtiment. Une intégration plus étroite avec Android, Chrome et des outils comme Ollama et Vertex AI rendra le réglage fin et l'inférence locale de plus en plus clés en main.
Mise en œuvre dans le monde réel
Exécuter un chatbot entièrement hors ligne sur un ordinateur portable ou un seul GPU pour les données sensibles à la confidentialité
Affiner un petit modèle Gemma sur les documents internes d'une entreprise pour un assistant de support personnalisé
Utiliser CodeGemma comme assistant local de complétion et de génération de code dans un IDE
Création d'applications de sous-titrage d'images ou de questions-réponses visuelles avec la variante PaliGemma en langage visuel
Risques et garde-fous
Les annonces de lancement peuvent dépasser la stabilité des flux de production réels.
La tarification des API ou les changements de politique peuvent briser les hypothèses du jour au lendemain.
La dépendance à un seul fournisseur augmente les coûts de verrouillage et de migration.
Feuille de route de mise en œuvre
Évaluez les fournisseurs à l’aide de vos propres tâches et ensembles de données.
Vérifiez les conditions de confidentialité, de sécurité et juridiques avant l’intégration.
Maintenez un plan de secours entre les modèles ou les fournisseurs.
Surveillez les notes de version afin que les modifications de la feuille de route ne surprennent pas les équipes.
Continuez à explorer
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Google Gemma quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Guide suivant
Google Esprit profond
Questions fréquemment posées
What is Google Gemma?
Gemma est la famille de modèles d'IA légers et ouverts de Google, construits à partir de la même recherche et de la même technologie que Gemini. Il permet aux développeurs de télécharger, d'affiner et d'exécuter des modèles performants sur leur propre matériel, même sur un seul ordinateur portable ou GPU.
Quelle est la principale différence entre Gemma et Gemini ?
Les poids entraînés de Gemma peuvent être téléchargés et exécutés localement, tandis que Gemini est proposé sous forme de modèle fermé via les applications et API de Google.
Quelles étaient les tailles de la première version de Gemma en 2024 ?
Le lancement initial de Gemma comprenait des modèles de 2 et 7 milliards de paramètres, délibérément suffisamment petits pour fonctionner sur un matériel modeste.
Quelle variante de Gemma est spécialisée pour les tâches de programmation ?
CodeGemma est la variante adaptée à la génération et à l'achèvement du code, tandis que PaliGemma gère le langage de vision et RecurrentGemma cible de longues séquences efficaces.
Que signifie « poids ouvert » pour un modèle comme Gemma ?
Le poids ouvert signifie que vous pouvez télécharger et exécuter les paramètres entraînés, mais les données d'entraînement complètes et le pipeline ne sont pas nécessairement open source.
Quelle technique permet à la génération Gemma 2 d’obtenir une qualité élevée dans de petites tailles ?
La distillation des connaissances permet à un modèle « étudiant » plus petit d'apprendre à imiter un modèle « enseignant » plus grand, offrant ainsi de solides performances dans une taille compacte.