Bedrijven GIDS

Google Gemma

Gemma is de familie van lichtgewicht AI-modellen van Google, gebouwd op basis van hetzelfde onderzoek en dezelfde technologie als Gemini.

2 min readLaatst bijgewerkt

Overzicht

It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.

Diepe duik

Gemma, aangekondigd in februari 2024, geeft Google een deelname aan de open-weight modelrace naast de Llama en Mistral van Meta. De modellen worden in kleine formaten verzonden, de eerste release kwam in 2B- en 7B-parameterversies, met gewichten die u lokaal kunt downloaden en uitvoeren, in tegenstelling tot de gesloten, API-only Gemini. Google distribueert zowel basisvarianten (voorgetraind) als op instructies afgestemde varianten onder een permissieve licentie die commercieel gebruik toestaat. De familie breidde zich snel uit: CodeGemma voor programmeren, PaliGemma voor taken in beeldtaal, RecurrentGemma voor efficiënte lange reeksen, en Gemma 2 (en later) met sterkere prestaties in formaten als 9B en 27B. Gemma is ontworpen om goed samen te werken met populaire tools, Hugging Face, Keras, PyTorch, JAX en Ollama, waardoor het een praktische keuze is voor on-premise, privacygevoelige of kostenbewuste implementaties.

Technisch inzicht

Gemma maakt gebruik van een Transformer-architectuur die alleen voor een decoder geschikt is en hergebruikt technieken uit Gemini onderzoek, waaronder een grote woordenschat-tokenizer (ongeveer 256.000 tokens) en training afgeleid van grotere lerarenmodellen uit de Gemma 2-generatie. Door kennisdistillatie kan een klein studentenmodel een veel groter model nabootsen, waardoor een sterke kwaliteit bij een bescheiden omvang wordt bereikt. 'Open-weight' betekent dat de getrainde parameters kunnen worden gedownload, zodat u ze kunt verfijnen en zelf kunt hosten, hoewel de trainingsgegevens en de volledige pijplijn niet volledig open source zijn.

Strategische impact

Vendor strategy

Roadmaps van leveranciers beïnvloeden welke functies uw team vervolgens kan bouwen.

Cost and budget

Commerciële voorwaarden en implementatieopties zijn van invloed op de kosten en risico's op de lange termijn.

Risk and safety

Bedrijfsprikkels bepalen productgebreken, veiligheidshouding en openheid.

De toekomst van Google Gemma

Verwacht dat Google Gemma-varianten blijft uitbrengen die zijn afgestemd op specifieke modaliteiten en taken, visie, code, wiskunde en gebruik op het apparaat, terwijl de voetafdruk die nodig is om ze uit te voeren, wordt verkleind. Terwijl open-weight-modellen de kloof met frontier-systemen dichten, positioneert Gemma Google om de mindshare van ontwikkelaars en power edge- en private implementaties te winnen waar data het gebouw niet kunnen verlaten. Nauwere integratie met Android, Chrome en tools als Ollama en Vertex AI zal ervoor zorgen dat finetuning en lokale gevolgtrekking steeds belangrijker worden.

Implementatie in de echte wereld

Een chatbot geheel offline draaien op een laptop of enkele GPU voor privacygevoelige data

Een klein Gemma-model verfijnen op de interne documenten van een bedrijf voor een ondersteuningsassistent op maat

CodeGemma gebruiken als lokale assistent voor het aanvullen en genereren van code in een IDE

Bouw beeldbijschriften of visuele vraag- en antwoord-apps met de beeldtaal PaliGemma-variant

Risico's en vangrails

Lanceringsaankondigingen kunnen de stabiliteit in echte productieworkflows overtreffen.

API-prijzen of beleidswijzigingen kunnen van de ene op de andere dag de aannames doorbreken.

De afhankelijkheid van één leverancier verhoogt de lock-in- en migratiekosten.

Implementatie routekaart

1

Evalueer providers met behulp van uw eigen taken en datasets.

2

Controleer de privacy-, beveiligings- en juridische voorwaarden vóór de integratie.

3

Onderhoud een noodplan voor alle modellen of leveranciers.

4

Houd de release-opmerkingen in de gaten, zodat wijzigingen in de routekaart teams niet verrassen.

Blijf verkennen

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Google Gemma quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Start quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Google Diepe geest

Frequently asked questions

What is Google Gemma?

Gemma is de familie van lichtgewicht AI-modellen van Google, gebouwd op basis van hetzelfde onderzoek en dezelfde technologie als Gemini. Hiermee kunnen ontwikkelaars geschikte modellen downloaden, verfijnen en uitvoeren op hun eigen hardware, zelfs op een enkele laptop of GPU.

Wat is het belangrijkste verschil tussen Gemma en Gemini?

Gemma's getrainde gewichten kunnen worden gedownload en lokaal worden uitgevoerd, terwijl Gemini wordt aangeboden als een gesloten model via de apps en API's van Google.

Welke maten zaten er in de eerste Gemma-release in 2024?

De eerste Gemma-lancering omvatte parametermodellen van 2 miljard en 7 miljard, opzettelijk klein genoeg om op bescheiden hardware te draaien.

Welke Gemma-variant is gespecialiseerd in programmeertaken?

CodeGemma is de variant die is afgestemd op het genereren en voltooien van code, terwijl PaliGemma beeldtaal hanteert en RecurrentGemma zich richt op efficiënte lange reeksen.

Wat betekent 'open gewicht' voor een model als Gemma?

Open-weight betekent dat u de getrainde parameters kunt downloaden en uitvoeren, maar dat de volledige trainingsgegevens en pijplijn niet noodzakelijkerwijs open source zijn.

Welke techniek zorgt ervoor dat de Gemma 2-generatie sterke kwaliteit kan bereiken in kleine maten?

Door kennisdestillatie kan een kleiner 'student'-model een groter 'leraar'-model leren nabootsen, waarbij sterke prestaties in een compact formaat worden verpakt.