BedriftsGUIDE

Google Gemma

Gemma er Googles familie av lette, åpne AI-modeller bygget fra samme forskning og teknologi som Gemini.

2 min lesingSist oppdatert

Oversikt

It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.

Dypdykk

Gemma ble kunngjort i februar 2024 og gir Google en påmelding i modellløpet med åpen vekt sammen med Metas Llama og Mistral. Modellene leveres i små størrelser, den første utgivelsen kom i 2B og 7B parameterversjoner, med vekter du kan laste ned og kjøre lokalt, i motsetning til den lukkede, API-bare Gemini. Google distribuerer både basisvarianter (forhåndstrenet) og instruksjonstilpassede varianter under en tillatende lisens som tillater kommersiell bruk. Familien utvidet seg raskt: CodeGemma for programmering, PaliGemma for vision-språkoppgaver, RecurrentGemma for effektive lange sekvenser, og Gemma 2 (og senere) med sterkere ytelse i størrelser som 9B og 27B. Gemma er designet for å spille godt sammen med populære verktøy, Hugging Face, Keras, PyTorch, JAX og Ollama, noe som gjør det til et praktisk valg for lokale, personvernsensitive eller kostnadsbevisste distribusjoner.

Teknisk innsikt

Gemma bruker en transformatorarkitektur som kun er dekoder og gjenbruker teknikker fra Gemini-forskning, inkludert en stor vokabular-tokenizer (rundt 256 000 tokens) og opplæring destillert fra større lærermodeller i Gemma 2-generasjonen. Kunnskapsdestillasjon lar en liten studentmodell etterligne en mye større modell, og oppnå sterk kvalitet i beskjeden størrelse. "Åpen vekt" betyr at de trente parametrene kan lastes ned, slik at du kan finjustere og være vert for deg selv, selv om treningsdataene og hele pipelinen ikke er fullstendig åpen kildekode.

Strategisk innvirkning

Vendor strategy

Leverandørveikart påvirker hvilke funksjoner teamet ditt kan bygge videre.

Cost and budget

Kommersielle vilkår og distribusjonsalternativer påvirker langsiktige kostnader og risiko.

Risiko og sikkerhet

Selskapets insentiver former produktstandarder, sikkerhetsstilling og åpenhet.

Fremtiden til Google Gemma

Forvent at Google fortsetter å gi ut Gemma-varianter tilpasset spesifikke modaliteter og oppgaver, visjon, kode, matematikk og bruk på enheten, mens du krymper fotavtrykket som trengs for å kjøre dem. Mens åpne modeller lukker gapet med grensesystemer, posisjonerer Gemma Google for å vinne utviklerens mindshare og kraftfordeler og private distribusjoner der data ikke kan forlate bygningen. Tettere integrasjon med Android, Chrome og verktøy som Ollama og Vertex AI vil gjøre finjustering og lokal slutning stadig mer nøkkelferdige.

Real-World Implementering

Kjøre en chatbot helt offline på en bærbar datamaskin eller enkelt GPU for personvernsensitive data

Finjustering av en liten Gemma-modell på selskapets interne dokumenter for en tilpasset støtteassistent

Bruke CodeGemma som en lokal kodefullførings- og generasjonsassistent i en IDE

Bygg bildeteksting eller visuelle spørsmål og svar-apper med den visjonsspråklige PaliGemma-varianten

Risikoer og rekkverk

Lanseringskunngjøringer kan overgå stabiliteten i ekte produksjonsarbeidsflyter.

API-priser eller endringer i retningslinjene kan bryte antagelser over natten.

Avhengighet av én leverandør øker kostnadene for innlåsing og migrering.

Veikart for implementering

1

Evaluer leverandører ved å bruke dine egne oppgaver og datasett.

2

Se gjennom personvern, sikkerhet og juridiske vilkår før integrering.

3

Oppretthold en reserveplan på tvers av modeller eller leverandører.

4

Overvåk utgivelsesnotater slik at endringer i veikart ikke overrasker teamene.

Fortsett å utforske

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Google Gemma quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Start quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Ofte stilte spørsmål

What is Google Gemma?

Gemma er Googles familie av lette, åpne AI-modeller bygget fra samme forskning og teknologi som Gemini. Den lar utviklere laste ned, finjustere og kjøre kompatible modeller på sin egen maskinvare, til og med en enkelt bærbar PC eller GPU.

Hva er hovedforskjellen mellom Gemma og Gemini?

Gemmas trenede vekter kan lastes ned og kjøres lokalt, mens Gemini tilbys som en lukket modell gjennom Google sine apper og APIer.

Hvilke størrelser var det i den første Gemma-utgivelsen i 2024?

Den første Gemma-lanseringen inkluderte 2-milliarder og 7-milliarder parametermodeller, bevisst små nok til å kjøre på beskjeden maskinvare.

Hvilken Gemma-variant er spesialisert for programmeringsoppgaver?

CodeGemma er varianten innstilt for kodegenerering og fullføring, mens PaliGemma håndterer visjonsspråk og RecurrentGemma retter seg mot effektive lange sekvenser.

Hva betyr "åpen vekt" for en modell som Gemma?

Åpen vekt betyr at du kan laste ned og kjøre de trente parameterne, men de komplette treningsdataene og pipeline er ikke nødvendigvis åpen kildekode.

Hvilken teknikk hjelper Gemma 2-generasjonen med å oppnå sterk kvalitet i små størrelser?

Kunnskapsdestillasjon lar en mindre "elev"-modell lære å etterligne en større "lærer"-modell, og pakker sterk ytelse inn i en kompakt størrelse.