GUIDA alle aziende

Google Gemma

Gemma è la famiglia di modelli IA leggeri e open-weight di Google, realizzati con la stessa ricerca e tecnologia di Gemini.

2 minuti di letturaUltimo aggiornamento

Panoramica

It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.

Immersione profonda

Annunciato nel febbraio 2024, Gemma dà a Google un ingresso nella gara di modelli a peso aperto insieme a Llama e Mistral di Meta. I modelli vengono forniti in dimensioni ridotte, la prima versione era disponibile nelle versioni con parametri 2B e 7B, con pesi che è possibile scaricare ed eseguire localmente, a differenza del Gemini chiuso, solo API. Google distribuisce sia le varianti base (preaddestrate) che quelle ottimizzate per le istruzioni con una licenza permissiva che ne consente l'uso commerciale. La famiglia si espanse rapidamente: CodeGemma per la programmazione, PaliGemma per attività di linguaggio visivo, RecurrentGemma per lunghe sequenze efficienti e Gemma 2 (e successivi) con prestazioni più elevate in dimensioni come 9B e 27B. Gemma è progettato per funzionare bene con gli strumenti più diffusi, Hugging Face, Keras, PyTorch, JAX e Ollama, rendendolo una scelta pratica per implementazioni locali, sensibili alla privacy o attente ai costi.

Approfondimento tecnico

Gemma utilizza un'architettura Transformer solo decoder e riutilizza le tecniche della ricerca Gemini, incluso un grande tokenizzatore di vocabolario (circa 256.000 token) e la formazione distillata da modelli di insegnanti più grandi nella generazione Gemma 2. La distillazione della conoscenza consente a un modello di piccolo studente di imitarne uno molto più grande, ottenendo una qualità elevata con dimensioni modeste. "Open-weight" significa che i parametri addestrati sono scaricabili in modo da poterli ottimizzare e ospitare autonomamente, sebbene i dati di addestramento e la pipeline completa non siano completamente open source.

Impatto strategico

Strategia del fornitore

Le roadmap dei fornitori influenzano le funzionalità che il tuo team può sviluppare successivamente.

Costo e budget

I termini commerciali e le opzioni di implementazione influiscono sui costi e sui rischi a lungo termine.

Rischio e sicurezza

Gli incentivi aziendali modellano le impostazioni predefinite dei prodotti, la postura di sicurezza e l’apertura.

Il futuro di Google Gemma

Aspettatevi che Google continui a rilasciare varianti Gemma ottimizzate per modalità e attività specifiche, visione, codice, matematica e utilizzo sul dispositivo, riducendo al contempo l'ingombro necessario per eseguirle. Mentre i modelli open-weight colmano il divario con i sistemi di frontiera, Gemma posiziona Google per conquistare la condivisione mentale degli sviluppatori e il power edge e le implementazioni private dove i dati non possono lasciare l'edificio. Una più stretta integrazione con Android, Chrome e strumenti come Ollama e Vertex AI renderanno la messa a punto e l'inferenza locale sempre più chiavi in ​​mano.

Implementazione nel mondo reale

Esecuzione di un chatbot interamente offline su un laptop o su una singola GPU per dati sensibili alla privacy

Messa a punto di un piccolo modello Gemma sui documenti interni di un'azienda per un assistente di supporto personalizzato

Utilizzo di CodeGemma come assistente locale per il completamento e la generazione del codice all'interno di un IDE

Creazione di didascalie di immagini o app visive di domande e risposte con la variante PaliGemma con linguaggio visivo

Rischi e guardrail

Gli annunci di lancio potrebbero superare la stabilità nei flussi di lavoro di produzione reali.

I prezzi delle API o i cambiamenti politici possono infrangere le ipotesi da un giorno all’altro.

La dipendenza da un unico fornitore aumenta i costi di lock-in e di migrazione.

Tabella di marcia per l'implementazione

1

Valuta i fornitori utilizzando le tue attività e i tuoi set di dati.

2

Esamina la privacy, la sicurezza e i termini legali prima dell'integrazione.

3

Mantenere un piano di riserva tra modelli o fornitori.

4

Monitora le note di rilascio in modo che le modifiche alla roadmap non sorprendano i team.

Continua a esplorare

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Google Gemma quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Inizia il quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Domande frequenti

What is Google Gemma?

Gemma è la famiglia di modelli IA leggeri e open-weight di Google, realizzati con la stessa ricerca e tecnologia di Gemini. Consente agli sviluppatori di scaricare, ottimizzare ed eseguire modelli compatibili sul proprio hardware, anche su un singolo laptop o GPU.

Qual è la differenza fondamentale tra Gemma e Gemini?

I pesi addestrati di Gemma possono essere scaricati ed eseguiti localmente, mentre Gemini viene offerto come modello chiuso tramite le app e le API di Google.

Che dimensioni c'erano nella prima uscita di Gemma nel 2024?

Il lancio iniziale di Gemma includeva modelli da 2 e 7 miliardi di parametri, volutamente abbastanza piccoli da poter essere eseguiti su hardware modesto.

Quale variante Gemma è specializzata per attività di programmazione?

CodeGemma è la variante ottimizzata per la generazione e il completamento del codice, mentre PaliGemma gestisce il linguaggio visivo e RecurrentGemma si rivolge a lunghe sequenze efficienti.

Cosa significa 'peso aperto' per una modella come Gemma?

Open-weight significa che puoi scaricare ed eseguire i parametri addestrati, ma i dati e la pipeline di addestramento completi non sono necessariamente open source.

Quale tecnica aiuta la generazione Gemma 2 a raggiungere una qualità elevata in dimensioni ridotte?

La distillazione della conoscenza consente a un modello di "studente" più piccolo di imparare a imitare un modello di "insegnante" più grande, racchiudendo prestazioni elevate in dimensioni compatte.