PRZEWODNIK FIRM

Google Gemma

Gemma to rodzina lekkich, otwartych modeli sztucznej inteligencji firmy Google, zbudowana w oparciu o te same badania i technologię, co Gemini.

2 minuty czytaniaOstatnia aktualizacja

Przegląd

It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.

Głębokie nurkowanie

Ogłoszona w lutym 2024 r. Gemma zapewnia Google udział w wyścigu modeli w wadze otwartej obok Lamy i Mistrala z Meta. Modele są dostarczane w małych rozmiarach, pierwsza wersja była dostępna w wersjach z parametrami 2B i 7B, z ciężarami, które można pobrać i uruchomić lokalnie, w przeciwieństwie do zamkniętego Gemini, obsługującego wyłącznie API. Google dystrybuuje zarówno warianty podstawowe (wstępnie przeszkolone), jak i dostrojone do instrukcji w ramach liberalnej licencji, która umożliwia wykorzystanie komercyjne. Rodzina szybko się powiększyła: CodeGemma do programowania, PaliGemma do zadań wizjonersko-językowych, RecurrentGemma do wydajnych długich sekwencji oraz Gemma 2 (i nowsze) z lepszą wydajnością w rozmiarach takich jak 9B i 27B. Gemma została zaprojektowana tak, aby dobrze współpracować z popularnymi narzędziami, Hugging Face, Keras, PyTorch, JAX i Ollama, co czyni ją praktycznym wyborem do wdrożeń lokalnych, wrażliwych na prywatność lub oszczędnych.

Wgląd techniczny

Gemma używa architektury Transformer przeznaczonej wyłącznie do dekodera i ponownie wykorzystuje techniki z badań Gemini, w tym duży tokenizator słownictwa (około 256 tys. tokenów) i szkolenia wywodzące się z większych modeli nauczycieli z pokolenia Gemma 2. Destylacja wiedzy pozwala małemu uczniowi naśladować znacznie większy model, osiągając wysoką jakość przy skromnych rozmiarach. „Open-weight” oznacza, że ​​wyszkolone parametry można pobrać, dzięki czemu można je dostroić i samodzielnie hostować, chociaż dane szkoleniowe i pełny potok nie są w pełni dostępne na zasadach open source.

Wpływ strategiczny

Strategia dostawcy

Plany dostawców wpływają na to, jakie funkcje Twój zespół będzie mógł dalej tworzyć.

Koszt i budżet

Warunki handlowe i opcje wdrożenia wpływają na długoterminowe koszty i ryzyko.

Ryzyko i bezpieczeństwo

Zachęty firmowe kształtują wady produktów, postawę bezpieczeństwa i otwartość.

Przyszłość Google Gemmy

Spodziewaj się, że Google będzie nadal udostępniać warianty Gemmy dostosowane do określonych modalności i zadań, wizji, kodu, matematyki i użycia na urządzeniu, przy jednoczesnym zmniejszeniu zajmowanego miejsca potrzebnego do ich uruchomienia. Ponieważ modele o otwartej wadze wypełniają lukę w stosunku do systemów pionierskich, Gemma pozycjonuje Google, aby pozyskać programistów do dzielenia się wiedzą, zasilania brzegowego i wdrożeń prywatnych, w których dane nie mogą opuścić budynku. Ściślejsza integracja z Androidem, przeglądarką Chrome i narzędziami takimi jak Ollama i Vertex AI sprawi, że precyzyjne dostrajanie i wnioskowanie lokalne będzie coraz bardziej realizowane „pod klucz”.

Implementacja w świecie rzeczywistym

Uruchamianie chatbota całkowicie offline na laptopie lub pojedynczym procesorze graficznym w celu przechowywania danych wrażliwych na prywatność

Dopracowanie małego modelu Gemmy w wewnętrznych dokumentach firmy dla niestandardowego asystenta wsparcia

Używanie CodeGemma jako lokalnego asystenta uzupełniania i generowania kodu w IDE

Tworzenie aplikacji z podpisami obrazów lub wizualnymi pytaniami i odpowiedziami za pomocą wariantu PaliGemma w języku wizyjnym

Zagrożenia i poręcze

Ogłoszenia o wprowadzeniu na rynek mogą przekroczyć stabilność w rzeczywistych przepływach pracy.

Ceny interfejsów API lub zmiany zasad mogą z dnia na dzień złamać założenia.

Zależność od jednego dostawcy zwiększa koszty uzależnienia i migracji.

Plan wdrożenia

1

Oceniaj dostawców, korzystając z własnych zadań i zbiorów danych.

2

Przed integracją przejrzyj warunki dotyczące prywatności, bezpieczeństwa i prawa.

3

Utrzymuj plan awaryjny dla różnych modeli i dostawców.

4

Monitoruj informacje o wersji, aby zmiany w planie działania nie zaskoczyły zespołów.

Odkrywaj dalej

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Google Gemma quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Rozpocznij quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Często zadawane pytania

What is Google Gemma?

Gemma to rodzina lekkich, otwartych modeli sztucznej inteligencji firmy Google, zbudowana w oparciu o te same badania i technologię, co Gemini. Umożliwia programistom pobieranie, dostrajanie i uruchamianie odpowiednich modeli na własnym sprzęcie, nawet na jednym laptopie lub procesorze graficznym.

Jaka jest kluczowa różnica między Gemmą a Gemini?

Wytrenowane ciężary Gemmy można pobrać i uruchomić lokalnie, natomiast Gemini jest oferowany jako model zamknięty za pośrednictwem aplikacji i interfejsów API Google.

Jakie rozmiary były w pierwszym wydaniu Gemmy w 2024 roku?

Pierwsza premiera Gemmy obejmowała modele o 2 miliardach i 7 miliardach parametrów, celowo wystarczająco małe, aby działać na skromnym sprzęcie.

Który wariant Gemmy specjalizuje się w zadaniach programistycznych?

CodeGemma to wariant dostosowany do generowania i uzupełniania kodu, podczas gdy PaliGemma obsługuje język wizji, a RecurrentGemma celuje w wydajne długie sekwencje.

Co oznacza „otwarta waga” dla modelki takiej jak Gemma?

Waga otwarta oznacza, że ​​można pobierać i uruchamiać przeszkolone parametry, ale pełne dane szkoleniowe i potok niekoniecznie pochodzą z otwartych źródeł.

Która technika pomaga generacji Gemma 2 osiągnąć wysoką jakość przy małych rozmiarach?

Destylacja wiedzy pozwala mniejszemu modelowi „ucznia” nauczyć się naśladować większy model „nauczyciela”, łącząc wysoką wydajność w kompaktowym rozmiarze.