Google Gemma
Gemma to rodzina lekkich, otwartych modeli sztucznej inteligencji firmy Google, zbudowana w oparciu o te same badania i technologię, co Gemini.
Przegląd
It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.
Głębokie nurkowanie
Ogłoszona w lutym 2024 r. Gemma zapewnia Google udział w wyścigu modeli w wadze otwartej obok Lamy i Mistrala z Meta. Modele są dostarczane w małych rozmiarach, pierwsza wersja była dostępna w wersjach z parametrami 2B i 7B, z ciężarami, które można pobrać i uruchomić lokalnie, w przeciwieństwie do zamkniętego Gemini, obsługującego wyłącznie API. Google dystrybuuje zarówno warianty podstawowe (wstępnie przeszkolone), jak i dostrojone do instrukcji w ramach liberalnej licencji, która umożliwia wykorzystanie komercyjne. Rodzina szybko się powiększyła: CodeGemma do programowania, PaliGemma do zadań wizjonersko-językowych, RecurrentGemma do wydajnych długich sekwencji oraz Gemma 2 (i nowsze) z lepszą wydajnością w rozmiarach takich jak 9B i 27B. Gemma została zaprojektowana tak, aby dobrze współpracować z popularnymi narzędziami, Hugging Face, Keras, PyTorch, JAX i Ollama, co czyni ją praktycznym wyborem do wdrożeń lokalnych, wrażliwych na prywatność lub oszczędnych.
Wgląd techniczny
Gemma używa architektury Transformer przeznaczonej wyłącznie do dekodera i ponownie wykorzystuje techniki z badań Gemini, w tym duży tokenizator słownictwa (około 256 tys. tokenów) i szkolenia wywodzące się z większych modeli nauczycieli z pokolenia Gemma 2. Destylacja wiedzy pozwala małemu uczniowi naśladować znacznie większy model, osiągając wysoką jakość przy skromnych rozmiarach. „Open-weight” oznacza, że wyszkolone parametry można pobrać, dzięki czemu można je dostroić i samodzielnie hostować, chociaż dane szkoleniowe i pełny potok nie są w pełni dostępne na zasadach open source.
Wpływ strategiczny
Strategia dostawcy
Plany dostawców wpływają na to, jakie funkcje Twój zespół będzie mógł dalej tworzyć.
Koszt i budżet
Warunki handlowe i opcje wdrożenia wpływają na długoterminowe koszty i ryzyko.
Ryzyko i bezpieczeństwo
Zachęty firmowe kształtują wady produktów, postawę bezpieczeństwa i otwartość.
Przyszłość Google Gemmy
Spodziewaj się, że Google będzie nadal udostępniać warianty Gemmy dostosowane do określonych modalności i zadań, wizji, kodu, matematyki i użycia na urządzeniu, przy jednoczesnym zmniejszeniu zajmowanego miejsca potrzebnego do ich uruchomienia. Ponieważ modele o otwartej wadze wypełniają lukę w stosunku do systemów pionierskich, Gemma pozycjonuje Google, aby pozyskać programistów do dzielenia się wiedzą, zasilania brzegowego i wdrożeń prywatnych, w których dane nie mogą opuścić budynku. Ściślejsza integracja z Androidem, przeglądarką Chrome i narzędziami takimi jak Ollama i Vertex AI sprawi, że precyzyjne dostrajanie i wnioskowanie lokalne będzie coraz bardziej realizowane „pod klucz”.
Implementacja w świecie rzeczywistym
Uruchamianie chatbota całkowicie offline na laptopie lub pojedynczym procesorze graficznym w celu przechowywania danych wrażliwych na prywatność
Dopracowanie małego modelu Gemmy w wewnętrznych dokumentach firmy dla niestandardowego asystenta wsparcia
Używanie CodeGemma jako lokalnego asystenta uzupełniania i generowania kodu w IDE
Tworzenie aplikacji z podpisami obrazów lub wizualnymi pytaniami i odpowiedziami za pomocą wariantu PaliGemma w języku wizyjnym
Zagrożenia i poręcze
Ogłoszenia o wprowadzeniu na rynek mogą przekroczyć stabilność w rzeczywistych przepływach pracy.
Ceny interfejsów API lub zmiany zasad mogą z dnia na dzień złamać założenia.
Zależność od jednego dostawcy zwiększa koszty uzależnienia i migracji.
Plan wdrożenia
Oceniaj dostawców, korzystając z własnych zadań i zbiorów danych.
Przed integracją przejrzyj warunki dotyczące prywatności, bezpieczeństwa i prawa.
Utrzymuj plan awaryjny dla różnych modeli i dostawców.
Monitoruj informacje o wersji, aby zmiany w planie działania nie zaskoczyły zespołów.
Odkrywaj dalej
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Google Gemma quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Następny poradnik
Google DeepMind
Często zadawane pytania
What is Google Gemma?
Gemma to rodzina lekkich, otwartych modeli sztucznej inteligencji firmy Google, zbudowana w oparciu o te same badania i technologię, co Gemini. Umożliwia programistom pobieranie, dostrajanie i uruchamianie odpowiednich modeli na własnym sprzęcie, nawet na jednym laptopie lub procesorze graficznym.
Jaka jest kluczowa różnica między Gemmą a Gemini?
Wytrenowane ciężary Gemmy można pobrać i uruchomić lokalnie, natomiast Gemini jest oferowany jako model zamknięty za pośrednictwem aplikacji i interfejsów API Google.
Jakie rozmiary były w pierwszym wydaniu Gemmy w 2024 roku?
Pierwsza premiera Gemmy obejmowała modele o 2 miliardach i 7 miliardach parametrów, celowo wystarczająco małe, aby działać na skromnym sprzęcie.
Który wariant Gemmy specjalizuje się w zadaniach programistycznych?
CodeGemma to wariant dostosowany do generowania i uzupełniania kodu, podczas gdy PaliGemma obsługuje język wizji, a RecurrentGemma celuje w wydajne długie sekwencje.
Co oznacza „otwarta waga” dla modelki takiej jak Gemma?
Waga otwarta oznacza, że można pobierać i uruchamiać przeszkolone parametry, ale pełne dane szkoleniowe i potok niekoniecznie pochodzą z otwartych źródeł.
Która technika pomaga generacji Gemma 2 osiągnąć wysoką jakość przy małych rozmiarach?
Destylacja wiedzy pozwala mniejszemu modelowi „ucznia” nauczyć się naśladować większy model „nauczyciela”, łącząc wysoką wydajność w kompaktowym rozmiarze.