Google Gemma
Gemma je rodina lehkých modelů umělé inteligence s otevřenou hmotností Google vytvořených ze stejného výzkumu a technologie jako Gemini.
Přehled
It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.
Hluboký ponor
Gemma, která byla oznámena v únoru 2024, dává Google vstup do závodu modelů v otevřené váze spolu s lamou a Mistralem Meta. Modely se dodávají v malých velikostech, první verze přišla ve verzích s parametry 2B a 7B, s váhami, které si můžete stáhnout a spustit lokálně, na rozdíl od uzavřeného Gemini pouze pro API. Google distribuuje základní (předtrénované) i instrukčně vyladěné varianty pod licencí, která umožňuje komerční použití. Rodina se rychle rozrostla: CodeGemma pro programování, PaliGemma pro úlohy s vizuálním jazykem, RecurrentGemma pro efektivní dlouhé sekvence a Gemma 2 (a novější) se silnějším výkonem ve velikostech jako 9B a 27B. Gemma je navržena tak, aby si dobře pohrála s oblíbenými nástroji Hugging Face, Keras, PyTorch, JAX a Ollama, což z ní činí praktickou volbu pro on-prem, na soukromí nebo s ohledem na náklady.
Technický přehled
Gemma používá pouze dekodérovou architekturu Transformer a znovu využívá techniky z výzkumu Gemini, včetně velkého tokenizéru slovní zásoby (kolem 256 000 tokenů) a školení získaných z větších modelů učitelů v generaci Gemma 2. Destilace znalostí umožňuje malému studentskému modelu napodobit mnohem větší model a dosáhnout vysoké kvality při skromné velikosti. „Otevřená váha“ znamená, že trénované parametry jsou ke stažení, takže je můžete doladit a hostit sami, i když trénovací data a úplný kanál nejsou plně open source.
Strategický dopad
Strategie dodavatelů
Plány dodavatelů ovlivňují, jaké funkce může váš tým dále vybudovat.
Cena a rozpočet
Komerční podmínky a možnosti nasazení ovlivňují dlouhodobé náklady a rizika.
Riziko a bezpečnost
Firemní pobídky utvářejí výchozí produkty, bezpečný postoj a otevřenost.
Budoucnost Google Gemma
Očekávejte, že Google bude i nadále uvolňovat varianty Gemma vyladěné pro konkrétní modality a úkoly, vidění, kód, matematiku a použití v zařízení, přičemž bude zmenšovat nároky na jejich provozování. Vzhledem k tomu, že modely s otevřenou váhou uzavírají mezeru mezi hraničními systémy, Gemma staví Google, aby získala vývojářské mindshare a power edge a soukromá nasazení, kde data nemohou opustit budovu. Užší integrace s Androidem, Chromem a nástroji, jako jsou Ollama a Vertex AI, zajistí, že doladění a místní vyvození budou stále důležitější.
Real-World Implementace
Spuštění chatbota zcela offline na notebooku nebo jediném GPU pro data citlivá na soukromí
Doladění malého modelu Gemma na interních dokumentech společnosti pro asistenta zákaznické podpory
Použití CodeGemma jako místního pomocníka při dokončování a generování kódu v IDE
Vytváření titulků obrázků nebo vizuálních aplikací pro otázky a odpovědi pomocí varianty PaliGemma v jazyce vidění
Rizika a zábradlí
Oznámení o uvedení mohou předstihnout stabilitu v reálných výrobních pracovních postupech.
Změny cen API nebo politik mohou přes noc narušit předpoklady.
Závislost na jediném dodavateli zvyšuje náklady na uzamčení a migraci.
Plán implementace
Vyhodnoťte poskytovatele pomocí vlastních úkolů a datových sad.
Před integrací si přečtěte podmínky ochrany soukromí, zabezpečení a právní podmínky.
Udržujte záložní plán napříč modely nebo dodavateli.
Sledujte poznámky k vydání, aby změny plánu nepřekvapily týmy.
Pokračujte v objevování
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Google Gemma quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Další průvodce
Google DeepMind
Často kladené otázky
What is Google Gemma?
Gemma je rodina lehkých modelů umělé inteligence s otevřenou hmotností Google vytvořených ze stejného výzkumu a technologie jako Gemini. Umožňuje vývojářům stahovat, dolaďovat a provozovat schopné modely na vlastním hardwaru, dokonce i na jediném notebooku nebo GPU.
Jaký je klíčový rozdíl mezi Gemma a Gemini?
Trénované závaží Gemmy lze stáhnout a spustit lokálně, zatímco Gemini je nabízen jako uzavřený model prostřednictvím aplikací a rozhraní API Google.
Jaké velikosti byly v prvním vydání Gemmy v roce 2024?
Počáteční uvedení Gemmy zahrnovalo modely s 2 miliardami a 7 miliardami parametrů, které byly záměrně dostatečně malé, aby běžely na skromném hardwaru.
Která varianta Gemma je specializovaná na programovací úlohy?
CodeGemma je varianta vyladěná pro generování a dokončování kódu, zatímco PaliGemma zpracovává vizuální jazyk a RecurrentGemma se zaměřuje na efektivní dlouhé sekvence.
Co znamená „otevřená váha“ pro modelku, jako je Gemma?
Open-weight znamená, že si můžete stáhnout a spustit trénované parametry, ale kompletní trénovací data a kanál nemusí být nutně open source.
Která technika pomáhá generaci Gemma 2 dosáhnout vysoké kvality při malých velikostech?
Destilace znalostí umožňuje menšímu „studentskému“ modelu naučit se napodobovat větší „učitelský“ model, a to v kompaktní velikosti.