Google Gemma
Gemma ialah keluarga model AI ringan dan terbuka Google yang dibina daripada penyelidikan dan teknologi yang sama seperti Gemini.
Gambaran keseluruhan
It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.
Menyelam dalam
Diumumkan pada Februari 2024, Gemma memberikan Google penyertaan dalam perlumbaan model berat terbuka bersama Llama dan Mistral milik Meta. Model dihantar dalam saiz kecil, keluaran pertama datang dalam versi parameter 2B dan 7B, dengan pemberat yang anda boleh muat turun dan jalankan secara setempat, tidak seperti Gemini yang tertutup, API sahaja. Google mengedarkan kedua-dua varian asas (pralatihan) dan arahan ditala di bawah lesen permisif yang membenarkan penggunaan komersial. Keluarga dengan cepat berkembang: CodeGemma untuk pengaturcaraan, PaliGemma untuk tugasan bahasa penglihatan, RecurrentGemma untuk urutan panjang yang cekap dan Gemma 2 (dan lebih baru) dengan prestasi yang lebih kukuh pada saiz seperti 9B dan 27B. Gemma direka bentuk untuk bermain dengan baik dengan alatan popular, Memeluk Wajah, Keras, PyTorch, JAX dan Ollama, menjadikannya pilihan praktikal untuk penggunaan di tempat terbuka, sensitif privasi atau mementingkan kos.
Wawasan Teknikal
Gemma menggunakan seni bina Transformer dekoder sahaja dan menggunakan semula teknik daripada penyelidikan Gemini, termasuk tokenizer perbendaharaan kata yang besar (sekitar 256k token) dan latihan yang disuling daripada model guru yang lebih besar dalam generasi Gemma 2. Penyulingan pengetahuan membolehkan model pelajar kecil meniru model yang lebih besar, mencapai kualiti yang kukuh pada saiz yang sederhana. 'Berat terbuka' bermakna parameter terlatih boleh dimuat turun supaya anda boleh memperhalusi dan menjadi hos sendiri, walaupun data latihan dan saluran paip penuh tidak bersumberkan terbuka sepenuhnya.
Kesan Strategik
Strategi vendor
Peta jalan vendor mempengaruhi ciri yang boleh dibina oleh pasukan anda seterusnya.
Kos dan bajet
Terma komersial dan pilihan penggunaan mempengaruhi kos dan risiko jangka panjang.
Risiko dan keselamatan
Insentif syarikat membentuk keingkaran produk, postur keselamatan dan keterbukaan.
Masa Depan Google Gemma
Jangkakan Google untuk terus mengeluarkan varian Gemma yang ditala untuk modaliti dan tugasan tertentu, penglihatan, kod, matematik dan penggunaan pada peranti, sambil mengecilkan jejak yang diperlukan untuk menjalankannya. Apabila model berwajaran terbuka menutup jurang dengan sistem sempadan, Gemma meletakkan Google untuk memenangi perkongsian minda pembangun dan kelebihan kuasa serta penggunaan persendirian di mana data tidak boleh meninggalkan bangunan. Penyepaduan yang lebih ketat dengan Android, Chrome dan alatan seperti Ollama dan Vertex AI akan menjadikan penalaan halus dan inferens setempat menjadi semakin penting.
Pelaksanaan Dunia Sebenar
Menjalankan chatbot di luar talian sepenuhnya pada komputer riba atau GPU tunggal untuk data sensitif privasi
Memperhalusi model Gemma kecil pada dokumen dalaman syarikat untuk pembantu sokongan tersuai
Menggunakan CodeGemma sebagai pembantu pelengkap dan penjanaan kod tempatan di dalam IDE
Membina kapsyen imej atau apl Soal Jawab visual dengan varian PaliGemma bahasa penglihatan
Risiko & Pengawal
Pengumuman pelancaran mungkin melebihi kestabilan dalam aliran kerja pengeluaran sebenar.
Harga API atau anjakan dasar boleh memecahkan andaian semalaman.
Kebergantungan vendor tunggal meningkatkan kos kunci masuk dan penghijrahan.
Hala Tuju Pelaksanaan
Nilai penyedia menggunakan tugasan dan set data anda sendiri.
Semak privasi, keselamatan dan syarat undang-undang sebelum penyepaduan.
Kekalkan pelan sandaran merentas model atau vendor.
Pantau nota keluaran supaya perubahan peta jalan tidak mengejutkan pasukan.
Teruskan Meneroka
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Google Gemma quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Panduan seterusnya
Google DeepMind
Soalan lazim
What is Google Gemma?
Gemma ialah keluarga model AI ringan dan terbuka Google yang dibina daripada penyelidikan dan teknologi yang sama seperti Gemini. Ia membolehkan pembangun memuat turun, memperhalusi dan menjalankan model yang berkebolehan pada perkakasan mereka sendiri, walaupun satu komputer riba atau GPU.
Apakah perbezaan utama antara Gemma dan Gemini?
Berat terlatih Gemma boleh dimuat turun dan dijalankan secara tempatan, manakala Gemini ditawarkan sebagai model tertutup melalui apl dan API Google.
Apakah saiz dalam keluaran Gemma pertama pada tahun 2024?
Pelancaran Gemma awal termasuk model parameter 2 bilion dan 7 bilion, cukup kecil untuk dijalankan pada perkakasan sederhana.
Varian Gemma yang manakah dikhususkan untuk tugas pengaturcaraan?
CodeGemma ialah varian yang ditala untuk penjanaan dan penyiapan kod, manakala PaliGemma mengendalikan bahasa penglihatan dan RecurrentGemma menyasarkan urutan panjang yang cekap.
Apakah maksud 'open-weight' untuk model seperti Gemma?
Berat terbuka bermakna anda boleh memuat turun dan menjalankan parameter terlatih, tetapi data latihan dan saluran paip yang lengkap tidak semestinya sumber terbuka.
Teknik manakah yang membantu generasi Gemma 2 mencapai kualiti yang kukuh pada saiz yang kecil?
Penyulingan pengetahuan membolehkan model 'pelajar' yang lebih kecil belajar meniru model 'guru' yang lebih besar, membungkus prestasi yang kukuh ke dalam saiz yang padat.