Google เจมม่า
Gemma คือกลุ่มโมเดล AI น้ำหนักเบาแบบเปิดของ Google ที่สร้างขึ้นจากการวิจัยและเทคโนโลยีเดียวกันกับ Gemini
ภาพรวม
It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.
เจาะลึก
ประกาศเมื่อเดือนกุมภาพันธ์ 2024 Gemma มอบสิทธิ์ให้ Google เข้าร่วมการแข่งขันรุ่นโอเพ่นเวต ควบคู่ไปกับ Llama และ Mistral จาก Meta โมเดลจัดส่งในขนาดที่เล็ก โดยรุ่นแรกมาในเวอร์ชันพารามิเตอร์ 2B และ 7B โดยมีน้ำหนักที่คุณสามารถดาวน์โหลดและรันในเครื่องได้ ซึ่งแตกต่างจาก Gemini แบบปิดที่ใช้ API เท่านั้น Google จัดจำหน่ายทั้งเวอร์ชันพื้นฐาน (ฝึกล่วงหน้า) และเวอร์ชันที่ปรับแต่งคำสั่งภายใต้ใบอนุญาตที่อนุญาตซึ่งอนุญาตให้นำไปใช้ในเชิงพาณิชย์ได้ กลุ่มผลิตภัณฑ์ขยายออกไปอย่างรวดเร็ว: CodeGemma สำหรับการเขียนโปรแกรม, PaliGemma สำหรับงานด้านภาษาวิชั่น, RecurrentGemma สำหรับลำดับยาวที่มีประสิทธิภาพ และ Gemma 2 (และใหม่กว่า) ที่มีประสิทธิภาพแข็งแกร่งกว่าในขนาด เช่น 9B และ 27B Gemma ได้รับการออกแบบมาให้ทำงานได้ดีกับเครื่องมือยอดนิยมอย่าง Hugging Face, Keras, PyTorch, JAX และ Ollama ทำให้เป็นตัวเลือกที่ใช้งานได้จริงสำหรับการปรับใช้ภายในองค์กร คำนึงถึงความเป็นส่วนตัว หรือคำนึงถึงต้นทุน
ข้อมูลเชิงลึกทางเทคนิค
Gemma ใช้สถาปัตยกรรม Transformer ที่ใช้ตัวถอดรหัสเท่านั้น และนำเทคนิคจากการวิจัย Gemini มาใช้ซ้ำ รวมถึงโทเค็นไนเซอร์คำศัพท์ขนาดใหญ่ (ประมาณ 256,000 โทเค็น) และการฝึกอบรมที่กลั่นมาจากโมเดลครูขนาดใหญ่ในเจเนอเรชั่น Gemma 2 การกลั่นกรองความรู้ช่วยให้แบบจำลองของนักเรียนขนาดเล็กสามารถเลียนแบบแบบจำลองที่ใหญ่กว่ามากได้ ทำให้ได้คุณภาพที่ชัดเจนในขนาดที่พอเหมาะ 'Open-weight' หมายความว่าสามารถดาวน์โหลดพารามิเตอร์ที่ได้รับการฝึกอบรมได้ เพื่อให้คุณปรับแต่งและโฮสต์เองได้ แม้ว่าข้อมูลการฝึกอบรมและไปป์ไลน์ทั้งหมดจะไม่ใช่โอเพ่นซอร์สโดยสมบูรณ์ก็ตาม
ผลกระทบเชิงกลยุทธ์
กลยุทธ์ของผู้ขาย
โรดแมปของผู้จำหน่ายมีอิทธิพลต่อฟีเจอร์ที่ทีมของคุณสามารถสร้างได้ต่อไป
ต้นทุนและงบประมาณ
ข้อกำหนดทางการค้าและตัวเลือกการใช้งานส่งผลต่อต้นทุนและความเสี่ยงในระยะยาว
ความเสี่ยงและความปลอดภัย
สิ่งจูงใจของบริษัทจะกำหนดค่าเริ่มต้นของผลิตภัณฑ์ ท่าทางที่ปลอดภัย และความเปิดกว้าง
อนาคตของ Google เจมม่า
คาดว่า Google จะปล่อยตัวแปร Gemma ที่ได้รับการปรับแต่งมาสำหรับรูปแบบและงานเฉพาะ การมองเห็น โค้ด คณิตศาสตร์ และการใช้งานบนอุปกรณ์ ขณะเดียวกันก็ลดขนาดพื้นที่ที่จำเป็นในการเรียกใช้ ในขณะที่โมเดลแบบเปิดปิดช่องว่างด้วยระบบชายแดน Gemma วางตำแหน่ง Google เพื่อชนะใจนักพัฒนาและ Power Edge และการปรับใช้ส่วนตัวที่ข้อมูลไม่สามารถออกจากอาคารได้ การผสานรวมกับ Android, Chrome และเครื่องมืออย่าง Ollama และ Vertex AI อย่างใกล้ชิดยิ่งขึ้น จะทำให้การปรับแต่งอย่างละเอียดและการอนุมานเฉพาะจุดมีความพร้อมมากขึ้น
การใช้งานจริงในโลกแห่งความเป็นจริง
ใช้งานแชทบอทแบบออฟไลน์ทั้งหมดบนแล็ปท็อปหรือ GPU ตัวเดียวเพื่อข้อมูลที่ละเอียดอ่อนต่อความเป็นส่วนตัว
ปรับแต่งโมเดล Gemma ขนาดเล็กบนเอกสารภายในของบริษัทสำหรับผู้ช่วยฝ่ายสนับสนุนที่กำหนดเอง
การใช้ CodeGemma เป็นตัวช่วยเติมโค้ดภายในเครื่องและสร้างภายใน IDE
สร้างแอปคำบรรยายภาพหรือแอปถามตอบด้วยภาพด้วยตัวแปร PaliGemma ภาษาวิสัยทัศน์
ความเสี่ยงและรั้ว
การประกาศเปิดตัวอาจแซงหน้าความเสถียรในขั้นตอนการทำงานจริง
การกำหนดราคา API หรือการเปลี่ยนแปลงนโยบายสามารถทำลายสมมติฐานได้ในชั่วข้ามคืน
การพึ่งพาผู้ขายรายเดียวจะเพิ่มค่าใช้จ่ายในการล็อคอินและการย้ายข้อมูล
แผนงานการดำเนินงาน
ประเมินผู้ให้บริการโดยใช้งานและชุดข้อมูลของคุณเอง
ตรวจสอบความเป็นส่วนตัว ความปลอดภัย และข้อกำหนดทางกฎหมายก่อนรวมระบบ
รักษาแผนสำรองสำหรับรุ่นหรือผู้จำหน่าย
ตรวจสอบบันทึกประจำรุ่นเพื่อให้การเปลี่ยนแปลงแผนงานไม่ทำให้ทีมแปลกใจ
สำรวจต่อไป
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Google Gemma quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
คำแนะนำต่อไป
Google ดีพมายด์
คำถามที่พบบ่อย
What is Google Gemma?
Gemma คือกลุ่มโมเดล AI น้ำหนักเบาแบบเปิดของ Google ที่สร้างขึ้นจากการวิจัยและเทคโนโลยีเดียวกันกับ Gemini ช่วยให้นักพัฒนาดาวน์โหลด ปรับแต่ง และรันโมเดลที่มีความสามารถบนฮาร์ดแวร์ของตนเอง แม้แต่แล็ปท็อปหรือ GPU เครื่องเดียว
อะไรคือความแตกต่างที่สำคัญระหว่างเจมม่าและ Gemini?
สามารถดาวน์โหลดและเรียกใช้ตุ้มน้ำหนักที่ผ่านการฝึกอบรมของ Gemma ได้ในเครื่อง ในขณะที่ Gemini มีให้บริการในรูปแบบปิดผ่านแอปและ API ของ Google
Gemma เปิดตัวครั้งแรกในปี 2024 มีขนาดเท่าใด
การเปิดตัว Gemma ครั้งแรกประกอบด้วยโมเดลพารามิเตอร์ 2 พันล้านและ 7 พันล้านตัว ซึ่งตั้งใจให้มีขนาดเล็กพอที่จะทำงานบนฮาร์ดแวร์ขนาดเล็กได้
Gemma รุ่นใดที่เหมาะกับงานการเขียนโปรแกรมโดยเฉพาะ
CodeGemma เป็นตัวแปรที่ได้รับการปรับแต่งสำหรับการสร้างและการเสร็จสิ้นโค้ด ในขณะที่ PaliGemma จัดการภาษาการมองเห็น และ RecurrentGemma กำหนดเป้าหมายลำดับยาวที่มีประสิทธิภาพ
'open-weight' หมายถึงอะไรสำหรับโมเดลอย่าง Gemma
Open-weight หมายความว่าคุณสามารถดาวน์โหลดและเรียกใช้พารามิเตอร์ที่ได้รับการฝึกได้ แต่ข้อมูลและไปป์ไลน์การฝึกที่สมบูรณ์ไม่จำเป็นต้องเป็นโอเพ่นซอร์ส
เทคนิคใดที่ช่วยให้ Gemma 2 Generation บรรลุคุณภาพที่แข็งแกร่งในขนาดที่เล็ก?
การกลั่นกรองความรู้ช่วยให้โมเดล 'นักเรียน' ขนาดเล็กเรียนรู้ที่จะเลียนแบบโมเดล 'ครู' ที่ใหญ่กว่า โดยบรรจุประสิทธิภาพที่แข็งแกร่งไว้ในขนาดที่กะทัดรัด