회사 가이드

Google 젬마

Gemma는 Gemini와 동일한 연구 및 기술을 바탕으로 구축된 Google의 경량 개방형 AI 모델 제품군입니다.

2분 읽기마지막 업데이트

개요

It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.

심층 분석

2024년 2월에 발표된 Gemma는 Google에게 Meta의 Llama 및 Mistral과 함께 개방형 모델 경주에 참가할 수 있는 기회를 제공합니다. 모델은 작은 크기로 제공되며, 첫 번째 릴리스는 2B 및 7B 매개변수 버전으로 제공되었으며 폐쇄형 API 전용 Gemini와 달리 가중치를 로컬로 다운로드하여 실행할 수 있습니다. Google은 상업적 사용을 허용하는 허용 라이선스에 따라 기본(사전 훈련된) 변형과 명령 조정 변형을 모두 배포합니다. 제품군은 프로그래밍을 위한 CodeGemma, 비전 언어 작업을 위한 PaliGemma, 효율적인 긴 시퀀스를 위한 RecurrentGemma, 9B 및 27B와 같은 크기에서 더 강력한 성능을 제공하는 Gemma 2(및 이후 버전)로 빠르게 확장되었습니다. Gemma는 인기 있는 도구인 Hugging Face, Keras, PyTorch, JAX 및 Ollama와 잘 작동하도록 설계되어 온프레미스, 개인 정보 보호에 민감하거나 비용에 민감한 배포에 실용적인 선택입니다.

기술적 통찰력

Gemma는 디코더 전용 Transformer 아키텍처를 사용하고 대규모 어휘 토크나이저(약 256,000개 토큰) 및 Gemma 2 세대의 대규모 교사 모델에서 추출한 교육을 포함하여 Gemini 연구의 기술을 재사용합니다. 지식 증류를 통해 소규모 학생 모델이 훨씬 더 큰 모델을 모방하여 적당한 크기로 강력한 품질을 달성할 수 있습니다. '공개 가중치'는 훈련된 매개변수를 다운로드할 수 있으므로 미세 조정 및 자체 호스팅이 가능하지만 훈련 데이터와 전체 파이프라인이 완전히 오픈 소스화되지는 않음을 의미합니다.

전략적 영향

벤더 전략

공급업체 로드맵은 팀이 다음에 구축할 수 있는 기능에 영향을 미칩니다.

비용 및 예산

상업적 조건과 배포 옵션은 장기적인 비용과 위험에 영향을 미칩니다.

위험과 안전

회사 인센티브는 제품 기본값, 안전 태세 및 개방성을 형성합니다.

Google Gemma의 미래

Google는 특정 양식 및 작업, 비전, 코드, 수학 및 기기 내 사용에 맞게 조정된 Gemma 변형을 계속 출시하는 동시에 이를 실행하는 데 필요한 공간을 줄일 것으로 기대합니다. 개방형 모델이 프론티어 시스템과의 격차를 줄이면서 Gemma는 Google를 포지셔닝하여 개발자의 마음을 사로잡고 데이터가 건물 외부로 나갈 수 없는 엣지 및 프라이빗 배포를 강화합니다. Android, Chrome, Ollama 및 Vertex AI와 같은 도구와의 긴밀한 통합을 통해 미세 조정 및 로컬 추론이 점점 더 턴키 방식으로 이루어질 것입니다.

실제 구현

개인 정보 보호에 민감한 데이터를 위해 노트북이나 단일 GPU에서 완전히 오프라인으로 챗봇 실행

맞춤형 지원 보조자를 위해 회사 내부 문서에서 작은 Gemma 모델을 미세 조정합니다.

CodeGemma를 IDE 내에서 로컬 코드 완성 및 생성 도우미로 사용

비전 언어 PaliGemma 변형을 사용하여 이미지 캡션 또는 시각적 Q&A 앱 구축

위험 및 가드레일

출시 발표는 실제 생산 워크플로의 안정성보다 앞설 수 있습니다.

API 가격 책정이나 정책 변경으로 인해 하룻밤 사이에 가정이 깨질 수 있습니다.

단일 공급업체 종속성은 종속 및 마이그레이션 비용을 증가시킵니다.

구현 로드맵

1

자체 작업과 데이터 세트를 사용하여 공급자를 평가합니다.

2

통합하기 전에 개인정보 보호, 보안, 법적 약관을 검토하세요.

3

모델이나 공급업체 전반에 걸쳐 대체 계획을 유지합니다.

4

로드맵 변경으로 인해 팀이 놀라지 않도록 릴리스 노트를 모니터링하세요.

계속 탐색하세요

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Google Gemma quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

퀴즈 시작

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

자주 묻는 질문

What is Google Gemma?

Gemma는 Gemini와 동일한 연구 및 기술을 바탕으로 구축된 Google의 경량 개방형 AI 모델 제품군입니다. 이를 통해 개발자는 단일 노트북이나 GPU라도 자신의 하드웨어에서 가능한 모델을 다운로드하고, 미세 조정하고, 실행할 수 있습니다.

Gemma와 Gemini의 주요 차이점은 무엇입니까?

Gemma의 학습된 가중치는 로컬에서 다운로드하여 실행할 수 있으며, Gemini은 Google의 앱과 API를 통해 폐쇄형 모델로 제공됩니다.

2024년 첫 번째 Gemma 릴리스에는 어떤 크기가 있었나요?

초기 Gemma 출시에는 20억 및 70억 개의 매개변수 모델이 포함되었으며, 이는 의도적으로 적당한 하드웨어에서 실행될 수 있을 만큼 작았습니다.

프로그래밍 작업에 특화된 Gemma 변형은 무엇입니까?

CodeGemma는 코드 생성 및 완성을 위해 조정된 변형이고, PaliGemma는 비전 언어를 처리하고 RecurrentGemma는 효율적인 긴 시퀀스를 목표로 합니다.

Gemma와 같은 모델에게 '오픈 웨이트'는 무엇을 의미하나요?

개방형 가중치는 훈련된 매개변수를 다운로드하고 실행할 수 있지만 전체 훈련 데이터와 파이프라인이 반드시 오픈 소스일 필요는 없음을 의미합니다.

Gemma 2세대가 작은 크기에서도 강력한 품질을 달성하는 데 도움이 되는 기술은 무엇입니까?

지식 증류를 통해 더 작은 '학생' 모델이 더 큰 '교사' 모델을 모방하는 방법을 학습하여 작은 크기에 강력한 성능을 담을 수 있습니다.