企業ガイド

Google ジェマ

Gemma は、Gemini と同じ研究とテクノロジーに基づいて構築された、Google の軽量かつオープンウェイト AI モデルのファミリーです。

2分の読書最終更新日

概要

It lets developers download, fine-tune, and run capable models on their own hardware, even a single laptop or GPU.

ディープダイブ

2024 年 2 月に発表され、ジェマは Meta のラマとミストラルとともに、Google に無差別級モデル レースへのエントリーを与えます。モデルは小さいサイズで出荷され、最初のリリースは 2B および 7B パラメータ バージョンで提供され、クローズされた API のみの Gemini とは異なり、ローカルにダウンロードして実行できるウェイトを備えていました。 Google は、商用利用を許可する寛容なライセンスの下で、基本 (事前トレーニング済み) バリアントと命令調整済みバリアントの両方を配布します。このファミリーは急速に拡大しました。プログラミング用の CodeGemma、ビジョン言語タスク用の PaliGemma、効率的な長いシーケンス用の RecurrentGemma、そして 9B や 27B などのサイズでより強力なパフォーマンスを備えた Gemma 2 (およびそれ以降) です。 Gemma は、人気のあるツールである Hugging Face、Keras、PyTorch、JAX、Ollama とうまく連携できるように設計されており、オンプレミス、プライバシー重視、またはコスト重視の導入に実用的な選択肢となっています。

技術的な洞察

Gemma は、デコーダー専用の Transformer アーキテクチャを使用し、大規模な語彙トークナイザー (約 256,000 トークン) や Gemma 2 世代の大規模な教師モデルから抽出されたトレーニングなど、Gemini 研究からの技術を再利用します。知識の蒸留により、小さな学生モデルがはるかに大きな学生モデルを模倣できるようになり、適度なサイズで強力な品質を実現できます。 「オープンウェイト」とは、トレーニング データと完全なパイプラインが完全にオープンソースではないにもかかわらず、トレーニングされたパラメーターがダウンロード可能であるため、微調整や自己ホストが可能であることを意味します。

戦略的影響

ベンダー戦略

ベンダーのロードマップは、チームが次に構築できる機能に影響を与えます。

費用と予算

商業条件と導入オプションは、長期的なコストとリスクに影響します。

リスクと安全性

企業のインセンティブは、製品のデフォルト、安全姿勢、オープン性を形成します。

Google ジェマの未来

Google は、実行に必要なフットプリントを縮小しながら、特定のモダリティとタスク、ビジョン、コード、数学、およびデバイス上での使用に合わせて調整された Gemma バリアントをリリースし続けることが期待されます。オープンウェイト モデルがフロンティア システムとのギャップを縮める中、Gemma 氏は Google を開発者のマインドシェアを獲得し、データが建物の外に出ることができないエッジおよびプライベート展開を強化できると位置づけています。 Android、Chrome、および Ollama や Vertex AI などのツールとの緊密な統合により、微調整とローカル推論がますますターンキー化されます。

現実世界の実装

ラップトップまたは単一の GPU 上で完全にオフラインでチャットボットを実行し、プライバシーに配慮したデータを処理する

カスタム サポート アシスタント向けに、企業の内部文書に基づいて小さな Gemma モデルを微調整する

IDE 内のローカル コード補完および生成アシスタントとして CodeGemma を使用する

ビジョン言語 PaliGemma バリアントを使用して画像キャプションまたはビジュアル Q&A アプリを構築する

リスクとガードレール

実際の制作ワークフローでは、発売の発表が安定性を上回る可能性があります。

API の価格設定やポリシーの変更により、一夜にして想定が崩れる可能性があります。

単一ベンダーへの依存により、ロックインと移行のコストが増加します。

実装ロードマップ

1

独自のタスクとデータセットを使用してプロバイダーを評価します。

2

統合する前に、プライバシー、セキュリティ、法的条件を確認してください。

3

モデルやベンダー全体でフォールバック計画を維持します。

4

ロードマップの変更がチームを驚かせないように、リリース ノートを監視します。

探検を続けましょう

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Google Gemma quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

クイズを開始する

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

次のガイド

Google ディープマインド

よくある質問

What is Google Gemma?

Gemma は、Gemini と同じ研究とテクノロジーに基づいて構築された、Google の軽量かつオープンウェイト AI モデルのファミリーです。これにより、開発者は、1 台のラップトップや GPU であっても、対応するモデルをダウンロードし、微調整し、自分のハードウェア上で実行できます。

Gemma と Gemini の主な違いは何ですか?

Gemma のトレーニングされた重みはダウンロードしてローカルで実行できますが、Gemini は Google のアプリと API を通じて閉じたモデルとして提供されます。

2024 年に最初にリリースされた Gemma のサイズは何でしたか?

Gemma の最初のリリースには、20 億と 70 億のパラメータ モデルが含まれており、控えめなハードウェアで実行できるよう意図的に十分に小さくされていました。

どの Gemma バリアントがプログラミング タスクに特化していますか?

CodeGemma はコード生成と補完用に調整されたバリアントですが、PaliGemma はビジョン言語を処理し、RecurrentGemma は効率的な長いシーケンスをターゲットとしています。

ジェマのようなモデルにとって「オープンウェイト」とは何を意味しますか?

オープンウェイトとは、トレーニングされたパラメーターをダウンロードして実行できることを意味しますが、完全なトレーニング データとパイプラインが必ずしもオープンソースであるとは限りません。

Gemma 2 世代が小型サイズで優れた品質を達成するのに役立つ技術はどれですか?

知識の蒸留により、より小さな「生徒」モデルがより大きな「教師」モデルを模倣することを学習し、強力なパフォーマンスをコンパクトなサイズに詰め込むことができます。