企業ガイド

さかなAI進化モデル融合

Sakena AI は東京を拠点とするラボで、自然からインスピレーションを得た手法を AI に適用しており、特に進化的アルゴリズムを使用して既存のオープン モデルを新しいより優れたモデルに統合します。

2分の読書最終更新日

概要

Instead of training from scratch, it 'breeds' models by automatically combining their strengths.

ディープダイブ

Sakena AI は、オリジナルの Transformer 論文「Attending Is All You Need」の共著者である Llion Jones と、元 Google Brain の David Ha によって 2023 年に設立されました。この名前は日本語で「魚」を意味し、群れや群れ、つまり 1 つの巨大なモデルではなく、多数の小規模な集合的なエージェントからインスピレーションを得た哲学を反映しています。その画期的な技術である進化的モデルの結合は、進化的探索を使用して、複数の事前トレーニングされたオープンソース モデルの重みと層を結合する方法を発見します。このアルゴリズムは何千ものマージ レシピを探索し、ターゲット タスクで良いスコアを獲得する組み合わせを維持します。 Sakana はこれを利用して、既存のモデルを結合することで、新しいモデルをトレーニングするのに比べてわずかなコストで、有能な日本語および日本語の数学および視覚モデルを作成しました。同社は研究そのものの自動化を図るシステム「AI Scientist」も開発した。

技術的な洞察

モデルの結合では、個別にトレーニングされたネットワークのパラメーターがブレンドされます。 Sayaka は、パラメーター空間 (各モデルの重みをレイヤーごとに重み付けおよび補間する方法) とデータフロー空間 (どのレイヤーからどのモデルをどのような順序でスタックするか) という 2 つの空間で同時にマージを行います。進化的アルゴリズムが候補レシピを提案し、ベンチマークで評価し、最良のものを選択して変更し、勾配ベースのトレーニングを行わずに高性能のハイブリッドを目指して反復します。

戦略的影響

ベンダー戦略

ベンダーのロードマップは、チームが次に構築できる機能に影響を与えます。

費用と予算

商業条件と導入オプションは、長期的なコストとリスクに影響します。

リスクと安全性

企業のインセンティブは、製品のデフォルト、安全姿勢、オープン性を形成します。

さかなAI進化モデル融合の未来

進化的マージは、増大するオープン モデルのライブラリから新しい有能なモデルを安価に組み立て、莫大なコンピューティング予算を持つラボを超えたアクセスを民主化する未来を示唆しています。 Sakana の自動化された「AI サイエンティスト」と組み合わせることで、長期的なビジョンは、独自の改善点の発見を支援する AI システムになります。未解決の疑問には、バグやバイアスを継承するマージされたモデルを避けること、進化的探索が主に既存のモデルに特化するのではなくフロンティアレベルのパフォーマンスにまで拡張できるかどうかなどが含まれます。

現実世界の実装

英語と日本語のオープンモデルを再トレーニングせずに統合することで、強力な日本語対応言語モデルを作成する

数学に特化したモデルの組み合わせを進化させて日本語の数学推論モデルを構築する

クロスドメインマージを通じて画像内の日本語テキストを処理するビジョン言語モデルを作成する

小規模な組織がゼロからトレーニングするのではなく、オープンウェイトからタスク固有のモデルを安価に組み立てられるようにする

リスクとガードレール

実際の制作ワークフローでは、発売の発表が安定性を上回る可能性があります。

API の価格設定やポリシーの変更により、一夜にして想定が崩れる可能性があります。

単一ベンダーへの依存により、ロックインと移行のコストが増加します。

実装ロードマップ

1

独自のタスクとデータセットを使用してプロバイダーを評価します。

2

統合する前に、プライバシー、セキュリティ、法的条件を確認してください。

3

モデルやベンダー全体でフォールバック計画を維持します。

4

ロードマップの変更がチームを驚かせないように、リリース ノートを監視します。

探検を続けましょう

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Sakana AI Evolutionary Model Merging quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

クイズを開始する

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

よくある質問

What is Sakana AI Evolutionary Model Merging?

Sakena AI は東京を拠点とするラボで、自然からインスピレーションを得た手法を AI に適用しており、特に進化的アルゴリズムを使用して既存のオープン モデルを新しいより優れたモデルに統合します。ゼロからトレーニングするのではなく、モデルの強みを自動的に組み合わせてモデルを「育成」します。

さかなAIの進化モデルのマージは実際に何をするのか?

新たにトレーニングするのではなく、複数の事前トレーニングされたオープン モデルの重みとレイヤーを組み合わせるレシピを進化させます。

Sakana AI の著名な共同創設者は誰ですか?

『アテンション・イズ・オール・ユー・ニード』の共著者であるリオン・ジョーンズ氏は、デイヴィッド・ハ氏とSakanaを共同設立した。

「さかな」という名前には何を意味し、何を反映しているのでしょうか?

サカナは魚を意味します。同社は、1 つのモノリシック モデルよりも多数の小規模な集合代理店を好みます。

さかな進化モデルはどの 2 つの空間をマージしますか?

パラメーターの重み付け/補間方法と、どのレイヤーをどのような順序で積み重ねるかの両方を検索します。

モデルの統合以外に、Sakana はどのような野心的なシステムを導入しましたか?

さかなは、研究プロセス自体の一部を自動化しようとするシステム「AI Scientist」をリリースした。