GHID Firme

Fuziunea modelului evolutiv Sakana AI

Sakana AI este un laborator cu sediul în Tokyo care aplică metode inspirate din natură AI, în special folosind algoritmi evolutivi pentru a îmbina modelele deschise existente în altele noi, mai bune.

2 minute de lecturăUltima actualizare

Prezentare generală

Instead of training from scratch, it 'breeds' models by automatically combining their strengths.

Scufundare în profunzime

Sakana AI a fost fondată în 2023 de Llion Jones, co-autor al lucrării originale „Attention Is All You Need” Transformer, și David Ha, fostul Google Brain. Numele înseamnă „pește” în japoneză, reflectând o filozofie inspirată de școli și roi: mulți agenți mici, colectivi, mai degrabă decât un model gigant. Tehnica sa inovatoare, Evolutionary Model Merging, folosește căutarea evolutivă pentru a descoperi cum să combinați greutățile și straturile mai multor modele open-source pregătite în prealabil. Algoritmul explorează mii de rețete de îmbinare, păstrând combinații care au rezultate bune la sarcinile țintă. Sakana a folosit acest lucru pentru a crea modele capabile de matematică și viziune în limba japoneză și japoneză prin fuzionarea modelelor existente, la o mică parte din costul antrenării altora noi. Compania a produs, de asemenea, „AI Scientist”, un sistem care încearcă să automatizeze cercetarea în sine.

Perspectivă tehnică

Fuziunea modelului combină parametrii rețelelor antrenate separat. Sakana evoluează îmbină în două spații simultan: spațiul parametrilor (cum se ponderează și se interpolează greutățile fiecărui model, strat cu strat) și spațiul fluxului de date (care straturi din ce modele se stivuiesc și în ce ordine). Un algoritm evolutiv propune rețete candidate, le evaluează pe un punct de referință și selectează și modifică cele mai bune, iterând către hibrizi de înaltă performanță fără antrenament bazat pe gradient.

Impact strategic

Strategia furnizorului

Foile de parcurs ale furnizorilor influențează caracteristicile pe care echipa ta le poate construi în continuare.

Cost și buget

Condițiile comerciale și opțiunile de implementare afectează costurile și riscurile pe termen lung.

Risc și siguranță

Stimulentele companiei modelează valorile implicite ale produselor, postura de siguranță și deschiderea.

Viitorul fuziunii modelelor evolutive Sakana AI

Fuziunea evolutivă sugerează un viitor în care noi modele capabile sunt asamblate dintr-o bibliotecă în creștere de modele deschise ieftin, democratizând accesul dincolo de laboratoarele cu bugete uriașe de calcul. Combinată cu „Scientist AI” automat de la Sakana, viziunea pe termen mai lung este sistemele AI care ajută la descoperirea propriilor îmbunătățiri. Întrebările deschise includ evitarea modelelor îmbinate care moștenesc erori sau părtiniri și dacă căutarea evolutivă se extinde la performanță la nivel de frontieră, mai degrabă decât specializarea modelelor existente.

Implementare în lumea reală

Crearea unui model puternic de limba japoneză prin îmbinarea modelelor deschise engleză și japoneză fără recalificare

Construirea unui model japonez de raționament matematic prin dezvoltarea combinațiilor de modele specializate în matematică

Producerea unui model de limbaj de viziune care gestionează textul japonez din imagini prin fuziune pe mai multe domenii

Permiteți organizațiilor mai mici să adune modele specifice sarcinilor ieftin din greutăți deschise în loc să se antreneze de la zero

Riscuri și balustrade

Anunțurile de lansare pot depăși stabilitatea în fluxurile de producție reale.

Prețurile API sau schimbările de politică pot rupe ipoteze peste noapte.

Dependența de un singur furnizor crește costurile de blocare și migrare.

Foaia de parcurs de implementare

1

Evaluați furnizorii folosind propriile sarcini și seturi de date.

2

Examinați confidențialitatea, securitatea și condițiile legale înainte de integrare.

3

Mențineți un plan alternativ pentru modele sau furnizori.

4

Monitorizați notele de lansare, astfel încât modificările foii de parcurs să nu surprindă echipele.

Continuați să explorați

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Sakana AI Evolutionary Model Merging quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Quiz Start

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Întrebări frecvente

What is Sakana AI Evolutionary Model Merging?

Sakana AI este un laborator cu sediul în Tokyo care aplică metode inspirate din natură AI, în special folosind algoritmi evolutivi pentru a îmbina modelele deschise existente în altele noi, mai bune. În loc să se antreneze de la zero, „crește” modele combinându-le automat punctele forte.

Ce face de fapt fuziunea modelului evolutiv al Sakana AI?

Evoluează rețete pentru combinarea mai multor greutăți și straturi ale modelelor deschise preantrenate, mai degrabă decât antrenamentul din nou.

Cine este un co-fondator notabil al Sakana AI?

Llion Jones, co-autor al cărții „Attention Is All You Need”, a co-fondat Sakana împreună cu David Ha.

Ce înseamnă și reflectă numele „Sakana”?

Sakana înseamnă pește; compania favorizează mulți agenți colectivi mici față de un model monolitic.

Sakana evoluează modelul fuzionează în care două spații?

Caută atât cum să cântăriți/interpolați parametrii, cât și ce straturi să stivuiți și în ce ordine.

Pe lângă fuziunea modelelor, ce sistem ambițios a introdus Sakana?

Sakana a lansat „AI Scientist”, un sistem care încearcă să automatizeze părți ale procesului de cercetare în sine.