FöretagsGUIDE

Sakana AI Evolutionary Model Merging

Sakana AI är ett Tokyo-baserat labb som tillämpar naturinspirerade metoder på AI, framför allt genom att använda evolutionära algoritmer för att slå samman befintliga öppna modeller till nya, bättre.

2 min readSenast uppdaterad

Översikt

Instead of training from scratch, it 'breeds' models by automatically combining their strengths.

Djupdykning

Sakana AI grundades 2023 av Llion Jones, en medförfattare till det ursprungliga "Attention Is All You Need" Transformer-papperet, och David Ha, tidigare från Google Brain. Namnet betyder "fisk" på japanska, vilket speglar en filosofi inspirerad av skolor och svärmar: många små, kollektiva agenter snarare än en jättemodell. Dess banbrytande teknik, Evolutionary Model Merging, använder evolutionär sökning för att upptäcka hur man kombinerar vikterna och lagren hos flera förtränade modeller med öppen källkod. Algoritmen utforskar tusentals sammanslagningsrecept och behåller kombinationer som ger bra resultat på måluppgifter. Sakana använde detta för att skapa kapabla japanskspråkiga och japanska matematik- och visionmodeller genom att slå samman befintliga modeller, till en liten bråkdel av kostnaden för att träna nya. Företaget producerade också "AI Scientist", ett system som försöker automatisera forskningen själv.

Teknisk insikt

Modellsammanslagning blandar parametrarna för separat tränade nätverk. Sakana utvecklas smälter samman i två utrymmen samtidigt: parameterutrymmet (hur man viktar och interpolerar varje modells vikter, lager för lager) och dataflödesutrymmet (vilka lager från vilka modeller som ska staplas och i vilken ordning). En evolutionär algoritm föreslår kandidatrecept, utvärderar dem på ett riktmärke och väljer ut och muterar de bästa, itererande mot högpresterande hybrider utan gradientbaserad träning.

Strategisk inverkan

Vendor strategy

Leverantörsfärdplaner påverkar vilka funktioner ditt team kan bygga härnäst.

Cost and budget

Kommersiella villkor och distributionsalternativ påverkar långsiktiga kostnader och risker.

Risk and safety

Företagsincitament formar produktstandarder, säkerhetsställning och öppenhet.

Framtiden för Sakana AI Evolutionary Model Merging

Evolutionär sammanslagning antyder en framtid där nya kapabla modeller sätts ihop från ett växande bibliotek av öppna modeller billigt, och demokratiserar åtkomst bortom labb med enorma datorbudgetar. I kombination med Sakanas automatiserade "AI Scientist" är den långsiktiga visionen AI-system som hjälper till att upptäcka sina egna förbättringar. Öppna frågor inkluderar att undvika sammanslagna modeller som ärver buggar eller fördomar, och om evolutionära sökningar skalar till prestanda på gränsnivå snarare än att främst specialisera befintliga modeller.

Real-World Implementation

Skapa en stark japansk-kapabel språkmodell genom att slå samman engelska och japanska öppna modeller utan omskolning

Bygga en japansk modell för matematisk resonemang genom att utveckla kombinationer av matematiska specialiserade modeller

Producerar en vision-språkmodell som hanterar japansk text i bilder via sammanslagning över flera domäner

Att låta mindre organisationer montera uppgiftsspecifika modeller billigt från öppna vikter istället för att träna från grunden

Risker & skyddsräcken

Lanseringsmeddelanden kan överträffa stabiliteten i verkliga produktionsarbetsflöden.

API-prissättning eller policyförskjutningar kan bryta antaganden över en natt.

Beroende av en leverantör ökar inlåsnings- och migreringskostnaderna.

Färdplan för genomförande

1

Utvärdera leverantörer med dina egna uppgifter och datauppsättningar.

2

Granska sekretess, säkerhet och juridiska villkor innan integration.

3

Upprätthåll en reservplan över modeller eller leverantörer.

4

Övervaka release notes så att förändringar i färdplanen inte överraskar team.

Fortsätt utforska

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Sakana AI Evolutionary Model Merging quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Starta frågesport

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Modellsammanslagning

Frequently asked questions

What is Sakana AI Evolutionary Model Merging?

Sakana AI är ett Tokyo-baserat labb som tillämpar naturinspirerade metoder på AI, framför allt genom att använda evolutionära algoritmer för att slå samman befintliga öppna modeller till nya, bättre. Istället för att träna från grunden, "föder upp" modeller genom att automatiskt kombinera sina styrkor.

Vad gör egentligen Sakana AI:s evolutionära modellsammanslagning?

Det utvecklar recept för att kombinera flera förtränade öppna modellers vikter och lager, snarare än att träna på nytt.

Vem är en anmärkningsvärd medgrundare av Sakana AI?

Llion Jones, en medförfattare till "Attention Is All You Need", grundade Sakana tillsammans med David Ha.

Vad betyder och reflekterar namnet "Sakana"?

Sakana betyder fisk; företaget gynnar många små kollektiva agenter framför en monolitisk modell.

Sakana utvecklar modell smälter samman över vilka två utrymmen?

Den söker både hur man viktar/interpolerar parametrar och vilka lager som ska staplas och i vilken ordning.

Förutom modellsammanslagning, vilket ambitiöst system introducerade Sakana?

Sakana släppte "AI Scientist", ett system som försöker automatisera delar av själva forskningsprocessen.