ГІД компаній

Сакана А. І. Злиття еволюційної моделі

Sakana AI — це токійська лабораторія, яка застосовує методи, натхненні природою, до штучного інтелекту, особливо використовуючи еволюційні алгоритми для об’єднання існуючих відкритих моделей у нові, кращі.

2 хвилини читанняОстаннє оновлення

Огляд

Instead of training from scratch, it 'breeds' models by automatically combining their strengths.

Глибоке занурення

Sakana AI була заснована в 2023 році Лліоном Джонсом, співавтором оригінальної статті Transformer «Увага — це все, що вам потрібно», і Девідом Ха, колишнім співробітником Google Brain. Назва японською означає «риба», що відображає філософію, натхненну школами та зграями: багато маленьких колективних агентів, а не одна гігантська модель. Його революційна техніка, злиття еволюційних моделей, використовує еволюційний пошук, щоб дізнатися, як поєднати ваги та шари кількох попередньо підготовлених моделей з відкритим кодом. Алгоритм досліджує тисячі рецептів злиття, зберігаючи комбінації, які добре оцінюють цільові завдання. Сакана використав це для створення ефективних японсько-мовних і японських математичних і бачення моделей шляхом об’єднання існуючих моделей за незначну частку вартості навчання нових. Компанія також розробила «AI Scientist», систему, яка намагається автоматизувати дослідження.

Технічне розуміння

Об’єднання моделей поєднує параметри окремо навчених мереж. Sakana evolves об’єднує два простори одночасно: простір параметрів (як зважувати та інтерполювати ваги кожної моделі, шар за шаром) і простір потоку даних (які шари, з яких моделей складати та в якому порядку). Еволюційний алгоритм пропонує рецепти-кандидати, оцінює їх за еталонним тестом, відбирає та видозмінює найкращі, ітеруючи до високоефективних гібридів без градієнтного навчання.

Стратегічний вплив

Стратегія постачальника

Дорожні карти постачальників впливають на те, які функції ваша команда може створити далі.

Вартість і бюджет

Комерційні умови та варіанти розгортання впливають на довгострокову вартість і ризик.

Ризики та безпека

Стимули компанії формують стандарти продукту, безпеку та відкритість.

Майбутнє злиття еволюційної моделі Sakana AI

Еволюційне злиття натякає на майбутнє, де нові потужні моделі збиратимуть із зростаючої бібліотеки відкритих моделей дешево, демократизуючи доступ за межі лабораторій із величезними обчислювальними бюджетами. У поєднанні з автоматизованим «Вченим штучного інтелекту» Sakana довгострокове бачення — це системи штучного інтелекту, які допомагають знаходити власні вдосконалення. Відкриті питання включають уникнення об’єднаних моделей, які успадковують помилки чи упередження, а також те, чи масштабується еволюційний пошук до продуктивності передового рівня, а не переважно до спеціалізації існуючих моделей.

Реалізація в реальному світі

Створення сильної мовної моделі з підтримкою японської мови шляхом об’єднання відкритих моделей англійської та японської без перепідготовки

Створення японської моделі математичних міркувань шляхом розвитку комбінацій спеціалізованих математичних моделей

Створення моделі мови бачення, яка обробляє японський текст у зображеннях за допомогою міждоменного злиття

Дозволити невеликим організаціям дешево збирати моделі для конкретних завдань із відкритих ваг замість навчання з нуля

Ризики та огорожі

Оголошення про запуск можуть випереджати стабільність у реальних робочих процесах виробництва.

Зміни в ціноутворенні API або в політиці можуть миттєво порушити припущення.

Залежність від одного постачальника збільшує витрати на блокування та міграцію.

Дорожня карта впровадження

1

Оцініть постачальників за допомогою власних завдань і наборів даних.

2

Перегляньте умови конфіденційності, безпеки та юридичні умови перед інтеграцією.

3

Підтримуйте запасний план для різних моделей або постачальників.

4

Слідкуйте за примітками до випуску, щоб зміни дорожньої карти не здивували команди.

Продовжуйте досліджувати

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Sakana AI Evolutionary Model Merging quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Розпочати вікторину

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Часті запитання

What is Sakana AI Evolutionary Model Merging?

Sakana AI — це токійська лабораторія, яка застосовує методи, натхненні природою, до штучного інтелекту, особливо використовуючи еволюційні алгоритми для об’єднання існуючих відкритих моделей у нові, кращі. Замість того, щоб навчатися з нуля, він «розводить» моделей, автоматично поєднуючи їхні сильні сторони.

Що насправді робить злиття еволюційної моделі Sakana AI?

Він розвиває рецепти для поєднання ваги та шарів кількох попередньо підготовлених відкритих моделей, а не навчання заново.

Хто є відомим співзасновником Sakana AI?

Лліон Джонс, співавтор книги «Увага — це все, що вам потрібно», разом із Девідом Ха заснував Sakana.

Що означає та відображає назва «Сакана»?

Сакана означає риба; компанія віддає перевагу багатьом малим колективним агентам, а не одній монолітній моделі.

Які два простори поєднує модель Sakana Evolves?

Він шукає як зважити/інтерполювати параметри, так і які шари скласти та в якому порядку.

Окрім злиття моделей, яку амбітну систему представив Сакана?

Sakana випустила «AI Scientist», систему, яка намагається автоматизувати частини самого дослідницького процесу.