Stability AI
Stability AI е базираната в Лондон стартираща компания зад Stable Diffusion, отвореният генератор на изображения, който поставя AI текст към изображение на милиони лаптопи.
Преглед
By releasing model weights publicly, it sparked a wave of open-source creative tooling that rivaled closed systems from OpenAI and Google.
Дълбоко гмуркане
Основан през 2019 г. от Emad Mostaque, Stability AI стана известен през август 2022 г., когато подкрепи публичното пускане на Stable Diffusion, модел на латентна дифузия, обучен до голяма степен върху набора от данни LAION-5B. За разлика от DALL-E или Midjourney, теглата можеха да се изтеглят, позволявайки на любители, изследователи и компании да управляват и прецизират модела локално безплатно. Това подхранва експлозия от разклонения, плъгини и инструменти като Automatic1111 и ControlNet. По-късно компанията се разшири до език (StableLM), аудио (Stable Audio), 3D и видео (Stable Video Diffusion) и достави Stable Diffusion 3 през 2024 г. След напрежението във финансирането и напускането на Mostaque през 2024 г., новото ръководство пренасочи компанията към устойчиво корпоративно лицензиране, като същевременно запази етиката на отворените компании.
Техническа информация
Stable Diffusion е модел на латентна дифузия: вместо директно премахване на шума на пикселите, той компресира изображения в по-малко латентно пространство с помощта на вариационен автоенкодер, след което стартира процеса на дифузия там. U-Net се научава да обръща шума стъпка по стъпка, ръководен от текстови вграждания от текстов енкодер в стил CLIP чрез кръстосано внимание. Работата в латентно пространство намалява изчисленията, поради което моделът може да работи на един потребителски GPU, а не на център за данни.
Стратегическо въздействие
Vendor strategy
Пътните карти на доставчиците влияят на това какви функции вашият екип може да изгради по-нататък.
Cost and budget
Търговските условия и опциите за внедряване влияят върху дългосрочните разходи и риск.
Risk and safety
Стимулите на компанията оформят продуктовите стандарти, безопасността и откритостта.
Бъдещето на стабилността AI
Изкуственият интелект за стабилност се препозиционира към корпоративни API, партньорства за медии и развлечения (включително сделка с WPP) и модели, удобни за периферията, достатъчно малки, за да работят на телефони и лаптопи. Очаквайте продължаващо напрежение между неговите открити корени и нуждата от приходи, плюс по-сериозни инвестиции във видео, аудио и 3D генериране. Правните въпроси относно данните за обучение и авторските права, включително съдебното дело на Getty Images, силно ще оформят доколко открито могат да бъдат обучавани и споделяни бъдещи модели.
Внедряване в реалния свят
Студио за независими игри прецизира Stable Diffusion локално, за да генерира последователно концептуално изкуство за персонажи без разходи за облак за всяко изображение.
Разработчик добавя ControlNet към Stable Diffusion, за да преобразува грубите скици в изчистени макети на продукти, като същевременно запазва точното оформление.
Музикант използва Stable Audio, за да генерира безплатни фонови цикли и околни текстури за интро на подкаст.
Изследователска лаборатория изтегля отворените тегла, за да проучи и намали демографските отклонения в генерираните лица, нещо невъзможно със затворени API.
Рискове и предпазни огради
Съобщенията за стартиране може да изпреварят стабилността в реалните производствени работни процеси.
Ценообразуването на API или промените в политиката могат да разбият предположенията за една нощ.
Зависимостта от един доставчик увеличава разходите за заключване и миграция.
Пътна карта за изпълнение
Оценявайте доставчиците, като използвате вашите собствени задачи и набори от данни.
Прегледайте поверителността, сигурността и правните условия преди интегриране.
Поддържайте резервен план за модели или доставчици.
Наблюдавайте бележките по изданието, така че промените в пътната карта да не изненадват екипите.
Продължете да изследвате
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Stability AI quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Next guide
Perplexity AI
Frequently asked questions
What is Stability AI?
Stability AI е базираната в Лондон стартираща компания зад Stable Diffusion, отвореният генератор на изображения, който поставя AI текст към изображение на милиони лаптопи. С публичното публикуване на теглата на моделите предизвика вълна от творчески инструменти с отворен код, които съперничиха на затворени системи от OpenAI и Google.
Какво е Stability AI, което е най-известно с пускането си през 2022 г.?
Stability AI подкрепи публичното издание на Stable Diffusion от август 2022 г., чиито тегла за изтегляне го превърнаха в забележителност в генеративния AI с отворен код.
Какво направи Stable Diffusion различен от DALL-E и Midjourney при стартирането?
За разлика от своите затворени конкуренти, тежестите на Stable Diffusion бяха пуснати открито, позволявайки на всеки да работи и да го настройва фино на собствения си хардуер.
Технически, къде Stable Diffusion извършва своя процес на обезшумяване?
Това е модел на латентна дифузия: автокодер компресира изображения в по-малко латентно пространство, където U-Net премахва шума, драстично намалявайки изчисленията.
Кой набор от данни беше централен за обучението на оригиналната стабилна дифузия?
Stable Diffusion беше обучен до голяма степен на LAION-5B, масивен набор от данни от двойки изображение-текст, извлечени от мрежата.
Отвъд изображенията, за коя модалност също е изградил модели Stability AI?
Стабилността е разширена в аудио (Stable Audio), език (StableLM), 3D и видео (Stable Video Diffusion).