Stability AI
Stability AI est la startup basée à Londres derrière Stable Diffusion, le générateur d'images à poids ouvert qui met l'IA texte-image sur des millions d'ordinateurs portables.
Aperçu
By releasing model weights publicly, it sparked a wave of open-source creative tooling that rivaled closed systems from OpenAI and Google.
Plongée profonde
Fondée en 2019 par Emad Mostaque, Stability AI est devenue célèbre en août 2022 en soutenant la sortie publique de Stable Diffusion, un modèle de diffusion latente formé en grande partie sur l'ensemble de données LAION-5B. Contrairement à DALL-E ou Midjourney, les poids étaient téléchargeables, permettant aux amateurs, aux chercheurs et aux entreprises d'exécuter et d'affiner le modèle localement gratuitement. Cela a alimenté une explosion de forks, de plugins et d’outils comme Automatic1111 et ControlNet. La société s'est ensuite développée dans le domaine du langage (StableLM), de l'audio (Stable Audio), de la 3D et de la vidéo (Stable Video Diffusion) et a expédié Stable Diffusion 3 en 2024. Après des difficultés de financement et le départ de Mostaque en 2024, la nouvelle direction a recentré l'entreprise sur les licences d'entreprise durables tout en conservant une philosophie de poids ouvert.
Aperçu technique
Stable Diffusion est un modèle de diffusion latente : au lieu de débruiter directement les pixels, il compresse les images dans un espace latent plus petit à l'aide d'un auto-encodeur variationnel, puis y exécute le processus de diffusion. Un U-Net apprend à inverser le bruit étape par étape, guidé par les intégrations de texte provenant d'un encodeur de texte de style CLIP via une attention croisée. Travailler dans un espace latent réduit le calcul, c'est exactement pourquoi le modèle peut fonctionner sur un seul GPU grand public plutôt que sur un centre de données.
Impact stratégique
Stratégie du fournisseur
Les feuilles de route des fournisseurs influencent les fonctionnalités que votre équipe peut ensuite créer.
Coût et budget
Les conditions commerciales et les options de déploiement affectent les coûts et les risques à long terme.
Risques et sécurité
Les incitations des entreprises façonnent les défauts des produits, la posture de sécurité et l’ouverture.
L’avenir de l’IA de stabilité
Stability AI se repositionne vers les API d'entreprise, les partenariats médias et divertissement (y compris un accord avec WPP) et les modèles edge-friendly suffisamment petits pour fonctionner sur les téléphones et les ordinateurs portables. Attendez-vous à une tension continue entre ses racines ouvertes et le besoin de revenus, ainsi qu’à des investissements plus importants dans la génération vidéo, audio et 3D. Les questions juridiques concernant les données de formation et les droits d'auteur, y compris le procès Getty Images, détermineront grandement la manière dont les futurs modèles pourront être formés et partagés ouvertement.
Mise en œuvre dans le monde réel
Un studio de jeux indépendant peaufine Stable Diffusion localement pour générer des concepts artistiques de personnages cohérents sans coûts cloud par image.
Un développeur ajoute ControlNet à Stable Diffusion pour convertir des esquisses en maquettes de produits soignées tout en préservant la mise en page exacte.
Un musicien utilise Stable Audio pour générer des boucles d'arrière-plan et des textures ambiantes libres de droits pour l'intro d'un podcast.
Un laboratoire de recherche télécharge les pondérations ouvertes pour étudier et réduire les biais démographiques dans les visages générés, ce qui est impossible avec les API fermées.
Risques et garde-fous
Les annonces de lancement peuvent dépasser la stabilité des flux de production réels.
La tarification des API ou les changements de politique peuvent briser les hypothèses du jour au lendemain.
La dépendance à un seul fournisseur augmente les coûts de verrouillage et de migration.
Feuille de route de mise en œuvre
Évaluez les fournisseurs à l’aide de vos propres tâches et ensembles de données.
Vérifiez les conditions de confidentialité, de sécurité et juridiques avant l’intégration.
Maintenez un plan de secours entre les modèles ou les fournisseurs.
Surveillez les notes de version afin que les modifications de la feuille de route ne surprennent pas les équipes.
Continuez à explorer
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Stability AI quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Guide suivant
Perplexity IA
Questions fréquemment posées
What is Stability AI?
Stability AI est la startup basée à Londres derrière Stable Diffusion, le générateur d'images à poids ouvert qui met l'IA texte-image sur des millions d'ordinateurs portables. En publiant publiquement les poids des modèles, cela a déclenché une vague d'outils créatifs open source qui rivalisaient avec les systèmes fermés de OpenAI et Google.
Quelle est la sortie de Stability AI la plus connue en 2022 ?
Stability AI a soutenu la sortie publique d'août 2022 de Stable Diffusion, dont les pondérations téléchargeables en ont fait une référence dans l'IA générative open source.
Qu'est-ce qui différenciait Stable Diffusion de DALL-E et Midjourney au lancement ?
Contrairement à ses concurrents fermés, les poids de Stable Diffusion ont été publiés ouvertement, permettant à chacun de l'exécuter et de l'affiner sur son propre matériel.
Techniquement, où Stable Diffusion effectue-t-elle son processus de débruitage ?
Il s'agit d'un modèle de diffusion latente : un auto-encodeur compresse les images dans un espace latent plus petit où l'U-Net débruit, réduisant ainsi considérablement le calcul.
Quel ensemble de données était au cœur de la formation de la diffusion stable d'origine ?
Stable Diffusion a été formé en grande partie sur LAION-5B, un ensemble de données massif de paires image-texte extraites du Web.
Au-delà des images, pour quelle modalité Stability AI a-t-elle également construit des modèles ?
Stabilité étendue à l'audio (Stable Audio), au langage (StableLM), à la 3D et à la vidéo (Stable Video Diffusion).