회사 가이드

Stability AI

Stability AI는 수백만 대의 노트북에 텍스트-이미지 AI를 적용한 개방형 이미지 생성기인 Stable Diffusion을 지원하는 런던 기반 스타트업입니다.

2분 읽기마지막 업데이트

개요

By releasing model weights publicly, it sparked a wave of open-source creative tooling that rivaled closed systems from OpenAI and Google.

심층 분석

2019년 Emad Mostaque가 설립한 Stability AI는 2022년 8월 LAION-5B 데이터세트를 기반으로 훈련된 잠재 확산 모델인 Stable Diffusion의 공개 출시를 지원하면서 명성을 얻었습니다. DALL-E 또는 Midjourney와는 달리 가중치를 다운로드할 수 있어 취미로 하는 사람, 연구원 및 회사가 무료로 로컬에서 모델을 실행하고 미세 조정할 수 있었습니다. 이로 인해 포크, 플러그인, Automate1111 및 ControlNet과 같은 도구가 폭발적으로 증가했습니다. 회사는 나중에 언어(StableLM), 오디오(Stable Audio), 3D 및 비디오(Stable Video Diffusion)로 확장하고 2024년에 Stable Diffusion 3을 출시했습니다. 자금 부담과 Mostaque의 2024년 퇴사 이후 새로운 리더십은 공개적인 정신을 유지하면서 지속 가능한 기업 라이센스에 회사를 다시 집중시켰습니다.

기술적 통찰력

Stable Diffusion은 잠재 확산 모델입니다. 픽셀의 노이즈를 직접 제거하는 대신 변형 자동 인코더를 사용하여 이미지를 더 작은 잠재 공간으로 압축한 다음 그곳에서 확산 프로세스를 실행합니다. U-Net은 교차 주의를 통해 CLIP 스타일 텍스트 인코더의 텍스트 임베딩에 따라 단계별로 노이즈를 반전시키는 방법을 학습합니다. 잠재 공간에서 작업하면 컴퓨팅 성능이 저하됩니다. 이것이 바로 모델이 데이터 센터가 아닌 단일 소비자 GPU에서 실행될 수 있는 이유입니다.

전략적 영향

벤더 전략

공급업체 로드맵은 팀이 다음에 구축할 수 있는 기능에 영향을 미칩니다.

비용 및 예산

상업적 조건과 배포 옵션은 장기적인 비용과 위험에 영향을 미칩니다.

위험과 안전

회사 인센티브는 제품 기본값, 안전 태세 및 개방성을 형성합니다.

안정성 AI의 미래

Stability AI는 엔터프라이즈 API, 미디어 및 엔터테인먼트 파트너십(WPP와의 거래 포함), 휴대폰과 노트북에서 실행할 수 있을 만큼 작은 엣지 친화적인 모델로 재배치되고 있습니다. 개방형 기반과 수익 요구 사이의 지속적인 긴장과 비디오, 오디오 및 3D 생성에 대한 더 많은 투자를 기대하십시오. Getty Images 소송을 포함하여 교육 데이터 및 저작권에 대한 법적 질문은 미래 모델을 공개적으로 교육하고 공유할 수 있는 방법에 큰 영향을 미칠 것입니다.

실제 구현

인디 게임 스튜디오에서는 Stable Diffusion을 로컬에서 미세 조정하여 이미지당 클라우드 비용 없이 일관된 캐릭터 컨셉 아트를 생성합니다.

개발자는 Stable Diffusion 위에 ControlNet을 추가하여 정확한 레이아웃을 유지하면서 대략적인 스케치를 세련된 제품 모형으로 변환합니다.

음악가는 Stable Audio를 사용하여 로열티 없는 배경 루프와 팟캐스트 소개용 주변 텍스처를 생성합니다.

연구실에서는 공개 가중치를 다운로드하여 생성된 얼굴의 인구통계적 편향을 연구하고 줄입니다. 이는 폐쇄형 API로는 불가능한 일입니다.

위험 및 가드레일

출시 발표는 실제 생산 워크플로의 안정성보다 앞설 수 있습니다.

API 가격 책정이나 정책 변경으로 인해 하룻밤 사이에 가정이 깨질 수 있습니다.

단일 공급업체 종속성은 종속 및 마이그레이션 비용을 증가시킵니다.

구현 로드맵

1

자체 작업과 데이터 세트를 사용하여 공급자를 평가합니다.

2

통합하기 전에 개인정보 보호, 보안, 법적 약관을 검토하세요.

3

모델이나 공급업체 전반에 걸쳐 대체 계획을 유지합니다.

4

로드맵 변경으로 인해 팀이 놀라지 않도록 릴리스 노트를 모니터링하세요.

계속 탐색하세요

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Stability AI quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

퀴즈 시작

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

자주 묻는 질문

What is Stability AI?

Stability AI는 수백만 대의 노트북에 텍스트-이미지 AI를 적용한 개방형 이미지 생성기인 Stable Diffusion을 지원하는 런던 기반 스타트업입니다. 모델 가중치를 공개적으로 공개함으로써 OpenAI 및 Google의 폐쇄형 시스템에 필적하는 오픈 소스 크리에이티브 도구의 물결이 촉발되었습니다.

2022년 출시로 가장 잘 알려진 Stability AI는 무엇인가요?

Stability AI는 다운로드 가능한 가중치를 통해 오픈 소스 생성 AI의 랜드마크가 된 Stable Diffusion의 2022년 8월 공개 릴리스를 지원했습니다.

출시 당시 Stable Diffusion이 DALL-E 및 Midjourney와 다른 점은 무엇입니까?

비공개 경쟁사와 달리 Stable Diffusion의 가중치는 공개적으로 출시되어 누구나 자신의 하드웨어에서 실행하고 미세 조정할 수 있습니다.

기술적으로 Stable Diffusion은 노이즈 제거 프로세스를 어디에서 수행합니까?

이는 잠재 확산 모델입니다. 자동 인코더는 U-Net이 노이즈를 제거하는 더 작은 잠재 공간으로 이미지를 압축하여 컴퓨팅을 대폭 줄입니다.

원래 Stable Diffusion을 훈련하는 데 핵심이 된 데이터 세트는 무엇입니까?

Stable Diffusion은 웹에서 스크랩한 이미지-텍스트 쌍의 대규모 데이터 세트인 LAION-5B를 통해 주로 훈련되었습니다.

이미지 외에도 Stability AI가 모델을 구축한 양식은 무엇입니까?

안정성은 오디오(Stable Audio), 언어(StableLM), 3D, 비디오(Stable Video Diffusion)로 확장되었습니다.