Metin Ters Çevirme
Metin Tersine Çevirme, bir görüntü oluşturucuya, modelin kendisini değiştirmeden, onun için tek bir yeni kelime öğrenerek, belirli bir kedi, sanat tarzı veya ürün gibi yepyeni bir konsepti öğretir.
Genel Bakış
It lets you put your own subject into AI art using just 3-5 example photos.
Derin Dalış
Araştırmacılar tarafından 2022'de tanıtılan Metin Tersine Çevirme, bir kişiselleştirme sorununu çözüyor: Stable Diffusion gibi bir modele, "köpek" tek başına onu yakalayamayacakken *köpeğinizi* çizmesini nasıl söylersiniz? Devasa sinir ağını yeniden eğitmek yerine, tüm modeli dondurur ve tek bir şeyi öğrenir: yeni bir 'sözde kelime' yerleştirmesi; metin kodlayıcının sözlüğünde genellikle S* olarak yazılan tek bir vektör. Konseptin 3-5 görselini beslersiniz ve optimizasyon, yeni kelimeyi yazdığınızda model konuyu güvenilir bir şekilde yeniden üretene kadar bu vektörü iter. Yalnızca bir vektör (birkaç kilobayt) öğrenildiği için sonuçlar küçük ve paylaşılabilirdir. Daha sonra 'S* kaykay sürmek, yağlıboya resim' gibi yönlendirmeler yazabilirsiniz ve konsept yeni bağlamlarda ortaya çıkar.
Teknik Bilgi
İşin püf noktası, metinden resme modellerin, her kelimeyi oluşturmadan önce bir gömme vektörüne dönüştürmesidir. Metin Ters Çevirme, bu yerleştirme tablosuna yeni bir vektör ekler ve örnek görüntülerinizdeki aynı yayılma gürültüsünü giderici kaybı kullanarak yalnızca onu optimize eder. Tüm model ağırlıkları donmuş halde kalırken degradeler yerleştirmeye geri döner. Sonuç, modelin mevcut sözcük alanında yaşayan kompakt bir vektördür (birkaç KB). Ağırlıklar değişmez, dolayısıyla temel model tüm ön bilgisini korur.
Stratejik Etki
Speed and scale
Visual AI, inceleme, algılama ve etiketleme görevlerini geniş ölçekte otomatikleştirebilir.
Build choices
Yaratıcı ekipler, daha az manuel revizyonla konseptleri daha hızlı prototipleyebilir.
Ekip ve iş akışı
Operasyonlar, daha önce işlenmesi zor olan görüntü ve video sinyallerini kullanabilir.
Metin Ters Çevirmenin Geleceği
Textual Inversion, küçük dosya boyutu ve paylaşılabilirliği nedeniyle popüler olmaya devam ediyor ve açık kaynak topluluğu bu yerleştirmelerin binlercesini satıyor. Gelecekteki yönelimler bunu diğer yöntemlerle harmanlıyor; daha zengin sahneler için birden fazla öğrenilen kelimeyi bir araya getiriyor, daha keskin bir aslına uygunluk için LoRA veya DreamBooth ile birleştiriyor ve fikri video ve 3D oluşturuculara genişletiyor. Kullanıcıların öğrenilen belirteçleri karıştırıp eşleştirdiği 'kavram kitaplıklarının' yanı sıra kişiselleştirmenin dakikalar yerine saniyeler içinde gerçekleşmesi için daha hızlı, neredeyse anında tersine çevirmeyi bekleyin.
Gerçek Dünya Uygulaması
Bir sanatçı, kendine özgü illüstrasyon stili için bir simge öğrenir ve ardından bunu tutarlı bir portföy için düzinelerce yeni sahneye yönlendirir.
Bir evcil hayvan sahibi, köpeğini astronot, Rönesans tablosu veya çizgi film olarak oluşturmak için beş fotoğrafını yükler.
Küçük bir e-ticaret markası, ürünü için bir kelime öğrenerek onu fotoğraf çekimi olmadan birçok pazarlama geçmişine aktarabiliyor.
Bir oyun stüdyosu, konsept tasarımının ekip genelinde tutarlı kalmasını sağlamak için yinelenen bir karakterin görünümünü yeniden kullanılabilir bir simge olarak yakalar.
Riskler ve Korkuluklar
Kaynağın belirsiz olması durumunda görüntü hakları ve rıza yasal risk haline gelebilir.
Model performansı aydınlatma, demografik özellikler ve ortamlara göre değişiklik gösterebilir.
Güven eşikleri izlenmediği sürece yanlış pozitifler fark edilmeyebilir.
Uygulama Yol Haritası
Kesinlik, geri çağırma ve hata maliyetlerine ilişkin kabul kriterlerini tanımlayın.
Gerçek üretim koşullarıyla eşleşen verilerle test edin.
Düşük güvenirliğe sahip veya yüksek etkili tahminler için gerçek kişi tarafından yapılan incelemeyi ekleyin.
Model kaymasını izleyin ve kamera veya veri kümesi değişikliklerinden sonra yeniden doğrulayın.
Keşfetmeye Devam Edin
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Textual Inversion quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Next guide
Boş Metin Ters Çevirme
Sık sorulan sorular
What is Textual Inversion?
Metin Tersine Çevirme, bir görüntü oluşturucuya, modelin kendisini değiştirmeden, onun için tek bir yeni kelime öğrenerek, belirli bir kedi, sanat tarzı veya ürün gibi yepyeni bir konsepti öğretir. Yalnızca 3-5 örnek fotoğraf kullanarak kendi nesnenizi yapay zeka sanatına yerleştirmenize olanak tanır.
Metin Tersine Çevirme eğitim sırasında tam olarak ne öğreniyor?
Tüm modelin dondurulmasını sağlarken yalnızca yeni bir sözde sözcük yerleştirme vektörünü optimize eder.
Metin Ters Çevirme'nin genellikle yaklaşık olarak kaç örnek görsele ihtiyacı vardır?
Kullanılabilir bir jetonu öğrenmek için küçük bir avuç, genellikle konseptin 3-5 resmi yeterlidir.
Metin Ters Çevirme dosyaları neden bu kadar küçük (genellikle birkaç kilobayt)?
Yalnızca tek bir yerleştirme vektörü kaydedilir, böylece dosya küçüktür ve paylaşılması kolaydır.
Metin Tersine Çevirme eğitimi sırasında neler değişmeden kalır?
Temel model dondurulmuştur; yalnızca yeni yerleştirme güncellenir, böylece önceki bilgiler korunur.
Öğrenilen bir kavramı Metin Tersine Çevirmeden sonra nasıl kullanırsınız?
Konsepti çağırmak için yeni jetonu (S* gibi) normal bir metin istemine eklemeniz yeterlidir.