Mekansal Trafo Ağları
Uzamsal Transformatör Ağları (STN'ler), bir sinir ağının önemli olana odaklanmak için girdisini aktif olarak çarpıtmasına, döndürmesine, kırpmasına veya yeniden ölçeklendirmesine olanak tanıyan öğrenilebilir modüllerdir.
Genel Bakış
They give CNNs a built-in sense of spatial attention and invariance.
Derin Dalış
Standart evrişimli ağlar, konum, ölçek ve dönüşteki değişikliklere karşı yalnızca zayıf bir şekilde değişmez ve küçük bir tolerans için havuzlamaya dayanır. Jaderberg ve diğerleri tarafından tanıtılan Mekansal Transformatör Ağları. 2015'te özellik haritalarına açık bir geometrik dönüşüm gerçekleştiren türevlenebilir bir modül ekleyerek bu sorunu düzeltin. Modülün üç bölümü vardır: dönüşüm parametrelerini tahmin eden bir yerelleştirme ağı, bu parametrelerden bir örnekleme ızgarası oluşturan bir ızgara oluşturucu ve ızgara noktalarındaki girişi enterpolasyona tabi tutan bir örnekleyici. Her adım farklılaşabildiği için tüm transformatör, hiçbir ekstra denetim olmaksızın geri yayılım yoluyla uçtan uca eğitilir. Ağ, örneğin eğik rakamları düzeltmeyi veya ilgili bölgeyi yakınlaştırmayı öğrenerek doğruluğu ve sağlamlığı artırır.
Teknik Bilgi
Yerelleştirme ağı, çeviri, ölçek, döndürme ve kesme için parametrelerin (genellikle 2x3 afin matris) çıktısını alır. Izgara oluşturucu, her çıktı pikselini bu matris aracılığıyla bir kaynak koordinatına eşleştirir. Örnekleyici daha sonra girdiyi, gradyanların yerelleştirme ağına akması için farklılaştırılabilen çift doğrusal enterpolasyon kullanarak okur. Bu, modülün yalnızca görev kaybından dönüşümleri öğrenmesine, ilgili bölgelere katılmasına ve kanonikleştirilmesine olanak tanır.
Stratejik Etki
Speed and scale
Visual AI, inceleme, algılama ve etiketleme görevlerini geniş ölçekte otomatikleştirebilir.
Build choices
Yaratıcı ekipler, daha az manuel revizyonla konseptleri daha hızlı prototipleyebilir.
Ekip ve iş akışı
Operasyonlar, daha önce işlenmesi zor olan görüntü ve video sinyallerini kullanabilir.
Mekansal Trafo Ağlarının Geleceği
STN'ler, deforme olabilen evrişimleri ve öğrenilmiş çarpıtma modüllerini besleyerek ağların geometriyi ve dikkati nasıl ele aldığını etkiledi. Öz-dikkat transformatörleri artık hakim olsa da, STN tarzı farklılaştırılabilir örnekleme, açık geometrik hizalama gerektiren görevlerde varlığını sürdürüyor: metin tanıma, ince taneli sınıflandırma ve poz normalleştirme. 3D görmede, sinirsel işlemede ve tıbbi görüntü kaydında farklılaştırılabilir çarpıklığın görünmeye devam etmesini ve çoğunlukla dikkatle değiştirilmek yerine dikkatle birleştirilmesini bekleyebilirsiniz.
Gerçek Dünya Uygulaması
Sahne metni OCR sistemlerinde kavisli veya döndürülmüş metni tanınmadan önce düzleştirme ve hizalama
İnce taneli görüntü sınıflandırması için ayırt edici bölgelere (bir kuşun gagası veya kanadı gibi) yakınlaştırma
Yüz tanıma işlem hatlarında bir ön işleme adımı olarak yüz pozunu ve hizalamasını normalleştirme
Tıbbi görüntü kaydında bozulmaların düzeltilmesi ve taramaların hizalanması
Riskler ve Korkuluklar
Kaynağın belirsiz olması durumunda görüntü hakları ve rıza yasal risk haline gelebilir.
Model performansı aydınlatma, demografik özellikler ve ortamlara göre değişiklik gösterebilir.
Güven eşikleri izlenmediği sürece yanlış pozitifler fark edilmeyebilir.
Uygulama Yol Haritası
Kesinlik, geri çağırma ve hata maliyetlerine ilişkin kabul kriterlerini tanımlayın.
Gerçek üretim koşullarıyla eşleşen verilerle test edin.
Düşük güvenirliğe sahip veya yüksek etkili tahminler için gerçek kişi tarafından yapılan incelemeyi ekleyin.
Model kaymasını izleyin ve kamera veya veri kümesi değişikliklerinden sonra yeniden doğrulayın.
Keşfetmeye Devam Edin
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Spatial Transformer Networks quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Next guide
DETR Trafo Tespiti
Sık sorulan sorular
What is Spatial Transformer Networks?
Uzamsal Transformatör Ağları (STN'ler), bir sinir ağının önemli olana odaklanmak için girdisini aktif olarak çarpıtmasına, döndürmesine, kırpmasına veya yeniden ölçeklendirmesine olanak tanıyan öğrenilebilir modüllerdir. CNN'lere yerleşik bir mekansal dikkat ve değişmezlik duygusu veriyorlar.
Uzamsal Trafo Ağı, sinir ağına hangi yeteneği katar?
STN'ler, ilgili içeriğe odaklanmak için özellik haritalarını çevirebilen, döndürebilen, ölçekleyebilen veya çözebilen öğrenilebilir bir modül ekler.
Hangi üç bileşen uzaysal transformatör modülünü oluşturur?
Bir STN, bir yerelleştirme ağından (parametreleri tahmin eder), bir ızgara oluşturucudan (örnekleme koordinatlarını oluşturur) ve bir örnekleyiciden (girdiyi enterpolasyona tabi tutar) oluşur.
Bir Uzaysal Trafo Ağı neden sıradan geri yayılımla eğitilebilir?
Örnekleyicideki çift doğrusal enterpolasyon farklılaştırılabilir, böylece gradyanlar ızgara oluşturucudan yerelleştirme ağına geri akar ve uçtan uca eğitime olanak tanır.
Yerelleştirme ağı, bir afin dönüşüm için tipik olarak ne çıktı verir?
Afin dönüşümler için yerelleştirme ağı, ötelemeyi, ölçeği, döndürmeyi ve kesmeyi kodlayan 2x3 matris olarak düzenlenmiş altı değeri tahmin eder.
Standart CNN'ler neden mekansal değişikliklere karşı yalnızca zayıf bir şekilde değişmez, bu da STN'leri motive eder?
CNN'ler, havuzlama yoluyla yalnızca mütevazı bir mekansal değişmezliğe ulaşır; STN'ler konum, ölçek ve döndürme işlemlerinin açık ve öğrenilebilir bir yolunu sunar.