Evrişimsel Sinir Ağları
Evrişimli Sinir Ağları (CNN'ler), görüntüleri anlamak için en güçlü mimaridir.
Genel Bakış
They learn visual patterns by sliding small filters across a picture, which is why they power everything from face unlock to medical scan analysis.
Derin Dalış
Bir CNN, filtreler veya çekirdekler adı verilen küçük ağırlık ızgaralarını pikseller boyunca kaydırarak bir görüntüyü işler. Her filtre bir kenar, bir renk bloğu veya bir köşe gibi bir deseni tarar. İlk katmanlar basit özellikleri algılar; daha derin katmanlar bunları gözler, tekerlekler veya metin halinde birleştirir. Aynı filtre her konumda yeniden kullanıldığından (ağırlık paylaşımı), bir CNN, tamamen bağlı bir ağdan çok daha az parametreye ihtiyaç duyar ve bir kediyi ister sol üstte ister sağ altta görünsün fark edebilir. Havuzlama katmanları, görüntüyü adımlar arasında küçülterek ağın daha hızlı olmasını ve küçük değişikliklere karşı daha toleranslı olmasını sağlar. LeNet, AlexNet (2012) ve ResNet gibi çığır açan tasarımlar, derin öğrenme patlamasını tetikledi ve AlexNet'in ImageNet zaferi alanın modern çağını ateşledi.
Teknik Bilgi
Temel işlem evrişimdir: bir piksel parçası üzerine bir filtre (örneğin 3x3 ağırlık) yerleştirilir, her ağırlık kendi pikseliyle çarpılır ve sonuçlar bir çıktı numarasında toplanır. Filtreyi kaydırmak bir özellik haritası oluşturur. Bunu verimli kılan iki fikir var: ağırlık paylaşımı (bir filtre her yerde yeniden kullanılıyor) ve yerel bağlantı (her nöron yalnızca küçük bir bölgeyi görüyor). Yığınlama evrişimi, ReLU gibi doğrusal olmama ve havuzlama, ağın giderek soyutlaşan görsel özelliklerden oluşan bir hiyerarşi oluşturmasına olanak tanır.
Stratejik Etki
Daha net kararlar
Açık teknik iddiaları pazarlama dilinden ayırmanıza yardımcı olur.
Maliyet ve bütçe
Para veya zaman harcamadan önce daha iyi uygulama soruları sorabilirsiniz.
Ekip ve iş akışı
Ortak anlayışa sahip ekipler daha iyi ürün, politika ve öğrenme kararları verir.
Evrişimsel Sinir Ağlarının Geleceği
CNN'ler, hızlı ve veri açısından verimli oldukları için telefon kameraları ve kendi kendine sürüş algısı gibi gerçek zamanlı ve kaynak sınırlı görüşte baskın olmaya devam ediyor. Vision Transformers artık büyük veri kümelerinde onlara rakip oluyor veya onları yeniyor; bu nedenle alan, evrişimin verimliliğini dikkatin küresel akıl yürütmesiyle birleştiren hibrit tasarımlara yöneliyor. CNN'lerin gömülü ve uç cihazlarda, verinin az olduğu tıbbi görüntülemede ve daha büyük multimodal sistemleri besleyen etkili özellik çıkarıcılar olarak önümüzdeki yıllarda da varlığını sürdürmesini bekliyoruz.
Gerçek Dünya Uygulaması
Röntgen, CT taramaları ve retina fotoğraflarında tümörleri, kırıkları ve diyabetik retinopatiyi tespit etmek
Google Photos gibi uygulamalarda telefonun kilidini açmak ve fotoğraf etiketlemek için yüz tanımayı güçlendirme
Sürücüsüz araç algılama sistemlerinde sokak tabelalarını, şerit işaretlerini ve yayaları okumak
Kamera denetimi yoluyla fabrika montaj hatlarındaki kusurlu ürünleri otomatik olarak işaretleme
Riskler ve Korkuluklar
Farklı ekipler aynı terimi farklı şekilde kullanabilir; bu nedenle kapsamı erken tanımlayın.
Gerçek dünya performansı dengesizken karşılaştırmalar güçlü görünebilir.
Veri kalitesini ve değerlendirme planlarını göz ardı etmek çoğu zaman hassas sonuçlar doğurur.
Uygulama Yol Haritası
İhtiyacınız olan sonucun sade bir dille tanımlanmasıyla başlayın.
Test etmeden önce bir başarı ölçüsü ve bir başarısızlık koşulu seçin.
Gösterişli bir demo seti yerine, temsili verilerle küçük bir pilot çalışma yürütün.
Evrişimli Sinir Ağlarının nerede yardımcı olduğunu ve daha basit yöntemlerin nerede daha iyi olduğunu belgeleyin.
Keşfetmeye Devam Edin
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Convolutional Neural Networks quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Next guide
Grafik Sinir Ağları
Sık sorulan sorular
What is Convolutional Neural Networks?
Evrişimli Sinir Ağları (CNN'ler), görüntüleri anlamak için en güçlü mimaridir. Küçük filtreleri bir resim üzerinde kaydırarak görsel kalıpları öğreniyorlar, bu yüzden yüz kilidini açmadan tıbbi tarama analizine kadar her şeye güç sağlıyorlar.
CNN'deki bir filtrenin (çekirdeğin) ana işi nedir?
Filtre, görüntünün üzerinde kayan, kenar veya doku gibi öğrendiği deseni bulduğunda etkinleşen küçük bir ağırlık ızgarasıdır.
Bir CNN'nin görüntüler için neden tamamen bağlı bir ağdan çok daha az parametreye ihtiyacı var?
Ağırlık paylaşımı, görüntünün her yerine küçük bir filtrenin uygulanması anlamına gelir; böylece ağ, her piksel konumu için ayrı ağırlıkları öğrenmek yerine aynı ağırlıkları yeniden kullanır.
Havuzlama katmanı genellikle ne yapar?
Havuzlama (maksimum havuzlama gibi), özellik haritasının alt örneğini alır, hesaplamayı azaltır ve ağın bir özelliğin tam olarak nerede göründüğüne karşı duyarlılığını azaltır.
Derin bir CNN'de özellikler genellikle ilk katmanlardan sonraki katmanlara nasıl değişir?
İlk katmanlar, kenarlar ve renkler gibi düşük düzeyli özellikleri algılar; daha derin katmanlar bunları yüzler veya nesne parçaları gibi daha üst düzey kavramlarla birleştirir.
Hangi olay, vizyondaki modern derin öğrenme patlamasını başlattığı için yaygın olarak itibar görüyor?
AlexNet'in GPU'larda derin bir CNN kullanarak 2012'de elde ettiği çarpıcı ImageNet zaferi, araştırmacıları derin öğrenmenin eski yöntemlerden daha iyi performans gösterebileceğine ikna ederek alanın hızlı büyümesini tetikledi.