Temel Bilgiler KILAVUZU

Evrişimsel Sinir Ağları

Evrişimli Sinir Ağları (CNN'ler), görüntüleri anlamak için en güçlü mimaridir.

2 min readSon güncelleme

Genel Bakış

They learn visual patterns by sliding small filters across a picture, which is why they power everything from face unlock to medical scan analysis.

Derin Dalış

Bir CNN, filtreler veya çekirdekler adı verilen küçük ağırlık ızgaralarını pikseller boyunca kaydırarak bir görüntüyü işler. Her filtre bir kenar, bir renk bloğu veya bir köşe gibi bir deseni tarar. İlk katmanlar basit özellikleri algılar; daha derin katmanlar bunları gözler, tekerlekler veya metin halinde birleştirir. Aynı filtre her konumda yeniden kullanıldığından (ağırlık paylaşımı), bir CNN, tamamen bağlı bir ağdan çok daha az parametreye ihtiyaç duyar ve bir kediyi ister sol üstte ister sağ altta görünsün fark edebilir. Havuzlama katmanları, görüntüyü adımlar arasında küçülterek ağın daha hızlı olmasını ve küçük değişikliklere karşı daha toleranslı olmasını sağlar. LeNet, AlexNet (2012) ve ResNet gibi çığır açan tasarımlar, derin öğrenme patlamasını tetikledi ve AlexNet'in ImageNet zaferi alanın modern çağını ateşledi.

Teknik Bilgi

Temel işlem evrişimdir: bir piksel parçası üzerine bir filtre (örneğin 3x3 ağırlık) yerleştirilir, her ağırlık kendi pikseliyle çarpılır ve sonuçlar bir çıktı numarasında toplanır. Filtreyi kaydırmak bir özellik haritası oluşturur. Bunu verimli kılan iki fikir var: ağırlık paylaşımı (bir filtre her yerde yeniden kullanılıyor) ve yerel bağlantı (her nöron yalnızca küçük bir bölgeyi görüyor). Yığınlama evrişimi, ReLU gibi doğrusal olmama ve havuzlama, ağın giderek soyutlaşan görsel özelliklerden oluşan bir hiyerarşi oluşturmasına olanak tanır.

Stratejik Etki

Daha net kararlar

Açık teknik iddiaları pazarlama dilinden ayırmanıza yardımcı olur.

Maliyet ve bütçe

Para veya zaman harcamadan önce daha iyi uygulama soruları sorabilirsiniz.

Ekip ve iş akışı

Ortak anlayışa sahip ekipler daha iyi ürün, politika ve öğrenme kararları verir.

Evrişimsel Sinir Ağlarının Geleceği

CNN'ler, hızlı ve veri açısından verimli oldukları için telefon kameraları ve kendi kendine sürüş algısı gibi gerçek zamanlı ve kaynak sınırlı görüşte baskın olmaya devam ediyor. Vision Transformers artık büyük veri kümelerinde onlara rakip oluyor veya onları yeniyor; bu nedenle alan, evrişimin verimliliğini dikkatin küresel akıl yürütmesiyle birleştiren hibrit tasarımlara yöneliyor. CNN'lerin gömülü ve uç cihazlarda, verinin az olduğu tıbbi görüntülemede ve daha büyük multimodal sistemleri besleyen etkili özellik çıkarıcılar olarak önümüzdeki yıllarda da varlığını sürdürmesini bekliyoruz.

Gerçek Dünya Uygulaması

Röntgen, CT taramaları ve retina fotoğraflarında tümörleri, kırıkları ve diyabetik retinopatiyi tespit etmek

Google Photos gibi uygulamalarda telefonun kilidini açmak ve fotoğraf etiketlemek için yüz tanımayı güçlendirme

Sürücüsüz araç algılama sistemlerinde sokak tabelalarını, şerit işaretlerini ve yayaları okumak

Kamera denetimi yoluyla fabrika montaj hatlarındaki kusurlu ürünleri otomatik olarak işaretleme

Riskler ve Korkuluklar

Farklı ekipler aynı terimi farklı şekilde kullanabilir; bu nedenle kapsamı erken tanımlayın.

Gerçek dünya performansı dengesizken karşılaştırmalar güçlü görünebilir.

Veri kalitesini ve değerlendirme planlarını göz ardı etmek çoğu zaman hassas sonuçlar doğurur.

Uygulama Yol Haritası

1

İhtiyacınız olan sonucun sade bir dille tanımlanmasıyla başlayın.

2

Test etmeden önce bir başarı ölçüsü ve bir başarısızlık koşulu seçin.

3

Gösterişli bir demo seti yerine, temsili verilerle küçük bir pilot çalışma yürütün.

4

Evrişimli Sinir Ağlarının nerede yardımcı olduğunu ve daha basit yöntemlerin nerede daha iyi olduğunu belgeleyin.

Keşfetmeye Devam Edin

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Convolutional Neural Networks quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Testi başlat

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Grafik Sinir Ağları

Sık sorulan sorular

What is Convolutional Neural Networks?

Evrişimli Sinir Ağları (CNN'ler), görüntüleri anlamak için en güçlü mimaridir. Küçük filtreleri bir resim üzerinde kaydırarak görsel kalıpları öğreniyorlar, bu yüzden yüz kilidini açmadan tıbbi tarama analizine kadar her şeye güç sağlıyorlar.

CNN'deki bir filtrenin (çekirdeğin) ana işi nedir?

Filtre, görüntünün üzerinde kayan, kenar veya doku gibi öğrendiği deseni bulduğunda etkinleşen küçük bir ağırlık ızgarasıdır.

Bir CNN'nin görüntüler için neden tamamen bağlı bir ağdan çok daha az parametreye ihtiyacı var?

Ağırlık paylaşımı, görüntünün her yerine küçük bir filtrenin uygulanması anlamına gelir; böylece ağ, her piksel konumu için ayrı ağırlıkları öğrenmek yerine aynı ağırlıkları yeniden kullanır.

Havuzlama katmanı genellikle ne yapar?

Havuzlama (maksimum havuzlama gibi), özellik haritasının alt örneğini alır, hesaplamayı azaltır ve ağın bir özelliğin tam olarak nerede göründüğüne karşı duyarlılığını azaltır.

Derin bir CNN'de özellikler genellikle ilk katmanlardan sonraki katmanlara nasıl değişir?

İlk katmanlar, kenarlar ve renkler gibi düşük düzeyli özellikleri algılar; daha derin katmanlar bunları yüzler veya nesne parçaları gibi daha üst düzey kavramlarla birleştirir.

Hangi olay, vizyondaki modern derin öğrenme patlamasını başlattığı için yaygın olarak itibar görüyor?

AlexNet'in GPU'larda derin bir CNN kullanarak 2012'de elde ettiği çarpıcı ImageNet zaferi, araştırmacıları derin öğrenmenin eski yöntemlerden daha iyi performans gösterebileceğine ikna ederek alanın hızlı büyümesini tetikledi.