Dil AI KILAVUZU

Felaket Unutuş

Yıkıcı unutma, bir sinir ağının yeni bir görevi öğrenmesi ve halihazırda ustalaştığı görevleri yerine getirme yeteneğini aniden kaybetmesidir.

2 min readSon güncelleme

Genel Bakış

It is a central obstacle to building AI that learns continually without retraining from scratch.

Derin Dalış

Sinir ağları bilgiyi paylaşılan ağırlıklarda saklar. Bir modeli yeni bir görev üzerinde eğittiğinizde, degrade güncellemeleri daha önceki becerileri kodlayan parametrelerin üzerine yazar, böylece eski performans çökebilir. Bu, ilk kez 1989'da McCloskey ve Cohen tarafından belgelenen, aynı zamanda felaket müdahalesi olarak da adlandırılan felaket niteliğindeki unutmadır. Verilerin birbirine karışması yerine aşamalar halinde geldiği sıralı veya sürekli öğrenmede bu durum akuttur. Örneğin, bir chatbot'a ağırlıklı olarak yasal metinler üzerinde ince ayar yapmak, genel konuşma yeteneğini olumsuz etkileyebilir. Standart kaba kuvvet düzeltmesi, tüm görevleri ortaklaşa yeniden eğitmektir, ancak bu pahalıdır ve hala eski verilere sahip olduğunuzu varsayar. Araştırmacılar bunun yerine önemli ağırlıkları koruyan, geçmiş örnekleri tekrarlayan veya göreve özgü parametreler ekleyen teknikler kullanıyor; bunların tümü, modellerin insanlar gibi bilgi biriktirmesine olanak sağlamayı amaçlıyor.

Teknik Bilgi

Unutma, aynı ağırlıkların görevler arasında yeniden kullanılması ve yeni verilerdeki sınırlandırılmamış gradyan inişinin bunları serbestçe hareket ettirmesi nedeniyle gerçekleşir. Azaltma önlemleri arasında, eski görevler için önemli olduğu düşünülen parametrelerde (Fisher bilgileri aracılığıyla tahmin edilen) değişiklikleri yavaşlatan bir ceza ekleyen Elastik Ağırlık Konsolidasyonu yer alır. Diğer yaklaşımlar, prova veya deneyim tekrarı (depolanan veya oluşturulan eski örneklerin araya eklenmesi) ve temel modeli donduran ve küçük yeni modüller ekleyen bağdaştırıcılar veya LoRA gibi parametre izolasyon yöntemleridir.

Stratejik Etki

Speed and scale

Dil iş akışları tutarlılıktan ödün vermeden daha hızlı ilerleyebilir.

Access and reach

Diller ve iletişim tarzları arasında erişimi genişletir.

Daha net kararlar

Otomasyon tekrarlamayı yönetirken ekipler karar vermeye daha fazla zaman ayırabilir.

Yıkıcı Unutuşun Geleceği

Modeller tek seferlik eğitimden yaşam boyu, sürekli güncellenen sistemlere doğru ilerledikçe, unutmayı kontrol etmek hayati önem taşıyor. LoRA bağdaştırıcıları gibi parametre açısından verimli yöntemler, ekiplerin temel modeli bozmadan beceriler eklemesine olanak tanır ve erişimle artırılmış sistemler, yeni bilgileri ağırlıklar yerine harici bir depoda tutarak sorunu ortadan kaldırır. Sürekli öğrenme kriterlerinin, modüler mimarilerin ve beyinden ilham alan birleştirme tekniklerinin olgunlaşmasını, bizi yeni bilgilerle güncellenen ve aynı zamanda zaten bildiklerini güvenilir bir şekilde koruyan modellere doğru yönlendirmesini bekliyoruz.

Gerçek Dünya Uygulaması

Tıbbi metinlere yoğun bir şekilde ince ayar yapan genel bir sohbet robotu gündelik konuşmalarda akıcılığını kaybediyor.

Elastik Ağırlık Konsolidasyonu, oyun oynayan bir temsilcinin eski Atari oyunlarını unutmadan yeni Atari oyunlarını öğrenmesine olanak tanır.

Ekipler, donmuş temel modelin yeteneklerini olduğu gibi bırakırken yeni bir etki alanı becerisi eklemek için LoRA bağdaştırıcılarını kullanır.

Deneyim tekrarı geçmiş örnekleri saklar ve eski performansı korumak için bunları yeni eğitim sırasında araya koyar.

Riskler ve Korkuluklar

Halüsinasyonlu gerçekler sessizce raporlara, destek akışlarına veya araştırma çıktılarına girebilir.

İstem hassasiyeti, benzer istekler arasında tutarsız sonuçlar yaratabilir.

Erişim kontrolleri zayıfsa hassas metin verileri açığa çıkabilir.

Uygulama Yol Haritası

1

Kullanıma sunmadan önce çıktı formatını, tonunu ve kalite standartlarını tanımlayın.

2

Doğruluğun önemli olduğu durumlarda güvenilir kaynaklarla zemin müdahaleleri.

3

Yüksek riskli çıktılar için insan incelemesi kontrol noktası bulundurun.

4

Arıza modellerini takip edin ve istemleri veya iş akışlarını düzenli olarak yeniden eğitin.

Keşfetmeye Devam Edin

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Catastrophic Forgetting quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Testi başlat

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Sürekli Öğrenme ve Felaketli Unutma

Sık sorulan sorular

What is Catastrophic Forgetting?

Yıkıcı unutma, bir sinir ağının yeni bir görevi öğrenmesi ve halihazırda ustalaştığı görevleri yerine getirme yeteneğini aniden kaybetmesidir. Sıfırdan yeniden eğitilmeden sürekli öğrenen yapay zeka oluşturmanın önündeki temel engeldir.

Felaketsel unutma nedir?

Felaket boyutunda unutma, bir ağ yeni bir görev üzerinde eğitildiğinde, paylaşılan ağırlıkların üzerine yazılması nedeniyle eski yeteneklerin aniden kaybolmasıdır.

Sinir ağlarında neden yıkıcı unutma oluyor?

Bilgi paylaşılan parametrelerde yaşar, dolayısıyla yeni veriler üzerinde eğitim aynı ağırlıkları değiştirir ve daha önceki öğrenmeleri siler.

Elastik Ağırlık Konsolidasyonu (EWC) unutmayı azaltmak için ne yapar?

EWC, Fisher bilgileri aracılığıyla tahmin edilen, eski görevler için önemli olduğu düşünülen parametrelere yapılan güncellemeleri yavaşlatan bir düzenleme cezası ekler.

Deneyim tekrarı (prova) unutmayla nasıl mücadele eder?

Prova, yeni görevleri öğrenirken eski örneklerin (depolanan veya oluşturulan) karıştırılmasıyla eski performansın güçlendirilmesini sağlar.

LoRA adaptörleri yıkıcı unutmayı önlemek için neden faydalıdır?

LoRA, temel modeli donmuş halde tutar ve küçük eklenti parametrelerini öğrenir, böylece yeni beceriler mevcut yetenekleri etkilemez.