Dil AI KILAVUZU

YaRN Bağlam Penceresini Ölçeklendirme

YaRN (Yine başka bir RoPE uzantısı), bir transformatörün kullanılabilir bağlam penceresini minimum ince ayar ile üzerinde eğitim verildiğinin çok ötesine genişleten bir tekniktir.

2 min readSon güncelleme

Genel Bakış

It matters because it lets existing models handle much longer documents without retraining from scratch.

Derin Dalış

Modern LLM'lerin çoğu, yalnızca modelin eğitim sırasında gördüğü uzunluğa kadar iyi çalışan Döner Konum Gömmeleri (RoPE) kullanarak sözcük konumlarını kodlar. Daha uzun bir sırayla beslerseniz model kötü bir şekilde bozulur. YaRN bunu, RoPE'nin dönüş frekanslarını frekansa duyarlı bir şekilde yeniden ölçeklendirerek çözer: yüksek frekanslı boyutlara (yerel, yakın ilişkileri yakalayan) çoğunlukla dokunulmazken, düşük frekanslı boyutlara (uzun menzilli konumu yakalayan) enterpolasyon yapılır. Ayrıca logitlerin uzun mesafelerde iyi durumda kalmasını sağlamak için dikkat edilmesi gereken bir sıcaklık ayarı da ekler. LLaMA modellerinde gösterilen sonuç, orijinal eğitim verilerinin yalnızca %0,1'ini ve birkaç yüz ince ayar adımını kullanarak bağlamı 4K'dan 64K-128K tokenlere kadar genişletiyor.

Teknik Bilgi

RoPE, sorgu ve anahtar vektörlerini konum ve boyut başına frekansla orantılı bir açıyla döndürür. Saf doğrusal enterpolasyon (Konum Enterpolasyonu), tüm frekansları eşit şekilde bastırarak yerel ayrıntılara zarar verir. YaRN bunun yerine 'NTK'yi parçalara göre' uygular: yalnızca düşük frekanslı (uzun dalga boyu) boyutları enterpolasyona tabi tutar, yüksek frekanslı olanları yalnız bırakır ve bunların arasında rampalar yapar. Dikkat sıcaklığının ölçeklendirilmesi, entropi değişimini telafi ederek daha uzun uzunluklarda doğruluğu korur.

Stratejik Etki

Speed and scale

Dil iş akışları tutarlılıktan ödün vermeden daha hızlı ilerleyebilir.

Access and reach

Diller ve iletişim tarzları arasında erişimi genişletir.

Daha net kararlar

Otomasyon tekrarlamayı yönetirken ekipler karar vermeye daha fazla zaman ayırabilir.

YaRN Bağlam Penceresi Ölçeklendirmenin Geleceği

YaRN tarzı frekansa duyarlı uzantı, uzun bağlamlı modellerin gönderilmesi için varsayılan bir bileşen haline geldi; Laboratuvarlar milyon jetonlu pencerelere doğru ilerlerken, varyantlar ve ardılları ortaya çıkmaya devam ediyor. Verimli dikkat, KV önbellek sıkıştırması ve istek başına anında ayarlanan dinamik ölçeklendirme ile daha sıkı entegrasyon bekleyebilirsiniz. Daha geniş bir eğilim, 'bir modelin ne kadar süreyle eğitildiğini' 'ne kadar süreyle yararlı bir şekilde okuyabileceği'nden ayırmak ve uzun bağlamı pahalı bir mimari taahhütten ziyade ucuz bir eğitim sonrası özellik haline getirmektir.

Gerçek Dünya Uygulaması

Açık bir LLaMA modelini 4K'dan 128K token'a genişletme, böylece tek geçişte tüm kod tabanını veya uzun sözleşmeyi alabilmesi

Bir chatbotun daha önceki dönüşleri kesmeden çok uzun konuşma geçmişlerini korumasına izin vermek

Temel modelin yerel penceresini aşan kitap uzunluğundaki belgeleri veya birkaç saatlik transkriptleri özetleme

Yalnızca küçük bir ince ayar çalıştırması kullanarak uzun bağlam alma görevleri için önceden eğitilmiş bir modeli ucuz bir şekilde uyarlama

Riskler ve Korkuluklar

Halüsinasyonlu gerçekler sessizce raporlara, destek akışlarına veya araştırma çıktılarına girebilir.

İstem hassasiyeti, benzer istekler arasında tutarsız sonuçlar yaratabilir.

Erişim kontrolleri zayıfsa hassas metin verileri açığa çıkabilir.

Uygulama Yol Haritası

1

Kullanıma sunmadan önce çıktı formatını, tonunu ve kalite standartlarını tanımlayın.

2

Doğruluğun önemli olduğu durumlarda güvenilir kaynaklarla zemin müdahaleleri.

3

Yüksek riskli çıktılar için insan incelemesi kontrol noktası bulundurun.

4

Arıza modellerini takip edin ve istemleri veya iş akışlarını düzenli olarak yeniden eğitin.

Keşfetmeye Devam Edin

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the YaRN Context Window Scaling quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Testi başlat

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Bağlam Pencereleri

Sık sorulan sorular

What is YaRN Context Window Scaling?

YaRN (Yine başka bir RoPE uzantısı), bir transformatörün kullanılabilir bağlam penceresini minimum ince ayar ile üzerinde eğitim verildiğinin çok ötesine genişleten bir tekniktir. Bu önemlidir çünkü mevcut modellerin, sıfırdan yeniden eğitilmeden çok daha uzun belgeleri işlemesine olanak tanır.

YaRN bağlam uzunluğunu genişletmek için hangi konum kodlama şemasını değiştirir?

YaRN, 'Yine başka bir RoPE uzantısı' anlamına gelir ve Döner Pozisyon Gömmelerinde kullanılan dönüş frekanslarını yeniden ölçeklendirerek çalışır.

YaRN, yüksek frekanslı ve düşük frekanslı RoPE boyutlarını nasıl ele alıyor?

YaRN'nin 'Parçalara göre NTK' yaklaşımı, yerel ayrıntılara zarar vermemek için yüksek frekanslı (yerel) boyutları korurken düşük frekanslı (uzun menzilli) boyutları enterpolasyona tabi tutar.

Uzun bağlamlı bir modeli sıfırdan eğitmeye kıyasla YaRN'nin önemli verimlilik avantajı nedir?

YaRN, orijinal eğitim verilerinin kabaca %0,1'ini ve az sayıda ince ayar adımını kullanarak bağlamı genişletebilir; bu, yeniden eğitimden çok daha ucuzdur.

Frekansları yeniden ölçeklendirmenin yanı sıra, uzun mesafeli dikkati sabit tutmak için YaRN hangi ekstra ayarlamayı uygular?

YaRN, diziler çok daha uzun hale geldiğinde meydana gelen entropi/logit kaymasını telafi etmek için dikkat sıcaklığını değiştirir.

Bir RoPE modeli dizisini herhangi bir ölçeklendirme olmadan üzerinde eğitim verildiğinden çok daha uzun süre beslerseniz ne gibi sorun oluşur?

RoPE, görülmeyen uzun pozisyonlara zayıf bir şekilde genelleştirir, bu nedenle frekanslar yeniden ölçeklendirilmediği sürece kalite çöker.