Dil AI KILAVUZU

Karşılaştırmalı Kod Çözme

Karşılaştırmalı kod çözme, küçük, zayıf bir dil modelinin eğilimlerini büyük, güçlü bir dil modelinin eğilimlerinden çıkararak daha yüksek kaliteli metin üretir.

2 min readSon güncelleme

Genel Bakış

It amplifies what the expert knows and the amateur misses, reducing repetition and bland output.

Derin Dalış

Bir dil modeli bir sonraki kelimeyi seçtiğinde, kelime dağarcığı üzerinden bir olasılık üretir. Karşılaştırmalı kod çözme (Li ve diğerleri tarafından 2022'de tanıtıldı) aynı bağlamda iki modeli çalıştırıyor: büyük bir 'uzman' ve küçük bir 'amatör'. Uzmanın ham olasılıklarına güvenmek yerine, her aday jetonunu uzmanın log-olasılığı ile amatörün log-olasılığı arasındaki farka göre puanlar. Uzmanın tercih ettiği jetonlar, ancak amatör desteklenmez; Her iki modelin de sevdiği genel kelimeler ('the' veya tekrarlanan ifadeler gibi) amatörler de onları sevdiği için bastırılır. Bir inandırıcılık filtresi, öncelikle uzmanın çok olası görmediği belirteçleri atar, böylece karşıtlık hiçbir zaman saçmalığı teşvik etmez. Sonuç olarak, açgözlü veya çekirdek örneklemeye göre daha akıcı, tutarlı ve daha az tekrarlı uzun biçimli metin elde edilir; ayrıca hiçbir ekstra eğitim gerekmez.

Teknik Bilgi

Temel puan, log p_expert(token) eksi bir katsayı çarpı log p_amateur(token)'dir. Amatör, uzmanın sistematik hatalarını paylaştığı için (yüksek frekanslı belirteçleri tercih etme, döngü yapma, dejenere tekrarlama), log olasılıklarını çıkarmak, gerçek uzman bilgisini korurken bu paylaşılan hata modlarını iptal eder. Uyarlanabilir bir olasılık kısıtlaması, yalnızca en üst düzey uzman olasılığının bir kısmının (alfa) üzerinde belirteçleri tutar ve kontrastın nadir, tutarsız sözcükleri güçlendirmesini önler.

Stratejik Etki

Speed and scale

Dil iş akışları tutarlılıktan ödün vermeden daha hızlı ilerleyebilir.

Access and reach

Diller ve iletişim tarzları arasında erişimi genişletir.

Daha net kararlar

Otomasyon tekrarlamayı yönetirken ekipler karar vermeye daha fazla zaman ayırabilir.

Karşılaştırmalı Kod Çözmenin Geleceği

Karşılaştırmalı kod çözme, DoLa (halüsinasyonu kesmek için bir modelin kendi erken ve geç katmanlarının karşılaştırılması) ve alınan belgelerle ve bunlar olmadan kontrast oluşturan bağlama duyarlı değişkenler de dahil olmak üzere bir 'çıkarımda kontrast' yöntemleri ailesine ilham kaynağı olmuştur. Geri getirme, olgusallık puanlaması ve küçük amatör damıtma ile daha sıkı entegrasyonun yanı sıra spekülatif kod çözme ile kombinasyon bekleyebilirsiniz, böylece amatör hem kaliteyi yönlendirir hem de üretimi aynı anda hızlandırır.

Gerçek Dünya Uygulaması

Çekirdek örneklemenin döngülere sürüklendiği uzun, tekrarlanmayan hikaye veya makale devamları oluşturmak

İnce ayar yapmadan açık uçlu nesli geliştirmek için 65B uzmanını 1,5B amatörle eşleştirmek

Özetleme ve diyalog çıktılarında dejenere tekrarların azaltılması

Gerçek halüsinasyonları azaltmak için DoLa tarzı öz kontrastın temelini oluşturur

Riskler ve Korkuluklar

Halüsinasyonlu gerçekler sessizce raporlara, destek akışlarına veya araştırma çıktılarına girebilir.

İstem hassasiyeti, benzer istekler arasında tutarsız sonuçlar yaratabilir.

Erişim kontrolleri zayıfsa hassas metin verileri açığa çıkabilir.

Uygulama Yol Haritası

1

Kullanıma sunmadan önce çıktı formatını, tonunu ve kalite standartlarını tanımlayın.

2

Doğruluğun önemli olduğu durumlarda güvenilir kaynaklarla zemin müdahaleleri.

3

Yüksek riskli çıktılar için insan incelemesi kontrol noktası bulundurun.

4

Arıza modellerini takip edin ve istemleri veya iş akışlarını düzenli olarak yeniden eğitin.

Keşfetmeye Devam Edin

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Contrastive Decoding quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Testi başlat

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Minimum Bayes Risk Kod Çözme

Sık sorulan sorular

What is Contrastive Decoding?

Karşılaştırmalı kod çözme, küçük, zayıf bir dil modelinin eğilimlerini büyük, güçlü bir dil modelinin eğilimlerinden çıkararak daha yüksek kaliteli metin üretir. Uzmanın bildiğini ve amatörün kaçırdığını güçlendirir, tekrarı ve sıkıcı çıktıyı azaltır.

Karşılaştırmalı kod çözmede küçük 'amatör' modelin rolü nedir?

Amatörün log olasılıkları uzmanın log olasılıklarından çıkarılarak her iki modelin de paylaştığı sistematik hatalar (sık sık kullanılan jetonların tercih edilmesi gibi) iptal edilir.

Amatörün olasılıklarını çıkarmak neden tekrarı ve yavan çıktıyı azaltıyor?

Her iki model de yüksek frekanslı ve tekrarlanan tokenları aşırı tercih etme eğilimindedir; Amatörün çıkarılması, bu paylaşılan önyargıyı ortadan kaldırır ve yumuşak tercihleri ​​azaltır.

Uyarlanabilir inandırıcılık kısıtı ne işe yarar?

Olasılık filtresi, uzmanın gözetimindeki düşük olasılıklı belirteçleri atar, böylece kontrast tutarsız veya anlamsız sözcükleri destekleyemez.

Karşılaştırmalı kod çözmede puanlama formülü kabaca nedir?

Her aday, uzmanın log-olasılığı eksi ağırlıklı amatör log-olasılığı olarak puanlanır ve uzmanın benzersiz bir şekilde tercih ettiği jetonları ödüllendirir.

Daha sonraki hangi yöntem karşılaştırmalı fikri tek bir modelin kendi katmanlarına genişletir?

DoLa, halüsinasyonu azaltmak için modelin erken (erken katman) ve olgun (geç katman) tahminlerini karşılaştırır ve kontrast konseptini tek bir modelde uygular.