Logit Bias
A Logit Bias egy olyan gomb, amely a nyelvi modellt meghatározott tokenek felé vagy onnan elmozdítja azáltal, hogy fix számot ad a pontszámokhoz, mielőtt a modell kiválasztja a következő szót.
Áttekintés
It is a lightweight way to ban words, force choices, or shape style without retraining anything.
Mély merülés
Mielőtt egy modell kiválasztaná a következő tokenjét, egy logitot (normalizálatlan pontszámot) állít elő a szókincsében található minden tokenhez. A Logit torzítás lehetővé teszi, hogy állandó értéket adjon a kiválasztott tokenek logitjaihoz a numerikus tokenazonosítóik alapján. A nagy pozitív torzítás sokkal valószínűbbé teszi a token mintavételezését; a nagy negatív torzítás (az API-kban gyakran -100) gyakorlatilag tiltja. Mivel a kiigazítás a pontszámokat valószínűségekké alakító softmax előtt történik, még a szerény torzítások is jelentős mértékben eltolják az eloszlást. Lényeges, hogy az elfogultság a token azonosítókhoz, nem pedig a teljes szavakhoz kapcsolódik – így egy több tokenből álló szónak minden egyes darabját torzítani kell ahhoz, hogy teljesen elnyomja vagy előmozdítsa azt. Ez egy gyors, sebészeti vezérlés, amely nem igényel finomhangolást, és kérésre alkalmazható.
Technikai betekintés
A logitok valós értékű pontszámok; A softmax hatványozza őket, így ha egy tokenhez +5-öt adunk, az a normalizálás előtt megszorozza a nem normalizált súlyát e^5-tel (~148x). -100 hozzáadásával a softmax utáni valószínűség lényegében nullára csökken. Mivel a tokenizálók részszóegységeket használnak, a „boldogtalan” szó két jelzőből állhat; csak az első darab torzítása nem fogja teljesen irányítani azt. Ez az alszó részletessége a fő probléma, amikor az emberek megpróbálnak betiltani egy adott szót, de az részben mégis átszivárog.
Stratégiai hatás
Sebesség és méretarány
A nyelvi munkafolyamatok gyorsabban haladhatnak a következetesség feláldozása nélkül.
Hozzáférés és elérés
Kibővíti a hozzáférést a nyelvek és a kommunikációs stílusok között.
Tisztább döntések
A csapatok több időt tölthetnek az ítélkezéssel, míg az automatizálás kezeli az ismétlést.
A Logit Bias jövője
A logit torzítás továbbra is alapvető fontosságú a gyors irányításhoz, de egyre több alternatíva létezik: a strukturált/korlátozott dekódolás a kemény garanciák érdekében, valamint az aktiváló irányítás vagy reprezentáció tervezése, amely a modell belső vektorait tolja el, nem csupán a kimeneti pontszámokat. Az API-któl elvárható, hogy a logit elfogultságot egyszerű menekülési nyílásként tartsák meg, miközben magasabb szintű vezérlőket kínálnak – tiltott kifejezések, stílusirányelvek, biztonsági szűrők –, amelyek automatikusan kezelik a tokenizálást, így a fejlesztőknek nem kell okoskodniuk a nyers tokenazonosítókkal.
Valós megvalósítás
-100-as torzítás beállítása a trágár tokenekre, hogy megakadályozza, hogy a chatbot valaha is kiadjon bizonyos szavakat.
Az igen/nem osztályozó erőltetése az „Igen” és a „Nem” tokenek erős pozitív torzításával, és minden más elnyomásával.
A túlzottan használt kifejezések vagy töltelékszavak visszaszorítása mérsékelt negatív torzítás alkalmazásával a jelzőire.
A domain-specifikus kifejezések (például a terméknév) növelése, hogy az összefoglaló megbízhatóan említse őket.
Kockázatok és védőkorlátok
A hallucinált tények csendben bekerülhetnek a jelentésekbe, a támogatási folyamatokba vagy a kutatási eredményekbe.
Az azonnali érzékenység inkonzisztens eredményeket eredményezhet a hasonló kérések között.
Ha a hozzáférés-szabályozás gyenge, az érzékeny szöveges adatok megjelenhetnek.
Végrehajtási ütemterv
A kiadás előtt határozza meg a kimeneti formátumot, hangszínt és minőségi szabványokat.
Földelje a válaszokat megbízható forrásokból, amikor a pontosság számít.
Tartson emberi ellenőrzési pontot a nagy tétű kimenetekhez.
Kövesse nyomon a meghibásodási mintákat, és rendszeresen tanítsa át az utasításokat vagy a munkafolyamatokat.
Folytassa a felfedezést
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Logit Bias quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Következő útmutató
ALiBi pozíció torzítás
Gyakran ismételt kérdések
What is Logit Bias?
A Logit Bias egy olyan gomb, amely a nyelvi modellt meghatározott tokenek felé vagy onnan elmozdítja azáltal, hogy fix számot ad a pontszámokhoz, mielőtt a modell kiválasztja a következő szót. Könnyű módja a szavak betiltásának, a választások kényszerítésének vagy a stílus alakításának anélkül, hogy bármit is át kell tanítani.
Mit módosít a logit torzítás?
A logit torzítás állandót ad a kiválasztott tokenazonosítók logitjaihoz, megváltoztatva a kiválasztási valószínűségét anélkül, hogy magát a modellt megváltoztatná.
Sok API-ban mit ér el egy token -100-as logit torzítása?
Egy nagy negatív torzítás, mint például a -100, a token softmax utáni valószínűségét lényegében nullára hajtja, így gyakorlatilag soha nem kerül előállításra.
Miért szivároghat ki néha részleges kimenet a logit torzítású szó kitiltása esetén?
A tokenizátorok sok szót több részszó tokenre osztanak fel, így csak az első darab torzítása nem képes elnyomni a teljes szót.
Milyen azonosítóhoz van kulcsolva a logit torzítás?
Az elfogultsági értékek a tokenizátor szókincséből származó meghatározott tokenazonosítókra vonatkoznak, ezért ismernie kell a szórészek azonosítóit.
Mivel a logitokat egy softmax-on vezetik át, mi a hatása a pozitív torzítás hozzáadásának?
A Softmax hatványozza meg a logitokat, így még egy szerény pozitív torzítás is jelentősen megsokszorozza a token nem normalizált súlyát, jelentősen megnövelve az esélyét.