Език AI РЪКОВОДСТВО

Контрастно декодиране

Контрастното декодиране генерира текст с по-високо качество чрез изваждане на тенденциите на малък, слаб езиков модел от тези на голям, силен.

2 min readПоследна актуализация

Преглед

It amplifies what the expert knows and the amateur misses, reducing repetition and bland output.

Дълбоко гмуркане

Когато езиков модел избере следващата дума, той произвежда вероятност над своя речник. Контрастивното декодиране (въведено от Li et al. през 2022 г.) управлява два модела в един и същи контекст: голям „експерт“ и малък „аматьор“. Вместо да се доверява на необработените вероятности на експерта, той оценява всеки кандидат жетон по разликата между лог-вероятността на експерта и тази на аматьора. Токени, които експертът предпочита, но аматьорът не се подсилва; родовите думи, които и двата модела обичат (като „the“ или повтарящи се фрази), се потискат, тъй като аматьорът също ги обича. Филтърът за правдоподобност първо отхвърля токените, които експертът смята за много малко вероятни, така че контрастът никога не насърчава глупости. Резултатът е по-плавен, съгласуван и по-малко повтарящ се текст в дълга форма в сравнение с алчния или ядрения семплиране, без необходимост от допълнително обучение.

Техническа информация

Основният резултат е log p_expert(token) минус коефициент по log p_amateur(token). Тъй като аматьорът споделя систематичните грешки на експерта (предпочитане на високочестотни токени, зацикляне, изродено повторение), изваждането на неговите логаритмични вероятности отменя тези споделени режими на неуспех, като същевременно запазва истинското експертно знание. Адаптивното ограничение на правдоподобността поддържа само токени над част (алфа) от най-добрата експертна вероятност, предотвратявайки контраста от усилване на редки, несвързани думи.

Стратегическо въздействие

Speed and scale

Езиковите работни процеси могат да се движат по-бързо, без да се жертва последователността.

Access and reach

Той разширява достъпа между езици и стилове на комуникация.

Clearer decisions

Екипите могат да отделят повече време за преценка, докато автоматизацията се справя с повторението.

Бъдещето на контрастното декодиране

Контрастното декодиране е вдъхновило семейство от методи за „контраст при извод“, включително DoLa (контрастиране на собствените ранни и късни слоеве на модела за намаляване на халюцинациите) и варианти, съобразени с контекста, които контрастират с и без извлечени документи. Очаквайте по-тясна интеграция с извличане, точкуване на фактологията и малка любителска дестилация, плюс комбинация със спекулативно декодиране, така че любителът да управлява качеството и да ускорява генерирането едновременно.

Внедряване в реалния свят

Генериране на дълги, неповтарящи се истории или продължения на статии, където вземането на проби от ядра се отклонява в цикли

Сдвояване на 65B експерт с 1.5B аматьор за подобряване на генерирането с отворен край без фина настройка

Намаляване на изродените повторения в резюмирането и резултатите от диалога

Служи като основа за самоконтраст в стил DoLa за намаляване на фактическите халюцинации

Рискове и предпазни огради

Халюцинираните факти могат тихо да влязат в отчети, потоци за поддръжка или резултати от изследвания.

Бързата чувствителност може да създаде противоречиви резултати при подобни заявки.

Чувствителните текстови данни могат да бъдат разкрити, ако контролите за достъп са слаби.

Пътна карта за изпълнение

1

Определете изходен формат, тон и стандарти за качество преди внедряване.

2

Наземни отговори с доверени източници винаги, когато точността има значение.

3

Поддържайте контролна точка за човешки преглед за изходи с високи залози.

4

Проследявайте моделите на неуспехи и редовно обучавайте подкани или работни потоци.

Продължете да изследвате

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Contrastive Decoding quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Start quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Next guide

Декодиране на минимален риск на Бейс

Frequently asked questions

What is Contrastive Decoding?

Контрастното декодиране генерира текст с по-високо качество чрез изваждане на тенденциите на малък, слаб езиков модел от тези на голям, силен. Той усилва това, което експертът знае и аматьорът пропуска, като намалява повторенията и скучния резултат.

При контрастното декодиране каква роля играе малкият „аматьорски“ модел?

Лог-вероятностите на аматьора се изваждат от тези на експерта, като се отменят системните грешки (като предпочитане на честите жетони), които и двата модела споделят.

Защо изваждането на вероятностите на аматьора намалява повторението и скучния изход?

И двата модела са склонни да предпочитат високочестотни и повтарящи се символи; изваждането на аматьора премахва това споделено пристрастие, понижавайки скучните избори.

Какво прави ограничението за адаптивна правдоподобност?

Филтърът за правдоподобност отхвърля токени с ниска вероятност под експерта, така че контрастът не може да насърчава непоследователни или безсмислени думи.

Приблизително каква е формулата за точкуване при контрастно декодиране?

Всеки кандидат се оценява като логаритмичната вероятност на експерта минус претеглената аматьорска логаритмична вероятност, награждаващи жетони, които експертът уникално предпочита.

Кой по-късен метод разширява контрастната идея до собствените слоеве на един модел?

DoLa контрастира преждевременните (ранен слой) и зрелите (късен слой) прогнози на модела, за да намали халюцинациите, прилагайки концепцията за контраст в рамките на един модел.