РУКОВОДСТВО ПО ЯЗЫКУ ИИ

Контрастное декодирование

Контрастное декодирование генерирует текст более высокого качества за счет вычитания тенденций маленькой и слабой языковой модели из тенденций большой и сильной модели.

2 минуты чтенияПоследнее обновление

Обзор

It amplifies what the expert knows and the amateur misses, reducing repetition and bland output.

Глубокое погружение

Когда языковая модель выбирает следующее слово, она создает вероятность для его словаря. Контрастное декодирование (представленное Ли и др. в 2022 году) использует две модели в одном и том же контексте: большого «эксперта» и маленького «любителя». Вместо того, чтобы доверять необработанным вероятностям эксперта, он оценивает каждый токен-кандидат по разнице между логарифмической вероятностью эксперта и любителя. Токены, которые предпочитает эксперт, но любитель не получает повышения; общие слова, которые нравятся обеим моделям (например, «the» или повторяющиеся фразы), подавляются, поскольку любители их тоже любят. Фильтр правдоподобия сначала отбрасывает то, что эксперт считает очень маловероятным, поэтому контраст никогда не приводит к бессмысленности. В результате получается более беглый, связный и менее повторяющийся длинный текст, чем при жадной или ядерной выборке, без необходимости дополнительного обучения.

Техническая информация

Основная оценка равна log p_expert(token) минус коэффициент, умноженный на log p_amateur(token). Поскольку любитель разделяет систематические ошибки эксперта (отдавая предпочтение высокочастотным токенам, зацикливанию, вырожденному повторению), вычитание его логарифмических вероятностей отменяет эти общие режимы ошибок, сохраняя при этом подлинные экспертные знания. Адаптивное ограничение правдоподобия сохраняет только токены выше доли (альфа) верхней экспертной вероятности, не позволяя контрасту усиливать редкие, бессвязные слова.

Стратегическое воздействие

Скорость и масштаб

Языковые рабочие процессы могут развиваться быстрее, не жертвуя при этом согласованностью.

Доступ и охват

Это расширяет доступ к различным языкам и стилям общения.

Более четкие решения

Команды могут тратить больше времени на принятие решений, в то время как автоматизация занимается повторением.

Будущее контрастного декодирования

Контрастное декодирование вдохновило на создание семейства методов «контрастного вывода», включая DoLa (сопоставление собственных ранних и поздних слоев модели для устранения галлюцинаций) и контекстно-зависимые варианты, которые контрастируют с извлеченными документами и без них. Ожидайте более тесной интеграции с поиском, оценкой фактов и мелкой любительской дистилляцией, а также сочетанием с спекулятивным декодированием, чтобы любитель одновременно управлял качеством и ускорял генерацию.

Реальная реализация

Создание длинных, неповторяющихся историй или продолжений статей, в которых отбор проб ядер зацикливается.

Объединение эксперта 65B с любителем 1,5B для улучшения генерации с открытым концом без тонкой настройки

Уменьшение вырожденного повторения в результатах резюмирования и диалога.

Служит основой для самоконтраста в стиле DoLa для снижения фактических галлюцинаций.

Риски и ограничения

Галлюцинированные факты могут незаметно войти в отчеты, потоки поддержки или результаты исследований.

Незамедлительная чувствительность может привести к противоречивым результатам по схожим запросам.

Конфиденциальные текстовые данные могут быть раскрыты, если контроль доступа слабый.

Дорожная карта реализации

1

Перед развертыванием определите выходной формат, тон и стандарты качества.

2

Наземные ответы с помощью надежных источников, когда точность имеет значение.

3

Обеспечьте контрольную точку человеческого контроля для получения важных результатов.

4

Отслеживайте закономерности сбоев и регулярно обновляйте подсказки или рабочие процессы.

Продолжайте исследовать

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Contrastive Decoding quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Начать тест

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Следующее руководство

Декодирование минимального байесовского риска

Часто задаваемые вопросы

What is Contrastive Decoding?

Контрастное декодирование генерирует текст более высокого качества за счет вычитания тенденций маленькой и слабой языковой модели из тенденций большой и сильной модели. Он усиливает то, что знает эксперт и упускает любитель, уменьшая количество повторений и скучный результат.

Какую роль играет маленькая «любительская» модель в контрастном декодировании?

Лог-вероятности любителя вычитаются из вероятностей эксперта, исключая систематические ошибки (например, предпочтение частым токенам), которые являются общими для обеих моделей.

Почему вычитание любительских вероятностей уменьшает повторение и неудовлетворительный результат?

Обе модели имеют тенденцию отдавать предпочтение высокочастотным и повторяющимся токенам; вычитание любителя устраняет эту общую предвзятость, понижая в должности мягкий выбор.

Что делает адаптивное ограничение правдоподобия?

Фильтр правдоподобия отбрасывает токены с низкой вероятностью под экспертом, поэтому контраст не может способствовать появлению бессвязных или бессмысленных слов.

Какова примерно формула оценки при контрастном декодировании?

Каждый кандидат оценивается как логарифмическая вероятность эксперта минус взвешенная логарифмическая вероятность любителя, при этом эксперт получает в награду жетоны, которые однозначно предпочитает эксперт.

Какой более поздний метод распространяет идею контраста на собственные слои одной модели?

DoLa сопоставляет преждевременные (ранний уровень) и зрелые (поздний уровень) прогнозы модели, чтобы уменьшить галлюцинации, применяя концепцию контраста в одной модели.