Логит-смещение
Логит-смещение — это ручка, которая подталкивает языковую модель к определенным токенам или от них, добавляя фиксированное число к их баллам, прежде чем модель выберет следующее слово.
Обзор
It is a lightweight way to ban words, force choices, or shape style without retraining anything.
Глубокое погружение
Прежде чем модель выберет следующий токен, она выдает логит (ненормализованную оценку) для каждого токена в своем словаре. Смещение логита позволяет добавлять постоянное значение к логитам выбранных токенов по их числовым идентификаторам токенов. Большое положительное смещение делает токен гораздо более вероятным для выборки; большое отрицательное смещение (часто -100 в API) фактически запрещает это. Поскольку корректировка происходит до мягкого максимума, который превращает оценки в вероятности, даже небольшие отклонения существенно меняют распределение. Важно отметить, что предвзятость связана с идентификаторами токенов, а не целыми словами, поэтому для слова, состоящего из нескольких токенов, может потребоваться, чтобы каждая из его частей была смещена, чтобы полностью подавить или продвинуть его. Это быстрый хирургический контроль, который не требует тонкой настройки и применяется по запросу.
Техническая информация
Логиты — это действительные оценки; softmax возводит их в степень, поэтому добавление +5 к токену умножает его ненормализованный вес на e^5 (~ 148x) перед нормализацией. Добавление -100 сводит вероятность после softmax практически к нулю. Поскольку токенизаторы используют подслова, слово «несчастный» может состоять из двух токенов; смещение только первой части не позволит полностью контролировать ее. Эта детализация подслов является основной проблемой, когда люди пытаются запретить определенное слово, но оно все равно частично просачивается.
Стратегическое воздействие
Скорость и масштаб
Языковые рабочие процессы могут развиваться быстрее, не жертвуя при этом согласованностью.
Доступ и охват
Это расширяет доступ к различным языкам и стилям общения.
Более четкие решения
Команды могут тратить больше времени на принятие решений, в то время как автоматизация занимается повторением.
Будущее логит-предвзятости
Смещение логита остается основным средством быстрого управления, но появляются более богатые альтернативы: структурированное/ограниченное декодирование для жестких гарантий, управление активацией или разработка представления, которые подталкивают внутренние векторы модели, а не просто выходные оценки. Ожидайте, что API сохранят логит-смещение в качестве простого аварийного люка, предлагая элементы управления более высокого уровня — запрещенные фразы, директивы стиля, фильтры безопасности — которые автоматически обрабатывают токенизацию, поэтому разработчикам не придется думать о необработанных идентификаторах токенов.
Реальная реализация
Установка смещения -100 для жетонов ненормативной лексики, чтобы чат-бот никогда не произносил определенные слова.
Принудительное использование классификатора «да/нет» путем придания сильного положительного смещения токенам «Да» и «Нет» и подавления всего остального.
Препятствуйте злоупотреблению фразой или словом-паразитом, применяя умеренный негативный уклон к его токенам.
Увеличение количества терминов, специфичных для предметной области (например, названия продукта), чтобы составитель отчета достоверно упоминал их.
Риски и ограничения
Галлюцинированные факты могут незаметно войти в отчеты, потоки поддержки или результаты исследований.
Незамедлительная чувствительность может привести к противоречивым результатам по схожим запросам.
Конфиденциальные текстовые данные могут быть раскрыты, если контроль доступа слабый.
Дорожная карта реализации
Перед развертыванием определите выходной формат, тон и стандарты качества.
Наземные ответы с помощью надежных источников, когда точность имеет значение.
Обеспечьте контрольную точку человеческого контроля для получения важных результатов.
Отслеживайте закономерности сбоев и регулярно обновляйте подсказки или рабочие процессы.
Продолжайте исследовать
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the Logit Bias quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
Следующее руководство
Смещение позиции ALiBi
Часто задаваемые вопросы
What is Logit Bias?
Логит-смещение — это ручка, которая подталкивает языковую модель к определенным токенам или от них, добавляя фиксированное число к их баллам, прежде чем модель выберет следующее слово. Это легкий способ запретить слова, заставить выбирать или изменить стиль, ничего не переучивая.
Что изменяет логит-смещение?
Смещение логита добавляет константу к логитам выбранных идентификаторов токенов, изменяя вероятность их выбора без изменения самой модели.
Что во многих API дает логит-смещение -100 на токене?
Большое отрицательное смещение, такое как -100, сводит вероятность пост-softmax токена практически к нулю, поэтому он практически никогда не производится.
Почему запрет слова с логит-смещением иногда может привести к частичной утечке вывода?
Токенизаторы разбивают множество слов на несколько токенов подслов, поэтому смещение только первой части не может подавить полное слово.
Логит-смещение привязано к какому идентификатору?
Значения смещения применяются к конкретным идентификаторам токенов из словаря токенизатора, поэтому вам необходимо знать идентификаторы частей слова.
Поскольку логиты проходят через softmax, каков эффект добавления положительного смещения?
Softmax возводит логиты в степень, поэтому даже скромное положительное смещение существенно умножает ненормализованный вес токена, резко повышая его шансы.