Мова AI GUIDE

Логіт-упередженість

Зміщення логіту – це ручка, яка підштовхує мовну модель до певних токенів або від них, додаючи фіксоване число до їхніх оцінок, перш ніж модель вибере наступне слово.

2 хвилини читанняОстаннє оновлення

Огляд

It is a lightweight way to ban words, force choices, or shape style without retraining anything.

Глибоке занурення

Перш ніж модель вибере свій наступний токен, вона створює логіт (ненормалізований бал) для кожного лексема у своєму словнику. Зміщення логітів дозволяє додавати постійне значення до логітів вибраних токенів за їхніми числовими ідентифікаторами токенів. Велике позитивне упередження робить маркер набагато більш вірогідним для вибірки; велике негативне упередження (часто -100 в API) фактично забороняє це. Оскільки коригування відбувається перед softmax, який перетворює оцінки на ймовірності, навіть помірні зміщення суттєво змінюють розподіл. Важливо те, що упередження залежить від ідентифікаторів токенів, а не цілих слів — тому слово з кількома лексемами може потребувати зміщення кожної його частини, щоб повністю придушити або просувати його. Це швидкий хірургічний контроль, який не потребує тонкого налаштування та застосовується за запитом.

Технічне розуміння

Логіти є дійсними оцінками; softmax підносить їх до степеня, тому додавання +5 до маркера множить його ненормалізовану вагу на e^5 (~148x) перед нормалізацією. Додавання -100 зводить його ймовірність після softmax фактично до нуля. Оскільки лексемери використовують одиниці підслів, слово «нещасний» може складатися з двох лексем; зміщення лише першої частини не дасть повного контролю. Деталізація підслов є головною проблемою, коли люди намагаються заборонити конкретне слово, але воно все одно просочується частково.

Стратегічний вплив

Швидкість і масштаб

Мовні робочі процеси можуть рухатися швидше без шкоди для узгодженості.

Доступ і охоплення

Це розширює доступ до різних мов і стилів спілкування.

Чіткіші рішення

Команди можуть витрачати більше часу на оцінювання, поки автоматизація справляється з повторенням.

Майбутнє Logit Bias

Зміщення логіту залишається основним елементом швидкого керування, але зростають багатші альтернативи: структуроване/обмежене декодування для жорстких гарантій, керування активацією чи розробка репрезентації, які підштовхують внутрішні вектори моделі, а не просто виводять результати. Очікуйте, що API збережуть упередженість логіту як простий вихідний люк, пропонуючи елементи керування вищого рівня — заборонені фрази, директиви стилю, фільтри безпеки — які автоматично обробляють токенізацію, щоб розробникам не доводилося міркувати про необроблені ідентифікатори маркерів.

Реалізація в реальному світі

Встановлення зміщення -100 для маркерів ненормативної лексики, щоб запобігти створенню певних слів чат-ботом.

Примусовий класифікатор так/ні шляхом надання сильного позитивного упередження лексемам «Так» і «Ні» та придушення всього іншого.

Запобігання надмірному використанню фрази чи слова-заповнювача шляхом застосування помірного негативного упередження до його токенів.

Підвищення доменних термінів (наприклад, назви продукту), щоб підсумовувач надійно згадував їх.

Ризики та огорожі

Галюциновані факти можуть непомітно входити у звіти, допоміжні потоки або результати досліджень.

Делікатність підказок може створити суперечливі результати для подібних запитів.

Конфіденційні текстові дані можуть бути розкриті, якщо контроль доступу слабкий.

Дорожня карта впровадження

1

Визначте вихідний формат, тон і стандарти якості перед розгортанням.

2

Якщо точність має значення, зв’яжіться з надійними джерелами.

3

Тримайте контрольну точку перевірки людьми для отримання високих ставок.

4

Відстежуйте моделі збоїв і регулярно перенавчайте підказки або робочі процеси.

Продовжуйте досліджувати

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Logit Bias quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Розпочати вікторину

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Наступний посібник

Зміщення позиції ALiBi

Часті запитання

What is Logit Bias?

Зміщення логіту – це ручка, яка підштовхує мовну модель до певних токенів або від них, додаючи фіксоване число до їхніх оцінок, перш ніж модель вибере наступне слово. Це легкий спосіб заборонити слова, примусово вибирати або формувати стиль без перенавчання.

Що змінює зміщення logit?

Logit-зміщення додає константу до логітів вибраних ідентифікаторів токенів, змінюючи ймовірність їх вибору, не змінюючи саму модель.

У багатьох API, чого досягає логітичне зміщення -100 для маркера?

Велике негативне упередження, як-от -100, зводить ймовірність токена після softmax практично до нуля, тому він практично ніколи не виробляється.

Чому заборона слова зі зміщенням logit іноді може привести до часткового витоку?

Токенізатори розбивають багато слів на кілька підслівних токенів, тому зміщення лише першого фрагмента не пригнічує повне слово.

До якого ідентифікатора прив’язане логічне зміщення?

Значення зміщення застосовуються до конкретних ідентифікаторів токенів зі словника токенізера, тому ви повинні знати ідентифікатори для фрагментів слова.

Оскільки логіти передаються через softmax, який ефект від додавання позитивного зміщення?

Softmax експоненціює логіти, тому навіть помірне позитивне зміщення суттєво збільшує ненормалізовану вагу токена, різко підвищуючи його шанси.