言語AIガイド

対照デコーディング

対照デコードでは、大きくて強力な言語モデルの傾向から小さくて弱い言語モデルの傾向を差し引くことで、より高品質のテキストが生成されます。

2分の読書最終更新日

概要

It amplifies what the expert knows and the amateur misses, reducing repetition and bland output.

ディープダイブ

言語モデルが次の単語を選択するとき、その語彙に対する確率が生成されます。対照的デコード (2022 年に Li らによって導入) は、同じコンテキストで 2 つのモデル、つまり大規模な「専門家」と小規模の「アマチュア」を実行します。専門家の生の確率を信頼する代わりに、専門家の対数確率とアマチュアの対数確率の差によって各候補トークンをスコア付けします。エキスパートが好むトークンですが、アマチュアはブーストされません。両方のモデルが好む一般的な単語(「the」や繰り返されるフレーズなど)は、アマチュアもそれらを好むため、抑制されます。もっともらしさフィルターは、専門家が非常に可能性が低いと判断したトークンを最初に破棄するため、コントラストがナンセンスを助長することはありません。その結果、グリーディ サンプリングや核サンプリングよりも流暢で一貫性があり、繰り返しの少ない長文テキストが得られ、追加のトレーニングは必要ありません。

技術的な洞察

コアスコアは、log p_expert(token) から係数を掛けた log p_amateur(token) です。アマチュアは専門家の系統的エラー (高頻度トークンの優先、ループ、縮退反復) を共有するため、その対数確率を減算すると、本物の専門家の知識を維持しながら、共有された失敗モードがキャンセルされます。適応的尤度制約により、上位の専門家確率の一部 (アルファ) を超えるトークンのみが保持され、コントラストによってまれで一貫性のない単語が増幅されるのを防ぎます。

戦略的影響

速度とスケール

言語ワークフローは、一貫性を犠牲にすることなく、より高速に移行できます。

アクセスと到達範囲

言語やコミュニケーション スタイルを超えてアクセスが拡張されます。

より明確な判決

自動化が繰り返しを処理する間、チームは判断により多くの時間を費やすことができます。

コントラストデコーディングの未来

コントラスト デコードは、DoLa (モデル自体の初期層と後期層を対比して幻覚をカットする) や、取得した文書の有無にかかわらず対比するコンテキスト認識型のバリアントなど、一連の「推論時のコントラスト」手法にインスピレーションを与えました。検索、事実スコアリング、および小規模アマチュアの蒸留とのより緊密な統合に加え、投機的なデコーディングとの組み合わせにより、アマチュアが品質を管理し、生成を同時に加速できることが期待されます。

現実世界の実装

核サンプリングがループに入る、長くて反復のないストーリーや記事の続きを生成する

650 億のエキスパートと 150 億のアマチュアを組み合わせて、微調整を行わずにオープンエンドの生成を改善する

要約と対話出力における退化した繰り返しの削減

事実上の幻覚を軽減するための DoLa スタイルのセルフコントラストの基礎として機能します

リスクとガードレール

幻覚のような事実が、レポート、サポート フロー、または研究結果に静かに組み込まれる可能性があります。

迅速な対応により、同様のリクエスト間で一貫性のない結果が生じる可能性があります。

アクセス制御が弱いと、機密テキスト データが漏洩する可能性があります。

実装ロードマップ

1

展開する前に、出力形式、トーン、品質基準を定義します。

2

正確さが重要な場合は常に、信頼できる情報源を使って地上対応を行ってください。

3

一か八かの成果物については人間によるレビュー チェックポイントを維持します。

4

失敗パターンを追跡し、プロンプトやワークフローを定期的に再トレーニングします。

探検を続けましょう

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Contrastive Decoding quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

クイズを開始する

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

次のガイド

最小限のベイズ リスク デコーディング

よくある質問

What is Contrastive Decoding?

対照デコードでは、大きくて強力な言語モデルの傾向から小さくて弱い言語モデルの傾向を差し引くことで、より高品質のテキストが生成されます。専門家が知っていてアマチュアが見逃していることを増幅し、繰り返しや当たり障りのない出力を減らします。

対照的な解読において、小さな「アマチュア」モデルはどのような役割を果たしますか?

アマチュアの対数確率が専門家の対数確率から差し引かれ、両方のモデルに共通する系統的エラー (頻繁なトークンを優先するなど) がキャンセルされます。

なぜアマチュアの確率を差し引くと繰り返しが減り、当たり障りのない出力が得られるのでしょうか?

どちらのモデルも、高頻度で反復的なトークンを過剰に好む傾向があります。アマチュアを差し引くことで共通の偏見が取り除かれ、当たり障りのない選択が降格されます。

適応的妥当性制約は何をするのでしょうか?

妥当性フィルターは、エキスパートの下で確率の低いトークンを破棄するため、コントラストによって支離滅裂な単語や無意味な単語が助長されることはありません。

対照的デコードにおけるスコア計算式はおおよそどのようなものですか?

各候補は、専門家の対数確率から重み付けされたアマチュアの対数確率を引いたものとしてスコア付けされ、専門家が独自に好むトークンに報酬を与えます。

対照的なアイデアを単一のモデル自体のレイヤーに拡張する後の方法はどれですか?

DoLa は、モデルの時期尚早 (初期層) 予測と成熟期 (後期層) の予測を対比して幻覚を軽減し、1 つのモデル内でコントラストの概念を適用します。