GUIDE IA du langage

Décodage d'auto-cohérence

L'autocohérence est une stratégie de décodage qui échantillonne de nombreux chemins de raisonnement différents à partir d'un modèle de langage, puis sélectionne la réponse sur laquelle la plupart d'entre eux sont d'accord.

2 minutes de lectureDernière mise à jour

Aperçu

It matters because a single greedy answer can be wrong, while the consensus across diverse attempts is far more often correct.

Plongée profonde

Introduite par les chercheurs de Google en 2022, l'auto-cohérence remplace le décodage « gourmand » habituel, dans lequel le modèle s'engage sur le jeton suivant le plus probable à chaque étape, par une approche d'échantillonnage et de vote. L'idée s'appuie sur une chaîne de pensée : le modèle est invité à raisonner étape par étape, mais au lieu de générer une chaîne, il échantillonne de nombreuses chaînes diverses en utilisant une température non nulle. Chaque chaîne peut emprunter un chemin différent, mais un raisonnement correct tend à converger vers la même réponse finale tandis que les erreurs se dispersent dans des directions différentes. Le système vote ensuite à la majorité sur les réponses finales. Ce simple changement a produit des gains importants sur les tests de raisonnement arithmétique et de bon sens comme GSM8K, ajoutant souvent des améliorations de précision à deux chiffres sans aucun recyclage.

Aperçu technique

La méthode exploite l’intuition selon laquelle il existe de nombreuses façons valables d’obtenir une réponse correcte, mais d’innombrables façons de se tromper. En échantillonnant, disons, 40 chaînes dont la température est supérieure à zéro, le modèle produit un raisonnement varié. Seules les réponses finales sont regroupées par un vote majoritaire de type marginalisation ; le texte de raisonnement est écarté. La précision augmente généralement avec le nombre d'échantillons, mais avec des rendements décroissants, échangeant un calcul d'inférence supplémentaire contre de la fiabilité. Il ne nécessite aucune donnée étiquetée ni réglage fin.

Impact stratégique

Vitesse et échelle

Les flux de travail linguistiques peuvent évoluer plus rapidement sans sacrifier la cohérence.

Accès et portée

Il étend l’accès à toutes les langues et styles de communication.

Décisions plus claires

Les équipes peuvent consacrer plus de temps au jugement tandis que l’automatisation gère les répétitions.

L'avenir du décodage d'auto-cohérence

L'autocohérence est un exemple fondamental de mise à l'échelle du temps d'inférence, et ses descendants alimentent désormais des modèles de raisonnement qui dépensent davantage de calculs pour réfléchir plus sérieusement. Les orientations futures incluent la pondération des votes par un vérificateur expérimenté ou un score de confiance plutôt que de compter de manière égale, le choix adaptatif du nombre d'échantillons à prélever en fonction de la difficulté des questions et la combinaison du vote avec des cadres de recherche comme Tree of Thoughts. Attendez-vous à ce qu'il reste une base de référence bon marché et sans formation sur laquelle tout système peut s'appuyer lorsque l'exactitude compte plus que la latence.

Mise en œuvre dans le monde réel

Améliorer la précision des problèmes de mots mathématiques à l'école primaire (GSM8K) en échantillonnant de nombreuses solutions et en votant sur le numéro final.

Améliorer la fiabilité des réponses à des questions de bon sens en plusieurs étapes lorsqu'une seule chaîne pourrait glisser sur une inférence.

Augmenter la confiance dans les réponses de génération de code en vérifiant quelle sortie apparaît la plus cohérente dans les échantillons.

Renforcer les tâches de raisonnement symbolique ou logique où diverses dérivations doivent converger vers une conclusion correcte.

Risques et garde-fous

Les faits hallucinés peuvent discrètement entrer dans des rapports, des flux de support ou des résultats de recherche.

La sensibilité des invites peut créer des résultats incohérents pour des demandes similaires.

Les données textuelles sensibles peuvent être exposées si les contrôles d’accès sont faibles.

Feuille de route de mise en œuvre

1

Définissez le format de sortie, le ton et les normes de qualité avant le déploiement.

2

Établissez des réponses auprès de sources fiables chaque fois que la précision est importante.

3

Gardez un point de contrôle d’examen humain pour les résultats à enjeux élevés.

4

Suivez les modèles de défaillance et recyclez régulièrement les invites ou les flux de travail.

Continuez à explorer

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Self-Consistency Decoding quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Démarrer le quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Guide suivant

Têtes de décodage Medusa

Questions fréquemment posées

What is Self-Consistency Decoding?

L'autocohérence est une stratégie de décodage qui échantillonne de nombreux chemins de raisonnement différents à partir d'un modèle de langage, puis sélectionne la réponse sur laquelle la plupart d'entre eux sont d'accord. C’est important parce qu’une seule réponse avide peut être fausse, alors que le consensus obtenu à travers diverses tentatives est bien plus souvent correct.

Quelle est l’idée centrale du décodage par autocohérence ?

L'auto-cohérence échantillonne plusieurs chaînes de raisonnement diverses et sélectionne la réponse finale sur laquelle la plupart des chaînes s'accordent.

Pourquoi l’échantillonnage de divers chemins de raisonnement contribue-t-il à l’exactitude ?

Il existe de nombreux chemins valables vers une réponse correcte, mais d'innombrables façons de se tromper, de sorte que les réponses correctes se regroupent tandis que les erreurs divergent, ce qui rend la majorité plus fiable.

Quelle méthode de décodage l’auto-cohérence remplace-t-elle ?

Au lieu de s’engager avidement sur un chemin le plus probable, des échantillons et des agrégats d’auto-cohérence sur de nombreux chemins.

Quelle partie de chaque chaîne échantillonnée est réellement utilisée lors du vote final ?

Le raisonnement intermédiaire est écarté ; seules les réponses finales sont regroupées par vote majoritaire.

Quel est le principal coût de l’utilisation de l’autocohérence ?

Générer des dizaines de chaînes de raisonnement multiplie le coût d'inférence ; la précision augmente avec le nombre d'échantillons, mais avec des rendements décroissants.