GUIDE IA du langage

Recherche de faisceau

La recherche de faisceaux est une stratégie de décodage qui conserve les séquences partielles les plus prometteuses à chaque étape au lieu de s'engager avidement sur une seule.

2 minutes de lectureDernière mise à jour

Aperçu

C’est important car cela produit un texte de meilleure qualité et plus cohérent pour des tâches comme la traduction et le résumé que de choisir le meilleur mot à chaque fois.

Plongée profonde

Lorsqu'un modèle de langage génère du texte, il prédit une probabilité pour le prochain jeton, puis se répète. Le décodage gourmand prend toujours le jeton unique ayant la probabilité la plus élevée, mais cela peut vous mettre dans une impasse : un premier choix local, le meilleur, peut conduire à une peine globalement pire. La recherche de faisceau couvre les haies en conservant les séquences partielles top-k (la « largeur du faisceau », souvent 4-10). À chaque étape, il élargit chaque faisceau avec les prochains jetons possibles, note tous les candidats en fonction de leur probabilité logarithmique cumulée et ne conserve que le k supérieur. Le résultat est la séquence complète ayant obtenu le score le plus élevé. Il est devenu la norme en matière de traduction automatique et reste courant là où un résultat fidèle et à haute probabilité compte plus que la créativité.

Aperçu technique

La recherche par faisceau évalue les séquences en additionnant les log-probabilités des jetons, ce qui la biaise vers des séquences plus courtes (chaque jeton supplémentaire ajoute un terme négatif). Pour contrecarrer cela, les systèmes appliquent une normalisation de la longueur, en divisant le score par longueur de séquence (parfois élevée à une puissance). Une largeur de faisceau plus grande explore plus de candidats mais coûte plus cher en calcul et, contre-intuitivement, peut parfois produire un texte fade ou dégénéré – un effet bien documenté dans la traduction automatique neuronale.

Impact stratégique

Vitesse et échelle

Les flux de travail linguistiques peuvent évoluer plus rapidement sans sacrifier la cohérence.

Accès et portée

Il étend l’accès à toutes les langues et styles de communication.

Décisions plus claires

Les équipes peuvent consacrer plus de temps au jugement tandis que l’automatisation gère les répétitions.

L'avenir de la recherche de faisceaux

Pour une génération créative et ouverte, la recherche par faisceaux est de plus en plus remplacée par des méthodes d'échantillonnage (top-k, noyau) car les faisceaux ont tendance à produire un texte générique et répétitif. Mais pour les tâches contraintes – traduction, reconnaissance vocale, génération de code, sortie structurée – la recherche par faisceau et ses variantes (recherche par faisceau diversifié, recherche par faisceau contraint qui force les mots requis) restent utiles. Attendez-vous à des approches hybrides continues qui combinent l’exploration de type faisceau avec l’échantillonnage, ainsi qu’un décodage sensible aux tâches qui adapte la stratégie selon que la fidélité ou la diversité est la priorité.

Mise en œuvre dans le monde réel

Les systèmes de traduction automatique neuronale choisissent le rendu le plus fluide d'une phrase parmi de nombreuses formulations candidates

Reconnaissance vocale automatique décodant la transcription la plus probable à partir des probabilités du modèle acoustique

Modèles de sous-titrage d'images produisant une seule légende cohérente plutôt qu'une légende plausible aléatoire

Génération contrainte qui force des mots-clés ou une terminologie spécifique à apparaître dans la sortie à l'aide d'une recherche par poutre contrainte

Risques et garde-fous

Les faits hallucinés peuvent discrètement entrer dans des rapports, des flux de support ou des résultats de recherche.

La sensibilité des invites peut créer des résultats incohérents pour des demandes similaires.

Les données textuelles sensibles peuvent être exposées si les contrôles d’accès sont faibles.

Feuille de route de mise en œuvre

1

Définissez le format de sortie, le ton et les normes de qualité avant le déploiement.

2

Établissez des réponses auprès de sources fiables chaque fois que la précision est importante.

3

Gardez un point de contrôle d’examen humain pour les résultats à enjeux élevés.

4

Suivez les modèles de défaillance et recyclez régulièrement les invites ou les flux de travail.

Continuez à explorer

Free newsletter

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Démarrer le quiz

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Guide suivant

Recherche de poutre guidée avec contraintes

Questions fréquemment posées

Qu’est-ce que la recherche par rayons ?

La recherche de faisceaux est une stratégie de décodage qui conserve les séquences partielles les plus prometteuses à chaque étape au lieu de s'engager avidement sur une seule. C'est important car cela produit un texte de meilleure qualité et plus cohérent pour des tâches telles que la traduction et le résumé que de choisir le meilleur mot à chaque fois.

Que contrôle la « largeur du faisceau » (k) dans la recherche de faisceau ?

La largeur du faisceau est le nombre de séquences partielles supérieures conservées et développées à chaque étape ; des largeurs plus grandes explorent plus de candidats.

En quoi la recherche de faisceau diffère-t-elle du décodage gourmand ?

Le décodage gourmand ne prend que le jeton supérieur à chaque étape ; des haies de recherche de faisceaux en suivant simultanément plusieurs séquences prometteuses.

Pourquoi la normalisation de longueur est-elle couramment appliquée dans la recherche de faisceaux ?

Chaque jeton supplémentaire ajoute une probabilité journalière négative, donc sans normalisation, les séquences plus courtes obtiennent injustement un score plus élevé.

Pour quelle tâche la recherche par faisceau est-elle particulièrement adaptée ?

La recherche par faisceau excelle lorsque l’objectif est un rendu unique, précis et fluide, c’est pourquoi elle est devenue la norme en traduction.

Quel est l’inconvénient connu de l’utilisation d’une très grande largeur de faisceau pour la génération ouverte ?

Contre-intuitivement, des faisceaux plus larges dans la génération de texte neuronal favorisent souvent les séquences génériques et répétitives plutôt que les séquences intéressantes.