دليل اللغة AI

فك تشفير الاتساق الذاتي

الاتساق الذاتي عبارة عن استراتيجية فك تشفير تقوم بأخذ عينات من العديد من مسارات التفكير المختلفة من نموذج اللغة ثم تختار الإجابة التي يتفق عليها معظمهم.

قراءة لمدة دقيقتينآخر تحديث

نظرة عامة

It matters because a single greedy answer can be wrong, while the consensus across diverse attempts is far more often correct.

الغوص العميق

يحل الاتساق الذاتي، الذي قدمه باحثون في Google في عام 2022، محل فك التشفير "الجشع" المعتاد، حيث يلتزم النموذج بالرمز المميز التالي الأكثر احتمالًا في كل خطوة، مع نهج العينة والتصويت. تعتمد الفكرة على تحفيز سلسلة الأفكار: يُطلب من النموذج أن يفكر خطوة بخطوة، ولكن بدلاً من إنشاء سلسلة واحدة، فإنه يأخذ عينات من العديد من السلاسل المتنوعة باستخدام درجة حرارة غير الصفر. قد تتخذ كل سلسلة طريقًا مختلفًا، إلا أن الاستدلال الصحيح يميل إلى الالتقاء على نفس الإجابة النهائية بينما تتناثر الأخطاء في اتجاهات مختلفة. ثم يأخذ النظام تصويت الأغلبية على الإجابات النهائية. أنتج هذا التغيير البسيط مكاسب كبيرة في معايير الحساب والمنطق المنطقي مثل GSM8K، وغالبًا ما يضيف تحسينات في الدقة مكونة من رقمين دون أي إعادة تدريب.

البصيرة الفنية

تستغل هذه الطريقة الحدس بأن هناك العديد من الطرق الصحيحة للوصول إلى إجابة صحيحة ولكن هناك طرقًا لا حصر لها للخطأ. ومن خلال أخذ عينات، على سبيل المثال، من 40 سلسلة ذات درجة حرارة أعلى من الصفر، ينتج النموذج تفكيرًا متنوعًا. يتم تجميع الإجابات النهائية فقط من خلال تصويت الأغلبية بأسلوب التهميش؛ يتم تجاهل النص المنطق. وترتفع الدقة عمومًا مع وجود عدد أكبر من العينات ولكن مع تناقص العوائد، مما يؤدي إلى استبدال حساب الاستدلال الإضافي بالموثوقية. لا يتطلب الأمر أي بيانات مصنفة أو ضبط دقيق.

التأثير الاستراتيجي

السرعة والحجم

يمكن أن تتحرك مسارات عمل اللغة بشكل أسرع دون التضحية بالاتساق.

الوصول والوصول

فهو يوسع الوصول عبر اللغات وأنماط الاتصال.

قرارات أوضح

يمكن للفرق قضاء المزيد من الوقت في الحكم بينما تتعامل الأتمتة مع التكرار.

مستقبل فك تشفير الاتساق الذاتي

يعد الاتساق الذاتي مثالًا أساسيًا على قياس وقت الاستدلال، وتعمل الآن نماذج الاستدلال التي تنفق المزيد من الحساب على التفكير بجدية أكبر. تتضمن الاتجاهات المستقبلية ترجيح الأصوات من خلال مدقق متعلم أو درجة ثقة بدلاً من العد بالتساوي، واختيار عدد العينات التي سيتم سحبها بشكل تكيفي بناءً على صعوبة السؤال، والجمع بين التصويت وأطر البحث مثل شجرة الأفكار. توقع أن يظل خط أساس رخيصًا وخاليًا من التدريب يمكن لأي نظام الاعتماد عليه عندما تكون الصحة أكثر أهمية من زمن الاستجابة.

التنفيذ في العالم الحقيقي

تعزيز الدقة في المسائل اللفظية الرياضية للمدرسة الابتدائية (GSM8K) عن طريق أخذ عينات من العديد من مسارات الحلول والتصويت على الرقم النهائي.

تحسين موثوقية الإجابة على الأسئلة المنطقية متعددة الخطوات حيث قد تنزلق سلسلة واحدة عند استنتاج واحد.

زيادة الثقة في إجابات إنشاء التعليمات البرمجية عن طريق التحقق من المخرجات التي تظهر بشكل أكثر اتساقًا عبر العينات.

تعزيز مهام الاستدلال الرمزي أو المنطقي حيث ينبغي أن تتقارب المشتقات المتنوعة على نتيجة واحدة صحيحة.

المخاطر والدرابزين

يمكن للحقائق المهلوسة إدخال التقارير أو تدفقات الدعم أو مخرجات البحث بهدوء.

يمكن أن تؤدي الحساسية السريعة إلى نتائج غير متناسقة عبر الطلبات المماثلة.

قد يتم كشف البيانات النصية الحساسة إذا كانت عناصر التحكم في الوصول ضعيفة.

خارطة طريق التنفيذ

1

حدد تنسيق الإخراج والنغمة ومعايير الجودة قبل بدء التشغيل.

2

استجابات أرضية من مصادر موثوقة عندما تكون الدقة مهمة.

3

احتفظ بنقطة تفتيش للمراجعة البشرية للمخرجات عالية المخاطر.

4

تتبع أنماط الفشل وأعد تدريب المطالبات أو سير العمل بانتظام.

استمر في الاستكشاف

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Self-Consistency Decoding quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

ابدأ الاختبار

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

الدليل التالي

رؤوس فك رموز ميدوسا

الأسئلة المتداولة

What is Self-Consistency Decoding?

الاتساق الذاتي عبارة عن استراتيجية فك تشفير تقوم بأخذ عينات من العديد من مسارات التفكير المختلفة من نموذج اللغة ثم تختار الإجابة التي يتفق عليها معظمهم. إنه أمر مهم لأن إجابة واحدة جشعة يمكن أن تكون خاطئة، في حين أن الإجماع عبر المحاولات المتنوعة يكون صحيحًا في كثير من الأحيان.

ما هي الفكرة الأساسية وراء فك تشفير الاتساق الذاتي؟

يختبر الاتساق الذاتي سلاسل متعددة ومتنوعة من الاستدلال ويختار الإجابة النهائية التي تتفق عليها معظم السلاسل.

لماذا يساعد أخذ عينات من مسارات التفكير المتنوعة على الدقة؟

هناك العديد من الطرق الصحيحة للحصول على إجابة صحيحة ولكن هناك طرق لا حصر لها للخطأ، لذا تتجمع الإجابات الصحيحة بينما تتباعد الأخطاء، مما يجعل الأغلبية أكثر موثوقية.

ما هي طريقة فك التشفير التي يحل محل الاتساق الذاتي؟

فبدلاً من الالتزام الجشع بمسار واحد أكثر احتمالاً، قم بتجميع عينات الاتساق الذاتي وتجميعها عبر العديد من المسارات.

أي جزء من كل سلسلة عينة يتم استخدامه فعليًا في التصويت النهائي؟

يتم تجاهل المنطق الوسيط. يتم تجميع الإجابات النهائية فقط بأغلبية الأصوات.

ما هي التكلفة الرئيسية لاستخدام الاتساق الذاتي؟

يؤدي توليد العشرات من سلاسل الاستدلال إلى مضاعفة تكلفة الاستدلال؛ وترتفع الدقة مع زيادة عدد العينات ولكن مع تناقص العوائد.