المحاذاة هي كل ما تحتاجه: تدريب خالي من التعليمات لنماذج اللغة الصوتية العامة
يلغي النهج الجديد لتدريب نماذج اللغات الكبيرة متعددة الوسائط (MLLMs) الحاجة إلى إشراف واسع النطاق خاص بالمهمة.
يتم تحديثها يوميا1797 قصص تم التحقق منها
تغطية الذكاء الاصطناعي التي تم التحقق من مصدرها لعمليات إطلاق المنتجات، وتحولات السياسات، وأبحاث السلامة، وتحركات الصناعة، تم شرحها بلغة إنجليزية بسيطة من قبل فريق تعليمي غير ربحي.
ترتبط كل قصة بأقوى الأدلة المتاحة: المصادر الأصلية عندما تكون متاحة، أو التقارير المنسوبة بوضوح.
ما حدث، ولماذا هو مهم، وما يجب مشاهدته - بدون المصطلحات.
عندما تكون الإشارة ضعيفة، لا ننشر أي شيء بدلاً من تعبئة البث.
قصص الذكاء الاصطناعي التي تم التحقق من مصدرها، الأحدث أولاً، للأشخاص الذين يحتاجون إلى فهم الذكاء الاصطناعي دون مطاردة الضجيج.
يلغي النهج الجديد لتدريب نماذج اللغات الكبيرة متعددة الوسائط (MLLMs) الحاجة إلى إشراف واسع النطاق خاص بالمهمة.
يفحص هذا العمل المطالبات المعززة بالرموز التعبيرية كحالة اختبار للثغرات في تقييم سلامة نماذج اللغات الكبيرة (LLMs).
غالبًا ما تقوم منصات التجارة الإلكترونية الحديثة بتشغيل أنظمة البحث والتوصية والتخصيص وإدارة علاقات العملاء بشكل مستقل، مما يحد من فرص إعادة مشاركة العملاء بشكل استباقي.
تقدم ورقة بحثية THPT-Ladder، وهو معيار مكون من 632 عنصرًا يطبق نظام درجات الامتحانات الوطنية الفيتنامية لعام 2025 على نماذج اللغة ويبلغ عن درجات مختلفة ماديًا عن مقاييس الدقة التناسبية القياسية.
توضح ورقة بحثية arXiv كيف قامت Netflix ببناء ونشر ومراقبة محكمي LLM بشكل مستمر للحصول على تفسيرات للتوصية، والإبلاغ عن مكاسب المشاهدة والمشاركة في اختبار A/B مدته خمسة أسابيع يشمل عشرات الملايين من الأعضاء.
يقترح استطلاع arXiv الجديد عرض ذكريات وكيل الذكاء الاصطناعي وأدواته ومهاراته وسير العمل وعلاقاته كرسم بياني يتغير بمرور الوقت، ويدعو إلى التقييم والحوكمة المدركين للرسم البياني.
تقدم النسخة الأولية الجديدة من arXiv FACET، وهو إطار عمل لإنشاء مهام طرفية قابلة للتنفيذ تم تصميم تعليماتها وبيئاتها وحلولها وأدوات التحقق منها لتظل متسقة.
تقدم النسخة الأولية من arXiv SESSE، وهو إطار عمل خالٍ من التدريب يقسم تفضيلات محكم LLM إلى أسئلة فرعية. أبلغ المؤلفون عن تكافؤ قريب مع خط أساس لسلسلة الأفكار على 1000 مثال من RewardBench وسجلات التصويت على مستوى المعيار؛ يظل التعميم والتكلفة والتحقق المستقل من الأسئلة المفتوحة.
يقول فريق IBM Spyre إن وكلاء الترميز ساعدوا في إنشاء 13 محولًا لوقت التشغيل غطت 7,960 من 10,000 نموذج تضمين Hugging Face الأكثر تنزيلًا في المجموعة المستهدفة، مع اجتياز 6,804 اختبارات شاملة على Spyre. يقول الفريق إن تصحيح الأخطاء البشرية ظل ضروريًا.
تصف ورقة بحث Apple طريقة وضع العلامات الزائفة التكرارية ثلاثية المراحل للتعرف التلقائي على الكلام بتبديل التعليمات البرمجية للغة الماندرين والإنجليزية، وتفيد عن تخفيضات في معدل الخطأ المختلط في مجموعتين فرعيتين من تطوير SEAME.
يقول Google أن المستخدمين سيتمكنون قريبًا من معرفة الموضوعات والروابط التي يرغبون في رؤيتها أكثر أو أقل، بينما تقوم عناصر التحكم الجديدة أيضًا بتخصيص البحث والإيجازات الصوتية لـ Google News.
تقدم Amazon Bedrock الآن نماذج GPT-5.6 Sol وTerra وLuna من OpenAI في أكثر من 25 منطقة AWS، مع خيارات التوجيه الجغرافية والعالمية التي تعمل على توسيع مجموعة الحوسبة المتاحة.
إحاطة مفيدة واحدة كل أسبوع
احصل على أخبار الذكاء الاصطناعي التي تم التحقق منها لهذا الأسبوع، والبيانات الأصلية، والأدوات المفيدة، واختيارات التعلم، ووظائف الذكاء الاصطناعي الجديدة.
هل توظف متخصصًا في الذكاء الاصطناعي أم تطلق منتجًا مفيدًا للذكاء الاصطناعي؟ ضعها أمام الأشخاص الذين أتوا إلى هنا للتعلم والعمل.
نشر وظيفة الذكاء الاصطناعي إرسال أداة الذكاء الاصطناعي