أبلغ باحثو Apple عن قانون القياس لنماذج التدريب ذات البيانات النادرة
تقول دراسة أجريت على أكثر من 2000 عملية تدريب على نماذج اللغة، إن البيانات المستهدفة النادرة يمكن تكرارها من 15 إلى 20 مرة في مجموعات، مع اختلاف أفضل معدل حسب الحجم والحساب.
يتم تحديثها يوميا1797 قصص تم التحقق منها
تغطية الذكاء الاصطناعي التي تم التحقق من مصدرها لعمليات إطلاق المنتجات، وتحولات السياسات، وأبحاث السلامة، وتحركات الصناعة، تم شرحها بلغة إنجليزية بسيطة من قبل فريق تعليمي غير ربحي.
ترتبط كل قصة بأقوى الأدلة المتاحة: المصادر الأصلية عندما تكون متاحة، أو التقارير المنسوبة بوضوح.
ما حدث، ولماذا هو مهم، وما يجب مشاهدته - بدون المصطلحات.
عندما تكون الإشارة ضعيفة، لا ننشر أي شيء بدلاً من تعبئة البث.
قصص الذكاء الاصطناعي التي تم التحقق من مصدرها، الأحدث أولاً، للأشخاص الذين يحتاجون إلى فهم الذكاء الاصطناعي دون مطاردة الضجيج.
تقول دراسة أجريت على أكثر من 2000 عملية تدريب على نماذج اللغة، إن البيانات المستهدفة النادرة يمكن تكرارها من 15 إلى 20 مرة في مجموعات، مع اختلاف أفضل معدل حسب الحجم والحساب.
يصف الباحثون في Apple LINK، وهو تدخل تدريبي مسبق يستبدل الكلمات الإنجليزية المحددة بترجمات على مستوى الكلمة من اللغة المستهدفة. تشير الورقة إلى تحسينات عبر ثماني لغات وخمسة أحجام للنماذج، بما في ذلك تسريع يصل إلى ضعفين في الوصول إلى أداء مكافئ في المراحل النهائية.
تشير ورقة الموقف إلى وجود تواطؤ ضمني من قبل عملاء DeepSeek-R1 في سوق تسعير برتراند المحاكية، حتى بعد مطالبات بشرية ضد التواطؤ. ويجادل بأن شهادة السلوك الملحوظ يجب أن تسبق نشر وكلاء الاستدلال في الأسواق الاقتصادية؛ تظل الأدلة والضمانات أولية.
تستعرض مراجعة منهجية كيفية دراسة النماذج اللغوية الكبيرة لتحليل الصحة العقلية، وتقييم المخاطر، ودعم العلاج، والرصد متعدد الوسائط، مع التركيز على التحديات الأخلاقية والتنظيمية التي لم يتم حلها.
تشير ورقة موقف ICML 2026 التي تحلل 500 بطاقة نموذجية Hugging Face إلى أن نماذج الأساس ذات الوزن المفتوح تحتاج إلى بطاقات نموذجية منسقة، وسياسات الاستخدام المقبول، والتراخيص لمعالجة فجوات السلامة والحوكمة.
تقترح ورقة الموقف ملف تعريف التعقيد الانتقالي، وهو طريقة موحدة لوصف مدى عدم القدرة على التنبؤ وطويلة المدى لديناميكيات بيئات اللعبة بالنسبة لنمذجة عالم اللعبة والتعلم المعزز.
يضع معيار arXiv الجديد 15 وكيلًا لنموذج اللغة في محاكاة لإدارة كرة القدم لمدة 20 عامًا، لاختبار ما إذا كان بإمكانهم اتخاذ قرارات متسقة عندما تؤثر الاختيارات قصيرة المدى على النتائج طويلة المدى.
يشير معيار arXiv الجديد إلى أن تغيير طريقة الاسترداد فقط أدى إلى زيادة الدقة الدقيقة للنموذج الثابت في حالات التسوية المالية من 2.05% إلى 72.44%. وجدت الدراسة أيضًا أن التصنيف الصحيح للسبب الجذري لا يعني في كثير من الأحيان أن النظام قد أعاد أدلة كافية لتشخيص قابل للتدقيق.
تقدم دراسة arXiv الجديدة تجارب قانون القياس لنماذج نشر النص إلى الصورة عبر ميزانيات الحوسبة من 10^19 إلى 10^22 FLOPs. يشير مؤلفوها إلى أن نماذج الصور تحتاج إلى بيانات أكثر بكثير لكل معلمة من النماذج اللغوية للتدريب بكفاءة.
تصف ورقة arXiv الجديدة طريقة EEG ذاتية الإشراف والتي تبلغ دقة 92.4% في التمييز بين مرض الزهايمر والضوابط المعرفية الطبيعية في مجموعة ADFTD.
تقدم ورقة بحثية arXiv Agentic ESOpt، وهو إطار مقترح لاستراتيجية التطور لضبط عوامل نموذج اللغة طويلة الأفق باستخدام ذاكرة GPU على مستوى الاستدلال. أبلغ المؤلفون عن مكاسب لـ Qwen-3.5-27B على WebArena-Lite وتحسينات في 28 من 36 إعدادًا للتحسين السريع.
تقول ورقة arXiv أن متوسط الخطأ التربيعي يمكن أن يخطئ في الحكم على تنبؤات السلاسل الزمنية غير المنتظمة، ويقترح مقياسًا للوقت المستمر تم اختباره عبر مجموعات بيانات اصطناعية وشبه اصطناعية وثماني مجموعات بيانات حقيقية.
إحاطة مفيدة واحدة كل أسبوع
احصل على أخبار الذكاء الاصطناعي التي تم التحقق منها لهذا الأسبوع، والبيانات الأصلية، والأدوات المفيدة، واختيارات التعلم، ووظائف الذكاء الاصطناعي الجديدة.
هل توظف متخصصًا في الذكاء الاصطناعي أم تطلق منتجًا مفيدًا للذكاء الاصطناعي؟ ضعها أمام الأشخاص الذين أتوا إلى هنا للتعلم والعمل.
نشر وظيفة الذكاء الاصطناعي إرسال أداة الذكاء الاصطناعي