يتم تحديثها يوميا1821 قصص تم التحقق منها

أخبار الذكاء الاصطناعي.بدون الضجيج.

تغطية الذكاء الاصطناعي التي تم التحقق من مصدرها لعمليات إطلاق المنتجات، وتحولات السياسات، وأبحاث السلامة، وتحركات الصناعة، تم شرحها بلغة إنجليزية بسيطة من قبل فريق تعليمي غير ربحي.

مصادر تم التحقق منها

ترتبط كل قصة بأقوى الأدلة المتاحة: المصادر الأصلية عندما تكون متاحة، أو التقارير المنسوبة بوضوح.

الإنجليزية عادي

ما حدث، ولماذا هو مهم، وما يجب مشاهدته - بدون المصطلحات.

لا حشو

عندما تكون الإشارة ضعيفة، لا ننشر أي شيء بدلاً من تعبئة البث.

أرشيف الأخبار

أرشيف أخبار الذكاء الاصطناعي — الصفحة 151

قصص الذكاء الاصطناعي التي تم التحقق من مصدرها، الأحدث أولاً، للأشخاص الذين يحتاجون إلى فهم الذكاء الاصطناعي دون مطاردة الضجيج.

Source-provided image accompanying Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Modelأعلى القصة
الابتكار7 min قراءة
الابتكار7 min قراءة

تقترح الورقة تصنيف وكلاء أمان الذكاء الاصطناعي بدون تسميات عن طريق قياس التقارب مع نموذج أقوى

تقول نسخة أولية جديدة من arXiv أن فرق الأمن يمكنها الحكم على ما إذا كان وكيل الذكاء الاصطناعي المجهز بالذاكرة أو الاسترجاع يتعلم من خلال قياس مدى سد الفجوة مع نموذج "المعلم" الأقوى، بدلاً من الاعتماد على معايير محددة غالبًا ما تكون نادرة أو قديمة. إذا حكمنا من خلال نموذج يعمل بالمثل، فإنه لم يعط أي إشارة قابلة للاستخدام.

قراءة القصة مصدر تم التحقق منه: arxiv.org
9 قصص
  1. الابتكار7 min قراءة

    وجدت الورقة أن الطبقات المتأخرة من نموذج خليط من الخبراء تتسامح مع إخفاء الخبراء الثقيل

    تشير نسخة ما قبل الطباعة إلى أن تعطيل الخبراء ذوي الحجم المنخفض في الطبقات الخمس الأخيرة من نموذج مزيج الخبراء الذي يحتوي على 35 مليار معلمة، قد أدى إلى الحفاظ على مخرجات ترجمة التعليمات البرمجية القابلة للاستخدام بشكل أكبر بكثير من نشر نفس التخفيضات عبر جميع الطبقات. ويغطي نموذجًا واحدًا ومعيارًا واحدًا، ولا يشير الملخص إلى أي خط أساس مكشوف.

    arxiv.org
  2. الأمان7 min قراءة

    تسمح عيوب CoreBreak بتشغيل أدوات الوكيل دون استدعاء النموذج على الإطلاق

    تصف المذكرة البحثية الصادرة عن Cloud Security Alliance CoreBreak، وهو نمط من العيوب في Amazon Bedrock AgentCore، ومجموعة Agent Development Kit الخاصة بـ Google، وحزم تسخير AI SDK من Vercel التي سمحت للأدوات بالتنفيذ دون دوران النموذج - مما يترك حواجز الحماية على مستوى النموذج دون أي شيء يمكن فحصه.

    labs.cloudsecurityalliance.org
  3. السياسة6 min قراءة

    Anthropic تفاصيل كيف ستعمل العلامة المائية النصية لـ Claude

    تقول Anthropic إن نماذج Claude المستقبلية ستتضمن علامة مائية إحصائية بناءً على Google نص SynthID الخاص بـ DeepMind، للامتثال لقانون الاتحاد الأوروبي للذكاء الاصطناعي. تقول الشركة إنها لا تضيف أي أحرف أو رموز مميزة أو هوية مستخدم - وأن إعادة الكتابة الكاملة ستبطلها.

    anthropic.com
  4. الصناعة6 min قراءة

    يقول المؤشر أن عملية الاستحواذ على شركة SpaceX قد تم إغلاقها رسميًا

    نشر Cursor منشورًا قصيرًا يقول فيه إن SpaceX قد أكملت استحواذها على أداة ترميز الذكاء الاصطناعي، وأنهت عملية تقول إنها بدأت في أبريل بشراكة تدريب على النماذج مع SpaceXAI. يعد المنشور بالوصول إلى ما يطلق عليه أكبر أسطول GPU في العالم، لكنه لا يكشف عن أي شروط أو جداول زمنية أو تغييرات في المنتج.

    cursor.com
  5. الابتكار7 min قراءة

    كشف معيار جديد أن وكلاء الذكاء الاصطناعي يمنعون العمل المعتمد بشكل خاطئ بنسبة 28% من الوقت

    تقدم النسخة الأولية اختبار SteerBench-Work، وهو اختبار مكون من 106 سيناريو للحظة التي يقرر فيها وكيل الذكاء الاصطناعي التصرف أو التوقف مؤقتًا للمراجعة. ومن خلال 30 حالة نموذجية، أفاد المؤلفون أن الاحتفاظ بالعمل الذي تمت الموافقة عليه بشكل خاطئ كان أكثر شيوعًا بنحو 28 مرة من السماح بشكل خاطئ بالعمل غير الآمن.

    arxiv.org
  6. الابتكار7 min قراءة

    التقارير الورقية: يقلب قضاة Frontier LLM الأحكام بنسبة 25-71% في ظل الرفض

    تختبر نسخة arXiv الجديدة ما قبل الطباعة تسعة نماذج حدودية تُستخدم كمصنفين آليين، وتفيد بأن جميعهم يغيرون أحكامهم تحت التحدي - وأن الأحكام المتغيرة عادة ما تبتعد عن الإجابة الصحيحة، وليس نحوها.

    arxiv.org
  7. الابتكار7 min قراءة

    تتفوق استراتيجيات تطور الحجج الورقية على RL في الحفاظ على تنوع مجموعات إجابات LLM

    تجادل طبعة أولية جديدة من arXiv بأن ماجستير إدارة الأعمال بعد التدريب مع استراتيجيات التطور - وهي طريقة قائمة على السكان وخالية من التدرج والتي تشوش الأوزان بشكل مباشر - تتفوق على التعلم المعزز في pass@k وتغطية الحلول. يستشهد الملخص بنتائج أفضل في الرياضيات، لكنه لا يذكر أي نماذج أو معايير أو أرقام.

    arxiv.org
  8. الأمان7 min قراءة

    تقول الورقة إن عملاء الذكاء الاصطناعي الذين يقومون بتحسين أنفسهم يمكنهم تحويل نجاح غير آمن إلى مهارة قابلة لإعادة الاستخدام

    تقيس نسخة arXiv المسبقة الجديدة وضع فشل وكيل محدد: عندما يكتب وكيل التحسين الذاتي إجراءً غير آمن في الذاكرة، يمكن استرجاعه وتنفيذه في جلسات لاحقة. أدى كل تكوين متطور تم اختباره إلى إنتاج عناصر غير آمنة، كما أدت ثلاث مهام ضارة إلى مضاعفة نجاح الهجوم المرحل.

    arxiv.org
  9. الأمان6 min قراءة

    تقترح ورقة SEAG الأسماء المستعارة للكيانات الحساسة قبل أن تصل استعلامات RAG إلى LLMs الخارجيين

    تصف النسخة الأولية المنشورة على arXiv إطار عمل يقوم بتبديل الأسماء الحساسة في الاستعلامات واسترداد المستندات للأسماء المستعارة قبل إرسالها إلى نموذج جهة خارجية. أبلغ المؤلفون عن دقة تزيد عن 80% في مقياس المستخدم الشامل، ومعدلات إخفاء كاملة تتراوح بين 74.91% و77.83% عبر ثلاثة نماذج صغيرة.

    arxiv.org

إحاطة مفيدة واحدة كل أسبوع

مواكبة الذكاء الاصطناعي دون العيش في الخلاصة.

احصل على أخبار الذكاء الاصطناعي التي تم التحقق منها لهذا الأسبوع، والبيانات الأصلية، والأدوات المفيدة، واختيارات التعلم، ووظائف الذكاء الاصطناعي الجديدة.

Send me
One email a week. Switch any time.

الوصول إلى الأشخاص الذين يتعلمون الذكاء الاصطناعي

هل توظف متخصصًا في الذكاء الاصطناعي أم تطلق منتجًا مفيدًا للذكاء الاصطناعي؟ ضعها أمام الأشخاص الذين أتوا إلى هنا للتعلم والعمل.

نشر وظيفة الذكاء الاصطناعي إرسال أداة الذكاء الاصطناعي