يتم تحديثها يوميا2272 قصص تم التحقق منها
أخبار الذكاء الاصطناعي. بدون الضجيج.
تغطية الذكاء الاصطناعي التي تم التحقق من مصدرها لعمليات إطلاق المنتجات، وتحولات السياسات، وأبحاث السلامة، وتحركات الصناعة، تم شرحها بلغة إنجليزية بسيطة من قبل فريق تعليمي غير ربحي.
مصادر تم التحقق منها
ترتبط كل قصة بأقوى الأدلة المتاحة: المصادر الأصلية عندما تكون متاحة، أو التقارير المنسوبة بوضوح.
الإنجليزية عادي
ما حدث، ولماذا هو مهم، وما يجب مشاهدته - بدون المصطلحات.
لا حشو
عندما تكون الإشارة ضعيفة، لا ننشر أي شيء بدلاً من تعبئة البث.
المزيد من القصص
9 قصصالابتكار
تقول الورقة إن إدارة ذاكرة التخزين المؤقت Agent-Aware تقلل من تأخير الرمز الأول بنسبة تصل إلى 45% في الخدمة المتعددة الوكلاء
تصف النسخة الأولية arXiv الجديدة CacheScout، وهي طبقة مبنية على خادم vLLM مفتوح المصدر الذي يقرر ما يجب الاحتفاظ به في ذاكرة التخزين المؤقت ذات القيمة الرئيسية للنموذج بناءً على الوكيل الذي من المرجح أن يتم تشغيله بعد ذلك. أفاد المؤلفون بزمن وصول مزدوج ومكاسب في الإنتاجية؛ لم يتم ذكر أعباء العمل والنماذج والأجهزة في الملخص.arxiv.orgالابتكار
تدقيق OpenAI دليل تم إنشاؤه بواسطة الذكاء الاصطناعي يعثر على حالة معكوسة، وينشر إصلاحًا
يقول باحثان إن برهان lemma في الفصل السادس من وثيقة الرياضيات OpenAI به خطأ قطبي: اختبار من حيث متوسط النجاح حيث تحتاج الخطوة التالية إلى فشل مشروط كبير. ويعطون مثالا مضادا وبرهانا مصححا، ويحذرون من أن هذا ليس تحققا من صحة النظرية الرئيسية للفصل.arxiv.orgالابتكار
دراسة النسخ المتماثل تقول إن FLOPs لا تزال تخطئ في توقع وقت تشغيل الذكاء الاصطناعي، وفشل الإصلاح المقترح على الأجهزة الأحدث
تستنسخ نسخة أولية أجراها باحثان دراسة سابقة حول السبب في أن أعداد FLOP المتساوية لا تعني وقت تنفيذ متساويًا. إنه يؤكد المطالبة الأساسية ولكنه يشير إلى أن صيغة تصحيح α-FLOPs تقلل بشكل عام من وقت التشغيل على الأجهزة الأحدث، مما يظهر القفزات والتذبذبات التي لا تلتقطها الصيغة.arxiv.orgالمؤسسة
البحث المعياري يجد أربع طرق للاستعلام عن بيانات المؤسسة مع درجات ماجستير إدارة الأعمال (LLM) أقل من 26%
تضع النسخة الأولية الجديدة من arXiv أربع بنيات للاستعلام باللغة الطبيعية لقواعد بيانات المؤسسة مقابل بعضها البعض على أساس معيار ثنائي اللغة اصطناعي. ولم يجيب أي منهم بشكل صحيح على أكثر من ربع الحالات تقريبًا، ولم يكن التصميم الذي حصل على أعلى الدرجات هو الأكثر أمانًا أو الأرخص.arxiv.orgالابتكار
تقترح الورقة تصنيف وكلاء أمان الذكاء الاصطناعي بدون تسميات عن طريق قياس التقارب مع نموذج أقوى
تقول نسخة أولية جديدة من arXiv أن فرق الأمن يمكنها الحكم على ما إذا كان وكيل الذكاء الاصطناعي المجهز بالذاكرة أو الاسترجاع يتعلم من خلال قياس مدى سد الفجوة مع نموذج "المعلم" الأقوى، بدلاً من الاعتماد على معايير محددة غالبًا ما تكون نادرة أو قديمة. إذا حكمنا من خلال نموذج يعمل بالمثل، فإنه لم يعط أي إشارة قابلة للاستخدام.arxiv.orgالابتكار
معيار جديد يختبر ما إذا كان بإمكان مساعدي الذكاء الاصطناعي تذكر سنة من استخدام الهاتف
يقدم تقرير فني مؤلف من 17 مؤلفًا تم نشره على arXiv MobileMem، وهو معيار وإطار عمل للذاكرة طويلة المدى الموجودة على الجهاز والتي تم إنشاؤها من مجموعة من تجارب الأجهزة المحمولة على مدار العام. يصف الملخص التصميم ولكنه لا يذكر أي نتائج، ولا تزال التفاصيل الأساسية حول البيانات الأساسية غير معلنة.arxiv.orgالابتكار
تشير الورقة إلى ظهور منظمة معيارية شبيهة بالدماغ داخل نماذج لغوية كبيرة
تشير الطبعة الأولية الجديدة لـ arXiv إلى أن النماذج اللغوية الكبيرة تطور بنية داخلية متخصصة وظيفيًا تتوافق مع شبكات الدماغ البشري المتميزة، بناءً على تحليلات الدوائر عبر 46 مهمة في أربعة مجالات معرفية. تترك صفحة الملخص التفاصيل المنهجية الرئيسية غير مذكورة.arxiv.orgالابتكار
وجدت الورقة أن الطبقات المتأخرة من نموذج خليط من الخبراء تتسامح مع إخفاء الخبراء الثقيل
تشير نسخة ما قبل الطباعة إلى أن تعطيل الخبراء ذوي الحجم المنخفض في الطبقات الخمس الأخيرة من نموذج مزيج الخبراء الذي يحتوي على 35 مليار معلمة، قد أدى إلى الحفاظ على مخرجات ترجمة التعليمات البرمجية القابلة للاستخدام بشكل أكبر بكثير من نشر نفس التخفيضات عبر جميع الطبقات. ويغطي نموذجًا واحدًا ومعيارًا واحدًا، ولا يشير الملخص إلى أي خط أساس مكشوف.arxiv.orgالأمان
تسمح عيوب CoreBreak بتشغيل أدوات الوكيل دون استدعاء النموذج على الإطلاق
تصف المذكرة البحثية الصادرة عن Cloud Security Alliance CoreBreak، وهو نمط من العيوب في Amazon Bedrock AgentCore، ومجموعة Agent Development Kit الخاصة بـ Google، وحزم تسخير AI SDK من Vercel التي سمحت للأدوات بالتنفيذ دون دوران النموذج - مما يترك حواجز الحماية على مستوى النموذج دون أي شيء يمكن فحصه.labs.cloudsecurityalliance.org
إحاطة مفيدة واحدة كل أسبوع
مواكبة الذكاء الاصطناعي دون العيش في الخلاصة.
احصل على أخبار الذكاء الاصطناعي التي تم التحقق منها لهذا الأسبوع، والبيانات الأصلية، والأدوات المفيدة، واختيارات التعلم، ووظائف الذكاء الاصطناعي الجديدة.
الوصول إلى الأشخاص الذين يتعلمون الذكاء الاصطناعي
هل توظف متخصصًا في الذكاء الاصطناعي أم تطلق منتجًا مفيدًا للذكاء الاصطناعي؟ ضعها أمام الأشخاص الذين أتوا إلى هنا للتعلم والعمل.
نشر وظيفة الذكاء الاصطناعيإرسال أداة الذكاء الاصطناعي