يتم تحديثها يوميا2543 قصص تم التحقق منها
أخبار الذكاء الاصطناعي. بدون الضجيج.
تغطية الذكاء الاصطناعي التي تم التحقق من مصدرها لعمليات إطلاق المنتجات، وتحولات السياسات، وأبحاث السلامة، وتحركات الصناعة، تم شرحها بلغة إنجليزية بسيطة من قبل فريق تعليمي غير ربحي.
مصادر تم التحقق منها
ترتبط كل قصة بأقوى الأدلة المتاحة: المصادر الأصلية عندما تكون متاحة، أو التقارير المنسوبة بوضوح.
الإنجليزية عادي
ما حدث، ولماذا هو مهم، وما يجب مشاهدته - بدون المصطلحات.
لا حشو
عندما تكون الإشارة ضعيفة، لا ننشر أي شيء بدلاً من تعبئة البث.
المزيد من القصص
9 قصصالابتكار
تقارير ما قبل الطباعة تشير إلى تصنيفات أعلى لمرشحي LLM للمؤسسات المرموقة
تشير نسخة arXiv الأولية إلى أن أربعة نماذج لغوية كبيرة قامت بتقييم الملفات الشخصية للمرشحين بشكل أفضل عند ربطها بمؤسسات ومجلات مرموقة. يقول المؤلفون إن الإشارات المؤسسية والجغرافية يمكن أن تشكل التقييم، في حين تظل النماذج المختبرة والمجالات المهنية غير محددة في المصدر المقدم.arxiv.orgالابتكار
وجدت الدراسة أن سياق الاستدلال يمكن أن يغير مخرجات LLM في سيناريوهات التخصيص الطبي
تشير ورقة arXiv إلى أن ثلاثة من أربعة نماذج لغوية تم اختبارها قد غيرت احتمالات تخصيص الموارد بشكل مختلف عندما تم تقييم نفس السيناريو السريري مع أو بدون الاستجابة السابقة للنموذج في السياق.arxiv.orgالابتكار
Preprint reports AI decoding of natural sentences from non-invasive brain recordings
A research team describes Brain2Qwerty v2, a model that uses real-time MEG recordings to decode typed natural sentences, reporting a 39% average word error rate across nine subjects.arxiv.orgالابتكار
خرائط الدراسة 46 نموذجًا للغة مصممة للغة البرتغالية
تقوم دراسة رسم الخرائط المنهجية بفهرسة 46 نموذجًا باللغة البرتغالية ومقارنة البنيات وموارد التدريب والترخيص والتعليمات البرمجية والبيانات والأوزان. يقول المؤلفون إن هذا المجال ينمو ولكن من الصعب تقييمه لأن المعلومات منتشرة عبر الأوراق والتقارير الفنية والمستودعات ووثائق المشروع.arxiv.orgالابتكار
Interpretability study links Qwen3-4B’s overconfident answers to a certainty-biased mechanism
An arXiv study reports that Qwen3-4B favors certainty over uncertainty in controlled reasoning tasks and identifies model features that may drive the imbalance. The authors say targeted interventions reduced overconfident errors, but the abstract does not disclose effect sizes or testing details.arxiv.orgالابتكار
The Deontic Gap: Large Language Models and the Modal Language of Obligation
Modal auxiliaries such as must, should, and have to mark necessity and obligation within the contexts of speaker authority and interpersonal stance.arxiv.orgالأمان
Paper proposes obscuring refusal signals to resist abliteration attacks
An arXiv preprint introduces a weight-editing method intended to make safety refusals harder to extract and remove. The paper reports stronger post-abliteration refusal scores on two open models, with different tradeoffs in general-purpose performance.arxiv.orgالابتكار
تشير الورقة إلى طريقة زمنية للكشف عن الهلوسة على المستوى الرمزي
تصف النسخة الأولية من arXiv كاشف الهلوسة الذي يجمع بين إحصائيات النص وإشارات الاستلزام ومفاجأة نموذج اللغة عبر التسلسلات بدلاً من الحكم على الرموز المميزة بشكل مستقل. وصل نموذج BiGRU الخاص بها إلى AUC بقيمة 0.840 على RAGTruth، وفقًا للصحيفة.arxiv.orgالابتكار
Entity tracking emerges at 410 million parameters, exceeds humans across naturalistic narratives
Understanding language requires tracking entities across discourse - i.e., knowing where things are and how they change, even when not explicitly stated.arxiv.org
إحاطة مفيدة واحدة كل أسبوع
مواكبة الذكاء الاصطناعي دون العيش في الخلاصة.
احصل على أخبار الذكاء الاصطناعي التي تم التحقق منها لهذا الأسبوع، والبيانات الأصلية، والأدوات المفيدة، واختيارات التعلم، ووظائف الذكاء الاصطناعي الجديدة.
الوصول إلى الأشخاص الذين يتعلمون الذكاء الاصطناعي
هل توظف متخصصًا في الذكاء الاصطناعي أم تطلق منتجًا مفيدًا للذكاء الاصطناعي؟ ضعها أمام الأشخاص الذين أتوا إلى هنا للتعلم والعمل.
نشر وظيفة الذكاء الاصطناعيإرسال أداة الذكاء الاصطناعي