روزانہ اپ ڈیٹ کیا جاتا ہے۔1426 تصدیق شدہ کہانیاں

اے آئی نیوز۔شور کے بغیر۔

Source-checked AI coverage of product launches, policy shifts, safety research, and industry moves, explained in plain English by a nonprofit education team.

Verified sourcing

Every story links to the strongest available evidence: original sources when available, otherwise clearly attributed reporting.

سادہ انگریزی

کیا ہوا، کیوں اس سے فرق پڑتا ہے، اور کیا دیکھنا ہے - کوئی جرگن ٹیکس نہیں۔

کوئی فلر نہیں۔

جب سگنل پتلا ہوتا ہے، تو ہم فیڈ کو پیڈ کرنے کے بجائے کچھ بھی شائع نہیں کرتے ہیں۔

نیوز آرکائیو

AI نیوز آرکائیو — صفحہ 118

ان لوگوں کے لیے تصدیق شدہ نقطہ نظر کا بڑھتا ہوا سلسلہ جنہیں ہائپ کا پیچھا کیے بغیر AI کو سمجھنے کی ضرورت ہے۔

Source-page capture accompanying Benchmark Paper Finds Four Ways to Query Enterprise Data With LLMs All Score Under 26%ٹاپ سٹوری
انٹرپرائز6 min پڑھیں
انٹرپرائز6 min پڑھیں

بینچ مارک پیپر نے LLMs کے ساتھ انٹرپرائز ڈیٹا کو استفسار کرنے کے چار طریقے ڈھونڈے ہیں تمام اسکور 26% سے کم

ایک نیا arXiv پری پرنٹ ایک مصنوعی دو لسانی بینچ مارک پر ایک دوسرے کے خلاف انٹرپرائز ڈیٹا بیس کی قدرتی زبان میں استفسار کے لیے چار فن تعمیرات کو کھڑا کرتا ہے۔ کسی نے بھی تقریباً ایک چوتھائی سے زیادہ کیسز کا صحیح جواب نہیں دیا، اور جس ڈیزائن نے سب سے زیادہ اسکور کیا وہ سب سے محفوظ یا سستا نہیں تھا۔

کہانی پڑھیں Verified source: arxiv.org
اختراع7 min پڑھیں

کاغذ ایک مضبوط ماڈل میں کنورجنسی کی پیمائش کرکے لیبل کے بغیر AI سیکیورٹی ایجنٹوں کو گریڈ کرنے کی تجویز کرتا ہے

ایک نیا arXiv پری پرنٹ دلیل دیتا ہے کہ سیکیورٹی ٹیمیں یہ فیصلہ کر سکتی ہیں کہ آیا میموری- یا بازیافت سے لیس AI ایجنٹ یہ پیمائش کر کے سیکھ رہا ہے کہ یہ ایک مضبوط "ٹیچر" ماڈل کے خلا کو کس حد تک بند کرتا ہے، بجائے اس کے کہ اکثر نایاب یا باسی ہوتے ہیں۔ اسی طرح سے چلنے والے ماڈل کی طرف سے فیصلہ کرنے سے کوئی قابل استعمال سگنل نہیں ملا۔

arxiv.org
اختراع7 min پڑھیں

نیا بینچ مارک ٹیسٹ کرتا ہے کہ آیا AI معاونین فون کے استعمال کا ایک سال یاد رکھ سکتے ہیں۔

arXiv پر پوسٹ کی گئی ایک 17 مصنف کی تکنیکی رپورٹ میں MobileMem متعارف کرایا گیا ہے، جو ایک بینچ مارک اور فریم ورک آن ڈیوائس طویل مدتی میموری کے لیے موبائل تجربات کے ایک سال کے پیمانے کے مجموعہ سے بنایا گیا ہے۔ خلاصہ ڈیزائن کی وضاحت کرتا ہے لیکن کوئی اسکور رپورٹ نہیں کرتا، اور بنیادی ڈیٹا کے بارے میں اہم تفصیلات نامعلوم رہتی ہیں۔

arxiv.org
9 کہانیاں
  1. اختراع7 min پڑھیں

    کاغذ کی رپورٹیں دماغ کی طرح ماڈیولر تنظیم بڑی زبان کے ماڈلز کے اندر ابھرتی ہیں

    ایک نیا arXiv preprint کہتا ہے کہ بڑے لینگویج ماڈلز فنکشنل طور پر مخصوص اندرونی ڈھانچہ تیار کرتے ہیں جو چار علمی ڈومینز میں 46 کاموں کے سرکٹ تجزیوں کی بنیاد پر مختلف انسانی دماغی نیٹ ورکس کے ساتھ ملتے ہیں۔ خلاصہ صفحہ کلیدی طریقہ کار کی تفصیلات کو غیر بیان کرتا ہے۔

    arxiv.org
  2. اختراع7 min پڑھیں

    کاغذ ماہرین کے مرکب کی دیر سے پرتیں ڈھونڈتا ہے ماڈل بھاری ماہر ماسکنگ کو برداشت کرتا ہے

    ایک پری پرنٹ رپورٹ کرتا ہے کہ 35-بلین پیرامیٹر مکسچر-آف-ماہرین ماڈل کی آخری پانچ پرتوں میں کم شدت والے ماہرین کو غیر فعال کرنے سے تمام پرتوں میں یکساں کٹوتی پھیلانے سے کہیں زیادہ قابل استعمال کوڈ ٹرانسلیشن آؤٹ پٹس محفوظ رہے۔ اس میں ایک ماڈل اور ایک بینچ مارک کا احاطہ کیا گیا ہے، اور خلاصہ کی رپورٹ کوئی بے نقاب بیس لائن نہیں ہے۔

    arxiv.org
  3. سیکیورٹی7 min پڑھیں

    کور بریک کی خامیاں ایجنٹ ٹولز کو ماڈل کے بغیر چلنے دیتی ہیں۔

    کلاؤڈ سیکیورٹی الائنس کا ایک تحقیقی نوٹ CoreBreak، Amazon Bedrock AgentCore میں خامیوں کا ایک نمونہ، Google کی ایجنٹ ڈویلپمنٹ کٹ، اور Vercel کے AI SDK ہارنس پیکجز کی وضاحت کرتا ہے جس نے ٹولز کو ماڈل موڑ کے بغیر عمل کرنے کی اجازت دی — ماڈل کی سطح کے گارڈریلز کو دیکھنے کے لیے کچھ بھی نہیں چھوڑا۔

    labs.cloudsecurityalliance.org
  4. پالیسی6 min پڑھیں

    Anthropic تفصیلات Claude کا ٹیکسٹ واٹر مارک کیسے کام کرے گا

    Anthropic کا کہنا ہے کہ مستقبل کے Claude ماڈلز EU AI ایکٹ کی تعمیل کرنے کے لئے Google DeepMind کے SynthID-Text پر مبنی شماریاتی واٹر مارک کو سرایت کریں گے۔ کمپنی کا کہنا ہے کہ اس میں کوئی حرف، ٹوکن، یا صارف کی شناخت شامل نہیں کی گئی ہے - اور یہ کہ مکمل دوبارہ لکھنا اسے شکست دیتا ہے۔

    anthropic.com
  5. صنعت6 min پڑھیں

    کرسر کا کہنا ہے کہ اسپیس ایکس کے ذریعہ اس کا حصول سرکاری طور پر بند ہوگیا ہے۔

    کرسر نے ایک مختصر پوسٹ شائع کی جس میں کہا گیا ہے کہ SpaceX نے AI کوڈنگ ٹول کا اپنا حصول مکمل کر لیا ہے، اس عمل کو مکمل کر کے اس کا کہنا ہے کہ اپریل میں SpaceXAI کے ساتھ ماڈل ٹریننگ پارٹنرشپ کے ساتھ شروع ہوا تھا۔ پوسٹ اس تک رسائی کا وعدہ کرتی ہے جسے وہ دنیا کا سب سے بڑا GPU فلیٹ کہتا ہے، لیکن اس میں کوئی شرائط، ٹائم لائنز، یا پروڈکٹ کی تبدیلیوں کا انکشاف نہیں کیا گیا ہے۔

    cursor.com

One useful briefing each week

Keep up with AI without living in the feed.

Get the week’s verified AI news, original data, useful tools, learning picks, and fresh AI jobs.

Send me
One email a week. Switch any time.

Build with our audience

Hiring an AI professional or launching a useful AI product? Put it in front of people who came here to learn and act.

Post an AI job Submit an AI tool