روزانہ اپ ڈیٹ کیا جاتا ہے۔2528 تصدیق شدہ کہانیاں

اے آئی نیوز۔ شور کے بغیر۔

مصنوعات کی لانچز، پالیسی تبدیلیوں، حفاظتی تحقیق، اور صنعت کی تبدیلیوں کی ماخذ سے چیک شدہ AI کوریج، جسے ایک غیر منافع بخش تعلیمی ٹیم نے سادہ انگریزی میں بیان کیا۔

تصدیق شدہ سورسنگ

ہر کہانی سب سے مضبوط دستیاب شواہد سے جڑی ہوتی ہے: اصل ذرائع جب دستیاب ہوں، ورنہ واضح طور پر منسوب رپورٹنگ۔

سادہ انگریزی

کیا ہوا، یہ کیوں اہمیت رکھتا ہے، اور کیا دیکھنا ہے — بغیر لغت کے۔

کوئی فلر نہیں۔

جب سگنل پتلا ہوتا ہے، تو ہم فیڈ کو پیڈ کرنے کے بجائے کچھ بھی شائع نہیں کرتے ہیں۔

9 کہانیاں
  1. اختراعاختراع6 min پڑھیں

    پیپر نے "شیڈو ایویلیویشنز" کا تعارف کرایا: AI ایجنٹوں نے انجینئرنگ کی لیکن دو تحقیقی سوالات میں ناکام رہے

    24-مصنفین کے پری پرنٹ میں فرنٹیئر AI ایجنٹوں نے دو غیر مطبوعہ NeurIPS 2026 جمع کرانے کے مرکزی تحقیقی سوالات کی کوشش کی تھی، پھر پیپرز کے اپنے مصنفین نے نتائج کی درجہ بندی کی تھی۔ ایجنٹوں نے انجینئرنگ کو بغیر کسی امداد کے چھ دنوں تک سنبھالا لیکن تحقیق پر انہیں غیر واضح طور پر مسترد کر دیا گیا۔arxiv.org
  2. پروڈکٹپروڈکٹ7 min پڑھیں

    وارپ "فیکٹریوں" تک ابتدائی رسائی کھولتا ہے، کوڈنگ ایجنٹوں کے بیڑے چلانے کے لیے ایک ترتیب کے طور پر کوڈ سسٹم

    Warp Warp Factories کے لیے ابتدائی رسائی کی درخواستیں لے رہا ہے، جو کوڈنگ ایجنٹوں کے بیڑے کو کوڈ کے طور پر بیان کرتا ہے - ایک YAML فائل میں ریپوز، ماڈلز، اجازتوں اور انسانی چوکیوں کو، CLI، API، SDK اور MCP کے ذریعے چلایا جاتا ہے۔ اس کی آٹومیشن اور لاگت کے اعداد و شمار وینڈر کے دعوے ہیں: کوئی قیمت نہیں، عام دستیابی کی تاریخ یا آزاد جانچ۔warp.dev
  3. اختراعاختراع7 min پڑھیں

    بینچ مارک کا کہنا ہے کہ سرفہرست ملٹی موڈل ماڈلز قلم کی آوازوں اور ہاتھ کی حرکت سے الفاظ پڑھنے پر 10 فیصد سے کم اسکور حاصل کرتے ہیں۔

    ایک نیا arXiv پیپر ایک ایسا ٹیسٹ متعارف کرایا ہے جس میں ماڈلز کو قلم سے اسکریچ آڈیو اور ہاتھ سے چلنے والی ویڈیو سے تحریری لفظ کا اندازہ لگانا چاہیے، جس میں سیاہی نظر نہیں آتی۔ مصنفین 80% سے اوپر والے انسانوں کو خط کی درستگی اور 10% سے نیچے معروف ماڈلز کی اطلاع دیتے ہیں - اور یہ کہ دونوں طریقوں کو دینے سے اکثر نتائج خراب ہوتے ہیں۔arxiv.org
  4. اختراعاختراع7 min پڑھیں

    کاغذ کا کہنا ہے کہ ایجنٹ سے آگاہ کیش مینجمنٹ ملٹی ایجنٹ کی خدمت میں پہلے ٹوکن کی تاخیر کو 45٪ تک کاٹتا ہے۔

    ایک نیا arXiv preprint CacheScout کی وضاحت کرتا ہے، جو اوپن سورس vLLM سرور پر بنی ایک پرت ہے جو فیصلہ کرتی ہے کہ ماڈل کے کلیدی قدر والے کیشے میں کیا رکھنا ہے اس بنیاد پر کہ اگلا کون سا ایجنٹ چلائے گا۔ مصنفین دوہرے ہندسوں میں تاخیر اور تھرو پٹ حاصلات کی اطلاع دیتے ہیں۔ کام کے بوجھ، ماڈل، اور ہارڈ ویئر کو خلاصہ میں بیان نہیں کیا گیا ہے۔arxiv.org
  5. اختراعاختراع7 min پڑھیں

    ایک OpenAI AI سے تیار کردہ ثبوت کا آڈٹ ایک الٹی حالت تلاش کرتا ہے، اور ایک مرمت شائع کرتا ہے

    دو محققین کا کہنا ہے کہ OpenAI کی ریاضی کی دستاویز کے باب 6 میں ایک لیما ثبوت میں قطبیت کی خرابی ہے: اوسط کامیابی کے لحاظ سے ایک امتحان جہاں اگلے مرحلے میں بڑی مشروط ناکامی کی ضرورت ہے۔ وہ ایک جوابی مثال اور ایک درست ثبوت دیتے ہیں، اور احتیاط کرتے ہیں کہ یہ باب کے مرکزی نظریہ کی تصدیق نہیں ہے۔arxiv.org
  6. اختراعاختراع7 min پڑھیں

    نقل کے مطالعہ کا کہنا ہے کہ FLOPs پھر بھی AI رن ٹائم کی غلط پیش گوئی کرتے ہیں، اور مجوزہ فکس نئے ہارڈ ویئر پر ناکام ہو جاتا ہے۔

    دو محققین کا ایک پری پرنٹ ایک سابقہ مطالعہ کو دوبارہ پیش کرتا ہے کہ کیوں مساوی FLOP شمار کا مطلب عمل درآمد کا مساوی وقت نہیں ہے۔ یہ بنیادی دعوے کی تصدیق کرتا ہے لیکن رپورٹ کرتا ہے کہ α-FLOPs اصلاحی فارمولہ عام طور پر نئے ہارڈ ویئر پر رن ​​ٹائم کو کم سمجھتا ہے، جو فارمولہ کی گرفت میں آنے والی چھلانگوں اور دوغلوں کو ظاہر کرتا ہے۔arxiv.org
  7. انٹرپرائزانٹرپرائز6 min پڑھیں

    بینچ مارک پیپر نے LLMs کے ساتھ انٹرپرائز ڈیٹا کو استفسار کرنے کے چار طریقے ڈھونڈے ہیں تمام اسکور 26% سے کم

    ایک نیا arXiv پری پرنٹ ایک مصنوعی دو لسانی بینچ مارک پر ایک دوسرے کے خلاف انٹرپرائز ڈیٹا بیس کی قدرتی زبان میں استفسار کے لیے چار فن تعمیرات کو کھڑا کرتا ہے۔ کسی نے بھی تقریباً ایک چوتھائی سے زیادہ کیسز کا صحیح جواب نہیں دیا، اور جس ڈیزائن نے سب سے زیادہ اسکور کیا وہ سب سے محفوظ یا سستا نہیں تھا۔arxiv.org
  8. اختراعاختراع7 min پڑھیں

    کاغذ ایک مضبوط ماڈل میں کنورجنسی کی پیمائش کرکے لیبل کے بغیر AI سیکیورٹی ایجنٹوں کو گریڈ کرنے کی تجویز کرتا ہے

    ایک نیا arXiv پری پرنٹ دلیل دیتا ہے کہ سیکیورٹی ٹیمیں یہ فیصلہ کر سکتی ہیں کہ آیا میموری- یا بازیافت سے لیس AI ایجنٹ یہ پیمائش کر کے سیکھ رہا ہے کہ یہ ایک مضبوط "ٹیچر" ماڈل کے خلا کو کس حد تک بند کرتا ہے، بجائے اس کے کہ اکثر نایاب یا باسی ہوتے ہیں۔ اسی طرح سے چلنے والے ماڈل کی طرف سے فیصلہ کرنے سے کوئی قابل استعمال سگنل نہیں ملا۔arxiv.org

ہر ہفتے ایک مفید بریفنگ

AI کے ساتھ بغیر فیڈ میں رہنے کے ساتھ قدم ملا کر چلیں۔

ہفتے کی تصدیق شدہ AI خبریں، اصل ڈیٹا، مفید اوزار، سیکھنے کے انتخاب، اور تازہ AI نوکریاں حاصل کریں۔

Send me
One email a week. Switch any time.

ان لوگوں تک پہنچیں جو AI سیکھ رہے ہیں۔

کسی AI پروفیشنل کو ہائر کرنا یا کوئی مفید AI پروڈکٹ لانچ کرنا؟ اسے ان لوگوں کے سامنے رکھیں جو یہاں سیکھنے اور عمل کرنے آئے ہیں۔

اے آئی کی نوکری پوسٹ کریںایک AI ٹول جمع کروائیں