প্রতিদিন আপডেট করা হয়1787 যাচাইকৃত গল্প

এআই নিউজ।গোলমাল ছাড়া।

একটি অলাভজনক শিক্ষা দল দ্বারা সরল ইংরেজিতে ব্যাখ্যা করা পণ্য লঞ্চ, নীতি পরিবর্তন, নিরাপত্তা গবেষণা, এবং শিল্প পদক্ষেপের উৎস-চেক করা AI কভারেজ।

যাচাইকৃত সোর্সিং

প্রতিটি গল্প শক্তিশালী উপলব্ধ প্রমাণের সাথে লিঙ্ক করে: যখন উপলব্ধ মূল উত্স, অন্যথায় স্পষ্টভাবে দায়ী প্রতিবেদন।

সরল ইংরেজি

What happened, why it matters, and what to watch — without the jargon.

ফিলার নেই

যখন সংকেত পাতলা হয়, আমরা ফিড প্যাড করার পরিবর্তে কিছুই প্রকাশ করি না।

সংবাদ সংরক্ষণাগার

এআই নিউজ আর্কাইভ — পাতা 148

Source-checked AI stories, newest first, for people who need to understand AI without chasing hype.

Source-page capture accompanying Replication Study Says FLOPs Still Mispredict AI Runtime, and the Proposed Fix Fails on Newer Hardwareশীর্ষ গল্প
উদ্ভাবন7 min পড়া
উদ্ভাবন7 min পড়া

রেপ্লিকেশন স্টাডি বলেছে যে FLOPগুলি এখনও AI রানটাইমকে ভুলভাবে অনুমান করে, এবং প্রস্তাবিত ফিক্স নতুন হার্ডওয়্যারে ব্যর্থ হয়

কেন সমান FLOP গণনা সমান কার্যকর করার সময় বোঝায় না তা নিয়ে দুই গবেষকের একটি প্রিপ্রিন্ট একটি পূর্ববর্তী গবেষণা পুনরুত্পাদন করে। এটি অন্তর্নিহিত দাবিকে নিশ্চিত করে কিন্তু রিপোর্ট করে যে α-FLOPs সংশোধন সূত্রটি সাধারণত নতুন হার্ডওয়্যারে রানটাইমকে অবমূল্যায়ন করে, যা সূত্রটি ক্যাপচার করে না লাফ এবং দোলন দেখায়।

গল্প পড়ুন যাচাইকৃত উৎস: arxiv.org
এন্টারপ্রাইজ6 min পড়া

বেঞ্চমার্ক পেপার 26% এর নিচে সমস্ত স্কোর এলএলএম সহ এন্টারপ্রাইজ ডেটা জিজ্ঞাসা করার চারটি উপায় খুঁজে পেয়েছে

একটি নতুন arXiv প্রিপ্রিন্ট একটি সিন্থেটিক দ্বিভাষিক বেঞ্চমার্কে একে অপরের বিরুদ্ধে এন্টারপ্রাইজ ডেটাবেসগুলির প্রাকৃতিক-ভাষা অনুসন্ধানের জন্য চারটি আর্কিটেকচারকে পিট করে। কেউই প্রায় এক চতুর্থাংশের বেশি ক্ষেত্রে সঠিকভাবে উত্তর দেয়নি এবং যে ডিজাইনটি সর্বোচ্চ স্কোর করেছে সেটি সবচেয়ে নিরাপদ বা সস্তা ছিল না।

arxiv.org
উদ্ভাবন7 min পড়া

কাগজ একটি শক্তিশালী মডেলের অভিসারী পরিমাপ করে লেবেল ছাড়া AI নিরাপত্তা এজেন্টদের গ্রেড করার প্রস্তাব দেয়

একটি নতুন arXiv প্রিপ্রিন্ট যুক্তি দেয় যে নিরাপত্তা দল বিচার করতে পারে যে একটি মেমরি- বা পুনরুদ্ধার-সজ্জিত AI এজেন্ট শিখছে কিনা তা পরিমাপ করে কতদূর এটি একটি শক্তিশালী "শিক্ষক" মডেলের ফাঁক বন্ধ করে, লেবেলযুক্ত বেঞ্চমার্কের পরিবর্তে যা প্রায়শই দুর্লভ বা বাসি। একইভাবে চালিত মডেল দ্বারা বিচার করা কোন ব্যবহারযোগ্য সংকেত দেয়নি।

arxiv.org
9 গল্প
  1. উদ্ভাবন7 min পড়া

    নতুন বেঞ্চমার্ক পরীক্ষা করে যে এআই সহকারীরা ফোন ব্যবহারের এক বছর মনে রাখতে পারে কিনা

    arXiv-এ পোস্ট করা একটি 17-লেখকের প্রযুক্তিগত প্রতিবেদন মোবাইলমেমের পরিচয় দেয়, মোবাইল অভিজ্ঞতার এক বছরের স্কেল সংগ্রহ থেকে তৈরি অন-ডিভাইস দীর্ঘমেয়াদী মেমরির জন্য একটি বেঞ্চমার্ক এবং ফ্রেমওয়ার্ক। বিমূর্ত নকশা বর্ণনা করে কিন্তু কোনো স্কোর রিপোর্ট করে না, এবং অন্তর্নিহিত ডেটা সম্পর্কে মূল বিবরণ অপ্রকাশিত থাকে।

    arxiv.org
  2. উদ্ভাবন7 min পড়া

    কাগজ রিপোর্ট মস্তিষ্কের মত মডুলার সংগঠন বড় ভাষার মডেলের ভিতরে উদীয়মান

    একটি নতুন arXiv প্রিপ্রিন্ট বলে যে বড় ভাষার মডেলগুলি কার্যকরীভাবে বিশেষায়িত অভ্যন্তরীণ কাঠামো তৈরি করে যা চারটি জ্ঞানীয় ডোমেনে 46টি কাজ জুড়ে সার্কিট বিশ্লেষণের উপর ভিত্তি করে স্বতন্ত্র মানব মস্তিষ্কের নেটওয়ার্কগুলির সাথে লাইন আপ করে। বিমূর্ত পৃষ্ঠাটি মূল পদ্ধতিগত বিবরণ অব্যক্ত রেখে দেয়।

    arxiv.org
  3. উদ্ভাবন7 min পড়া

    কাগজ একটি বিশেষজ্ঞের মিশ্রণের দেরী স্তর খুঁজে বের করে মডেল ভারী বিশেষজ্ঞ মাস্কিং সহ্য করে

    একটি প্রিপ্রিন্ট রিপোর্ট করে যে 35-বিলিয়ন-প্যারামিটার মিক্সচার-অফ-এক্সপার্টস মডেলের শেষ পাঁচটি স্তরে কম মাত্রার বিশেষজ্ঞদের নিষ্ক্রিয় করা সমস্ত স্তরে একই কাট ছড়িয়ে দেওয়ার চেয়ে অনেক বেশি ব্যবহারযোগ্য কোড-অনুবাদ আউটপুট সংরক্ষণ করেছে। এটি একটি মডেল এবং একটি বেঞ্চমার্ক কভার করে, এবং বিমূর্ত কোন মুখোশহীন বেসলাইন রিপোর্ট করে না।

    arxiv.org
  4. নিরাপত্তা7 min পড়া

    কোরব্রেক ত্রুটিগুলি এজেন্ট টুলগুলিকে মডেল ছাড়াই চলতে দেয়

    ক্লাউড সিকিউরিটি অ্যালায়েন্সের একটি গবেষণা নোট CoreBreak বর্ণনা করে, অ্যামাজন বেডরক এজেন্টকোরের ত্রুটির একটি প্যাটার্ন, Google এর এজেন্ট ডেভেলপমেন্ট কিট, এবং Vercel এর AI SDK হারনেস প্যাকেজ যা টুলগুলিকে মডেল টার্ন ছাড়াই চালানোর অনুমতি দেয় — মডেল-স্তরের গার্ডেলগুলিকে দেখার কিছু নেই৷

    labs.cloudsecurityalliance.org
  5. নীতি6 min পড়া

    Anthropic বিশদ বিবরণ কিভাবে Claude এর টেক্সট ওয়াটারমার্ক কাজ করবে

    Anthropic বলছে ভবিষ্যতের Claude মডেলগুলি EU AI আইন মেনে চলার জন্য Google DeepMind-এর SynthID-টেক্সটের উপর ভিত্তি করে একটি পরিসংখ্যানগত ওয়াটারমার্ক এম্বেড করবে। সংস্থাটি বলে যে এটি কোনও অক্ষর, টোকেন বা ব্যবহারকারীর পরিচয় যোগ করে না - এবং একটি সম্পূর্ণ পুনর্লিখন এটিকে পরাজিত করে।

    anthropic.com
  6. শিল্প6 min পড়া

    কার্সার বলে স্পেসএক্স দ্বারা এর অধিগ্রহণ আনুষ্ঠানিকভাবে বন্ধ হয়ে গেছে

    কার্সার একটি সংক্ষিপ্ত পোস্ট প্রকাশ করেছে যে স্পেসএক্স এআই কোডিং টুলের অধিগ্রহণ সম্পন্ন করেছে, একটি প্রক্রিয়া শেষ করেছে যা এপ্রিল মাসে SpaceXAI এর সাথে মডেল-প্রশিক্ষণ অংশীদারিত্বের মাধ্যমে শুরু হয়েছিল। পোস্টটি বিশ্বের বৃহত্তম জিপিইউ বহর যাকে বলে তাতে অ্যাক্সেসের প্রতিশ্রুতি দেয়, তবে কোনও শর্ত, সময়সীমা বা পণ্যের পরিবর্তন প্রকাশ করে না।

    cursor.com
  7. উদ্ভাবন7 min পড়া

    নতুন বেঞ্চমার্ক AI এজেন্টদের খুঁজে পেয়েছে ভুলভাবে অনুমোদিত কাজের 28% সময় ব্লক করে

    একটি প্রিপ্রিন্ট স্টিয়ারবেঞ্চ-ওয়ার্কের সাথে পরিচয় করিয়ে দেয়, যে মুহূর্তে একজন এআই এজেন্ট কাজ করার বা পর্যালোচনার জন্য বিরতি দেওয়ার সিদ্ধান্ত নেয় সেই মুহূর্তের একটি 106-দৃশ্যক পরীক্ষা। 30টি মডেলের শর্ত জুড়ে, লেখকরা রিপোর্ট করেছেন যে ভুলভাবে ক্লিয়ার করা কাজ ধারণ করা ভুলভাবে অনিরাপদ কাজের অনুমতি দেওয়ার চেয়ে প্রায় 28 গুণ বেশি সাধারণ ছিল।

    arxiv.org
  8. উদ্ভাবন7 min পড়া

    কাগজ রিপোর্ট Frontier LLM বিচারক পুশব্যাকের অধীনে 25-71% ফ্লিপ রায়

    একটি নতুন arXiv প্রিপ্রিন্ট স্ট্রেস-পরীক্ষা করে স্বয়ংক্রিয় গ্রেডার হিসাবে ব্যবহৃত নয়টি সীমান্ত মডেল এবং রিপোর্ট করে যে তারা সকলেই চ্যালেঞ্জের অধীনে তাদের রায় পরিবর্তন করে — এবং পরিবর্তিত রায় সাধারণত সঠিক উত্তর থেকে দূরে সরে যায়, এর দিকে নয়।

    arxiv.org
  9. উদ্ভাবন7 min পড়া

    পেপার যুক্তি দেয় যে বিবর্তন কৌশলগুলি এলএলএম উত্তর সেটে বৈচিত্র্য বজায় রাখার ক্ষেত্রে RLকে পরাজিত করে

    একটি নতুন arXiv প্রিপ্রিন্ট যুক্তি দেয় যে বিবর্তন কৌশলগুলির সাথে প্রশিক্ষণ-পরবর্তী LLM - একটি জনসংখ্যা-ভিত্তিক, গ্রেডিয়েন্ট-মুক্ত পদ্ধতি যা ওজনকে সরাসরি বিরক্ত করে - pass@k এবং সমাধান কভারেজের উপর শক্তিবৃদ্ধি শিক্ষাকে হারায়। বিমূর্তটি আরও ভাল গণিত-বেঞ্চমার্ক ফলাফল উদ্ধৃত করে তবে কোনও মডেল, বেঞ্চমার্ক বা সংখ্যার নাম দেয় না।

    arxiv.org

প্রতি সপ্তাহে একটি দরকারী ব্রিফিং

ফিডে বসবাস না করে এআই-এর সাথে যোগাযোগ রাখুন।

সপ্তাহের যাচাইকৃত AI খবর, আসল ডেটা, দরকারী টুল, শেখার পছন্দ এবং নতুন AI চাকরি পান।

Send me
One email a week. Switch any time.

Reach people who are learning AI

একজন AI পেশাদার নিয়োগ করছেন বা একটি দরকারী AI পণ্য চালু করছেন? যারা এখানে শিখতে এবং অভিনয় করতে এসেছেন তাদের সামনে এটি রাখুন।

একটি AI চাকরি পোস্ট করুন একটি AI টুল জমা দিন