প্রতিদিন আপডেট করা হয়1873 যাচাইকৃত গল্প

এআই নিউজ। গোলমাল ছাড়া।

একটি অলাভজনক শিক্ষা দল দ্বারা সরল ইংরেজিতে ব্যাখ্যা করা পণ্য লঞ্চ, নীতি পরিবর্তন, নিরাপত্তা গবেষণা, এবং শিল্প পদক্ষেপের উৎস-চেক করা AI কভারেজ।

সংবাদ সংরক্ষণাগার

এআই নিউজ আর্কাইভ — পাতা 156

সোর্স-চেক করা AI গল্প, নতুনতম প্রথম, এমন লোকেদের জন্য যাদের AI বুঝতে হবে হাইপ না করে।

Source-provided image accompanying Paper Reports Frontier LLM Judges Flip Verdicts 25-71% Under Pushbackশীর্ষ গল্পউদ্ভাবন7 min পড়া

কাগজ রিপোর্ট Frontier LLM বিচারক পুশব্যাকের অধীনে 25-71% ফ্লিপ রায়

একটি নতুন arXiv প্রিপ্রিন্ট স্ট্রেস-পরীক্ষা করে স্বয়ংক্রিয় গ্রেডার হিসাবে ব্যবহৃত নয়টি সীমান্ত মডেল এবং রিপোর্ট করে যে তারা সকলেই চ্যালেঞ্জের অধীনে তাদের রায় পরিবর্তন করে — এবং পরিবর্তিত রায় সাধারণত সঠিক উত্তর থেকে দূরে সরে যায়, এর দিকে নয়।গল্প পড়ুনযাচাইকৃত উৎস: arxiv.org

যাচাইকৃত সোর্সিং

প্রতিটি গল্প শক্তিশালী উপলব্ধ প্রমাণের সাথে লিঙ্ক করে: যখন উপলব্ধ মূল উত্স, অন্যথায় স্পষ্টভাবে দায়ী প্রতিবেদন।

সরল ইংরেজি

কি ঘটেছে, কেন এটা গুরুত্বপূর্ণ, এবং কি দেখতে হবে — শব্দবাক্য ছাড়া.

ফিলার নেই

যখন সংকেত পাতলা হয়, আমরা ফিড প্যাড করার পরিবর্তে কিছুই প্রকাশ করি না।

9 গল্প
  1. নিরাপত্তানিরাপত্তা6 min পড়া

    SEAG পেপার RAG কোয়েরিগুলি বহিরাগত LLM-এ পৌঁছানোর আগে সংবেদনশীল সত্ত্বাগুলির নামকরণের প্রস্তাব করে

    arXiv-এ পোস্ট করা একটি প্রিপ্রিন্ট একটি ফ্রেমওয়ার্ক বর্ণনা করে যা তৃতীয় পক্ষের মডেলে পাঠানোর আগে কোয়েরিতে সংবেদনশীল নাম অদলবদল করে এবং উপনামের জন্য নথি উদ্ধার করে। লেখকরা তাদের এন্ড-টু-এন্ড ইউজার মেট্রিকের উপর 80% নির্ভুলতা এবং তিনটি ছোট মডেল জুড়ে 74.91% এবং 77.83% এর মধ্যে সম্পূর্ণ-গোপন হার রিপোর্ট করেছেন।arxiv.org
  2. উদ্ভাবনউদ্ভাবন6 min পড়া

    CABS+ পেপার রিপোর্ট সস্তা, দ্রুত মডেল 27 ডেটাসেট জুড়ে মার্জিং

    arXiv-এ পোস্ট করা একটি প্রিপ্রিন্ট CABS+ বর্ণনা করে, একটি মডেল-মার্জিং পদ্ধতি যা গ্রিড অনুসন্ধানকে গ্রেডিয়েন্ট-মুক্ত সহগ অনুসন্ধানের সাথে প্রতিস্থাপন করে। লেখকরা একটি বেসলাইনের জিপিইউ মেমরির এক চতুর্থাংশের নিচে এবং অন্যটির তুলনায় মোটামুটি 4x স্পিডআপ দুটি বেসলাইনের উপর দ্বিগুণ-অঙ্কের কর্মক্ষমতা লাভের রিপোর্ট করেছেন।arxiv.org
  3. উদ্ভাবনউদ্ভাবন6 min পড়া

    কাগজ হিমায়িত দৃষ্টি-ভাষা মডেলগুলিতে স্থানিক যুক্তির উন্নতি করার জন্য পুনরুদ্ধার করা "পাঠ" প্রস্তাব করে

    একটি arXiv প্রিপ্রিন্ট স্থানিক মেমরি এজেন্টকে বর্ণনা করে, যা অনুমানের সময়ে পুনরুদ্ধার করা পাঠ্য পাঠ হিসাবে যাচাইকৃত অভিজ্ঞতা সঞ্চয় করে, মডেল ওজন পরিবর্তন না করে পাঁচটি স্থানিক বেঞ্চমার্ক এবং চারটি দৃষ্টি-ভাষা মডেল জুড়ে লাভের দাবি করে। এটি পর্যালোচনা করা হচ্ছে; এর বিমূর্ত নাম কোন বেঞ্চমার্ক, বেস মডেল বা মার্জিন নেই।arxiv.org
  4. উদ্ভাবনউদ্ভাবন7 min পড়া

    PROVE-RT পেপার রিপোর্ট 44.7% সফলতা তৈরি করে মেশিন-চেক করা রিয়েল-টাইম প্রুফ

    একটি arXiv প্রিপ্রিন্ট PROVE-RT উপস্থাপন করে, যা পুনরুদ্ধার এবং স্টেজড প্রম্পটিং ব্যবহার করে বৃহৎ ভাষার মডেলগুলিকে রিয়েল-টাইম সময়সূচী বিশ্লেষণের জন্য PROSA/ROCQ প্রুফ স্ক্রিপ্ট লিখতে। লেখকরা একটি কিউরেটেড মূল্যায়ন সেটে 44.7% সাফল্যের হার রিপোর্ট করেছেন, যেখানে সরাসরি প্রম্পটিং নির্ভরযোগ্যভাবে বৈধ যান্ত্রিকীকরণ তৈরি করতে ব্যর্থ হয়।arxiv.org
  5. নীতিনীতি6 min পড়া

    ওয়ার্কিং পেপার জিজ্ঞাসা করে যে ভারতের ভোক্তা আইন এআই ক্ষতি কভার করতে পারে কিনা

    একটি নতুন arXiv ওয়ার্কিং পেপার যুক্তি দেয় যে ভারতের ভোক্তা সুরক্ষা আইন, 2019 নীতিগতভাবে এআই-সম্পর্কিত ক্ষতিতে পৌঁছানোর জন্য যথেষ্ট বিস্তৃত, তবে AI সরবরাহ শৃঙ্খল জুড়ে কার্যকারণ প্রমাণ করা এবং দোষারোপ করা অমীমাংসিত রয়ে গেছে। শুধুমাত্র বিমূর্ত এখানে সর্বজনীনভাবে সংক্ষিপ্ত করা হয়েছে; কাগজ সমকক্ষ পর্যালোচনা করা হয় না.arxiv.org
  6. উদ্ভাবনউদ্ভাবন6 min পড়া

    অ্যাপল পেপার লো-ইনফ্লুয়েন্স ডেটা বাদ দিয়ে সস্তা মেশিন আনলার্নিংয়ের প্রস্তাব করে

    একটি অ্যাপল মেশিন লার্নিং রিসার্চ পেপার যুক্তি দেয় যে মুছে ফেলার অনুরোধের প্রতিটি ডেটা পয়েন্ট সক্রিয় অপসারণের প্রয়োজন হয় না। ভাষা এবং ভিশন টাস্ক জুড়ে প্রভাব ফাংশন ব্যবহার করে, লেখক বলেছেন কম-প্রভাব উদাহরণগুলি ভুলে যাওয়া সেট থেকে বাদ দেওয়া যেতে পারে, প্রায় 50 শতাংশ পর্যন্ত অশিক্ষার কম্পিউট কাটা যায়।machinelearning.apple.com
  7. উদ্ভাবনউদ্ভাবন6 min পড়া

    অটোওয়ার্ল্ডমডেল-বেঞ্চ পরীক্ষা করে যে কোডিং এজেন্ট বিশ্ব মডেলগুলিকে উন্নত করতে পারে কিনা

    একটি নতুন arXiv প্রিপ্রিন্ট আটটি গেম পরিবেশে ওপেন-এন্ডেড ওয়ার্ল্ড-মডেল গবেষক হিসাবে কোডিং এজেন্টদের মূল্যায়ন করার জন্য একটি বেঞ্চমার্ক প্রবর্তন করে, 64টির মধ্যে 63টি সেশনে উন্নতির প্রতিবেদন করে।arxiv.org
  8. উদ্ভাবনউদ্ভাবন6 min পড়া

    ডিস্ট্রিবার্ড পেপার বায়েসিয়ান মডেল প্রিয়ারদের জন্য সাহিত্য-ভিত্তিক এআই এজেন্ট বর্ণনা করে

    একটি arXiv প্রিপ্রিন্ট ডিস্ট্রিবার্ড উপস্থাপন করে, একটি মাল্টি-এজেন্ট অ্যাপ্লিকেশন যা বৈজ্ঞানিক সাহিত্য অনুসন্ধান করে, রিপোর্ট করা পরামিতি মানগুলি বের করে এবং বায়েসিয়ান মডেল ক্রমাঙ্কনের জন্য সনাক্তযোগ্য পূর্ববর্তী বিতরণ তৈরি করে।arxiv.org
  9. উদ্ভাবনউদ্ভাবন5 min পড়া

    গবেষকরা বৃহৎ-স্কেল ভাষার মডেল ব্যাখ্যাযোগ্যতার জন্য OmniLens প্রবর্তন করেন

    একটি নতুন arXiv পেপার OmniLens বর্ণনা করে, পুরো বড় ভাষার মডেল জুড়ে অভ্যন্তরীণ সংকেত পরীক্ষা করার জন্য এবং যেখানে হস্তক্ষেপ কাজ করে তার বিপরীতে আচরণগুলি কোথায় উপস্থিত হয় তা সনাক্ত করার জন্য একটি কম খরচের পদ্ধতি।arxiv.org

প্রতি সপ্তাহে একটি দরকারী ব্রিফিং

ফিডে বসবাস না করে এআই-এর সাথে যোগাযোগ রাখুন।

সপ্তাহের যাচাইকৃত AI খবর, আসল ডেটা, দরকারী টুল, শেখার পছন্দ এবং নতুন AI চাকরি পান।

Send me
One email a week. Switch any time.

যারা এআই শিখছেন তাদের কাছে পৌঁছান

একজন AI পেশাদার নিয়োগ করছেন বা একটি দরকারী AI পণ্য চালু করছেন? যারা এখানে শিখতে এবং অভিনয় করতে এসেছেন তাদের সামনে এটি রাখুন।

একটি AI চাকরি পোস্ট করুনএকটি AI টুল জমা দিন