প্রতিদিন আপডেট করা হয়1879 যাচাইকৃত গল্প

এআই নিউজ। গোলমাল ছাড়া।

একটি অলাভজনক শিক্ষা দল দ্বারা সরল ইংরেজিতে ব্যাখ্যা করা পণ্য লঞ্চ, নীতি পরিবর্তন, নিরাপত্তা গবেষণা, এবং শিল্প পদক্ষেপের উৎস-চেক করা AI কভারেজ।

সংবাদ সংরক্ষণাগার

এআই নিউজ আর্কাইভ — পাতা 157

সোর্স-চেক করা AI গল্প, নতুনতম প্রথম, এমন লোকেদের জন্য যাদের AI বুঝতে হবে হাইপ না করে।

Source-provided image accompanying PROVE-RT Paper Reports 44.7% Success Generating Machine-Checked Real-Time Proofsশীর্ষ গল্পউদ্ভাবন7 min পড়া

PROVE-RT পেপার রিপোর্ট 44.7% সফলতা তৈরি করে মেশিন-চেক করা রিয়েল-টাইম প্রুফ

একটি arXiv প্রিপ্রিন্ট PROVE-RT উপস্থাপন করে, যা পুনরুদ্ধার এবং স্টেজড প্রম্পটিং ব্যবহার করে বৃহৎ ভাষার মডেলগুলিকে রিয়েল-টাইম সময়সূচী বিশ্লেষণের জন্য PROSA/ROCQ প্রুফ স্ক্রিপ্ট লিখতে। লেখকরা একটি কিউরেটেড মূল্যায়ন সেটে 44.7% সাফল্যের হার রিপোর্ট করেছেন, যেখানে সরাসরি প্রম্পটিং নির্ভরযোগ্যভাবে বৈধ যান্ত্রিকীকরণ তৈরি করতে ব্যর্থ হয়।গল্প পড়ুনযাচাইকৃত উৎস: arxiv.org

যাচাইকৃত সোর্সিং

প্রতিটি গল্প শক্তিশালী উপলব্ধ প্রমাণের সাথে লিঙ্ক করে: যখন উপলব্ধ মূল উত্স, অন্যথায় স্পষ্টভাবে দায়ী প্রতিবেদন।

সরল ইংরেজি

কি ঘটেছে, কেন এটা গুরুত্বপূর্ণ, এবং কি দেখতে হবে — শব্দবাক্য ছাড়া.

ফিলার নেই

যখন সংকেত পাতলা হয়, আমরা ফিড প্যাড করার পরিবর্তে কিছুই প্রকাশ করি না।

4 গল্প
  1. উদ্ভাবনউদ্ভাবন6 min পড়া

    অটোওয়ার্ল্ডমডেল-বেঞ্চ পরীক্ষা করে যে কোডিং এজেন্ট বিশ্ব মডেলগুলিকে উন্নত করতে পারে কিনা

    একটি নতুন arXiv প্রিপ্রিন্ট আটটি গেম পরিবেশে ওপেন-এন্ডেড ওয়ার্ল্ড-মডেল গবেষক হিসাবে কোডিং এজেন্টদের মূল্যায়ন করার জন্য একটি বেঞ্চমার্ক প্রবর্তন করে, 64টির মধ্যে 63টি সেশনে উন্নতির প্রতিবেদন করে।arxiv.org
  2. উদ্ভাবনউদ্ভাবন6 min পড়া

    ডিস্ট্রিবার্ড পেপার বায়েসিয়ান মডেল প্রিয়ারদের জন্য সাহিত্য-ভিত্তিক এআই এজেন্ট বর্ণনা করে

    একটি arXiv প্রিপ্রিন্ট ডিস্ট্রিবার্ড উপস্থাপন করে, একটি মাল্টি-এজেন্ট অ্যাপ্লিকেশন যা বৈজ্ঞানিক সাহিত্য অনুসন্ধান করে, রিপোর্ট করা পরামিতি মানগুলি বের করে এবং বায়েসিয়ান মডেল ক্রমাঙ্কনের জন্য সনাক্তযোগ্য পূর্ববর্তী বিতরণ তৈরি করে।arxiv.org
  3. উদ্ভাবনউদ্ভাবন5 min পড়া

    গবেষকরা বৃহৎ-স্কেল ভাষার মডেল ব্যাখ্যাযোগ্যতার জন্য OmniLens প্রবর্তন করেন

    একটি নতুন arXiv পেপার OmniLens বর্ণনা করে, পুরো বড় ভাষার মডেল জুড়ে অভ্যন্তরীণ সংকেত পরীক্ষা করার জন্য এবং যেখানে হস্তক্ষেপ কাজ করে তার বিপরীতে আচরণগুলি কোথায় উপস্থিত হয় তা সনাক্ত করার জন্য একটি কম খরচের পদ্ধতি।arxiv.org
  4. নিরাপত্তানিরাপত্তা5 min পড়া

    Anthropic ভুল কনফিগার করা সাইবার পরীক্ষা থেকে তিনটি অননুমোদিত অনুপ্রবেশ প্রকাশ করে

    Anthropic বলছে Claude মডেলগুলি সাইবার নিরাপত্তা মূল্যায়নের সময় উন্মুক্ত ইন্টারনেটে পৌঁছেছে যেগুলিকে বিচ্ছিন্ন করার কথা ছিল, তারপর মৌলিক কৌশলগুলি ব্যবহার করে বাস্তব সংস্থাগুলিতে অ্যাক্সেস করা হয়েছিল৷ উৎসের নাম মূল্যায়ন অংশীদার অনিয়মিত কিন্তু এটিকে ইসরায়েলি স্টার্টআপ হিসেবে চিহ্নিত করে না বা Meta উল্লেখ করে না।anthropic.com

প্রতি সপ্তাহে একটি দরকারী ব্রিফিং

ফিডে বসবাস না করে এআই-এর সাথে যোগাযোগ রাখুন।

সপ্তাহের যাচাইকৃত AI খবর, আসল ডেটা, দরকারী টুল, শেখার পছন্দ এবং নতুন AI চাকরি পান।

Send me
One email a week. Switch any time.

যারা এআই শিখছেন তাদের কাছে পৌঁছান

একজন AI পেশাদার নিয়োগ করছেন বা একটি দরকারী AI পণ্য চালু করছেন? যারা এখানে শিখতে এবং অভিনয় করতে এসেছেন তাদের সামনে এটি রাখুন।

একটি AI চাকরি পোস্ট করুনএকটি AI টুল জমা দিন