প্রতিদিন আপডেট করা হয়2391 যাচাইকৃত গল্প
এআই নিউজ। গোলমাল ছাড়া।
একটি অলাভজনক শিক্ষা দল দ্বারা সরল ইংরেজিতে ব্যাখ্যা করা পণ্য লঞ্চ, নীতি পরিবর্তন, নিরাপত্তা গবেষণা, এবং শিল্প পদক্ষেপের উৎস-চেক করা AI কভারেজ।
যাচাইকৃত সোর্সিং
প্রতিটি গল্প শক্তিশালী উপলব্ধ প্রমাণের সাথে লিঙ্ক করে: যখন উপলব্ধ মূল উত্স, অন্যথায় স্পষ্টভাবে দায়ী প্রতিবেদন।
সরল ইংরেজি
কি ঘটেছে, কেন এটা গুরুত্বপূর্ণ, এবং কি দেখতে হবে — শব্দবাক্য ছাড়া.
ফিলার নেই
যখন সংকেত পাতলা হয়, আমরা ফিড প্যাড করার পরিবর্তে কিছুই প্রকাশ করি না।
আরও গল্প
9 গল্পউদ্ভাবন
একটি OpenAI এআই-জেনারেটেড প্রমাণের অডিট একটি বিপরীত অবস্থা খুঁজে পায় এবং একটি মেরামত প্রকাশ করে
দু'জন গবেষক বলেছেন OpenAI এর গণিতের নথির অধ্যায় 6-এ একটি লেমা প্রমাণ একটি পোলারিটি ত্রুটি রয়েছে: গড় সাফল্যের পরিপ্রেক্ষিতে একটি পরীক্ষা যেখানে পরবর্তী ধাপে একটি বড় শর্তসাপেক্ষ ব্যর্থতার প্রয়োজন। তারা একটি পাল্টা উদাহরণ এবং একটি সংশোধিত প্রমাণ দেয় এবং সতর্ক করে যে এটি অধ্যায়ের মূল উপপাদ্যের যাচাই নয়।arxiv.orgউদ্ভাবন
রেপ্লিকেশন স্টাডি বলেছে যে FLOPগুলি এখনও AI রানটাইমকে ভুলভাবে অনুমান করে, এবং প্রস্তাবিত ফিক্স নতুন হার্ডওয়্যারে ব্যর্থ হয়
কেন সমান FLOP গণনা সমান কার্যকর করার সময় বোঝায় না তা নিয়ে দুই গবেষকের একটি প্রিপ্রিন্ট একটি পূর্ববর্তী গবেষণা পুনরুত্পাদন করে। এটি অন্তর্নিহিত দাবিকে নিশ্চিত করে কিন্তু রিপোর্ট করে যে α-FLOPs সংশোধন সূত্রটি সাধারণত নতুন হার্ডওয়্যারে রানটাইমকে অবমূল্যায়ন করে, যা সূত্রটি ক্যাপচার করে না লাফ এবং দোলন দেখায়।arxiv.orgএন্টারপ্রাইজ
বেঞ্চমার্ক পেপার 26% এর নিচে সমস্ত স্কোর এলএলএম সহ এন্টারপ্রাইজ ডেটা জিজ্ঞাসা করার চারটি উপায় খুঁজে পেয়েছে
একটি নতুন arXiv প্রিপ্রিন্ট একটি সিন্থেটিক দ্বিভাষিক বেঞ্চমার্কে একে অপরের বিরুদ্ধে এন্টারপ্রাইজ ডেটাবেসগুলির প্রাকৃতিক-ভাষা অনুসন্ধানের জন্য চারটি আর্কিটেকচারকে পিট করে। কেউই প্রায় এক চতুর্থাংশের বেশি ক্ষেত্রে সঠিকভাবে উত্তর দেয়নি এবং যে ডিজাইনটি সর্বোচ্চ স্কোর করেছে সেটি সবচেয়ে নিরাপদ বা সস্তা ছিল না।arxiv.orgউদ্ভাবন
কাগজ একটি শক্তিশালী মডেলের অভিসারী পরিমাপ করে লেবেল ছাড়া AI নিরাপত্তা এজেন্টদের গ্রেড করার প্রস্তাব দেয়
একটি নতুন arXiv প্রিপ্রিন্ট যুক্তি দেয় যে নিরাপত্তা দল বিচার করতে পারে যে একটি মেমরি- বা পুনরুদ্ধার-সজ্জিত AI এজেন্ট শিখছে কিনা তা পরিমাপ করে কতদূর এটি একটি শক্তিশালী "শিক্ষক" মডেলের ফাঁক বন্ধ করে, লেবেলযুক্ত বেঞ্চমার্কের পরিবর্তে যা প্রায়শই দুর্লভ বা বাসি। একইভাবে চালিত মডেল দ্বারা বিচার করা কোন ব্যবহারযোগ্য সংকেত দেয়নি।arxiv.orgউদ্ভাবন
নতুন বেঞ্চমার্ক পরীক্ষা করে যে এআই সহকারীরা ফোন ব্যবহারের এক বছর মনে রাখতে পারে কিনা
arXiv-এ পোস্ট করা একটি 17-লেখকের প্রযুক্তিগত প্রতিবেদন মোবাইলমেমের পরিচয় দেয়, মোবাইল অভিজ্ঞতার এক বছরের স্কেল সংগ্রহ থেকে তৈরি অন-ডিভাইস দীর্ঘমেয়াদী মেমরির জন্য একটি বেঞ্চমার্ক এবং ফ্রেমওয়ার্ক। বিমূর্ত নকশা বর্ণনা করে কিন্তু কোনো স্কোর রিপোর্ট করে না, এবং অন্তর্নিহিত ডেটা সম্পর্কে মূল বিবরণ অপ্রকাশিত থাকে।arxiv.orgউদ্ভাবন
কাগজ রিপোর্ট মস্তিষ্কের মত মডুলার সংগঠন বড় ভাষার মডেলের ভিতরে উদীয়মান
একটি নতুন arXiv প্রিপ্রিন্ট বলে যে বড় ভাষার মডেলগুলি কার্যকরীভাবে বিশেষায়িত অভ্যন্তরীণ কাঠামো তৈরি করে যা চারটি জ্ঞানীয় ডোমেনে 46টি কাজ জুড়ে সার্কিট বিশ্লেষণের উপর ভিত্তি করে স্বতন্ত্র মানব মস্তিষ্কের নেটওয়ার্কগুলির সাথে লাইন আপ করে। বিমূর্ত পৃষ্ঠাটি মূল পদ্ধতিগত বিবরণ অব্যক্ত রেখে দেয়।arxiv.orgউদ্ভাবন
কাগজ একটি বিশেষজ্ঞের মিশ্রণের দেরী স্তর খুঁজে বের করে মডেল ভারী বিশেষজ্ঞ মাস্কিং সহ্য করে
একটি প্রিপ্রিন্ট রিপোর্ট করে যে 35-বিলিয়ন-প্যারামিটার মিক্সচার-অফ-এক্সপার্টস মডেলের শেষ পাঁচটি স্তরে কম মাত্রার বিশেষজ্ঞদের নিষ্ক্রিয় করা সমস্ত স্তরে একই কাট ছড়িয়ে দেওয়ার চেয়ে অনেক বেশি ব্যবহারযোগ্য কোড-অনুবাদ আউটপুট সংরক্ষণ করেছে। এটি একটি মডেল এবং একটি বেঞ্চমার্ক কভার করে, এবং বিমূর্ত কোন মুখোশহীন বেসলাইন রিপোর্ট করে না।arxiv.orgনিরাপত্তা
কোরব্রেক ত্রুটিগুলি এজেন্ট টুলগুলিকে মডেল ছাড়াই চলতে দেয়
ক্লাউড সিকিউরিটি অ্যালায়েন্সের একটি গবেষণা নোট CoreBreak বর্ণনা করে, অ্যামাজন বেডরক এজেন্টকোরের ত্রুটির একটি প্যাটার্ন, Google এর এজেন্ট ডেভেলপমেন্ট কিট, এবং Vercel এর AI SDK হারনেস প্যাকেজ যা টুলগুলিকে মডেল টার্ন ছাড়াই চালানোর অনুমতি দেয় — মডেল-স্তরের গার্ডেলগুলিকে দেখার কিছু নেই৷labs.cloudsecurityalliance.orgনীতি
Anthropic বিশদ বিবরণ কিভাবে Claude এর টেক্সট ওয়াটারমার্ক কাজ করবে
Anthropic বলছে ভবিষ্যতের Claude মডেলগুলি EU AI আইন মেনে চলার জন্য Google DeepMind-এর SynthID-টেক্সটের উপর ভিত্তি করে একটি পরিসংখ্যানগত ওয়াটারমার্ক এম্বেড করবে। সংস্থাটি বলে যে এটি কোনও অক্ষর, টোকেন বা ব্যবহারকারীর পরিচয় যোগ করে না - এবং একটি সম্পূর্ণ পুনর্লিখন এটিকে পরাজিত করে।
anthropic.com
প্রতি সপ্তাহে একটি দরকারী ব্রিফিং
ফিডে বসবাস না করে এআই-এর সাথে যোগাযোগ রাখুন।
সপ্তাহের যাচাইকৃত AI খবর, আসল ডেটা, দরকারী টুল, শেখার পছন্দ এবং নতুন AI চাকরি পান।
যারা এআই শিখছেন তাদের কাছে পৌঁছান
একজন AI পেশাদার নিয়োগ করছেন বা একটি দরকারী AI পণ্য চালু করছেন? যারা এখানে শিখতে এবং অভিনয় করতে এসেছেন তাদের সামনে এটি রাখুন।
একটি AI চাকরি পোস্ট করুনএকটি AI টুল জমা দিন