প্রতিদিন আপডেট করা হয়2391 যাচাইকৃত গল্প

এআই নিউজ। গোলমাল ছাড়া।

একটি অলাভজনক শিক্ষা দল দ্বারা সরল ইংরেজিতে ব্যাখ্যা করা পণ্য লঞ্চ, নীতি পরিবর্তন, নিরাপত্তা গবেষণা, এবং শিল্প পদক্ষেপের উৎস-চেক করা AI কভারেজ।

সংবাদ সংরক্ষণাগার

এআই নিউজ আর্কাইভ — পাতা 198

সোর্স-চেক করা AI গল্প, নতুনতম প্রথম, এমন লোকেদের জন্য যাদের AI বুঝতে হবে হাইপ না করে।

Source-provided image accompanying Warp Opens Early Access to "Factories," a Config-as-Code System for Running Fleets of Coding Agentsশীর্ষ গল্পপণ্য7 min পড়া

ওয়ার্প কোডিং এজেন্টদের ফ্লিট চালানোর জন্য একটি কনফিগার-এ-কোড সিস্টেম "ফ্যাক্টরিগুলিতে" প্রাথমিক অ্যাক্সেস খোলে

Warp ওয়ার্প ফ্যাক্টরিগুলির জন্য প্রাথমিক-অ্যাক্সেসের অনুরোধ নিচ্ছে, যা কোডিং এজেন্টদের ফ্লিটকে কোড হিসাবে সংজ্ঞায়িত করে - CLI, API, SDK এবং MCP দ্বারা চালিত একটি YAML ফাইলে রেপো, মডেল, অনুমতি এবং মানব চেকপয়েন্ট। এর অটোমেশন এবং খরচ পরিসংখ্যান বিক্রেতা দাবি: কোন মূল্য, সাধারণ প্রাপ্যতা তারিখ বা স্বাধীন পরীক্ষা.গল্প পড়ুনযাচাইকৃত উৎস: warp.dev

যাচাইকৃত সোর্সিং

প্রতিটি গল্প শক্তিশালী উপলব্ধ প্রমাণের সাথে লিঙ্ক করে: যখন উপলব্ধ মূল উত্স, অন্যথায় স্পষ্টভাবে দায়ী প্রতিবেদন।

সরল ইংরেজি

কি ঘটেছে, কেন এটা গুরুত্বপূর্ণ, এবং কি দেখতে হবে — শব্দবাক্য ছাড়া.

ফিলার নেই

যখন সংকেত পাতলা হয়, আমরা ফিড প্যাড করার পরিবর্তে কিছুই প্রকাশ করি না।

9 গল্প
  1. উদ্ভাবনউদ্ভাবন7 min পড়া

    একটি OpenAI এআই-জেনারেটেড প্রমাণের অডিট একটি বিপরীত অবস্থা খুঁজে পায় এবং একটি মেরামত প্রকাশ করে

    দু'জন গবেষক বলেছেন OpenAI এর গণিতের নথির অধ্যায় 6-এ একটি লেমা প্রমাণ একটি পোলারিটি ত্রুটি রয়েছে: গড় সাফল্যের পরিপ্রেক্ষিতে একটি পরীক্ষা যেখানে পরবর্তী ধাপে একটি বড় শর্তসাপেক্ষ ব্যর্থতার প্রয়োজন। তারা একটি পাল্টা উদাহরণ এবং একটি সংশোধিত প্রমাণ দেয় এবং সতর্ক করে যে এটি অধ্যায়ের মূল উপপাদ্যের যাচাই নয়।arxiv.org
  2. উদ্ভাবনউদ্ভাবন7 min পড়া

    রেপ্লিকেশন স্টাডি বলেছে যে FLOPগুলি এখনও AI রানটাইমকে ভুলভাবে অনুমান করে, এবং প্রস্তাবিত ফিক্স নতুন হার্ডওয়্যারে ব্যর্থ হয়

    কেন সমান FLOP গণনা সমান কার্যকর করার সময় বোঝায় না তা নিয়ে দুই গবেষকের একটি প্রিপ্রিন্ট একটি পূর্ববর্তী গবেষণা পুনরুত্পাদন করে। এটি অন্তর্নিহিত দাবিকে নিশ্চিত করে কিন্তু রিপোর্ট করে যে α-FLOPs সংশোধন সূত্রটি সাধারণত নতুন হার্ডওয়্যারে রানটাইমকে অবমূল্যায়ন করে, যা সূত্রটি ক্যাপচার করে না লাফ এবং দোলন দেখায়।arxiv.org
  3. এন্টারপ্রাইজএন্টারপ্রাইজ6 min পড়া

    বেঞ্চমার্ক পেপার 26% এর নিচে সমস্ত স্কোর এলএলএম সহ এন্টারপ্রাইজ ডেটা জিজ্ঞাসা করার চারটি উপায় খুঁজে পেয়েছে

    একটি নতুন arXiv প্রিপ্রিন্ট একটি সিন্থেটিক দ্বিভাষিক বেঞ্চমার্কে একে অপরের বিরুদ্ধে এন্টারপ্রাইজ ডেটাবেসগুলির প্রাকৃতিক-ভাষা অনুসন্ধানের জন্য চারটি আর্কিটেকচারকে পিট করে। কেউই প্রায় এক চতুর্থাংশের বেশি ক্ষেত্রে সঠিকভাবে উত্তর দেয়নি এবং যে ডিজাইনটি সর্বোচ্চ স্কোর করেছে সেটি সবচেয়ে নিরাপদ বা সস্তা ছিল না।arxiv.org
  4. উদ্ভাবনউদ্ভাবন7 min পড়া

    কাগজ একটি শক্তিশালী মডেলের অভিসারী পরিমাপ করে লেবেল ছাড়া AI নিরাপত্তা এজেন্টদের গ্রেড করার প্রস্তাব দেয়

    একটি নতুন arXiv প্রিপ্রিন্ট যুক্তি দেয় যে নিরাপত্তা দল বিচার করতে পারে যে একটি মেমরি- বা পুনরুদ্ধার-সজ্জিত AI এজেন্ট শিখছে কিনা তা পরিমাপ করে কতদূর এটি একটি শক্তিশালী "শিক্ষক" মডেলের ফাঁক বন্ধ করে, লেবেলযুক্ত বেঞ্চমার্কের পরিবর্তে যা প্রায়শই দুর্লভ বা বাসি। একইভাবে চালিত মডেল দ্বারা বিচার করা কোন ব্যবহারযোগ্য সংকেত দেয়নি।arxiv.org
  5. উদ্ভাবনউদ্ভাবন7 min পড়া

    নতুন বেঞ্চমার্ক পরীক্ষা করে যে এআই সহকারীরা ফোন ব্যবহারের এক বছর মনে রাখতে পারে কিনা

    arXiv-এ পোস্ট করা একটি 17-লেখকের প্রযুক্তিগত প্রতিবেদন মোবাইলমেমের পরিচয় দেয়, মোবাইল অভিজ্ঞতার এক বছরের স্কেল সংগ্রহ থেকে তৈরি অন-ডিভাইস দীর্ঘমেয়াদী মেমরির জন্য একটি বেঞ্চমার্ক এবং ফ্রেমওয়ার্ক। বিমূর্ত নকশা বর্ণনা করে কিন্তু কোনো স্কোর রিপোর্ট করে না, এবং অন্তর্নিহিত ডেটা সম্পর্কে মূল বিবরণ অপ্রকাশিত থাকে।arxiv.org
  6. উদ্ভাবনউদ্ভাবন7 min পড়া

    কাগজ রিপোর্ট মস্তিষ্কের মত মডুলার সংগঠন বড় ভাষার মডেলের ভিতরে উদীয়মান

    একটি নতুন arXiv প্রিপ্রিন্ট বলে যে বড় ভাষার মডেলগুলি কার্যকরীভাবে বিশেষায়িত অভ্যন্তরীণ কাঠামো তৈরি করে যা চারটি জ্ঞানীয় ডোমেনে 46টি কাজ জুড়ে সার্কিট বিশ্লেষণের উপর ভিত্তি করে স্বতন্ত্র মানব মস্তিষ্কের নেটওয়ার্কগুলির সাথে লাইন আপ করে। বিমূর্ত পৃষ্ঠাটি মূল পদ্ধতিগত বিবরণ অব্যক্ত রেখে দেয়।arxiv.org
  7. উদ্ভাবনউদ্ভাবন7 min পড়া

    কাগজ একটি বিশেষজ্ঞের মিশ্রণের দেরী স্তর খুঁজে বের করে মডেল ভারী বিশেষজ্ঞ মাস্কিং সহ্য করে

    একটি প্রিপ্রিন্ট রিপোর্ট করে যে 35-বিলিয়ন-প্যারামিটার মিক্সচার-অফ-এক্সপার্টস মডেলের শেষ পাঁচটি স্তরে কম মাত্রার বিশেষজ্ঞদের নিষ্ক্রিয় করা সমস্ত স্তরে একই কাট ছড়িয়ে দেওয়ার চেয়ে অনেক বেশি ব্যবহারযোগ্য কোড-অনুবাদ আউটপুট সংরক্ষণ করেছে। এটি একটি মডেল এবং একটি বেঞ্চমার্ক কভার করে, এবং বিমূর্ত কোন মুখোশহীন বেসলাইন রিপোর্ট করে না।arxiv.org
  8. নিরাপত্তানিরাপত্তা7 min পড়া

    কোরব্রেক ত্রুটিগুলি এজেন্ট টুলগুলিকে মডেল ছাড়াই চলতে দেয়

    ক্লাউড সিকিউরিটি অ্যালায়েন্সের একটি গবেষণা নোট CoreBreak বর্ণনা করে, অ্যামাজন বেডরক এজেন্টকোরের ত্রুটির একটি প্যাটার্ন, Google এর এজেন্ট ডেভেলপমেন্ট কিট, এবং Vercel এর AI SDK হারনেস প্যাকেজ যা টুলগুলিকে মডেল টার্ন ছাড়াই চালানোর অনুমতি দেয় — মডেল-স্তরের গার্ডেলগুলিকে দেখার কিছু নেই৷labs.cloudsecurityalliance.org
  9. নীতিনীতি6 min পড়া

    Anthropic বিশদ বিবরণ কিভাবে Claude এর টেক্সট ওয়াটারমার্ক কাজ করবে

    Anthropic বলছে ভবিষ্যতের Claude মডেলগুলি EU AI আইন মেনে চলার জন্য Google DeepMind-এর SynthID-টেক্সটের উপর ভিত্তি করে একটি পরিসংখ্যানগত ওয়াটারমার্ক এম্বেড করবে। সংস্থাটি বলে যে এটি কোনও অক্ষর, টোকেন বা ব্যবহারকারীর পরিচয় যোগ করে না - এবং একটি সম্পূর্ণ পুনর্লিখন এটিকে পরাজিত করে।anthropic.com

প্রতি সপ্তাহে একটি দরকারী ব্রিফিং

ফিডে বসবাস না করে এআই-এর সাথে যোগাযোগ রাখুন।

সপ্তাহের যাচাইকৃত AI খবর, আসল ডেটা, দরকারী টুল, শেখার পছন্দ এবং নতুন AI চাকরি পান।

Send me
One email a week. Switch any time.

যারা এআই শিখছেন তাদের কাছে পৌঁছান

একজন AI পেশাদার নিয়োগ করছেন বা একটি দরকারী AI পণ্য চালু করছেন? যারা এখানে শিখতে এবং অভিনয় করতে এসেছেন তাদের সামনে এটি রাখুন।

একটি AI চাকরি পোস্ট করুনএকটি AI টুল জমা দিন