በየቀኑ ይዘምናል።1821 የተረጋገጡ ታሪኮች

AI ዜና.ያለ ጫጫታ።

በምንጭ የተረጋገጠ የኤአይአይ ሽፋን የምርት ጅምር፣ የፖሊሲ ሽግግሮች፣ የደህንነት ጥናት እና የኢንዱስትሪ እንቅስቃሴዎች፣ ለትርፍ ያልተቋቋመ የትምህርት ቡድን በግልፅ እንግሊዝኛ ተብራርቷል።

የተረጋገጠ ምንጭ

እያንዳንዱ ታሪክ በጣም ጠንካራ ከሆኑ ማስረጃዎች ጋር ይገናኛል፡ ኦሪጅናል ምንጮች ሲገኝ፣ ያለበለዚያ በግልጽ ከተመዘገበ ሪፖርት።

ግልጽ እንግሊዝኛ

ምን እንደተከሰተ ፣ ለምን አስፈላጊ ነው ፣ እና ምን መታየት እንዳለበት - ያለ ጃርጎን።

ምንም መሙያ የለም።

ምልክቱ ቀጭን ሲሆን ምግቡን ከማሸግ ይልቅ ምንም ነገር አናተምም።

የዜና መዝገብ

AI የዜና መዝገብ — ገጽ 151

ምንጭ-የተፈተሸ የኤአይ ታሪኮች፣ በጣም አዲስ መጀመሪያ፣ አበረታች ሳታሳድዱ AI መረዳት ለሚያስፈልጋቸው ሰዎች።

Source-provided image accompanying Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Modelዋና ታሪክ
ፈጠራ7 min አንብብ
ፈጠራ7 min አንብብ

Paper Proposes Grading AI Security Agents Without Labels by Measuring Convergence to a Stronger Model

A new arXiv preprint argues security teams can judge whether a memory- or retrieval-equipped AI agent is learning by measuring how far it closes the gap to a stronger "teacher" model, rather than on labeled benchmarks that are often scarce or stale. Judging by a similarly powered model gave no usable signal.

ታሪክ አንብብ የተረጋገጠ ምንጭ: arxiv.org
9 ታሪኮች
  1. ፖሊሲ6 min አንብብ

    Anthropic የClaude የጽሁፍ ዉተርማርክ እንዴት እንደሚሰራ ዝርዝሮች

    Anthropic የወደፊቱ Claude ሞዴሎች የአውሮፓ ህብረት AI ህግን ለማክበር በGoogle DeepMind's SynthID-Text ላይ የተመሰረተ ስታቲስቲካዊ የውሃ ምልክትን ይከተላሉ ይላል። ኩባንያው ምንም ቁምፊዎች፣ ቶከኖች ወይም የተጠቃሚ መለያ እንደማይጨምር ተናግሯል - እና ሙሉ በሙሉ እንደገና መፃፍ ያሸነፈዋል።

    anthropic.com
  2. ኢንዱስትሪ6 min አንብብ

    ጠቋሚ በSpaceX ማግኘቱ በይፋ መዘጋቱን ተናግሯል።

    Cursor ስፔስኤክስ የ AI ኮድ መገልገያ መሳሪያውን መግዛቱን በማጠናቀቅ በሚያዝያ ወር ከ SpaceXAI ጋር በሞዴል የስልጠና አጋርነት የጀመረውን ሂደት እንዳጠናቀቀ ሲል Cursor አጭር ልጥፍ አሳትሟል። ልጥፉ የዓለማችን ትልቁ የጂፒዩ መርከቦችን ለማግኘት ቃል ገብቷል፣ ነገር ግን ምንም ውሎችን፣ የጊዜ ገደቦችን እና የምርት ለውጦችን አይገልጽም።

    cursor.com
  3. ፈጠራ7 min አንብብ

    አዲስ ቤንችማርክ የ AI ወኪሎችን 28% ጊዜውን በስህተት የተፈቀደውን ስራ አግዷል

    ቅድመ ህትመት SteerBench-Workን ያስተዋውቃል፣ የ AI ወኪል እርምጃ ለመውሰድ ወይም ለአፍታ ለማቆም የወሰነበት 106-scenario ሙከራ። በ30 የሞዴል ሁኔታዎች ውስጥ፣ ጸሃፊዎቹ እንደተናገሩት የጸዳ ስራን በስህተት መያዝ ደህንነቱ ያልተጠበቀ ስራን ከመፍቀድ በ28 እጥፍ ይበልጣል።

    arxiv.org
  4. ፈጠራ7 min አንብብ

    የወረቀት ሪፖርቶች የድንበር LLM ዳኞች 25-71% በፑሽባክ ስር ፍርዶችን ይገለብጣሉ

    አዲስ የ arXiv ቅድመ ህትመት ጭንቀት - እንደ አውቶሜትድ ክፍል ተማሪዎች ጥቅም ላይ የዋሉ ዘጠኝ የድንበር ሞዴሎችን ይፈትናል እና ሁሉም በፈተና ወቅት ፍርዳቸውን እንደሚቀይሩ ሪፖርት አድርጓል - እና የተቀየሩት ፍርዶች ብዙውን ጊዜ ከትክክለኛው መልስ እንጂ ወደ እሱ አይሄዱም።

    arxiv.org
  5. ፈጠራ7 min አንብብ

    ወረቀት ይከራከራል የዝግመተ ለውጥ ስትራቴጂዎች የኤል ኤም ኤል መልስ ስብስቦችን በማቆየት RL ን ይመቱ

    አዲስ የ arXiv ቅድመ ህትመት ከድህረ-ስልጠና LLMs ከዝግመተ ለውጥ ስትራቴጂዎች ጋር - ህዝብን መሰረት ያደረገ፣ ከግራዲንት-ነጻ ክብደትን በቀጥታ የሚጎዳ ዘዴ - በpass@k እና የመፍትሄ ሽፋን ላይ የማጠናከሪያ ትምህርትን ይመታል ይላል። አብስትራክቱ የተሻሉ የሒሳብ-ቤንችማርክ ውጤቶችን ይጠቅሳል ነገር ግን ምንም ዓይነት ሞዴሎችን፣ መመዘኛዎችን ወይም ቁጥሮችን አይሰይምም።

    arxiv.org
  6. ደህንነት7 min አንብብ

    ወረቀት ራሱን የሚያሻሽል AI ወኪሎች አንድን ያልተጠበቀ ስኬት ወደ ተደጋጋሚ ጥቅም ላይ ማዋል እንደሚችሉ ይናገራል

    አዲስ የ arXiv ቅድመ ህትመት መለኪያ የአንድ የተወሰነ ወኪል አለመሳካት ሁነታን ያሳያል፡ ራስን የሚያሻሽል ወኪል ደህንነቱ ያልተጠበቀ አሰራርን ወደ ማህደረ ትውስታ ሲጽፍ፣ በኋለኞቹ ክፍለ-ጊዜዎች ውስጥ ተሰርስሮ ሊተገበር ይችላል። እያንዳንዱ የተሻሻለ ውቅር የተፈተነ ደህንነቱ ያልተጠበቁ ቅርሶችን እና ሶስት ተንኮል አዘል ስራዎችን ከእጥፍ በላይ አስመዝግቧል።

    arxiv.org
  7. ደህንነት6 min አንብብ

    SEAG ወረቀት የRAG ጥያቄዎች ወደ ውጫዊ ኤል.ኤም.ኤም ከመድረሳቸው በፊት ሚስጥራዊነት ያላቸው አካላትን ይጠቁማል

    በ arXiv ላይ የተለጠፈው ቅድመ ህትመት ወደ የሶስተኛ ወገን ሞዴል ከመላኩ በፊት ሚስጥራዊነት ያላቸው ስሞችን በመጠይቅ እና የተገኙ ሰነዶችን ለተለዋጭ ስም የሚቀይር ማዕቀፍ ይገልፃል። ደራሲዎቹ ከጫፍ-እስከ-ጫፍ ባለው የተጠቃሚ ልኬታቸው ላይ ከ80% በላይ ትክክለኝነት እና ሙሉ የመደበቂያ ዋጋ በሶስት ትናንሽ ሞዴሎች መካከል በ74.91% እና 77.83% መካከል ሪፖርት አድርገዋል።

    arxiv.org

በየሳምንቱ አንድ ጠቃሚ አጭር መግለጫ

በምግብ ውስጥ ሳይኖሩ ከ AI ጋር ይቀጥሉ.

የሳምንቱን የተረጋገጠ የኤአይ ዜና፣ ኦሪጅናል ውሂብ፣ ጠቃሚ መሳሪያዎችን፣ የመማሪያ ምርጫዎችን እና ትኩስ AI ስራዎችን ያግኙ።

Send me
One email a week. Switch any time.

AI የሚማሩ ሰዎችን ይድረሱ

የ AI ባለሙያ መቅጠር ወይም ጠቃሚ የ AI ምርት ማስጀመር? ለመማር እና ለመስራት ወደዚህ በመጡ ሰዎች ፊት አስቀምጠው።

AI ሥራ ይለጥፉ የ AI መሳሪያ አስገባ