የኩባንያዎች መመሪያ

OpenAI o1 እና o3 የማመዛዘን ሞዴሎች ተብራርተዋል

OpenAI o1 እና o3 መልስ ከመስጠታቸው በፊት በሂሳብ፣ በሳይንስ እና በኮድ ውስጥ ባለ ብዙ ደረጃ ችግሮችን ለመፍታት ተጨማሪ የፈተና ጊዜ ስሌት የሚጠቀሙ የማመዛዘን ሞዴሎች ናቸው።

2 ሚን አንብብለመጨረሻ ጊዜ የዘመነው

ጥልቅ ዳይቭ

በ2024 መገባደጃ ላይ የተለቀቀው o1 ረጅም የውስጥ የአስተሳሰብ ሰንሰለት በማፍለቅ ምላሽ ከመስጠቱ በፊት 'ለማሰብ' የሰለጠነ የመጀመሪያው የOpenAI ሞዴል ነው። ልክ እንደ GPT-4o፣ ወዲያውኑ መልስ ከሚሰጠው፣ o1 ከሰከንዶች እስከ ደቂቃ በማመዛዘን፣ አቀራረቦችን በመመርመር፣ የራሱን ስህተቶች በመያዝ እና ወደኋላ በመመለስ ያሳልፋል። ይህ አሳማኝ ጽሑፍን ብቻ ሳይሆን ትክክለኛ አስተሳሰብን በሚሸልመ ሰፊ የማጠናከሪያ ትምህርት የተጎላበተ ነው። o3፣ በዲሴምበር 2024 በቅድመ-እይታ የታየ እና በ2025 የተለቀቀው፣ ይህንን የበለጠ ገፋፍቶታል፡ በ ARC-AGI ረቂቅ-ምክንያታዊ መለኪያ ላይ 87.5% ገደማ አስመዝግቧል እና ከፍተኛ የሰው ኮድ አውጪዎችን የሚወዳደር ተወዳዳሪ የፕሮግራም ደረጃ ላይ ደርሷል። ብዙ ማስላት 'ማሰብ'ን በማጣቀሻ ጊዜ ማሳለፍ በቀጥታ መልሶችን ስለሚያሻሽል ንግዱ ወጪ እና መዘግየት ነው።

ቴክኒካዊ ግንዛቤ

ዋናው ሀሳብ የግንዛቤ-ጊዜ (የሙከራ-ጊዜ) ስሌት ልኬት ነው። ሞዴሉን በስልጠና ወቅት ትልቅ ከማድረግ ይልቅ፣ o1 እና o3 በማጠናከሪያ ትምህርት ሰልጥነዋል ረዣዥም የውስጥ የአስተሳሰብ ሰንሰለቶችን ለማምረት፣ ከዚያም በተለዋዋጭ ስሌት በየጥያቄ እንዲያወጡ ይፈቀድላቸዋል። ብዙ የአስተሳሰብ ምልክቶች በአጠቃላይ በከባድ ችግሮች ላይ የተሻሉ መልሶችን ይሰጣሉ። OpenAI ጥሬውን የማመዛዘን ዱካ ከተጠቃሚዎች ይደብቃል፣ ማጠቃለያ ብቻ ያሳያል፣ በከፊል ቴክኒኩን ለመጠበቅ እና በተወዳዳሪዎች እንዳይሰራጭ ለመከላከል።

ስልታዊ ተጽእኖ

የአቅራቢ ስትራቴጂ

የአቅራቢዎች የመንገድ ካርታዎች ቡድንዎ በቀጣይ መገንባት በሚችላቸው ባህሪያት ላይ ተጽዕኖ ያሳድራል።

ወጪ እና በጀት

የንግድ ውሎች እና የማሰማራት አማራጮች የረጅም ጊዜ ወጪን እና አደጋን ይነካሉ።

አደጋ እና ደህንነት

የኩባንያው ማበረታቻዎች የምርት ነባሪዎችን፣ የደህንነት አቋምን እና ክፍትነትን ይቀርጻሉ።

የወደፊት የOpenAI o1 እና o3 የማመዛዘን ሞዴሎች ተብራርተዋል

የማመዛዘን ሞዴሎች ሜዳውን እንደገና እየቀረጹ ነው፡ ተቀናቃኞች እንደ DeepSeek-R1፣ Google's Gemini የአስተሳሰብ ሁነታዎች እና የAnthropic የተራዘመ አስተሳሰብ ሁሉም ተመሳሳይ የሙከራ ጊዜ-አሰላስል አቀራረቦችን ይቀበላሉ። ተጠቃሚዎች ፍጥነትን በጥልቅ እንዲገበያዩ የሚያስችላቸው 'ጥረት' መደወያዎችን ይጠብቁ፣ ብዙ መሣሪያን በመጠቀም ደረጃዎችን የሚያመዛዝኑ ወኪላዊ ሥርዓቶች፣ እና ወደ መልቲ ሞዳል እና ሳይንሳዊ መሳሪያዎች የተጋገሩ ምክንያቶች። ረዣዥም የአስተሳሰብ ሰንሰለቶች ታማኝ እና ከስውር ስህተቶች የፀዱ ሲሆኑ ድንበሩ ይህንን ርካሽ፣ ፈጣን እና የበለጠ አስተማማኝ ያደርገዋል።

የእውነተኛ-ዓለም አተገባበር

ባለብዙ ደረጃ ማረጋገጫዎችን በመስራት የውድድር ደረጃ የሂሳብ ችግሮችን መፍታት (AIME፣ IMO-style)

ውስብስብ ኮድን ማረም እና መጻፍ፣ በተወዳዳሪ-ፕሮግራም አወጣጥ ውድድሮች ላይ ከፍተኛ የሰው ልጅ ደረጃዎችን በማከናወን ላይ

ተመራማሪዎች በዲግሪ ደረጃ በፊዚክስ፣ ኬሚስትሪ እና ባዮሎጂ ጥያቄዎችን እንዲያስቡ መርዳት

በብዙ ደረጃዎች የሚያቅዱ፣ መሣሪያዎችን የሚጠሩ፣ ውጤቶችን የሚያረጋግጡ እና እራሳቸውን የሚያርሙ ወኪላዊ የስራ ፍሰቶችን ማብቃት።

አደጋዎች እና የጥበቃ መንገዶች

የማስጀመሪያ ማስታወቂያዎች በእውነተኛ የምርት የስራ ፍሰቶች ውስጥ ያለውን መረጋጋት ሊበልጡ ይችላሉ።

የኤፒአይ ዋጋ ወይም የመመሪያ ፈረቃ በአንድ ጀምበር ግምቶችን ሊሰብር ይችላል።

የነጠላ አቅራቢ ጥገኝነት የመቆለፍ እና የስደት ወጪዎችን ይጨምራል።

የትግበራ ፍኖተ ካርታ

1

የእራስዎን ተግባራት እና የውሂብ ስብስቦች በመጠቀም አቅራቢዎችን ይገምግሙ።

2

ከመዋሃድ በፊት ግላዊነትን፣ ደህንነትን እና የህግ ውሎችን ይገምግሙ።

3

በሞዴሎች ወይም አቅራቢዎች ላይ የውድቀት እቅድን ያቆዩ።

4

የመንገድ ካርታ ለውጦች ቡድኖችን እንዳያስደንቁ የመልቀቂያ ማስታወሻዎችን ይከታተሉ።

ማሰስዎን ይቀጥሉ

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the OpenAI o1 and o3 Reasoning Models Explained quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

ጥያቄ ጀምር

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

በተደጋጋሚ የሚጠየቁ ጥያቄዎች

What is OpenAI o1 and o3 Reasoning Models Explained?

OpenAI o1 እና o3 መልስ ከመስጠታቸው በፊት በሂሳብ፣ በሳይንስ እና በኮድ ውስጥ ባለ ብዙ ደረጃ ችግሮችን ለመፍታት ተጨማሪ የፈተና ጊዜ ስሌት የሚጠቀሙ የማመዛዘን ሞዴሎች ናቸው።

በ o1/o3 እና እንደ GPT-4o ባሉ መደበኛ ሞዴል መካከል ያለው ዋነኛው የባህሪ ልዩነት ምንድነው?

o1 እና o3 ፈጣን ምላሽ ከመስጠት ይልቅ የመጨረሻውን መልስ ከመስጠታቸው በፊት ረጅም የውስጥ የአስተሳሰብ ሰንሰለት ይፈጥራሉ።

O1 በደንብ እንዲያመዛዝን ለማስተማር ምን ዓይነት የስልጠና ዘዴ ነው?

o1 አሳማኝ-ድምጽ ያለው ጽሑፍ ብቻ ሳይሆን ውጤታማ የማመዛዘን እርምጃዎችን በሚሸልም የማጠናከሪያ ትምህርት ሰልጥኗል።

ለእነዚህ ሞዴሎች 'የጊዜ ስሌት ስሌት' ምን ማለት ነው?

ዋናው ማስተዋል ሞዴሉን በመልስ ሰአቱ ረዘም ላለ ጊዜ ' እንዲያስብ' መፍቀድ፣ በስልጠና ወቅት ትልቅ ማድረግ ብቻ ሳይሆን በከባድ ችግሮች ላይ አፈፃፀምን ያሳድጋል።

በየትኛው ቤንችማርክ ላይ ነው o3 በታዋቂነት ወደ 87.5% ያስመዘገበው ፣ ይህም ጠንካራ የአብስትራክት አስተሳሰብን ያሳያል?

በ ARC-AGI ረቂቅ-ምክንያታዊ መለኪያ ላይ የ o3 ከፍተኛ ነጥብ የማመዛዘን ችሎታውን የሚያሳይ የርእሰ ዜና ውጤት ነው።

ለምንድነው OpenAI ጥሬ የማመዛዘን ዱካውን ከተጠቃሚዎች የሚሰውረው?

OpenAI የአስተሳሰብ ሰንሰለት ማጠቃለያን ብቻ ያሳያል፣ በከፊል ዘዴውን ለመጠበቅ እና ተፎካካሪዎች እንዳይገለብጡት።