ምን ተፈጠረ
ፈርስትፖስት እንደዘገበው ጄንሰን ሁዋንግ በኤክስ ላይ OpenAI GPT-6 Astra ን ከጀመረ በኋላ AGI እንደደረሰ ተናግሯል። ሪፖርቱ የOpenAI የይገባኛል ጥያቄ የቀረበባቸውን የቤንችማርክ ውጤቶች፣ የአሰላለፍ ሙከራ፣ የታቀዱ ተገኝነት እና የኤፒአይ ዋጋን ጠቅለል አድርጎ ያቀርባል። እነዚህ የይገባኛል ጥያቄዎች ከHuang እና OpenAI የመጡት በፈርስትፖስት እንደተዘገበው እና በግል ያልተረጋገጡ ናቸው።
Firstpost እንደዘገበው የ Nvidia ዋና ሥራ አስፈፃሚ ጄንሰን ሁአንግ ለ OpenAI የምርት ማስታወቂያ በ X ላይ በጽሑፍ ምላሽ ሰጥተዋል: "GPT-6 Astra, በ ~ 100K NVIDIA ግሬስ ብላክዌል NVLink72 ላይ የሰለጠነ. ከ ChatGPT እስከ o1 ወደ Astralation በ 4 ዓመታት ውስጥ ደርሷል @Xgra AXZA ቡድን 400K ጂፒዩዎች በቀጣይ መስመር ላይ ይመጣሉ። Firstpost የመሠረተ ልማት ሥዕሉን ወይም የHuang መደምደሚያን በራሱ አያረጋግጥም።
በOpenAI የይገባኛል ጥያቄዎች የ Firstpost መለያ መሠረት GPT-6 Astra በኮምፒተር አጠቃቀም ፣ አሰሳ ፣ በሶፍትዌር ምህንድስና ፣ በሳይበር ደህንነት ፣ በሳይንሳዊ ስራ ፣ በሂሳብ እና በሌሎች ሙያዊ ተግባራት ውስጥ አፈፃፀምን ያሻሽላል። OpenAI በFronntierMath Tier 4 98%፣ በ ARC-AGI-3 99.9% እና በ ExploitBench ላይ 100% ማጠናቀቂያ ተመን፣ በተጨማሪም በOSWorld 2.0 ላይ 72.6% የስኬት መጠን ከZXZ.QAIU1 47% ፈጣን ውጤትን ጠቅሷል። ሪፖርቱ የእነዚህን ውጤቶች ገለልተኛ ማባዛት አይሰጥም።
Firstpost ይላል OpenAI በመጀመሪያ Astraን ድርጅቶችን እንዲመርጥ እያቀረበ ነው፣ በChatGPT Plus፣ Pro፣ Business and Enterprise፣ the API፣ Microsoft Azure እና AWS Bedrock በታቀደው ሰፊ መዳረሻ። መደበኛውን የኤፒአይ ዋጋ 10 ዶላር በሚሊዮን የግብዓት ቶከኖች እና 50 ዶላር በአንድ ሚሊዮን የውጤት ቶከኖች ሪፖርት ያደርጋል፣ ፈጣን ስሪት ከነዚያ ተመኖች ዋጋ አለው። አጠቃላይ የሸማቾች መገኘት እና የመጨረሻ የመዳረሻ ሁኔታዎች አልተገለፁም።
ሪፖርቱ በተጨማሪም OpenAI Astra ከተፈቀደው የተግባር ወሰን 0% ከተፈተኑ ጉዳዮች በላይ ያለፈበት፣ ለGPT-5.6 Sol ያለ የምርት ጥበቃዎች 48% ጋር ሲነጻጸር የአሰላለፍ ግምገማን ገልጿል። ፈርስትፖስት ይህን ንፅፅር ከOpenAI ጋር ያገናኘዋል እና የፈተናውን ዲዛይን፣ የናሙና መጠን ወይም ውጤቱን በራሱ አያረጋግጥም።
ለምን አስፈላጊ ነው።
ታሪኩ አስፈላጊ ነው ምክንያቱም የድንበር-ሞዴል ጅምርን ከታዋቂው የኢንዱስትሪ መሪ የይገባኛል ጥያቄ ጋር ለረጅም ጊዜ ሲከራከር የነበረው AGI ገደብ ላይ ደርሷል። ያ የይገባኛል ጥያቄ በሕዝብ የሚጠበቁ፣ የኢንቨስትመንት፣ የፖሊሲ እና የደህንነት ክርክሮች ላይ ተጽእኖ ሊያሳድር ይችላል፣ ነገር ግን የቀረበው ማስረጃ GPT-6 Astra ማንኛውንም የተስማማውን የ AGI ትርጉም እንደሚያሟላ አያረጋግጥም። ስለዚህ ተግባራዊ ጠቀሜታው የሚወሰነው በገለልተኛ ሙከራ ፣ በእውነተኛው ዓለም መገኘት እና የአምሳያው ገደቦችን መመርመር ነው።
AGI ደረጃውን የጠበቀ የቴክኒክ ማረጋገጫ አይደለም። ፈርስትፖስት የሰውን የግንዛቤ ችሎታዎች በተለያዩ የአዕምሮ ስራዎች ላይ ማዛመድ ወይም መብለጥ የሚችል መላምታዊ ስርዓት እንደሆነ ይገልፃል፣ ተመራማሪዎች እና ኩባንያዎች እንዴት እንደሚገልጹት ወይም እንደሚለኩበት አለመስማማታቸውን በመጥቀስ። ስለዚህ የ Huang መግለጫ ጉልህ የህዝብ ጥያቄ ነው እንጂ ራሱን የቻለ ግኝት አይደለም።
የ Astra ሪፖርት የተደረገው የኮምፒውተር አጠቃቀም እና የባለሙያ ተግባር ችሎታዎች ከኩባንያው የተመረጡ ግምገማዎችን የሚይዙ ከሆነ፣ድርጅቶች አስተዳደራዊ፣ ሶፍትዌሮችን እና የትንታኔ ስራዎችን በራስ ሰር እንደሚያስገቡ ላይ ተጽእኖ ሊያሳድሩ ይችላሉ። ሪፖርቱ አስተማማኝነትን፣ ወጪ ቆጣቢነትን፣ የስህተት መጠኖችን ወይም በመደበኛ ማሰማራቶች ላይ ደህንነትን አላስቀመጠም፣ ስለዚህ ተግባራዊ እንድምታዎች ሁኔታዊ ሆነው ይቆያሉ።
የመሠረተ ልማት ጥያቄው ከድንበር-ሞዴል ልማት ጋር የተያያዘውን የስሌት ልኬት ያጎላል። ነገር ግን፣ ሪፖርቱ ስለተገለጸው የNvidia ስርዓቶች ብዛት ወይም በዚያ መሠረተ ልማት እና በ Astra ችሎታዎች መካከል ስላለው ግንኙነት ገለልተኛ ማረጋገጫ አይሰጥም።
በይነተገናኝ ሜካኒዝም፡ በትክክል እንዴት እንደሚሰራ
ከዚህ ልማት በስተጀርባ ያለውን ቴክኖሎጂ በይነተገናኝ ያስሱ።
What is a common training objective for an autoregressive language model?
ቀጥሎ ምን እንደሚታይ
የ GPT-6 Astra ገለልተኛ ግምገማዎችን ይመልከቱ፣ OpenAI እና Nvidia በኤጂአይ ምን ማለት እንደሆነ ማብራርያ እና ከሰፊ የማሰማራት ማስረጃዎች። እንዲሁም ተደራሽነቱ ከተመረጡት ድርጅቶች በላይ መስፋፋቱን፣ የተገለፀው ዋጋ ትክክል እንደሆነ እና የአምሳያው አሰላለፍ እና የሳይበር ደህንነት ጥበቃዎች በውጫዊ ሙከራዎች መከናወናቸውን ይመልከቱ።
ገለልተኛ ተመራማሪዎች እና ደንበኞች የተዘገበው የቤንችማርክ ውጤቶች ለአዳዲስ ተግባራት እና የገሃዱ ዓለም የስራ ፍሰቶች አጠቃላይ መሆናቸውን ሊፈትኑ ይችላሉ። ልዩ ትኩረት ወደ ውድቀቶች ተመኖች፣ መራባት፣ የሳይበር ደህንነት ባህሪ እና በOpenAI ያልተመረጡ ተግባራት ላይ አፈጻጸም ላይ መሄድ አለበት።
ሞዴሉን በቀጥታ ማን መገምገም እንደሚችል መዳረሻ ይወስናል። ፈርስትፖስት ድርጅቶችን ለመምረጥ የመጀመሪያ ልቀት እና የታቀዱ መዳረሻ በበርካታ OpenAI እና የደመና አቅርቦቶች ሪፖርት አድርጓል፣ ነገር ግን የምርጫ መስፈርቶቹን፣ የታቀደውን የጊዜ ሰሌዳ ወይም የጂኦግራፊያዊ ተገኝነትን አይገልጽም።
የOpenAI የይገባኛል ጥያቄ 0% ከተፈቀደው ወሰን በላይ ማለፍ የውጭ ምርመራን ዋስትና ይሰጣል ፣ ይህም አሻሚ መመሪያዎችን ፣ የመሳሪያ ፈቃዶችን ፣ ፈጣን መርፌን እና የረጅም ጊዜ የኮምፒዩተር አጠቃቀም ተግባራትን ጨምሮ።
ሪፖርቱ የኤፒአይ ዋጋዎችን ይሰጣል ነገር ግን የመጨረሻውን የChatGPT የደንበኝነት ምዝገባ ዋጋን፣ ኮታዎችን፣ የዋጋ ገደቦችን ወይም ሁሉም የተዘረዘሩ የደመና መድረኮች ተመሳሳይ ስሪቶችን እና መከላከያዎችን አያቀርቡም።