Какво стана
Firstpost съобщава, че Дженсън Хуанг е казал на X, че AGI е пристигнал, след като OpenAI пусна GPT-6 Astra. Докладът също така обобщава заявените от OpenAI резултати от бенчмарка, тестовете за подравняване, планираната наличност и ценообразуването на API. Тези твърдения идват от Huang и OpenAI, както съобщава Firstpost, и не са потвърдени независимо.
Firstpost съобщава, че главният изпълнителен директор на Nvidia Дженсън Хуанг е отговорил на съобщението за продукта на OpenAI на X, като е написал: „GPT-6 Astra, обучен на ~100K NVIDIA Grace Blackwell NVLink72. От ChatGPT до o1 до Astra след 4 години. AGI пристигна. Поздравления Екипът на @OpenAI 400K графични процесори идват онлайн.” Firstpost не проверява независимо данните за инфраструктурата или заключението на Huang.
Според отчета на Firstpost за твърденията на OpenAI, GPT-6 Astra подобрява производителността при използване на компютър, сърфиране, софтуерно инженерство, киберсигурност, научна работа, математика и други професионални задачи. Съобщава се, че OpenAI цитира резултати от 98% на FrontierMath Tier 4, 99,9% на ARC-AGI-3 и 100% степен на завършване на ExploitBench, плюс 72,6% успеваемост на OSWorld 2.0, докато изпълнява задачи с 47% по-бързо от GPT-5.6 Sol. Докладът не предоставя независимо възпроизвеждане на тези резултати.
Firstpost казва, че OpenAI първоначално предлага Astra на избрани организации, с планиран по-широк достъп чрез ChatGPT Plus, Pro, Business и Enterprise, API, Microsoft Azure и AWS Bedrock. Той отчита стандартно ценообразуване на API от 10 долара за милион входни токени и 50 долара за милион изходни токени, като по-бързата версия е на цена два пъти по-висока. Общата потребителска наличност и условията за краен достъп остават неуточнени.
Докладът също така казва, че OpenAI описва оценка на подравняването, при която Astra надвишава разрешен обхват на задачата в 0% от тестваните случаи, в сравнение с 48% за GPT-5.6 Sol без предпазни мерки за производство. Firstpost приписва това сравнение на OpenAI и не потвърждава независимо дизайна на теста, размера на извадката или резултата.
Детайли за източника: firstpost.com ↗
Защо има значение
Историята има значение, защото съчетава последващо пускане на граничен модел с твърдението на виден лидер в индустрията, че дълго обсъжданият праг на AGI е достигнат. Това твърдение може да повлияе на обществените очаквания, инвестициите, политиките и дебатите за безопасност, но представените доказателства не установяват, че GPT-6 Astra отговаря на която и да е договорена дефиниция за AGI. Следователно практическото значение зависи от независимо тестване, наличност в реалния свят и внимателно изследване на ограниченията на модела.
AGI не е стандартизиран технически сертификат. Firstpost го описва като хипотетична система, способна да съпостави или надхвърли човешките когнитивни способности в широк спектър от интелектуални задачи, като същевременно отбелязва, че изследователите и компаниите не са съгласни как да го дефинират или измерят. Следователно изявлението на Хуанг е значимо публично твърдение, а не независимо установена констатация.
Ако докладваните възможности на Astra за използване на компютър и професионални задачи издържат извън избраните от компанията оценки, те биха могли да повлияят на това как организациите автоматизират административната, софтуерната и аналитичната работа. Докладът не установява надеждност, рентабилност, нива на грешки или безопасност при обичайните внедрявания, така че тези практически последици остават условни.
Твърдението за инфраструктура също така подчертава мащаба на изчисленията, свързани с развитието на граничен модел. Докладът обаче не предоставя независимо потвърждение на посочения брой системи Nvidia или на връзката между тази инфраструктура и възможностите на Astra.
Интерактивен механизъм: как всъщност работи
Разгледайте интерактивно основната технология зад тази разработка.
What is a common training objective for an autoregressive language model?
Какво да гледате след това
Следете за независими оценки на GPT-6 Astra, изясняване какво означават OpenAI и Nvidia под AGI и доказателства от по-широки внедрявания. Също така наблюдавайте дали достъпът се разширява отвъд избрани организации, дали заявеното ценообразуване остава точно и дали съответствието на модела и предпазните мерки за киберсигурност работят при външно тестване.
Независими изследователи и клиенти могат да тестват дали докладваните сравнителни резултати се обобщават за нови задачи и работни процеси в реалния свят. Особено внимание трябва да се обърне на процентите на неуспехи, възпроизводимостта, поведението на киберсигурността и ефективността на задачи, които не са избрани от OpenAI.
Access ще определи кой може директно да оцени модела. Firstpost съобщава за първоначално внедряване за избрани организации и планиран достъп чрез няколко OpenAI и облачни предложения, но не уточнява критериите за избор, графика за внедряване или географската наличност.
Заявеният 0% процент на превишаване на разрешения обхват на OpenAI изисква външна проверка, включително тестове, включващи двусмислени инструкции, разрешения за инструменти, бързо инжектиране и дългосрочни задачи за използване на компютър.
Докладът дава цени на API, но не установява окончателни ChatGPT цени за абонамент, квоти, ограничения на скоростта или дали всички изброени облачни платформи ще предлагат идентични версии и предпазни мерки.