Wat is er gebeurd
Firstpost meldt dat Jensen Huang op X zei dat AGI was gearriveerd nadat OpenAI de GPT-6 Astra had gelanceerd. Het rapport geeft ook een samenvatting van de geclaimde benchmarkresultaten, afstemmingstests, geplande beschikbaarheid en API-prijzen van OpenAI. Deze beweringen komen van Huang en OpenAI zoals gerapporteerd door Firstpost en zijn niet onafhankelijk bevestigd.
Firstpost meldt dat Jensen Huang, CEO van Nvidia, reageerde op de productaankondiging van OpenAI op X door te schrijven: "GPT-6 Astra, getraind op ~100K NVIDIA Grace Blackwell NVLink72. Van ChatGPT naar o1 naar Astra in 4 jaar. AGI is gearriveerd. Gefeliciteerd @OpenAI team. 400K GPU's komen hierna online." Firstpost verifieert niet onafhankelijk het infrastructuurcijfer of de conclusie van Huang.
Volgens het verslag van Firstpost over de beweringen van OpenAI verbetert GPT-6 Astra de prestaties bij computergebruik, browsen, software-engineering, cyberbeveiliging, wetenschappelijk werk, wiskunde en andere professionele taken. OpenAI noemde naar verluidt scores van 98% op FrontierMath Tier 4, 99,9% op ARC-AGI-3 en een voltooiingspercentage van 100% op ExploitBench, plus een succespercentage van 72,6% op OSWorld 2.0, terwijl taken 47% sneller werden voltooid dan GPT-5.6 Sol. Het rapport biedt geen onafhankelijke replicatie van deze resultaten.
Firstpost zegt dat OpenAI Astra in eerste instantie aan geselecteerde organisaties aanbiedt, met bredere toegang gepland via ChatGPT Plus, Pro, Business en Enterprise, de API, Microsoft Azure en AWS Bedrock. Het rapporteert standaard API-prijzen van $10 per miljoen inputtokens en $50 per miljoen outputtokens, terwijl een snellere versie twee keer zo duur is. De algemene beschikbaarheid voor consumenten en de definitieve toegangsvoorwaarden blijven ongespecificeerd.
In het rapport staat ook dat OpenAI een uitlijningsevaluatie beschreef waarbij Astra in 0% van de geteste gevallen een toegestane taakomvang overschreed, vergeleken met 48% voor GPT-5.6 Sol zonder productiebeveiligingen. Firstpost schrijft deze vergelijking toe aan OpenAI en bevestigt niet onafhankelijk het testontwerp, de steekproefomvang of het resultaat.
Waarom het ertoe doet
Het verhaal doet ertoe omdat het een consequente lancering van een grensmodel combineert met de bewering van een prominente marktleider dat de lang besproken AGI-drempel is bereikt. Die bewering zou de publieke verwachtingen, investerings-, beleids- en veiligheidsdebatten kunnen beïnvloeden, maar het gepresenteerde bewijsmateriaal bewijst niet dat de GPT-6 Astra aan enige overeengekomen definitie van AGI voldoet. De praktische betekenis hangt daarom af van onafhankelijk testen, beschikbaarheid in de echte wereld en onderzoek van de grenzen van het model.
AGI is geen gestandaardiseerde technische certificering. Firstpost beschrijft het als een hypothetisch systeem dat in staat is menselijke cognitieve vaardigheden te evenaren of te overtreffen voor een breed scala aan intellectuele taken, waarbij hij opmerkt dat onderzoekers en bedrijven het oneens zijn over de manier waarop dit moet worden gedefinieerd of gemeten. De verklaring van Huang is daarom een belangrijke publieke claim en geen onafhankelijk vastgestelde bevinding.
Als de gerapporteerde mogelijkheden van Astra op het gebied van computergebruik en professionele taken stand houden buiten de door het bedrijf geselecteerde evaluaties, zouden ze van invloed kunnen zijn op de manier waarop organisaties administratief, softwarematig en analytisch werk automatiseren. Het rapport stelt geen betrouwbaarheid, kosteneffectiviteit, foutenpercentages of veiligheid vast bij gewone implementaties, dus deze praktische implicaties blijven voorwaardelijk.
De infrastructuurclaim onderstreept ook de schaal van rekenkracht die gepaard gaat met de ontwikkeling van grensmodellen. Het rapport biedt echter geen onafhankelijke bevestiging van het genoemde aantal Nvidia-systemen of van de relatie tussen die infrastructuur en de mogelijkheden van Astra.
Interactief mechanisme: hoe het eigenlijk werkt
Ontdek interactief de onderliggende technologie achter deze ontwikkeling.
What is a common training objective for an autoregressive language model?
Wat je nu moet bekijken
Kijk uit naar onafhankelijke evaluaties van GPT-6 Astra, verduidelijking van wat OpenAI en Nvidia bedoelen met AGI, en bewijsmateriaal uit bredere implementaties. Kijk ook of de toegang zich uitbreidt tot buiten geselecteerde organisaties, of de genoemde prijzen accuraat blijven en of de afstemming van het model en de cyberbeveiligingswaarborgen presteren onder externe tests.
Onafhankelijke onderzoekers en klanten kunnen testen of de gerapporteerde benchmarkscores generaliseren naar nieuwe taken en praktijkworkflows. Bijzondere aandacht moet gaan naar faalpercentages, reproduceerbaarheid, cyberbeveiligingsgedrag en prestaties bij taken die niet door OpenAI zijn geselecteerd.
Toegang bepaalt wie het model rechtstreeks kan evalueren. Firstpost rapporteert een eerste uitrol naar geselecteerde organisaties en geplande toegang via verschillende OpenAI- en cloudaanbiedingen, maar specificeert niet de selectiecriteria, het tijdschema voor de uitrol of de geografische beschikbaarheid.
Het door OpenAI geclaimde percentage van overschrijding van de toegestane reikwijdte van 0% rechtvaardigt extern onderzoek, inclusief tests met dubbelzinnige instructies, gereedschapsrechten, snelle injectie en langlopende computergebruikstaken.
Het rapport geeft API-prijzen weer, maar stelt niet de definitieve ChatGPT-abonnementsprijzen, quota's, tarieflimieten vast en ook niet of alle vermelde cloudplatforms identieke versies en waarborgen zullen bieden.