Tilbake til Nyheter
IndustriAI Understanding orientering

OpenAIs interne benchmark avslører at Astra kan kodeeksperimenter, og danner rammen om deres 80 % AGI-påstand

Et TIME-intervju avslørte at OpenAIs sjefforsker Jakub Pachocki beskrev en konkret intern benchmark - et system kalt Astra som skriver, kjører og rapporterer om eksperimentell kode - som underbygger selskapets ofte siterte "80 prosent til AGI"-uttalelse.

4 min readRead the linked source
Source-provided image accompanying OpenAI’s internal benchmark reveals Astra can code experiments, framing its 80% AGI claim
KildereferanseKilde registrert
Utgiver
fourweekmba.com
Kilde lenke
fourweekmba.comhttps://fourweekmba.com/ai-openai-agi-benchmark-denominator-80-percent-claim/
Kildetype
Koblet kilde – status for primærkilde er ikke etablert.
KontekstForstå dette på 60 sekunder

Start her

Nøkkelord

AGI (Artificial General Intelligence)
Et hypotetisk AI-system som kan utføre de fleste intellektuelle oppgaver på menneskelig nivå på tvers av mange domener.
Benchmark
En standardisert test eller datasett som brukes til å måle og sammenligne modellytelse.
Klassifikasjon
En oppgave der en modell tilordner en inngang til én eller flere forhåndsdefinerte kategorier.
Test deg selvQuiz for forklaring av AI-modeller

Hva skjedde

I en artikkel 26. september 2026 gjengitt FourWeekMBA rapportering av TIME-journalisten Alex Heath, som brukte to uker på å intervjue mer enn tjue OpenAI-ledere, investorer og rivaler. Stykket avslører at forskningssjef Mark Chen fortalte TIME at selskapet er «80 prosent av veien» til kunstig generell intelligens (AGI). Sjefforsker Jakub Pachocki klargjorde nevneren for denne figuren: et internt system ved navn Astra som kan ta en eksperimentell idé, generere den nødvendige koden i OpenAIs kodebase, utføre eksperimentet og returnere resultatene. Sam Altmans offentlige frasering ble også fanget - han sa at OpenAI forventer å ha "et internt system han vil kalle AGI" innen slutten av året, og understreket at etiketten er hans egen klassifisering. Artikkelen bemerker at de resterende 20 prosentene, den eksakte metrikken som brukes, og enhver formell definisjon av AGI forblir uspesifisert.

FourWeekMBAs artikkel fra 26. september bygger på Alex Heaths TIME-rapport, som er basert på mer enn to uker med intervjuer med over tjue OpenAI-innsidere, inkludert ledere, investorer og rivaler. Rapporteringen fanger opp tre distinkte utsagn: (1) Mark Chens anslag om at OpenAI er «80 prosent av veien» til AGI; (2) Sam Altmans kvalifikasjon om at selskapet vil ha et internt system han vil kalle AGI innen utgangen av året; og (3) Jakub Pachockis beskrivelse av en konkret intern – et system kalt Astra som kan ta en eksperimentell idé, skrive den tilsvarende koden i OpenAIs kodebase, kjøre eksperimentet og rapportere resultatene.

Artikkelen understreker at referansen er beskrevet i en enkelt, falsifiserbar setning, noe som gjør det til et holdbart objekt som kan undersøkes av utenforstående, i motsetning til den tvetydige prosentandelen. Imidlertid bemerker stykket også at den nøyaktige sammensetningen av de resterende 20 prosentene, metoden for å komme frem til 80 prosent-tallet og enhver formell intern definisjon av AGI ikke ble avslørt.

Ingen ytterligere tekniske detaljer, referansepoeng eller utgivelsestidslinjer for Astra ble gitt, og OpenAI har ikke publisert en formell definisjon av AGI eller en offentlig versjon av referansen.

Kildedetaljer: fourweekmba.com ↗

Hvorfor det betyr noe

Avsløringen gir den første offentlig dokumenterte, falsifiserbare referansen for OpenAIs interne fremgang mot AGI, en påstand som tidligere bare har blitt uttrykt som en vag prosentandel. Ved å forankre 80 prosent-tallet til en konkret oppgave – automatisert kodegenerering, utførelse og rapportering – får analytikere et konkret referansepunkt for å evaluere fremtidige uttalelser fra OpenAI. Dette er uvanlig på et felt der mange firmaer siterer milepæler på høyt nivå uten å tilby målbare kriterier, noe som gjør referansen til en sjelden, verifiserbar artefakt som kan undersøkes av eksterne forskere hvis OpenAI velger å dele flere detaljer. Dessuten fremhever artikkelen hvordan medieoverføring kan fjerne nyanser fra tekniske påstander, og understreker behovet for presis rapportering når man vurderer AI-evner som kan ha brede økonomiske og sikkerhetsmessige implikasjoner.

Referanseindeksen gir analytikere en konkret målestokk for å spore OpenAIs fremgang, noe som er sjeldent i en sektor der mange kapasitetskrav er abstrakte. Dette kan muliggjøre en strengere ekstern evaluering av OpenAIs veikart og bidra til å skille vesentlige fremskritt fra markedsføringshype.

Ved å avsløre hvordan en numerisk påstand kan miste sin nevner gjennom mediekjeder, illustrerer artikkelen en bredere kommunikasjonsutfordring for AI-styring: beslutningstakere og offentligheten trenger presise, verifiserbare beregninger for å vurdere påstander om transformative teknologier som AGI.

Avsløringen kan presse OpenAI og andre AI-firmaer til å gi klarere, mer gjennomsiktige beregninger for fremtidige milepæler, og potensielt forme industrinormer rundt rapportering av AI-evne.

Interactive Mechanism

Interaktiv mekanisme: Hvordan det faktisk fungerer

Utforsk den underliggende teknologien bak denne utviklingen interaktivt.

Model Parameter Size:8B Parameters
VRAM Required5.5 GBGPU memory footprint
Target HardwareMacBook / Single GPUDeployment tier
Privacy100% Air-GappedLocal device capability
Core takeaway: Small, quantized models (3B–8B) now run directly inside smartphones and laptops with complete data privacy, while mammoth 400B+ models remain the domain of datacenter clusters.
Interaktiv konseptsjekk+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Hva du skal se neste

Fremtidige oppdateringer fra OpenAI bør overvåkes for enhver utvidelse av Astra-referansen, for eksempel bredere oppgavedekning, ytelsesmålinger eller offentlig utgivelse av evalueringsdata. Observatører bør også se etter hvordan selskapets ledelse fortsetter å ramme "80 prosent til AGI"-narrativet i investororienteringer, regulatoriske registreringer eller produktkunngjøringer, spesielt enhver avklaring av de manglende 20 prosentene. Til slutt kan reaksjonen til konkurrenter og beslutningstakere på denne nylig synlige interne beregningen påvirke industristandarder for åpenhet rundt AGI-relaterte milepæler.

Eventuelle fremtidige OpenAI-utsagn som utvider Astras muligheter, for eksempel bredere eksperimentelle domener, ytelsesreferanser eller offentlig utgivelse av evalueringsdata.

Avklaringer fra OpenAI-ledelsen om de manglende 20 prosentene og om 80 prosent-tallet reflekterer en formell intern beregning eller et uformelt estimat.

Regulatoriske eller konkurransemessige svar som refererer til denne referansen som en standard for vurdering av AGI-relatert fremgang.

Relaterte guider og quizer

AI-modeller forklartKI-etikkKIs fremtidTest det du vet – prøv en gratis AI-quizSlå opp et AI-begrep i ordlisten vårFølg AI-finansieringssporeren
Fant du dette nyttig?