Tilbake til Nyheter
InnovasjonAI Understanding orientering

En gratis chatbot fant en seks-die-løsning på omtrent 13 minutter

New Scientist rapporterer at en gratis chatbot produserte en matematisk gyldig seks-die-konstruksjon som en forsker sjekket, selv om designet er upraktisk og modellens metode forblir ukjent.

4 min readRead the original reporting
Source-provided image accompanying A free chatbot found a six-die solution in about 13 minutes
Tilskrevet rapporteringKilde registrert
Utgiver
newscientist.com
Kilde lenke
newscientist.comhttps://www.newscientist.com/article/2587148-i-made-a-free-ai-chatbot-solve-a-decade-long-maths-problem-in-13-minutes/
Kildetype
Rapportering fra en nyhetskanal - ikke et førstepartsdokument.

Det vi ikke kunne bekrefte uavhengig: Dette kravet tilskrives det navngitte utsalgsstedet. Vi har ikke verifisert det mot et førstepartsdokument. (newscientist.com)

KontekstForstå dette på 60 sekunder

Start her

Nøkkelord

Spør
Inndatainstruksjonene og konteksten gitt til en generativ modell.
Test deg selvQuiz for forklaring av AI-modeller

Hva skjedde

New Scientist-reporter Matthew Sparkes sier at ChatGPT genererte en løsning på et terningproblem med seks spillere etter omtrent 13 minutters resonnement. Forsker Eric Harshbarger sjekket tallene og fant dem riktige. Konstruksjonen bruker fem 720-sidede terninger og en 20-sidig terning, noe som gjør den matematisk gyldig, men upraktisk.

New Scientist rapporterer at Sparkes ba en gratisversjon av ChatGPT om å finne seks terninger for seks spillere, slik at hver terning hadde lik sjanse til å vinne og ingen kast kunne resultere i uavgjort. Forespørselen fulgte matematikeres tiårlange innsats for å konstruere et sammenlignbart fem-matrissett. Sparkes sier at chatboten ga et svar etter omtrent 13 minutter, etter to oppklarende spørsmål. Harshbarger, en forsker fra Auburn University som var involvert i arbeidet med fem-matriser, sjekket den numeriske konstruksjonen og fortalte New Scientist at den var riktig.

Den rapporterte konstruksjonen er ikke det mest kjente eller et praktisk spillprodukt. Fem terninger har 720 sider og den sjette har 20 sider. New Scientist sier at Harshbarger og samarbeidspartnere allerede hadde tilpasset resultatet med fem terninger til en konstruksjon med seks terninger der hver terning har 360 sider. Forskernes nettsted inneholder også femterningsløsningen og en metode for å utvide løsninger til flere terninger. New Scientist sier at et søk ikke fant spor av det eksakte svaret med seks terninger, men deltakerne kunne ikke fastslå om chatboten fant disse offentlige komponentene og fullførte arbeidet eller produserte løsningen uavhengig.

Kildedetaljer: newscientist.com ↗

Hvorfor det betyr noe

Rapporten gir et konkret, uavhengig kontrollert eksempel på et generell AI-system som kombinerer matematisk informasjon til en gyldig løsning. Den fastslår ikke at modellen skapte et nytt matematisk konsept, eller at den pålitelig kan løse vanskeligere problemer uten menneskelig tilsyn. Den praktiske implikasjonen er at chatbots kan hjelpe forskere med å generere kandidatkonstruksjoner, mens folk fortsatt må verifisere dem og vurdere om de er nyttige.

Dette er en nyttig funksjonsdemonstrasjon fordi chatboten ser ut til å ha koblet en eksisterende matematisk konstruksjon med en kjent induksjonsmetode og levert en gyldig utvidelse på vanlig engelsk. Harshbargers numeriske sjekk er et meningsfullt bevis på at svaret ikke bare var usammenhengende utdata, men det er ikke det samme som et formelt bevis eller en kontrollert evaluering på tvers av mange problemer.

Rapporten viser også grensen for resultatet. Svaret er vanskelig og fysisk ubrukelig, og kilden gir ingen uavhengig test av chatbotens resonneringsprosess. New Scientist siterer OpenAIs Sébastien Bubeck som forutsier fortsatt fremgang, men det er et ekspertsyn snarere enn bevis fra dette eksperimentet. Artikkelen sier at dagens systemer kan finne løsninger eller moteksempler på eksisterende problemer, men at de ikke har demonstrert etableringen av nye matematiske konsepter eller felt.

Interactive Mechanism

Interaktiv mekanisme: Hvordan det faktisk fungerer

Utforsk den underliggende teknologien bak denne utviklingen interaktivt.

Thinking Budget (Test-Time Tokens):1,024 tokens
Complex Accuracy79%Math & Code Logic
Latency3.2sTime to first full output
Inference Cost$0.0092Per query estimated
Reasoning StyleStep VerificationInternal chain depth
Active Thinking Trace:
1Deconstruct user problem into formal constraints
2Propose candidate hypotheses & step-by-step calculation
3Self-correction: Backtrack and refute subtle edge cases
4Exhaustive consistency check & final output synthesis
Core takeaway: Test-time compute fundamentally changes AI economics. Instead of only scaling during pre-training, giving reasoning models more tokens at inference time allows them to systematically solve PhD-level STEM problems.
Interaktiv konseptsjekk+10 Points
AI Models Explained Quiz

Which component of an AI application is the machine-learning model itself?

Hva du skal se neste

De sentrale uløste spørsmålene er om resultatet kan reproduseres uavhengig, om et fullstendig bevis og utskrift blir tilgjengelig, og hvor mye av svaret som kom fra materiale som allerede er publisert på nettet. Artikkelen beskriver chatboten som gratis, men identifiserer ikke den eksakte modellen, versjonen, bruksgrensene eller om funksjonen er allment tilgjengelig.

En sterkere vurdering ville kreve full -og-svar-utskrift, en formell verifisering av konstruksjonen og tester av matematikere som ikke visste det forventede svaret. Det vil også bidra til å fastslå om modellen brukte forskernes nettsted, hvor mye oppfordring som var nødvendig, og om resultatet kan reproduseres med samme frie tilgang.

Det bredere spørsmålet er om AI kan generalisere fra kjente matematiske ingredienser til genuint nye problemer, i stedet for å løse varianter hvis relevante metoder allerede er online. Inntil det er demonstrert, støtter rapporten forsiktig bruk av chatbots som assistenter for å generere og sjekke kandidatideer, ikke som erstatning for bevis, dømmekraft eller matematisk forfatterskap.

Relaterte guider og quizer

AI-modeller forklartTransformatorerKIs fremtidTest det du vet – prøv en gratis AI-quizSlå opp et AI-begrep i ordlisten vårFølg AI-modellutgivelsessporeren
Fant du dette nyttig?