Hva skjedde
New Scientist-reporter Matthew Sparkes sier at ChatGPT genererte en løsning på et terningproblem med seks spillere etter omtrent 13 minutters resonnement. Forsker Eric Harshbarger sjekket tallene og fant dem riktige. Konstruksjonen bruker fem 720-sidede terninger og en 20-sidig terning, noe som gjør den matematisk gyldig, men upraktisk.
New Scientist rapporterer at Sparkes ba en gratisversjon av ChatGPT om å finne seks terninger for seks spillere, slik at hver terning hadde lik sjanse til å vinne og ingen kast kunne resultere i uavgjort. Forespørselen fulgte matematikeres tiårlange innsats for å konstruere et sammenlignbart fem-matrissett. Sparkes sier at chatboten ga et svar etter omtrent 13 minutter, etter to oppklarende spørsmål. Harshbarger, en forsker fra Auburn University som var involvert i arbeidet med fem-matriser, sjekket den numeriske konstruksjonen og fortalte New Scientist at den var riktig.
Den rapporterte konstruksjonen er ikke det mest kjente eller et praktisk spillprodukt. Fem terninger har 720 sider og den sjette har 20 sider. New Scientist sier at Harshbarger og samarbeidspartnere allerede hadde tilpasset resultatet med fem terninger til en konstruksjon med seks terninger der hver terning har 360 sider. Forskernes nettsted inneholder også femterningsløsningen og en metode for å utvide løsninger til flere terninger. New Scientist sier at et søk ikke fant spor av det eksakte svaret med seks terninger, men deltakerne kunne ikke fastslå om chatboten fant disse offentlige komponentene og fullførte arbeidet eller produserte løsningen uavhengig.
Kildedetaljer: newscientist.com ↗
Hvorfor det betyr noe
Rapporten gir et konkret, uavhengig kontrollert eksempel på et generell AI-system som kombinerer matematisk informasjon til en gyldig løsning. Den fastslår ikke at modellen skapte et nytt matematisk konsept, eller at den pålitelig kan løse vanskeligere problemer uten menneskelig tilsyn. Den praktiske implikasjonen er at chatbots kan hjelpe forskere med å generere kandidatkonstruksjoner, mens folk fortsatt må verifisere dem og vurdere om de er nyttige.
Dette er en nyttig funksjonsdemonstrasjon fordi chatboten ser ut til å ha koblet en eksisterende matematisk konstruksjon med en kjent induksjonsmetode og levert en gyldig utvidelse på vanlig engelsk. Harshbargers numeriske sjekk er et meningsfullt bevis på at svaret ikke bare var usammenhengende utdata, men det er ikke det samme som et formelt bevis eller en kontrollert evaluering på tvers av mange problemer.
Rapporten viser også grensen for resultatet. Svaret er vanskelig og fysisk ubrukelig, og kilden gir ingen uavhengig test av chatbotens resonneringsprosess. New Scientist siterer OpenAIs Sébastien Bubeck som forutsier fortsatt fremgang, men det er et ekspertsyn snarere enn bevis fra dette eksperimentet. Artikkelen sier at dagens systemer kan finne løsninger eller moteksempler på eksisterende problemer, men at de ikke har demonstrert etableringen av nye matematiske konsepter eller felt.
Interaktiv mekanisme: Hvordan det faktisk fungerer
Utforsk den underliggende teknologien bak denne utviklingen interaktivt.
Which component of an AI application is the machine-learning model itself?
Hva du skal se neste
De sentrale uløste spørsmålene er om resultatet kan reproduseres uavhengig, om et fullstendig bevis og utskrift blir tilgjengelig, og hvor mye av svaret som kom fra materiale som allerede er publisert på nettet. Artikkelen beskriver chatboten som gratis, men identifiserer ikke den eksakte modellen, versjonen, bruksgrensene eller om funksjonen er allment tilgjengelig.
En sterkere vurdering ville kreve full -og-svar-utskrift, en formell verifisering av konstruksjonen og tester av matematikere som ikke visste det forventede svaret. Det vil også bidra til å fastslå om modellen brukte forskernes nettsted, hvor mye oppfordring som var nødvendig, og om resultatet kan reproduseres med samme frie tilgang.
Det bredere spørsmålet er om AI kan generalisere fra kjente matematiske ingredienser til genuint nye problemer, i stedet for å løse varianter hvis relevante metoder allerede er online. Inntil det er demonstrert, støtter rapporten forsiktig bruk av chatbots som assistenter for å generere og sjekke kandidatideer, ikke som erstatning for bevis, dømmekraft eller matematisk forfatterskap.