Wat is er gebeurd
WIRED meldt dat OpenAI zei dat het tienduizenden AI-agenten heeft gebruikt om het 90 jaar oude bestaans- en gladheidsprobleem van Navier-Stokes op te lossen, waarvoor een prijs van $ 1 miljoen is gewonnen. De oplossing vereist nog steeds onafhankelijke verificatie. Wiskundige Steven Strogatz zegt dat de ontwikkeling de pure wiskunde zou kunnen transformeren, terwijl hij ook waarschuwt dat de concurrentie van bedrijven laboratoria zou kunnen aanmoedigen om prioriteit te geven aan publieke doorbraken en krantenkoppen.
WIRED meldt dat OpenAI dinsdag zei dat het tienduizenden agenten had gebruikt om het bestaans- en gladheidsprobleem van Navier-Stokes op te lossen, een van de Millennium Prize-problemen van het Clay Mathematics Institute. De bron zegt dat de voorgestelde oplossing voortbouwt op een strategie ontwikkeld door de Spaanse wiskundigen Diego Córdoba en Luis Martínez-Zoroa, en dat het resultaat nog steeds onafhankelijke verificatie behoeft.
In het rapport wordt ook een kredietgeschil beschreven. Wiskundige Tristan Buckmaster van de Universiteit van New York zegt dat OpenAI snel handelde nadat hij hoorde over het werk dat hij met Anthropic-onderzoeker Levent Alpöge had gedaan aan drie nauw verwante problemen. Deze beweringen, inclusief de suggestie dat OpenAI de attributie probeerde te beïnvloeden, worden gepresenteerd als de beweringen van Buckmaster en worden niet onafhankelijk bevestigd in de bron.
WIRED plaatst de ontwikkeling naast Anthropic's gerapporteerde gebruik van Claude om 29.500 kleine stellingen te bewijzen, terwijl een bestaand bewijs van de laatste stelling van Fermat wordt geformaliseerd, en OpenAI's gerapporteerde vooruitgang in augustus op 10 andere al lang bestaande wiskundige problemen. De bron verstrekt geen onafhankelijke testresultaten of technische details die voldoende zijn om deze beweringen rechtstreeks te beoordelen.
Waarom het ertoe doet
Als het onafhankelijk wordt geverifieerd, zou het gerapporteerde resultaat een belangrijke stap voorwaarts betekenen in het door AI ondersteunde wiskundig onderzoek. Het legt ook moeilijke vragen bloot over hoe wiskundig krediet moet worden toegekend wanneer AI-systemen voortbouwen op menselijk werk, of menselijke experts door machines gegenereerde bewijzen kunnen blijven begrijpen, en hoe onderzoeksfinanciering en carrières kunnen veranderen. Het verhaal van WIRED maakt duidelijk dat de betekenis nog steeds onzeker is, omdat de oplossing nog niet onafhankelijk is geverifieerd en het geschil over de bijdrage onopgelost is.
De gerapporteerde activiteit suggereert dat AI-systemen zich ontwikkelen van het assisteren bij routinematig wiskundig werk naar het bijdragen aan moeilijke onderzoeksproblemen. Strogatz zegt dat AI baanbrekende wiskunde ontoegankelijk kan maken voor onderzoekers die dergelijke hulpmiddelen niet hebben, terwijl zijn medewerker Alex Townsend beschrijft dat hij zich bedreigd voelt door systemen die zijn toponderzoekscapaciteiten kunnen overtreffen.
De gevolgen reiken verder dan snelheid. Menselijke wiskundigen zijn wellicht in toenemende mate verantwoordelijk voor het verklaren en valideren van door machines gegenereerde bewijzen, maar de bron vraagt zich af hoe lang die rol verschillend zal blijven. Het roept ook zorgen op over de vraag of door AI gegenereerde resultaten het menselijk oordeel zullen behouden dat wordt gebruikt om te beslissen welke wiskundige vragen waardevol of esthetisch betekenisvol zijn.
De bron biedt zowel mogelijke voordelen als risico's: AI zou de deelname aan de wiskunde kunnen verbreden en voorheen onpraktisch onderzoek haalbaar kunnen maken. Deze voordelen zijn echter afhankelijk van betrouwbare verificatie, transparante attributie en voortdurende financiering van menselijke experts.
Interactief mechanisme: hoe het eigenlijk werkt
Ontdek interactief de onderliggende technologie achter deze ontwikkeling.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Wat je nu moet bekijken
De belangrijkste volgende stappen zijn onafhankelijke verificatie van de geclaimde oplossing van OpenAI, verduidelijking van hoe het werk zich verhoudt tot eerdere bijdragen en een eventuele beslissing over de prijs van $ 1 miljoen. Verdere details over de agenten, het bewijs- en beoordelingsproces zouden kunnen helpen vaststellen of dit een betrouwbare doorbraak in het onderzoek is of in de eerste plaats een demonstratie van AI-capaciteiten. Er zijn geen openbare gebruikerstoegang, productbeschikbaarheid of prijzen gedocumenteerd in de bron.
De beoordeling door onafhankelijke wiskundigen van de Navier-Stokes-oplossing is het belangrijkste onopgeloste probleem. De bron zegt niet wanneer die beoordeling zal worden voltooid en identificeert ook geen voltooide openbare verificatie.
De afhandeling van de prijs van $ 1 miljoen en de erkenning voor Córdoba, Martínez-Zoroa, Buckmaster, Alpöge en OpenAI zouden vaststellen hoe instellingen krediet toekennen wanneer AI-systemen bijdragen aan een bewijs.
Meer technische onthulling over de methoden van de agenten, de formele status van het bewijs en de scheiding tussen menselijk en machinaal werk zou helpen een gevalideerde wiskundige vooruitgang te onderscheiden van een demonstratie van capaciteiten.
De bron documenteert geen productlancering of algemene toegang tot de betrokken systemen. Het biedt ook geen prijsstelling, beschikbaarheid, onafhankelijke of bewijs dat de gerapporteerde methoden kunnen worden gereproduceerd door onderzoekers buiten de bedrijven.