Terug naar Nieuws
InnovatieAI Understanding-briefing

De wiskundige doorbraken van AI brengen wiskundigen van hun stuk en geven een nieuwe vorm aan pure wiskunde

WIRED onderzoekt hoe recente AI-claims in de wiskunde het onderzoek versnellen en tegelijkertijd onopgeloste vragen oproepen over verificatie, krediet en de toekomstige rol van menselijke wiskundigen.

4 min readRead the original reporting
Source-provided image accompanying AI’s mathematical breakthroughs unsettle mathematicians and reshape pure math
Toegeschreven rapportageBron opgenomen
Uitgever
wired.com
Bronlink
wired.comhttps://www.wired.com/story/mathematician-steven-strogatz-grapples-with-ai-recent-breakthroughs/
Brontype
Rapportage door een nieuwskanaal – geen document van eigen hand.

Wat we niet onafhankelijk konden bevestigen: Deze claim wordt toegeschreven aan het genoemde verkooppunt. We hebben het niet geverifieerd aan de hand van een document van de eerste partij. (wired.com)

ContextBegrijp dit in 60 seconden

Begin hier

Sleuteltermen

Benchmark
Een gestandaardiseerde test of dataset die wordt gebruikt om de prestaties van modellen te meten en te vergelijken.
Test jezelfAI-agentenquiz

Wat is er gebeurd

WIRED meldt dat OpenAI zei dat het tienduizenden AI-agenten heeft gebruikt om het 90 jaar oude bestaans- en gladheidsprobleem van Navier-Stokes op te lossen, waarvoor een prijs van $ 1 miljoen is gewonnen. De oplossing vereist nog steeds onafhankelijke verificatie. Wiskundige Steven Strogatz zegt dat de ontwikkeling de pure wiskunde zou kunnen transformeren, terwijl hij ook waarschuwt dat de concurrentie van bedrijven laboratoria zou kunnen aanmoedigen om prioriteit te geven aan publieke doorbraken en krantenkoppen.

WIRED meldt dat OpenAI dinsdag zei dat het tienduizenden agenten had gebruikt om het bestaans- en gladheidsprobleem van Navier-Stokes op te lossen, een van de Millennium Prize-problemen van het Clay Mathematics Institute. De bron zegt dat de voorgestelde oplossing voortbouwt op een strategie ontwikkeld door de Spaanse wiskundigen Diego Córdoba en Luis Martínez-Zoroa, en dat het resultaat nog steeds onafhankelijke verificatie behoeft.

In het rapport wordt ook een kredietgeschil beschreven. Wiskundige Tristan Buckmaster van de Universiteit van New York zegt dat OpenAI snel handelde nadat hij hoorde over het werk dat hij met Anthropic-onderzoeker Levent Alpöge had gedaan aan drie nauw verwante problemen. Deze beweringen, inclusief de suggestie dat OpenAI de attributie probeerde te beïnvloeden, worden gepresenteerd als de beweringen van Buckmaster en worden niet onafhankelijk bevestigd in de bron.

WIRED plaatst de ontwikkeling naast Anthropic's gerapporteerde gebruik van Claude om 29.500 kleine stellingen te bewijzen, terwijl een bestaand bewijs van de laatste stelling van Fermat wordt geformaliseerd, en OpenAI's gerapporteerde vooruitgang in augustus op 10 andere al lang bestaande wiskundige problemen. De bron verstrekt geen onafhankelijke testresultaten of technische details die voldoende zijn om deze beweringen rechtstreeks te beoordelen.

Brongegevens: wired.com ↗

Waarom het ertoe doet

Als het onafhankelijk wordt geverifieerd, zou het gerapporteerde resultaat een belangrijke stap voorwaarts betekenen in het door AI ondersteunde wiskundig onderzoek. Het legt ook moeilijke vragen bloot over hoe wiskundig krediet moet worden toegekend wanneer AI-systemen voortbouwen op menselijk werk, of menselijke experts door machines gegenereerde bewijzen kunnen blijven begrijpen, en hoe onderzoeksfinanciering en carrières kunnen veranderen. Het verhaal van WIRED maakt duidelijk dat de betekenis nog steeds onzeker is, omdat de oplossing nog niet onafhankelijk is geverifieerd en het geschil over de bijdrage onopgelost is.

De gerapporteerde activiteit suggereert dat AI-systemen zich ontwikkelen van het assisteren bij routinematig wiskundig werk naar het bijdragen aan moeilijke onderzoeksproblemen. Strogatz zegt dat AI baanbrekende wiskunde ontoegankelijk kan maken voor onderzoekers die dergelijke hulpmiddelen niet hebben, terwijl zijn medewerker Alex Townsend beschrijft dat hij zich bedreigd voelt door systemen die zijn toponderzoekscapaciteiten kunnen overtreffen.

De gevolgen reiken verder dan snelheid. Menselijke wiskundigen zijn wellicht in toenemende mate verantwoordelijk voor het verklaren en valideren van door machines gegenereerde bewijzen, maar de bron vraagt ​​zich af hoe lang die rol verschillend zal blijven. Het roept ook zorgen op over de vraag of door AI gegenereerde resultaten het menselijk oordeel zullen behouden dat wordt gebruikt om te beslissen welke wiskundige vragen waardevol of esthetisch betekenisvol zijn.

De bron biedt zowel mogelijke voordelen als risico's: AI zou de deelname aan de wiskunde kunnen verbreden en voorheen onpraktisch onderzoek haalbaar kunnen maken. Deze voordelen zijn echter afhankelijk van betrouwbare verificatie, transparante attributie en voortdurende financiering van menselijke experts.

Interactive Mechanism

Interactief mechanisme: hoe het eigenlijk werkt

Ontdek interactief de onderliggende technologie achter deze ontwikkeling.

Agent Lifecycle Stage:
1
User Intent & Planning: "Audit customer refund request #4092 and settle payment."
2
Tool Calling: Emits structured JSON call crm_get_transaction(id='4092').
3
Guardrail & Verification:🛡️ Paused: High-value action requires human operator sign-off.
4
Final Settlement: Refund recorded, email receipt dispatched, and audit log stored.
Core takeaway: An AI agent is not just a language model—it is a closed loop of planning, tool invocation, and environment feedback. Production systems require self-healing retries and strict human approval guardrails.
Interactieve conceptcheck+10 Points
AI Agents Quiz

An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?

Wat je nu moet bekijken

De belangrijkste volgende stappen zijn onafhankelijke verificatie van de geclaimde oplossing van OpenAI, verduidelijking van hoe het werk zich verhoudt tot eerdere bijdragen en een eventuele beslissing over de prijs van $ 1 miljoen. Verdere details over de agenten, het bewijs- en beoordelingsproces zouden kunnen helpen vaststellen of dit een betrouwbare doorbraak in het onderzoek is of in de eerste plaats een demonstratie van AI-capaciteiten. Er zijn geen openbare gebruikerstoegang, productbeschikbaarheid of prijzen gedocumenteerd in de bron.

De beoordeling door onafhankelijke wiskundigen van de Navier-Stokes-oplossing is het belangrijkste onopgeloste probleem. De bron zegt niet wanneer die beoordeling zal worden voltooid en identificeert ook geen voltooide openbare verificatie.

De afhandeling van de prijs van $ 1 miljoen en de erkenning voor Córdoba, Martínez-Zoroa, Buckmaster, Alpöge en OpenAI zouden vaststellen hoe instellingen krediet toekennen wanneer AI-systemen bijdragen aan een bewijs.

Meer technische onthulling over de methoden van de agenten, de formele status van het bewijs en de scheiding tussen menselijk en machinaal werk zou helpen een gevalideerde wiskundige vooruitgang te onderscheiden van een demonstratie van capaciteiten.

De bron documenteert geen productlancering of algemene toegang tot de betrokken systemen. Het biedt ook geen prijsstelling, beschikbaarheid, onafhankelijke of bewijs dat de gerapporteerde methoden kunnen worden gereproduceerd door onderzoekers buiten de bedrijven.

Gerelateerde gidsen en quizzen

AI-agentenAI-modellen uitgelegdToekomst van AITest wat je weet: probeer een gratis AI-quizZoek een AI-term op in onze woordenlijstVolg de AI-modelreleasetracker
Vond je dit nuttig?