Какво стана
WIRED съобщава, че OpenAI каза, че е използвал десетки хиляди AI агенти, за да реши 90-годишния проблем за съществуването и гладкостта на Navier-Stokes, който носи награда от 1 милион долара. Решението все още изисква независима проверка. Математикът Стивън Строгац казва, че разработката може да трансформира чистата математика, като същевременно предупреждава, че корпоративната конкуренция може да насърчава лабораториите да дават приоритет на публичните пробиви и заглавия.
WIRED съобщава, че OpenAI заяви във вторник, че е използвал десетки хиляди агенти за решаване на проблема за съществуването и гладкостта на Navier-Stokes, един от проблемите на наградата на хилядолетието на Clay Mathematics Institute. Източникът казва, че предложеното решение се основава на стратегия, разработена от испанските математици Диего Кордоба и Луис Мартинес-Зороа, и че резултатът все още се нуждае от независима проверка.
В доклада е описан и кредитен спор. Математикът от Нюйоркския университет Тристан Бъкмастър казва, че OpenAI се е придвижил бързо, след като е научил за работата, която е свършил с изследователя на Anthropic Левент Алпьоге по три тясно свързани проблема. Тези твърдения, включително предположението, че OpenAI се е опитал да повлияе на приписването, са представени като твърдения на Buckmaster и не са независимо потвърдени в източника.
WIRED поставя разработката заедно с докладваното използване на Claude от Anthropic за доказване на 29 500 малки теореми, като същевременно формализира съществуващо доказателство на последната теорема на Ферма, и докладвания напредък на OpenAI през август по 10 други дългогодишни математически проблема. Източникът не предоставя резултати от независими тестове или технически подробности, достатъчни за пряка оценка на тези твърдения.
Детайли за източника: wired.com ↗
Защо има значение
Ако бъде потвърден независимо, отчетеният резултат ще отбележи последващ напредък в математическите изследвания, подпомагани от AI. Той също така излага трудни въпроси за това как трябва да се присвоява математически кредит, когато AI системите се основават на човешка работа, дали човешките експерти могат да продължат да разбират машинно генерирани доказателства и как финансирането на научните изследвания и кариерите могат да се променят. Профилът на WIRED ясно показва, че значението остава неуредено, тъй като решението все още не е независимо проверено и спорът относно приноса е неразрешен.
Отчетената дейност предполага, че AI системите преминават от помощ при рутинна математическа работа към допринасяне за трудни изследователски проблеми. Strogatz казва, че изкуственият интелект може да направи пробивната математика недостъпна за изследователи, които нямат такива инструменти, докато сътрудникът му Алекс Таунсенд описва, че се чувства застрашен от системи, които могат да надминат неговите върхови изследователски способности.
Последствията се простират отвъд скоростта. Човешките математици може да са все по-отговорни за обяснението и валидирането на машинно генерирани доказателства, но източникът се съмнява колко дълго тази роля ще остане различна. Това също така поражда опасения относно това дали генерираните от AI резултати ще запазят човешката преценка, използвана за решаване кои математически въпроси са ценни или естетически значими.
Източникът представя възможни ползи, както и рискове: AI може да разшири участието в математиката и да направи непрактични преди изследвания осъществими. Тези ползи обаче зависят от надеждна проверка, прозрачно приписване и продължаващо финансиране за човешки експерти.
Интерактивен механизъм: как всъщност работи
Разгледайте интерактивно основната технология зад тази разработка.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Какво да гледате след това
Ключовите следващи стъпки са независима проверка на заявеното решение на OpenAI, изясняване на това как работата е свързана с предишни вноски и всяко решение относно наградата от $1 милион. Допълнителни подробности за агентите, доказателството и процеса на преглед биха помогнали да се установи дали това е надежден изследователски пробив или преди всичко демонстрация на способности на AI. В източника не е документиран публичен потребителски достъп, наличност на продукта или ценообразуване.
Оценката на независими математици на решението на Навие-Стокс е най-важният неразрешен проблем. Източникът не казва кога този преглед ще бъде завършен или идентифицира завършена публична проверка.
Управлението на наградата от 1 милион долара и признанието за Кордоба, Мартинес-Зороа, Бъкмастър, Алпьоге и OpenAI ще установи как институциите приписват кредит, когато AI системите допринасят за доказателство.
Повече техническо разкриване относно методите на агентите, официалния статус на доказателството и разделението между човешка и машинна работа биха помогнали да се разграничи валидиран математически напредък от демонстрация на способности.
Източникът не документира стартиране на продукт или общ достъп до включените системи. Той също така не предоставя цени, наличност, независим бенчмарк или доказателства, че отчетените методи могат да бъдат възпроизведени от изследователи извън компаниите.