Що сталося
WIRED повідомляє, що OpenAI заявив, що використав десятки тисяч агентів штучного інтелекту для вирішення 90-річної проблеми Нав’є-Стокса щодо існування та гладкості, яка приносить премію в 1 мільйон доларів. Рішення ще потребує незалежної перевірки. Математик Стівен Строгатц каже, що ця розробка може змінити чисту математику, а також попереджає, що корпоративна конкуренція може спонукати лабораторії надавати пріоритет публічним проривам і заголовкам.
WIRED повідомляє, що OpenAI заявив у вівторок, що використав десятки тисяч агентів для вирішення проблеми існування та гладкості Нав’є-Стокса, однієї з проблем Премії тисячоліття Інституту математики Клея. Джерело каже, що запропоноване рішення базується на стратегії, розробленій іспанськими математиками Дієго Кордовою та Луїсом Мартінесом-Зороа, і що результат все ще потребує незалежної перевірки.
У звіті також описується кредитний спір. Математик Нью-йоркського університету Трістан Бакмастер каже, що OpenAI швидко рухався після того, як дізнався про роботу, яку він виконував із дослідником Anthropic Левентом Альпеге над трьома тісно пов’язаними проблемами. Ці заяви, включаючи припущення про те, що OpenAI намагався вплинути на атрибуцію, представлені як заяви Бакмастера і не підтверджені незалежно в джерелі.
WIRED розміщує цю розробку разом із повідомленням Anthropic про використання Claude для доведення 29 500 невеликих теорем, формалізуючи існуючий доказ останньої теореми Ферма, і звітами OpenAI про серпневі досягнення щодо 10 інших давніх математичних проблем. Джерело не надає результатів незалежних тестів або технічних деталей, достатніх для безпосередньої оцінки цих тверджень.
Чому це важливо
У разі незалежної перевірки отримані результати означатимуть значний прогрес у математичних дослідженнях за допомогою ШІ. Він також розкриває складні питання про те, як слід призначати математичний кредит, коли системи штучного інтелекту базуються на роботі людини, чи можуть експерти-люди продовжувати розуміти згенеровані машиною докази та як можуть змінитися фінансування досліджень і кар’єра. Обліковий запис WIRED чітко пояснює, що значення залишається невизначеним, оскільки рішення ще не було незалежно перевірено, а суперечка щодо внеску не вирішена.
Повідомлена діяльність свідчить про те, що системи ШІ переходять від допомоги в рутинній математичній роботі до сприяння складним дослідницьким проблемам. Строгатц каже, що штучний інтелект може зробити проривну математику недоступною для дослідників, які не мають таких інструментів, тоді як його співробітник Алекс Таунсенд описує відчуття загрози з боку систем, які можуть перевершити його пікові дослідницькі здібності.
Наслідки виходять за межі швидкості. Математики-люди можуть дедалі більше нести відповідальність за пояснення та підтвердження згенерованих машиною доказів, але джерело сумнівається, як довго ця роль залишатиметься окремою. Це також викликає занепокоєння щодо того, чи збережуть отримані ШІ результати людське судження, яке використовується для вирішення того, які математичні питання є цінними чи естетично значущими.
Джерело представляє можливі переваги, а також ризики: штучний інтелект може розширити участь у математиці та зробити раніше непрактичні дослідження можливими. Однак ці переваги залежать від надійної верифікації, прозорого атрибуції та постійного фінансування експертів-людей.
Інтерактивний механізм: як він насправді працює
Дослідіть технологію, що лежить в основі цієї розробки, в інтерактивному режимі.
crm_get_transaction(id='4092').An agent must create a draft calendar event for Tuesday at 2 p.m. Which evidence would establish the requested result?
Що дивитися далі
Ключовими наступними кроками є незалежна перевірка заявленого рішення OpenAI, роз’яснення того, як робота пов’язана з попередніми внесками, і будь-яке рішення щодо премії в 1 мільйон доларів. Подальші відомості про агентів, докази та процес перевірки допоможуть визначити, чи є це надійним дослідницьким проривом чи в основному демонстрацією можливостей ШІ. У джерелі не задокументовано публічний доступ користувачів, наявність продукту чи ціни.
Оцінка рішення Нав’є-Стокса незалежними математиками є найважливішою невирішеною проблемою. Джерело не повідомляє, коли цей розгляд буде завершено, і не вказує на завершення публічної перевірки.
Обробка призу в 1 мільйон доларів США та визнання для Кордови, Мартінеса-Зороа, Бакмастера, Альпеге та OpenAI встановить, як установи призначають кредит, коли системи штучного інтелекту сприяють доказу.
Більше технічного розкриття методів агентів, формального статусу доказу та поділу між роботою людини та машини допоможе відрізнити перевірений математичний прогрес від демонстрації можливостей.
Джерело не документує запуск продукту чи загальний доступ до залучених систем. Він також не містить цін, доступності, незалежного порівняльного аналізу чи доказів того, що описані методи можуть бути відтворені дослідниками поза компаніями.