Что случилось
Репортер New Scientist Мэтью Спаркс говорит, что ChatGPT нашел решение задачи с игральными костями для шести игроков примерно после 13 минут рассуждений. Исследователь Эрик Харшбаргер проверил цифры и нашел их правильными. В конструкции используются пять игральных костей с 720 гранями и одна 20-гранная игральная кость, что делает ее математически обоснованной, но непрактичной.
New Scientist сообщает, что Спаркс попросил бесплатную версию ChatGPT найти шесть кубиков для шести игроков так, чтобы каждый кубик имел равные шансы на выигрыш и ни один бросок не мог привести к ничьей. Этот запрос последовал за десятилетней попыткой математиков построить сопоставимый набор из пяти кубиков. Спаркс говорит, что чат-бот дал ответ примерно через 13 минут после двух уточняющих запросов. Харшбаргер, исследователь из Обернского университета, участвовавший в работе с пятью штампами, проверил численную конструкцию и сообщил журналу New Scientist, что она верна.
Сообщаемая конструкция не является самым известным и практичным игровым продуктом. Пять игральных костей имеют 720 граней, а шестой — 20 граней. New Scientist сообщает, что Харшбаргер и его коллеги уже адаптировали результат игры на пяти кубиках в конструкцию из шести кубиков, в которой каждый кубик имеет 360 сторон. На веб-сайте исследователей также есть решение для пяти кубиков и метод распространения решения на большее количество кубиков. New Scientist сообщает, что поиск не нашел следов точного ответа на шесть кубиков, но участники не смогли определить, обнаружил ли чат-бот эти общедоступные компоненты и завершил работу или создал решение самостоятельно.
Подробности об источнике: newscientist.com ↗
Почему это важно
В отчете представлен конкретный, независимо проверенный пример системы искусственного интеллекта общего назначения, объединяющей математическую информацию в действенное решение. Он не устанавливает, что модель создала новую математическую концепцию или что она может надежно решать более сложные проблемы без контроля человека. Практический смысл заключается в том, что чат-боты могут помочь исследователям генерировать возможные конструкции, в то время как людям все равно придется проверять их и судить, полезны ли они.
Это полезная демонстрация возможностей, поскольку чат-бот, похоже, связал существующую математическую конструкцию с известным методом индукции и предоставил допустимое расширение на простом английском языке. Численная проверка Харшбаргера является убедительным свидетельством того, что ответ был не просто бессвязным выводом, но и не то же самое, что формальное доказательство или контролируемая оценка многих задач.
В отчете также показаны границы результата. Ответ неуклюж и физически непригоден для использования, а источник не предоставляет независимого теста процесса рассуждения чат-бота. New Scientist цитирует Себастьяна Бубека из OpenAI, предсказывающего дальнейший прогресс, но это скорее экспертная точка зрения, чем свидетельства этого эксперимента. В статье говорится, что современные системы могут находить решения или контрпримеры существующих проблем, но не продемонстрировали создание новых математических концепций или полей.
Интерактивный механизм: как он на самом деле работает
Изучите технологию, лежащую в основе этой разработки, в интерактивном режиме.
Which component of an AI application is the machine-learning model itself?
Что посмотреть дальше
Ключевые нерешенные вопросы: можно ли воспроизвести результат независимо, станут ли доступны полные доказательства и стенограмма и какая часть ответа получена из материалов, уже опубликованных в Интернете. В статье чат-бот описывается как бесплатный, но не указывается точная модель, версия, ограничения на использование и широко ли доступна эта возможность.
Более строгая оценка потребует полной расшифровки подсказок и ответов, формальной проверки конструкции и тестов математиков, которые не знали ожидаемого ответа. Это также помогло бы установить, использовала ли модель веб-сайт исследователей, сколько подсказок потребовалось и можно ли воспроизвести результат при таком же свободном доступе.
Более широкий вопрос заключается в том, может ли ИИ обобщать известные математические ингредиенты для решения действительно новых задач, а не решать варианты, соответствующие методы которых уже доступны в Интернете. Пока это не будет продемонстрировано, в отчете поддерживается осторожное использование чат-ботов в качестве помощников для генерации и проверки потенциальных идей, а не в качестве замены доказательств, суждений или математического авторства.