OpenAI опубликовала 377 математических результатов, вызвав вопросы о проверке доказательств

Компания OpenAI представила сотни результатов, полученных внутренней моделью искусственного интеллекта для открытых математических задач. Математики приветствуют доступ к материалам, но обсуждают, насколько независимо проверены доказательства и не использовала ли модель идеи исследователей.

В материале Sydney Morning Herald говорится о 377 новых результатах в алгебре, теории чисел, теоретической информатике, математической логике и топологии. OpenAI разместила работы в репозитории GitHub 6 октября. К выпуску приложены формализации многих доказательств на языке Lean, который позволяет проверять логические шаги с помощью компьютера.

Компания также опубликовала 10 кратких описаний рассуждений модели и сведения о затраченных вычислительных ресурсах. По оценке OpenAI, на один результат в среднем ушло вычислений примерно на три часа работы ChatGPT Pro. Модель, создавшая результаты, остается внутренней и не выпущена публично.

Ученые обсуждают, насколько эти результаты независимы от уже существовавшей человеческой работы. Тристан Бакмастер из Нью-Йоркского университета, который исследовал задачу Навье — Стокса, сказал, что некоторые доказательства могли развивать идеи математиков, использовавших ИИ. Он также усомнился, что такой большой массив результатов успели должным образом проверить.

OpenAI заявила, что консультировалась с независимой группой математиков при Институте перспективных исследований в Принстоне. Группа рекомендует публиковать запросы, поданные моделям, и цепочки их рассуждений. 29 сентября она призвала лаборатории прекратить проверять закрытые модели на сложных задачах. Ее участники подчеркнули, что публикация материалов — лишь начало их проверки и включения в научные знания.

В прошлом месяце OpenAI сообщила, что ее модель решила уравнение Навье — Стокса, одну из семи задач тысячелетия Института Клэя, за решение которых предусмотрена награда в 1 млн долларов. Компания говорит, что внутренние испытания нужны для создания научных инструментов, а доказательства стали побочным результатом такой работы. Публикация вновь подняла вопросы о проверке и атрибуции результатов, полученных с помощью закрытых моделей.