Публикация математических доказательств OpenAI вызвала спор об академических правилах

OpenAI разместила на GitHub сотни математических рукописей, созданных внутренней моделью. Математики спорят, достаточно ли такого формата для проверки и использования результатов, а сама компания предупреждает, что часть доказательств ещё не формализована.

OpenAI опубликовала на GitHub коллекцию из 722 математических рукописей, сгруппированных в 372 семейства результатов. Компания сообщает, что материалы создала внутренняя модель, а результаты находятся на разных стадиях проверки: у части нет формализаций в Lean, и некоторые неформализованные доказательства могут содержать ошибки. OpenAI обещает исправлять их и обновлять репозиторий.

Публикации предшествовала встреча в августе примерно 40 математиков и представителей компании. По данным Wired, учёные просили не ограничиваться постами в блоге или соцсетях, а выпускать полноценные статьи с объяснением методов и доказательств, чтобы коллеги могли проверить их, понять и использовать. Математик Северо-Западного университета Брайна Кра сказала, что, по её впечатлению, этот совет не был учтён.

Wired сообщал, что компания готовится выложить сотни результатов на GitHub. Представитель OpenAI Линдси Маккаллум сказала изданию, что ей неизвестно о заверениях не публиковать их одновременно; она также заявила, что срок выпуска не установлен и компания учитывает рекомендации консультативной группы по математике и искусственному интеллекту при Институте перспективных исследований.

Спор связан и с предыдущими разногласиями. В сентябре OpenAI задействовала тысячи ИИ-агентов для работы над задачей тысячелетия с премией в миллион долларов. Математик Нью-Йоркского университета Тристан Бакмастер обвинил компанию в том, что та опередила его работу над частью задачи, которую он исследовал вместе с сотрудником Anthropic Левентом Альпёге. Wired также описал претензии по поводу переговоров о возможном соавторстве с исследователем OpenAI Себастьяном Бубеком.

Некоторые учёные опасаются, что технологические компании концентрируют вычислительные ресурсы и меняют привычные нормы атрибуции и публикации. Профессор Нестор Гильен говорил Wired о таком восприятии среди математиков. Кра отмечала, что публикация доказательств в формате коротких постов не помогает научному сообществу развивать знания, на которых обучаются ИИ-системы.

После выхода коллекции OpenAI указала, что будет хранить историю версий и публиковать исправления отдельно. Компания сообщила, что большая часть результатов получена одним внутренним методом после примерно 4 тысяч задач; в среднем на результат уходило около трёх часов вычислений ChatGPT Pro. Часть математиков продолжает настаивать на подробном академическом изложении, тогда как Бубек считает, что ИИ может расширить возможности исследователей и помочь им браться за более сложные задачи.