Это та же модель, которая в прошлом месяце подготовила для OpenAI доказательство, связанное с уравнениями Навье — Стокса. Как сообщается в репозитории, во время оценки OpenAI предоставила ей около 4 000 задач. В среднем на каждый результат уходило около трёх часов вычислений ChatGPT Pro в режиме рассуждений.
Что находится в репозитории
К многим доказательствам прилагаются формальные версии на Lean — языке программирования, который позволяет компьютеру проверить доказательство. Но так оформлены не все работы. OpenAI предупреждает, что в некоторых результатах без формальной версии могут быть проблемы, и обещает оперативно их исправлять. Все предыдущие версии останутся в открытом доступе, а к каждой статье прилагается блок с данными для цитирования.
OpenAI также опубликовала десять кратких описаний рассуждений модели. Два результата были получены не по стандартной процедуре. Один из них — область, свободная от нулей дзета-функции Римана; текст о нём человек отредактировал для удобства чтения. Другой — доказательство гипотезы Ходжа для абелевых многообразий CM-типа.
Почти каждая статья появилась в результате одного запроса одному ИИ-агенту, рассказали в OpenAI изданию Scientific American. Компания будет финансировать семинары, конференции и специальные программы, посвящённые результатам, полученным с помощью ИИ. По её словам, она также работает над ответственным выпуском модели.
Советники говорят, что работа только начинается
OpenAI сообщила, что руководствовалась рекомендациями независимой группы математиков. Консультативную группу по математике и искусственному интеллекту (AGMAI) принимает у себя Институт перспективных исследований. В рекомендациях от 29 сентября группа призвала ИИ-лаборатории прекратить проверять сложные математические задачи на закрытых моделях. Она также призвала публиковать запросы, затраченное время и вычислительные ресурсы, использованные для получения каждого результата.
«Использование ИИ-лабораториями закрытых внутренних моделей для математических исследований грозит созданием системы двух уровней, в которой лаборатории будут опережать остальную научную область», — написала группа.
Во вторник вечером AGMAI заявила, что её рекомендации не являются ни одобрением результатов, ни одобрением методов, которыми OpenAI их получила.
«Эта публикация — начало, а не завершение процесса осмысления результатов людьми», — написала группа.
Руководитель исследовательского направления OpenAI Дэн Робертс сообщил The New York Times, что тестирование внутренних моделей помогает создавать более совершенные инструменты. По его словам, доказательства стали побочным результатом.
Математик Нью-Йоркского университета Тристан Бакмастер занимался задачей Навье — Стокса ещё до того, как её решила OpenAI. Он сказал Times, что сомневается, успела ли OpenAI проверить такое большое число результатов, опубликованных одновременно.
«Не думаю, что они вообще провели должную проверку», — сказал Бакмастер.
Математик Массачусетского технологического института Эндрю Сазерленд посоветовал Scientific American считать заявления о работе одного агента неподтверждёнными. По его словам, так следует считать до тех пор, пока другие не смогут запустить модель и повторить результаты.
Опубликовано 7 октября 2026 - 09:10 Наверх



