Перейти к содержимому
Новость

OpenAI выложила 722 математические работы своего ИИ, но проверены еще не все

В открытом репозитории OpenAI появились 722 математические рукописи, объединенные в 372 группы результатов. Их подготовила еще не выпущенная внутренняя модель компании, причем OpenAI прямо предупреждает: часть доказательств пока не формализована и может содержать ошибки.

RaVic
OpenAI выложила 722 математические работы своего ИИ, но проверены еще не все

Автор: openai

Масштаб публикации выглядит необычно даже для нынешнего темпа развития ИИ. В ходе эксперимента внутренней модели предложили около 4000 открытых математических задач. После отбора результатов компания сформировала каталог из 372 групп и 722 отдельных рукописей. По данным OpenAI, на получение одного результата в среднем уходило около трех часов вычислений в режиме ChatGPT Pro.

Сам каталог доступен в репозитории OpenAI Math на GitHub. Это не подборка коротких ответов модели: в репозитории находятся PDF-рукописи, исходные файлы, материалы для цитирования, формальные доказательства на Lean и сокращенные записи рассуждений для части результатов.

Среди заявленных результатов есть решение обратной гипотезы Гольдбаха Оствальда, новый верхний предел 9/4 для показателя сложности умножения матриц и алгоритм для задачи Subset Sum со временем O(2^0,49n). Каталог охватывает разные области математики, поэтому оценивать публикацию как одно большое доказательство было бы неправильно.

И здесь проходит граница между громким числом 722 и тем, что действительно можно считать проверенным результатом. OpenAI сама указывает, что работы находятся на разных стадиях верификации. Формализация в Lean имеется у многих рукописей, но не у всех, а в нефомализованных доказательствах компания допускает наличие ошибок. Репозиторий планируется обновлять, сохраняя предыдущие версии исправленных работ.

Это делает публикацию интереснее обычной демонстрации возможностей языковой модели. Результаты можно проверять по отдельности, сопоставлять с существующей математической литературой и отслеживать исправления. Но число опубликованных рукописей пока нельзя автоматически превращать в число доказанных математических открытий.

Не раскрыта и сама модель, выполнившая основную часть работы. OpenAI называет ее внутренней frontier-моделью и не сообщает название или сроки публичного выпуска. Поэтому сейчас проверить можно опубликованную математику, но не систему, которая ее получила. Именно дальнейшая независимая проверка покажет, какая часть огромного каталога выдержит обычную для математических результатов процедуру проверки.

Источник: GitHub
5 показов