Математическое сообщество ставит фундаментальный вопрос: насколько можно доверять 719 математическим рукописям, созданным ИИ и опубликованным OpenAI. Поводом стала недавняя статья, в которой отмечается, что ранее представленоое OpenAI доказательство уравнений Навье — Стокса не вполне соответствует проверенному компьютером коду Lean.
Главное
После обнаружения ошибки в знаке число математических рукописей OpenAI, созданных ИИ, сократилось с 722 до 719.
Три британских математика обнаружили два места в доказательстве уравнений Навье — Стокса, где письменное доказательство расходится с кодом Lean.
Авторы статей не утверждают, что сами доказательства ошибочны, но подчёркивают: машинная проверка не может заменить рецензирование.
Публикация OpenAI о математике с помощью ИИ
6 октября OpenAI опубликовала большую подборку математических доказательств. Вышедший в четверг аналитический доклад указал, что в этой работе есть отступления от рекомендаций, которые независимая группа математиков подготовила для лабораторий, занимающихся ИИ. В первоначальном каталоге было 722 работы, но OpenAI отозвала три из них после обнаружения ошибок со знаками: из-за них рушилось одно логическое рассуждение, а проблемы возникли и в ещё двух работах, опиравшихся на него.
Рекомендации опубликовала 29 сентября девятичленная Консультативная группа по математике и искусственному интеллекту (Advisory Group on Mathematics and Artificial Intelligence). Уже в первом предложении она призывает лаборатории «не тестировать сложные математические задачи на закрытых коммерческих моделях». Между тем в репозитории OpenAI говорится, что эти статьи стали результатом применения закрытой внутренней модели к неопубликованным исследовательским задачам.
Лишь к 10 работам из всего набора результатов прилагается описание, обобщающее ход рассуждений модели. Только около 42% основных итоговых результатов формализованы на Lean — языке программирования, который позволяет машине проверять математические доказательства.
Читайте также: Сколько зарабатывает генеральный директор Anthropic в год? Пакет вознаграждения раскрыт в документах к IPO
Доказательство Навье — Стокса: где оно дало сбой
**Александр Бастунис (Alexander Bastounis)** из Королевского колледжа Лондона, Фабиан Чирчелли (Fabian Circelli) и **Андерс Хансен (Anders Hansen)** из Кембриджского университета внимательно изучили доказательства, связанные с уравнениями Навье — Стокса, которые OpenAI в сентябре прошлого года объявила «решёнными». Они обнаружили два расхождения между текстом статьи и кодом Lean. В одном из случаев выяснилось, что код Lean доказывает лишь более слабую оценку, чем та, о которой говорится в статье.
Авторы воздержались от суждений о том, верны ли письменные доказательства. Их тезис уже: Lean может подтвердить истинность итоговой теоремы, но не гарантирует, что все промежуточные шаги аргументации, изложенной для чтения людьми, корректны. Поэтому авторы подчёркивают, что доказательства такого типа, созданные при помощи ИИ, всё равно должны проходить рецензирование людьми.
Лауреат Филдсовской премии **Теренс Тао (Terence Tao)** 6 октября написал, что нынешние задачи решают «промптеры ИИ», которые недостаточно понимают результаты и потому с трудом могут отвечать на вопросы или выступать с докладами на семинарах. Член консультативного совета и профессор Гарвардского университета Мелани Мачетт Вуд (Melanie Matchett Wood) также отметила, что к моменту публикации таких результатов «ещё никто не понимает их целиком — настоящая работа только начинается».
Доказательство OpenAI — в центре спора о доверии
Консультативный совет подчеркнул, что окончательное решение о том, насколько OpenAI следовала рекомендациям, должна принимать вся математическая среда в широком смысле. Споры вокруг проверки разгорелись после и без того напряжённого месяца.
8 сентября OpenAI объявила о результате, связанном с уравнениями Навье — Стокса, и вскоре это привело к спору о распределении заслуг с математиком Нью-Йоркского университета **Тристаном Бакмастером (Tristan Buckmaster)**. Через три дня после объявления 25 лауреатов Филдсовской премии опубликовали совместное заявление, предупредив, что массовое производство математических результатов с помощью ИИ может навредить академической среде.
Следующая статья: 722 опубликованные математические работы OpenAI, созданные с помощью ИИ: теперь оценивать их предстоит математикам
