OpenAI опубликовала 722 математические рукописи, созданные ИИ, вызвав и похвалу, и возражения
Коротко
OpenAI опубликовала на GitHub 722 математические рукописи, созданные неопубликованной внутренней моделью ИИ и сгруппированные в 372 результата в таких областях, как теория чисел и алгебраическая геометрия. Результат о «квази-гипотезе Римана» получил высокую оценку профессора Рутгерского университета Алекса Конторовича, однако не все рукописи формально проверены, и OpenAI заявила, что непроверенные могут содержать ошибки. Объединения математиков и лауреаты медали Филдса раскритиковали то, как компании в сфере ИИ используют нерешённые математические задачи.
Читать полностью 2 мин чтения
OpenAI опубликовала 722 математические рукописи, созданные неопубликованной внутренней моделью ИИ и сгруппированные в 372 результата в области теории чисел, алгебраической геометрии, дифференциальных уравнений, математической логики и других областях. Chosun Ilbo, Asia Economy и Newsis сообщили, что публикация состоялась 6 октября по местному времени; Korea Economic Daily со ссылкой на OpenAI и Wall Street Journal назвало день, предшествовавший 8 октября. Рукописи были опубликованы на GitHub. OpenAI заявила, что дала модели около 4000 задач и что на каждый результат в среднем уходили вычислительные ресурсы, равные примерно трём часам рассуждений ChatGPT Pro. Newsis отметило, что 722 рукописи не означают решения 722 отдельных задач. [ 1 , 2 , 3 , 4 ]
Самый обсуждаемый результат касается «квази-гипотезы Римана» — ослабленной формы гипотезы Римана. Korea Economic Daily сообщило, что рукопись не доказывает саму гипотезу Римана, но заявляет о расширении области, в которой отсутствуют нули дзета-функции Римана и L-функций Дирихле. Алекс Конторович, профессор Рутгерского университета, написал в X, что, если бы это сделал человек, он немедленно получил бы медаль Филдса. Korea Economic Daily сообщило, что публикация включает продвижение, связанное с тремя нерешёнными задачами тысячелетия, которые сами решены не были. Chosun Ilbo сообщило, что ранее, в августе, OpenAI объявила о результатах по 10 задачам, а в сентябре заявила о решении более 100 давних задач. [ 1 , 2 ]
Многие рукописи включают формальную проверку на языке Lean, но не все, и OpenAI заявила, что непроверенные рукописи могут содержать ошибки. Ом Сан Иль (엄상일) из Института фундаментальных наук сказал Asia Economy, что примерно у 42 % приложена формализация в Lean. Asia Economy сообщило, что, по словам OpenAI, по состоянию на 14:20 8 октября компания отозвала три результата и пересмотрела или дополнила около десятка доказательств. Пэк Хён Рёль (백형렬) из KAIST заявил, что в публикации есть несколько задач, которые в его области он назвал бы задачами уровня медали Филдса, и что влияние будет очень большим, если основные результаты подтвердятся, но прочитанные им рукописи трудно понять. [ 1 , 3 , 4 ]
Публикация вызвала критику. Независимая консультативная группа по математике и ИИ, созданная по предложению OpenAI, заявила 6 октября, что будущее математических исследований не должно сводиться только к осмыслению результатов, полученных компаниями в сфере ИИ, сообщило Chosun Ilbo. Объединение математиков, созданное в прошлом месяце, AHM (인간을 위한 수학협회), заявило 7 октября, что одновременная публикация более 700 файлов — демонстрация силы, и призвало математиков прекратить сотрудничество с OpenAI. В прошлом месяце 25 лауреатов медали Филдса, включая Теренса Тао, Петера Шольце и Джун Хо, выступили с совместным заявлением, в котором раскритиковали компании в сфере ИИ за использование математических задач в качестве эталонных тестов производительности. Nature сообщил 7 октября, что математики отреагировали и удивлением, и резким неприятием, пишет Newsis. [ 2 , 4 ]
OpenAI заявила, что опубликовала статьи и краткие изложения рассуждений по некоторым задачам, профинансирует семинары и конференции и готовится выпустить модель. Компания не согласилась с призывами прекратить испытывать сложные математические задачи на неопубликованных моделях, заявив, что такие оценки необходимы для создания более совершенных инструментов для исследователей. [ 1 , 2 ]
Почему это важно
Профессор KAIST Пэк Хён Рёль заявил, что влияние на математику будет очень большим, если основные результаты подтвердятся, а Newsis сообщило, что бремя проверки результатов ложится на математиков. Часть математического сообщества возражает против того, чтобы компании в сфере ИИ испытывали неопубликованные модели на нерешённых задачах; OpenAI заявила, что продолжит это делать.
Ключевые факты
- OpenAI опубликовала 722 математические рукописи, созданные неопубликованной внутренней моделью ИИ и сгруппированные в 372 результата. [ 1 , 2 , 3 , 4 ]
- Рукописи были опубликованы на GitHub. [ 1 , 3 , 4 ]
- OpenAI дала модели около 4000 задач; на получение одного результата в среднем уходили вычислительные ресурсы, равные примерно трём часам рассуждений ChatGPT Pro. [ 1 , 4 ]
- Самый обсуждаемый результат касается «квази-гипотезы Римана» — ослабленной формы гипотезы Римана; саму гипотезу Римана он не доказывает. [ 1 , 2 ]
- Многие рукописи включают формальную проверку на языке Lean, но не все; OpenAI заявила, что непроверенные рукописи могут содержать ошибки. [ 1 , 3 , 4 ]
- Asia Economy сообщило, что, по словам OpenAI, по состоянию на 14:20 8 октября компания отозвала три результата и пересмотрела или дополнила около десятка доказательств. [ 3 ]
- Двадцать пять лауреатов медали Филдса, включая Теренса Тао и Джун Хо, в прошлом месяце выступили с совместным заявлением, в котором раскритиковали цели компаний в сфере ИИ в математике. [ 2 , 4 ]
- OpenAI не согласилась с призывами прекратить испытывать сложные математические задачи на своих неопубликованных моделях. [ 1 , 2 ]
Подтверждено несколькими источниками
- OpenAI опубликовала 722 математические рукописи, созданные ИИ и сгруппированные в 372 результата. [ 1 , 2 , 3 , 4 ]
- Рукописи размещены на GitHub. [ 1 , 3 , 4 ]
- На один результат в среднем было потрачено около трёх часов рассуждений в пересчёте на вычислительные ресурсы. [ 1 , 3 , 4 ]
- Алекс Конторович из Рутгерского университета заявил, что человек, выполнивший работу по квази-гипотезе Римана, немедленно получил бы медаль Филдса. [ 1 , 2 ]
- Не все рукописи формально проверены с помощью Lean. [ 1 , 3 , 4 ]
- Двадцать пять лауреатов медали Филдса в прошлом месяце выступили с совместным заявлением, в котором раскритиковали подход компаний в сфере ИИ к математике. [ 2 , 4 ]
- OpenAI намерена и дальше испытывать математические и научные задачи на неопубликованных моделях. [ 1 , 2 ]
Пока неясно
- Дата публикации. Chosun Ilbo, Asia Economy и Newsis называют 6 октября по местному времени; Korea Economic Daily со ссылкой на OpenAI и WSJ называет день, предшествовавший 8 октября.
- Верны ли результаты и насколько они продвигают существующие исследования. Издания пишут, что по-прежнему нужна независимая проверка, а Asia Economy сообщило, что некоторые результаты уже отозваны или пересмотрены.
- Доля рукописей с формализацией в Lean. Цифра около 42 % принадлежит одному математику, процитированному только Asia Economy.
- Часовой пояс обновления в 14:20 8 октября об отзыве результатов. Asia Economy указывает время, не уточняя, к какому часовому поясу оно относится.
- Сколько лауреатов медали Филдса присоединились к прошломесячному предупреждению. Chosun Ilbo и Newsis называют 25; Korea Economic Daily пишет о математиках, среди которых около 20 лауреатов медали Филдса.
Что пишут местные СМИ
Хронология, местное время
- 8 октября: Korea Economic Daily сообщает о публикации OpenAI 722 математических рукописей. [ 1 ]
- 8 октября: по состоянию на это время OpenAI заявила, что отозвала три результата и пересмотрела около десятка доказательств, сообщило Asia Economy. [ 3 ]
- 8 октября: Chosun Ilbo сообщает об опасениях математиков и призыве AHM прекратить сотрудничество с OpenAI. [ 2 ]
- 9 октября: Asia Economy публикует комментарии корейских математиков о проверке. [ 3 ]
- 9 октября: Newsis сообщает о предупреждениях лауреатов медали Филдса и о бремени проверки, лежащем на математиках. [ 4 ]