Читайте нас в Telegram или Макс

Дело на $1 млн: разбор скандала вокруг кражи решения «задачи тысячелетия» ИИ моделью OpenAI

Уравнения Навье — Стокса больше 150 лет остаются одной из главных нерешённых задач математики. Институт Клэя обещает за её решение $1 млн долларов, и за четверть века никто не подошёл к нему вплотную.

Утром 8 сентября профессор Нью-Йоркского университета Тристан Бакмастер и математик из Anthropic Левент Альпёге опубликовали результаты годичной работы над задачей. Через двенадцать часов OpenAI объявила, что её внутренняя модель решила задачу целиком.

Совпадение не выглядело случайным. К своим работам Бакмастер приложил четырёхстраничное заявление, из которого следует: OpenAI взялась за задачу лишь после того, как узнала о его прогрессе и вероятно могла украсть его наработки из черновиков в Codex, которым он пользовался для обсуждения задачи.

В спор уже включились Сэм Альтман и Теренс Тао, профессор Калифорнийского университета в Лос-Анджелесе. Разбираемся, что произошло на самом деле.


Суть задачи

Уравнения Навье — Стокса описывают движение жидкостей и газов. Их сформулировали в XIX веке, но до сих пор неизвестно, всегда ли при гладких начальных условиях существует гладкое решение — то есть остаются ли скорость и её производные конечными везде и всегда, — или же решение может за конечное время разрушиться, сформировав сингулярность, в которой какая-либо величина обращается в бесконечность и гладкое решение перестаёт существовать.

Официальная формулировка Института Клэя состоит из четырёх пунктов: A и B касаются уравнений без внешней силы, C и D учитывают гладкую внешнюю силу. Основным считается вариант без внешней силы, но формально решение любого пункта закрывает проблему.

Подход с внешней силой несколько лет разрабатывали испанские математики Диего Кордоба и Луис Мартинес-Сороа. Год назад его продолжили Бакмастер и Альпёге (бывший сотрудник Anthropic). Это было личное сотрудничество без участия работодателей, инструменты оплачивались из гранта Бакмастера. Использовались Claude от Anthropic и Codex от OpenAI.

В середине августа работа резко ускорилась. 15 августа модели получили доказательства разрушения решений для уравнений Буссинеска и трёхмерных уравнений Эйлера (это уравнения Навье — Стокса без вязкости, важная промежуточная ступень). 22 августа доказательство прошло формальную проверку в системе Lean. Соавторы планировали потратить ещё несколько недель на приведение машинного текста в читаемый вид.

Как OpenAI пришла к результату

В конце августа в соцсетях появился слух, что Anthropic решила одну из «задач тысячелетия». Сообщество быстро связало его с Бакмастером и Альпёге. По версии OpenAI, компания узнала о слухе 1 сентября и в тот же день направила свою новую внутреннюю модель на все нерешённые «задачи тысячелетия».

Сначала 1 000 агентов за 50 часов решили уравнения Эйлера. Затем 10 000 параллельных агентов, обменивающихся результатами, за 88 часов получили доказательство для полных уравнений Навье — Стокса. На это ушло около 130 млрд токенов и 2,7 млн сообщений между агентами. По оценке TechCrunch, неделя экспериментов обошлась примерно в $22,5 млн, то есть OpenAI потратила в 20 раз больше денег, чем могла бы получить за решение задачи, однако компании нужны были не деньги, а общественная огласка самого факта, что их ИИ смог решить столь сложную задачу.

Переговоры

3 сентября Бакмастер, узнав, что сведения о его работе дошли до OpenAI, написал знакомому математику из компании. Он пояснил, что работа личная и скоро будет опубликована, и попросил не распространять слухи. В ответ его якобы попросили поделиться деталями «чтобы избежать конкуренции» и предложили вычислительные ресурсы. 6 сентября состоялись два звонка с участием Себастьена Бубека, руководителя математического направления OpenAI.

Далее версия Бакмастера. Ему сообщили, что модель OpenAI получила доказательство для уравнений с внешней силой. Это его насторожило: по этому пути шли только они с Альпёге, и прийти к нему за несколько дней, просто передав модели формулировку задачи, было на его взгляд невозможно, причём метод решения был подозрительно похож на его собственный. На вопрос, могли ли в обучение модели попасть его сессии из Codex, где соавторы год хранили черновики, ответа не последовало.

Затем, по словам Бакмастера, ему предложили два варианта.

  • Первый: они с Альпёге публикуют результат по Эйлеру, а на следующий день OpenAI выкладывает решение Навье — Стокса с упоминанием их заслуг.
  • Второй: Бакмастер единолично пишет статью по Навье — Стокса с решением OpenAI. При этом Бубек (отдел математики OpenAI) дважды заявил о намерении исключить Альпёге из авторов из-за его работы в Anthropic — прямого конкурента OpenAI.

В обоих случаях компания не претендовала на вознаграждение за решение задачи.

Бакмастер отказался и предупредил, что предаст ситуацию огласке. В ночь на 8 сентября Бакмастер опубликовал три работы вместе с Lean-доказательствами и заявлением, извинившись за качество текстов.

Через двенадцать часов OpenAI опубликовала собственное решение с формальной проверкой и отдельным разделом о конфликте.

Позиции сторон

OpenAI признаёт приоритет математиков по уравнениям Эйлера, но не по задаче Навье — Стокса. Компания утверждает, что связалась с ними уже после завершения своей работы 6 сентября, чтобы предложить совместный анонс. Модель, по заявлению OpenAI, не имела доступа к пользовательским данным, однако компания не исключает, что анонимизированные данные могли попасть в обучающую выборку.

Бубек (отдел математики OpenAI) признал, что метод для задачи Навье — Стокса схож с подходом соавторов. При этом на премию в 1 млн долларов OpenAI претендовать не намерена.

На фоне скандала Бубек назвал обвинения ложными и опубликовал переписку с Альпёге, в которой предлагал отдать всю заслугу математикам. По его словам, он не предлагал исключать Альпёге из его собственной работы, а лишь считал неуместным участие сотрудника Anthropic в оформлении результата OpenAI. Сэм Альтман заступился за своего сотрудника и заявил, что Бубек действовал честно. При этом ключевые эпизоды из заявления Бакмастера ни OpenAI, ни Бубек публично не опровергли.


На проверку предоставленных решений уйдёт много времени, поэтому на текущий момент Институт Клэя всё ещё считает задачу нерешённой, независимой экспертизы доказательств ещё не проводилось.

Но сейчас больший скандал разгорелся не из-за математике, на этом фоне в соцсетях разворачивается отдельная дискуссия: исследователи, разработчики и авторы делятся опасениями, что любая незавершённая работа, доверенная облачному ИИ-инструменту, рискует стать чужим результатом раньше, чем её успеют опубликовать.