«Зачем вам разрушать свою карьеру?»: как OpenAI оказалась в центре скандала вокруг проблемы тысячелетия
Математик Тристан Бакмастер утверждает, что компания использовала его работу над уравнениями Навье — Стокса, а затем угрожала ему. OpenAI отрицает обвинения, но признает: данные пользователей могли улучшить ее модели.
Тристан Бакмастер, математик из Нью-Йоркского университета, только что провел месяцы, работая над тем, что считал делом всей жизни — математическим доказательством. Затем, во время встречи 6 сентября с сотрудниками OpenAI, он, по его словам, получил резкое предупреждение: «Зачем вам разрушать свою карьеру?»
Этот обмен, который Бакмастер описал в подробном публичном заявлении на этой неделе, лежит в центре раздувающегося скандала вокруг знаменитой системы уравнений под названием Навье — Стокса.
OpenAI заявляет, что ее модель искусственного интеллекта (ИИ) решила нерешенную проблему, связанную с этой 200-летней системой уравнений гидродинамики. Система уравнений фигурирует в списке одной из семи задач тысячелетия, предложенных Институтом математики Клэя, а за ее решение полагается $1 миллион. Бакмастер работал над той же проблемой. И у него есть вопросы о том, как компания добралась до этого так быстро.
Прорыв OpenAI
Уравнения Навье — Стокса были сформулированы в начале 1800-х годов Клодом-Луи Навье и Джорджем Габриэлем Стоксом. Они, по сути, представляют собой второй закон Ньютона для жидкостей, описывая, как движется любая жидкость: толкните воздух лопастью вентилятора, и уравнения предскажут, как этот воздух потечет; или нагрейте атмосферу солнечным светом, и они помогут предсказать завтрашнюю погоду. Они описывают, как летают самолеты и как кровь движется по вашим артериям.
Проблема в том, что никто не доказал, всегда ли уравнения дают конечные ответы. Могут ли существовать редкие условия, при которых уравнения выходят из-под контроля? Это называется «взрывом», или сингулярностью, которая происходит, когда величина, должна представляющая что-то физическое (например, скорость жидкости или давление), в определенных точках пространства и времени устремляется к невозможным бесконечностям.
Представьте swirling воды, закручивающейся в сливе ванны. Уравнения Навье — Стокса описывают, как она вращается быстрее, сужаясь к центру. Взрыв означал бы, что математика предсказывает, что вращение ускоряется вечно — бесконечная скорость в одной точке. Ванна не может этого сделать, но если уравнения могут, это значит, что модель, которой мы доверяли годами, неверна, и мы даже не знаем, где она ломается.
Могут ли уравнения Навье — Стокса взорваться — один из самых знаменитых нерешенных вопросов.
Чтобы найти ответ, OpenAI использовала технику под названием «форсирование» — придание смоделированной жидкости плавного, контролируемого толчка извне. Представьте, что вы щелкаете пальцем по вращающемуся волчку, чтобы посмотреть, упадет ли он, — или, в случае уравнений Навье — Стокса, взорвется.
OpenAI задействовала около 10 000 ИИ-агентов для одновременной работы над проблемой. Агенты работали около 88 часов подряд, причем 100 из них начали со связанных уравнений Эйлера. Это более простой родственник Навье — Стокса, который отбрасывает вязкость, чтобы описать движение жидкости без внутреннего трения.
Примерно через 50 часов агенты OpenAI нашли взрывы в уравнениях Эйлера, написали представители OpenAI в заявлении. Это открытие убедило их, что Навье — Стокс достижим, и они обратили внимание на большую проблему.
OpenAI описала сингулярность как вихрь, закручивающийся все tighter и tighter, растягивающийся и истончающийся, как тянущаяся ирис. Результатом стала жидкость, которая математически закручивается в бесконечность.
OpenAI прогнала доказательство через программу под названием Lean — программное обеспечение, проверяющее каждый шаг математического аргумента. Агенты «отправили 2,7 миллиона сообщений и использовали примерно 130 миллиардов выходных токенов», написали представители OpenAI в заявлении. На пресс-конференции 8 сентября представители компании сказали, что аналогичная работа, выполненная клиентом, стоила бы $15 миллионов.
Скандал
Результат вызвал собственный взрыв в математике, сосредоточенный вокруг утверждений, что моделям OpenAI, возможно, дали фору, используя работу Тристана Бакмастера и Левента Альпёге, математика из конкурирующей ИИ-компании Anthropic.
Два математика работали над той же стратегией (плавное форсирование), примененной к тем же уравнениям Эйлера. Сам подход был разработан Диего Кордобой, математиком из Института математических наук в Мадриде, и Луисом Мартинесом-Сороа, еще одним математиком из Университета CUNEF в Мадриде. Почти никто другой в этой области его не использовал.
Бакмастер сказал, что 15 августа он и Альпёге достигли результатов взрыва для уравнений Эйлера с плавным форсированием. 3 сентября Бакмастер написал, что получил через Альпёге известие, что OpenAI узнала об их прогрессе и приняла тот же метод.
«Когда я услышал «форсированный», — писал Бакмастер в своем публичном заявлении, — это был яркий красный флаг».
Его беспокойство было в том, что подход с плавным форсированием не был очевидным или широко распространенным. «Идеи, делающие эту линию атаки возможной, принадлежат Кордобе и Мартинесу-Сороа», — писал Бакмастер, отдавая должное двум математикам, разработавшим технику. «Почти никто другой, о ком я знаю, над этим не работал».
И все же, согласно OpenAI, компания начала свои усилия по Навье — Стоксу 1 сентября — в тот же день, когда услышала «слухи о других решениях задач тысячелетия». Бакмастер утверждал в своем публичном заявлении, что эти слухи были именно о работе его и Альпёге.
Сэм Альтман, генеральный директор OpenAI, признал, что компания узнала о работе Бакмастера и Альпёге до объявления. «Нам было любопытно, сможет ли наша тоже это сделать», — написал он в X. Он добавил, что «подходы, похоже, разные», — утверждение, которое Бакмастер оспаривает.
Заявление OpenAI называет и Бакмастера, и Альпёге, отдает должное их независимому решению форсированной задачи Эйлера и говорит, что компания предложила со-публикацию.
«Я не получил ответа»
Бакмастер также revealed, что использовал помощник по кодированию Codex от OpenAI throughout своего исследования, помещая черновики работы в инструмент. OpenAI обучает свои модели на взаимодействиях пользователей, и Бакмастер сказал, что спросил компанию напрямую, были ли accessed его сессии Codex.
«Я спросил, была ли модель обучена на наших сессиях в Codex или имела к ним доступ, в которые мы помещали все наши черновики, — писал он. — Я спросил снова, о тренировке, и не получил ответа».
Корпоративные соглашения OpenAI регулируют, как могут использоваться данные клиентов. Но неясно, использовал ли Бакмастер Codex по корпоративному соглашению или как индивидуальный потребитель, — различие, которое может определить, были ли его черновики доступны для тренировки.
В заявлении в X представители OpenAI отрицали, что сотрудники или агенты компании видели работу пары «каким-либо образом» до ее публичного релиза. Однако «мы не можем исключить, что де-идентифицированные данные, полученные от их использования наших продуктов, помогли улучшить наши модели», добавили они.
Затем есть вопрос авторства. Бакмастер утверждает, что Себастьян Бубек, возглавляющий математические исследования OpenAI, дважды настаивал на исключении Альпёге из статьи, которую готовили два математика. Бакмастер подчеркнул, что Альпёге работает в Anthropic, конкурирующей ИИ-компании.
Именно на той же встрече 6 сентября Бакмастер утверждает, что OpenAI предложила ему два варианта, оба требовавшие исключения Альпёге из авторства. Он отказался и сказал, что сообщил Бубеку, что если OpenAI выпустит свой результат, как предложено, он предаст это огласке. Бубек якобы ответил: «Если вы не хотите, чтобы я был добрым, то мне не обязательно быть добрым».
Бубек категорически отрицал обвинения, назвав их «ложными и inflammatory» в заявлении в X. «Мы не использовали их промпт или доказательства, чтобы подсказывать нашим моделям», — сказал Бубек Wired. Марк Чен, главный научный сотрудник OpenAI, сказал на вчерашней пресс-конференции, что он «немного разочарован обвинениями».
«Я не видел доказательства OpenAI, — писал Бакмастер. — Я не знаю, что сделала их модель и как. Я не знаю, использовались ли наши данные. Я никого ни в чем не обвиняю». Он призвал к независимому расследованию того, как началась работа OpenAI.
В заключительной строке он написал: «Я гораздо предпочел бы говорить о математике, идеях Луиса и Диего и о том, что все это значит для остальных из нас».
Кордоба, один из первоначальных разработчиков техники форсирования, сказал, что был ошеломлен тем, как быстро материализовался результат. «Мы немного в шоке», — сказал он Scientific American.
Другие математики также отреагировали на новость, некоторые выразили открытое dismay по поводу того, как были выпущены результаты.
«Мы теперь увидели, что даже слух о том, что кто-то работает над огромной проблемой, может вызвать массивные усилия на основе ИИ, чтобы flatten ее, прежде чем оригинальный исследовательский проект успеет достичь своего полного потенциала, — написал Теренс Тао, профессор математики в UCLA, в Mastodon. — Стимулы теперь могут указывать в направлении больше не делиться никакими перспективными исследовательскими направлениями с широким сообществом, что обратило бы вспять века традиций открытой науки и нанесло бы серьезный долгосрочный ущерб будущему области».
Доказательство OpenAI все еще ожидает формального рецензирования, и Институт математики Клэя пока не вынес официального вердикта, подтверждающего или опровергающего доказательство OpenAI. Но эпизод уже поднял тревожные вопросы для математического сообщества. Например, когда компания обучает свои модели на взаимодействиях миллионов пользователей, кому на самом деле принадлежат ответы, которые возникают? И что означает участие ИИ для будущего области?
Эти вопросы, в отличие от проблемы Навье — Стокса, могут не иметь чистого доказательства.
Наука под угрозой: кто владеет открытиями в эпоху ИИ
Скандал вокруг Навье — Стокса — не просто спор о приоритете. Это столкновение двух миров: академической науки, где открытость и честность священны, и корпоративной гонки, где скорость и хватка важнее всего.
Бакмастер и Альпёге разработали подход, основанный на идеях Кордобы и Мартинеса-Сороа. Они использовали Codex для черновиков. Затем OpenAI, узнав об их прогрессе, allegedly бросила 10 000 агентов на ту же задачу и объявила о решении первой.
Если данные Бакмастера использовались для обучения моделей OpenAI, а затем компания обошла его в гонке за объявлением, это не научный прорыв. Это корпоративный сквош.
Угроза «разрушить карьеру» — если она имела место — усугубляет картину. Это не аргумент в научном споре. Это давление.
Тао прав: если стимулы указывают на то, что делиться идеями опасно, открытая наука умрет. Ученые перестанут публиковать черновики, обсуждать гипотезы, сотрудничать. Знание станет собственностью корпораций.
OpenAI отрицает обвинения, но признает: де-идентифицированные данные могли улучшить модели. Это признание — скользкая дорожка. Где грань между «улучшением» и «использованием»?
Ответа нет. И это самое тревожное.
Источники: публичное заявление Тристана Бакмастера, заявления OpenAI и Сэма Альтмана, комментарии Теренса Тао и Диего Кордобы, Scientific American, Wired.