Математик NYU Тристан Бакмастер во вторник объявил о готовности трёх доказательств, включая предварительный результат по одной из семи задач Millennium Prize — списку нерешённых проблем математики, за каждую из которых Институт Клэя обещает миллион долларов. Работа велась с математиком Anthropic Левентом Альпёге и моделями Codex и Claude. Само достижение впечатляющее. История вокруг него — куда занимательнее.
Пока Бакмастер и Альпёге доводили результат до финала, они узнали: информация об их прогрессе просочилась в OpenAI. Компания к этому моменту уже заявляла о полном доказательстве центральной задачи — существования и гладкости решений уравнений Навье-Стокса, одной из самых известных нерешённых проблем механики жидкостей. На вопросы о том, когда именно OpenAI начала работу и сколько человеческого участия в ней было, ответы становились всё более уклончивыми.
По словам Бакмастера, над задачей работала целая команда с огромным вычислительным бюджетом, а первый запрос модели отправили за несколько дней до этого — уже после того, как информация об их наработках дошла до OpenAI. Компания подтвердила часть хронологии: попытка началась 1 сентября, вдохновлённая слухами о том, что две задачи Millennium Prize уже решены. На неделю работы модели ушло 300 миллиардов токенов — по текущим тарифам это около $22.5 миллиона.
Бакмастер считает подозрительным совпадение подхода. Маршрут через гладкую силу, который они с Альпёге выбрали, крайне нестандартный — «почти никто, кого я знаю, над этим не работал», и прийти к нему за несколько дней, просто дав модели условие задачи, невозможно. Всё осложняется тем, что Бакмастер активно использовал Codex в своей работе, а OpenAI оставляет за собой право обучать модели на таких взаимодействиях, если пользователь не отказался явно. Компания заявляет, что не видела чужую работу до её публикации и что итоговые доказательства заметно отличаются, но полностью исключить влияние переиспользованных данных не может.
Академическая часть конфликта вышла за рамки научной вежливости. Бакмастер утверждает: представитель OpenAI просил убрать имя Альпёге из списка авторов как часть компромисса, а на попытку сделать спор публичным получил ответ «зачем тебе портить карьеру» и следом — «если не хочешь, чтобы я был доброжелательным, я не обязан быть доброжелательным». История поднимает вопрос, который раньше не стоял так остро: если у AI-лаборатории есть огромные вычислительные мощности и доступ к чужим рабочим данным через собственные продукты, где заканчивается конкуренция и начинается присвоение чужого труда.
Во что углубиться:
- Список задач Millennium Prize Институт Клэя: узнаешь, какие из семи проблем уже решены и что за это получил Григорий Перельман
- Уравнения Навье-Стокса и их роль в физике жидкостей: поймёшь, почему их решение важно не только математикам, но и инженерам
- Политика OpenAI по использованию данных Codex для обучения моделей: разберёшься, как отключить передачу своих данных в обучающий набор
