Меньше чем через месяц после начала обучения новой внутренней модели OpenAI заявила о результате, который ещё недавно выглядел фантастикой. Система якобы решила больше 100 давних открытых задач из разных областей математики, а скорость работы удивила даже математиков внутри компании. Одновременно OpenAI пришлось создавать независимую консультативную группу, которая поможет разбираться с потоком новых доказательств и решать, как публиковать результаты.
Новая Advisory Group on Mathematics and Artificial Intelligence будет оценивать значимость полученных результатов, помогать организовывать проверку и публикацию доказательств, следить за академическими нормами и предлагать способы применения ИИ в исследованиях и обучении. В группу вошли девять известных математиков, среди которых лауреаты Филдсовской премии Тимоти Гауэрс и Мартин Хайрер, физик-теоретик Эдвард Виттен, а также специалисты из Гарварда, Стэнфорда, Оксфорда, Беркли и других университетов.
Математики настояли на независимом статусе. Некоторые будущие участники первоначально получили от OpenAI предложение войти во внешний совет при компании, но вместо корпоративной структуры создали независимую группу при Институте перспективных исследований в Принстоне. Участники не получают денег от OpenAI, самостоятельно определяют состав и могут публично критиковать решения разработчика.
Право остановить математическую гонку группа не получила. OpenAI прямо исключила темп внутренних исследований из полномочий консультантов, а окончательные решения о публикациях и развитии моделей останутся за самой компанией. Представители группы также подчеркнули отсутствие полномочий принимать решения за разработчиков ИИ.
Создание совета последовало за резкой реакцией математического сообщества. В сентябре группа ведущих учёных опубликовала открытое письмо с предупреждением, что превращение нерешённых задач в тест для новых моделей может навредить самой математике. Среди авторов и подписантов оказались многие лауреаты Филдсовской премии, включая Теренса Тао, Питера Шольце, Мариам Мирзахани уже не могло быть среди подписантов из-за её смерти в 2017 году, поэтому актуальный список формируют ныне действующие исследователи, среди которых Артур Авила, Манжул Бхаргава, Максим Концевич, Марина Вязовская и другие известные математики.
Авторы обращения считают главным результатом математической работы не только готовый ответ. Исследовательский процесс рождает новые методы, понятия и связи между областями науки, а подготовка доказательства позволяет другим специалистам понять и развить найденную идею. Массовая генерация решений без времени на подробное изложение, обсуждение, проверку и корректное указание авторства, по мнению подписантов, рискует превратить открытые проблемы в набор галочек для сравнения ИИ-моделей.
Повод для особенно острой дискуссии появился после публикации решения Навье-Стокса, одной из семи задач тысячелетия. OpenAI задействовала внутреннюю модель, которую компания называет значительно более мощной, чем GPT-6 Astra. Около 10 тысяч параллельно работающих агентов пришли к доказательству примерно за 88 часов, после чего GPT-6 Astra потребовалось ещё 17 часов для формализации и проверки результата в системе Lean.
Публикацию сопровождал спор об авторстве и научной конкуренции. Профессор Нью-Йоркского университета Тристан Бакмастер и математик Levent Alpöge из Anthropic параллельно работали над связанными задачами и заявили, что OpenAI начала интенсивный поиск решения после получения информации об их прогрессе. Бакмастер также задавал вопросы о возможности использования материалов из его сессий Codex. OpenAI после внутренней проверки заявила, что запросы Бакмастера за предшествующие два месяца не могли повлиять на внутреннюю модель ни напрямую, ни через обучение.
На фоне спора цифра в 100 с лишним решённых проблем выглядит ещё значительнее, но пока требует осторожной трактовки. OpenAI не опубликовала в объявлении полный перечень задач и доказательств, а сама консультативная группа называет своей текущей работой подготовку к выпуску большого количества результатов, которые внутренний ИИ компании, по утверждению разработчика, уже получил. Независимой научной проверке предстоит определить, сколько заявленных решений выдержат подробный разбор и какие новые методы скрываются за ответами машины.
OpenAI начала обучение новой системы 28 августа. Спустя несколько недель разработчик уже обсуждает не вопрос способности ИИ решать отдельные сложные задачи, а порядок публикации результатов в объёме, с которым математическое сообщество раньше не сталкивалось. Разногласия теперь касаются не только качества доказательств, но и более фундаментального вопроса: что произойдёт с наукой, если нерешённые десятилетиями проблемы начнут закрываться быстрее, чем люди успевают читать и осмысливать решения.