Вход Регистрация

OpenAI пытается восстановить отношения с математиками после спорных заявлений о прорывах

5 мин.
OpenAI добилась заметных результатов в математике, но несколько раз испортила их публичную презентацию и вызвала раздражение исследователей. Теперь компания пытается снизить напряжённость с помощью независимой консультативной группы. Однако сами математики считают новый проект плохо организованным и не до конца объяснённым.

OpenAI пытается восстановить отношения с математическим сообществом, создав новую независимую консультативную группу из ведущих практикующих математиков. Инициатива должна помочь компании лучше проверять заявления о возможностях искусственного интеллекта и аккуратнее рассказывать о результатах исследований.

За последние несколько месяцев OpenAI неоднократно демонстрировала впечатляющие успехи в решении математических задач. Однако почти каждый такой прорыв сопровождался проблемами с коммуникацией: публикации выходили поспешно, формулировки оказывались чрезмерно громкими, а детали экспериментов не всегда были понятны специалистам.

В результате часть математического сообщества стала воспринимать действия OpenAI как попытку получить максимум публичного внимания при минимальной прозрачности. Особенно острые вопросы возникали вокруг того, какие задачи действительно решает модель самостоятельно, как проверяются ответы и насколько результаты сопоставимы с человеческими достижениями.

Новая группа пока вызывает больше вопросов, чем ответов

Компания представила совет как способ наладить диалог с исследователями и получить независимую оценку будущих проектов. В него вошли специалисты с высоким авторитетом в математике, однако точный формат работы, полномочия и критерии оценки группы остаются недостаточно ясными.

Математики, знакомые с инициативой, описывают её как запутанный и плохо организованный процесс. Один из участников группы также сообщил о трудностях, связанных с тем, как OpenAI формулирует задачи, координирует работу и объявляет о своих планах. По их оценке, новая попытка во многом повторяет прежний сценарий - быстрый запуск, недостаток деталей и последующее исправление публичных заявлений.

Для OpenAI это особенно чувствительная проблема. В математике мало просто показать правильный ответ: необходимо объяснить ход решения, подтвердить его воспроизводимость и исключить использование скрытых подсказок или заранее подготовленных данных. Поэтому даже впечатляющий результат без полного описания методики может быть встречен специалистами скептически.

Почему математические результаты важны для OpenAI

Математические тесты используются компаниями как показатель способности моделей рассуждать, планировать длинные цепочки действий и работать с абстрактными правилами. Но высокие баллы сами по себе ещё не доказывают наличие универсального мышления. Итог зависит от формата заданий, качества проверки и того, были ли похожие примеры в обучающих данных.

Показательным примером стала Международная математическая олимпиада 2024 года. Система Google DeepMind, объединявшая AlphaProof и AlphaGeometry 2, получила в сумме 28 из 42 возможных баллов - результат уровня серебряной медали. При этом решение задач требовало формальной проверки доказательств, а не только выдачи числового ответа.

Новая консультативная группа может помочь OpenAI выстроить более строгую процедуру публикации результатов: заранее раскрывать условия тестирования, отделять экспериментальные данные от маркетинговых формулировок и привлекать независимую проверку. Однако доверие математиков будет зависеть не от самого факта создания совета, а от того, получит ли он реальное влияние на исследования и публичные заявления компании.

AI-исследованияOpenAIискусственный интеллектматематикаматематические задачиматематический советмашинное обучениенаучная коммуникациянезависимая группа