Astra от OpenAI решила десять открытых задач математики

OpenAI опубликовала отчёт о десяти открытых задачах математики и теоретической информатики, решённых внутренней версией модели Astra. По каждой из них математики не продвигались как минимум десять лет, а по большинству - заметно дольше.
Astra от OpenAI решила десять открытых задач математики

Astra - следующая крупная модель OpenAI, о которой до сих пор говорили только по слухам. Отчётом от 1 августа компания впервые подтвердила название официально и сразу выложила рядом с ним доказательную базу: научную статью, репозиторий с машинно-проверяемыми доказательствами и отдельный документ, где модель восстанавливает ход собственных рассуждений. Публичного доступа к Astra пока нет - результаты получены на внутренней версии.

Десять задач, стоявших десятилетиями

Задачи, которые взяла Astra, охватывают восемь направлений: многомерная геометрия, теория кодирования, сложность арифметических схем, теория групп, операторные алгебры, квантовая сложность, решёточная криптография и экстремальная комбинаторика. Общее у них одно - по главному результату не было прогресса минимум десятилетие.

Самые заметные позиции из десяти:

  • Несофические группы. Построение, доказывающее их существование. Вопрос оставался открытым с 1999 года, когда Михаил Громов ввёл само понятие софичности.
  • Гипотеза жёсткости Конна. Опровержение давнего предположения о том, что определённые группы однозначно восстанавливаются по связанной с ними алгебраической структуре.
  • Гипотеза Эрхарта об объёме. Определён максимальный объём выпуклого тела, у которого единственная внутренняя точка решётки - его центр тяжести, и сделано это для любой размерности.
  • Задачи Эрдёша № 183, 146 и 180. Три позиции из знаменитого каталога открытых проблем, включая нижнюю границу для многоцветных чисел Рамсея.
  • Упаковка шаров в высоких размерностях. Новые верхние границы плотности, доведённые до порога Кона–Элкиса.

Отдельно идут результаты по стойкости решёточной криптографии - той самой, на которой строятся алгоритмы, рассчитанные на устойчивость к квантовым компьютерам.

Две тысячи долларов на всё

По оценке OpenAI, токены на поиск всех десяти решений обошлись бы примерно в 2000 долларов по тарифам API модели Sol. Цифра небольшая для задач, где сообщество годами стояло на месте, и компания явно рассчитывает, что именно она разойдётся по заголовкам.

Здесь нужно оговориться. В сумму входят только удачные прогоны. Сколько задач модель пыталась взять и не взяла - в отчёте не сказано. Ноам Браун, один из авторов подхода с вычислениями на этапе вывода, добавил, что на каждую задачу тратили немного и запас остаётся большим.

Lean-сертификаты вместо доверия

Слабое место любой истории про «ИИ доказал теорему» - проверка. OpenAI закрыла её формально: после того как модель выдала аргументы, она же перевела каждое доказательство на Lean - язык, на котором математику записывают так, что корректность каждого шага перепроверяет компьютер. Все сертификаты выложены в открытый репозиторий ten-proofs.

Прозрачность на этом заканчивается. Промпты и исходные трассы рассуждений компания не опубликовала - вместо них идёт пересказ, сгенерированный самой моделью. Для оценки того, насколько результат воспроизводим, этого мало.

OpenAI отказалась от человеческого авторства

Компания отдельно проговорила, кому принадлежат доказательства. Люди помогли оформить рукописи и участвовали в формализации, ответственность за корректность OpenAI берёт на себя, но сами математические аргументы сгенерировала система. Приписывать людям авторство доказательства, созданного ИИ целиком, в компании считают искажением и вклада модели, и природы человеческой работы.

Позиция редкая: обычно бизнес старается оставить сотрудников в списке авторов. OpenAI ссылается на Лейденскую декларацию об ИИ и математике, подписанты которой обеспокоены ролью моделей в науке, - и одновременно получает максимально громкую формулировку для демонстрации возможностей Astra.

Блум и Браун о результатах

Томас Блум, математик Манчестерского университета и автор каталога erdosproblems.com, назвал работу большой новостью и оценил её выше майского результата OpenAI, где модель опровергла гипотезу Эрдёша о единичных расстояниях. Тезис о том, что ИИ вытесняет математиков, он отверг: система опирается на век накопленной теории, построена математиками и обучена на всём, что они написали.

Браун обозначил и границу достигнутого: задач тысячелетия среди решённых нет. Семь проблем из списка Института Клэя по-прежнему стоят миллион долларов каждая, и с 2000 года решена только одна.

Astra пока не вышла

Astra станет отдельным семейством рядом с Sol, Terra и Luna, но формат выпуска не определён - ни номер версии, ни дата. По данным The Information, модель должна первой пройти новую американскую процедуру государственной проверки перед публичным релизом.

Судить об этих десяти результатах будут не по пресс-релизу. Майское опровержение гипотезы о единичных расстояниях за три месяца породило пять последующих научных работ - это и есть рабочий индикатор: если через полгода на нынешние доказательства начнут ссылаться и надстраивать их, значит, математика приняла Astra в качестве рабочего источника результатов.

18:55
35
Нет комментариев. Ваш будет первым!