Клод приблизился к разгадке 167-летней гипотезы: как ИИ совершил прорыв в математике
Клод приблизился к разгадке 167-летней гипотезы: как ИИ совершил прорыв в математике

Клод приблизился к разгадке 167-летней гипотезы: как ИИ совершил прорыв в математике

Клод приблизился к разгадке 167-летней гипотезы: как ИИ совершил прорыв в математике

Модель повысила известный нижний предел доли нулей дзета-функции с 41,6 % до 67,2 %.

Вскоре после предыдущего математического прорыва модель искусственного интеллекта Claude от компании Anthropic добилась прогресса в одном из направлений, связанных с гипотезой Римана — одной из самых известных нерешенных проблем математики. Как заявили разработчики в блоге, модель не смогла доказать саму гипотезу, однако повысила известный нижний предел доли её нулей с 41,6% до 67,2%.

О гипотезе Римана

Гипотеза Римана касается распределения простых чисел и была сформулирована в 1859 году. За её доказательство или опровержение назначено вознаграждение в 1 миллион долларов, но до сих пор математикам не удалось решить эту проблему.

Одним из направлений исследований, связанных с гипотезой, является определение доли нулей дзета-функции Римана, лежащих на так называемой критической прямой. Предыдущие математические исследования постепенно увеличивали известный нижний предел этой доли, и до работы Клода он составлял 41,6%.

Клод смог повысить этот показатель до 67,2%, объединив результаты предыдущих исследований четырёх учёных с работой Энрико Бомбьери, опубликованной в 2000 году. По данным Anthropic, модель предложила подход, который позволил рассмотреть более широкое пространство функций и использовать свойства квадратичной формы для получения новой оценки.

Сам по себе результат не означает, что гипотеза Римана доказана. В Anthropic прямо указали, что не ожидают, что методы, использованные Claude, приведут к её доказательству.

Как Claude пытался решить гипотезу

Результат Claude получил после того, как сотрудник Anthropic Джаред Самнер, не являющийся математиком, попросил модель попробовать решить гипотезу. Тогда Claude опробовал около 650 математических идей, однако ни одна из них не сработала. После этого модель в течение примерно полутора дней координировала работу около 60 субагентов, которые выполнили 2400 команд в командной строке и написали сотни Python-скриптов.

Субагенты проводили тысячи численных проверок, сравнивая результаты с известными нулями дзета-функции, а также проверяли работу друг друга. Участие Самнера в основном ограничивалось короткими ободряющими сообщениями, в частности призывами продолжать работу и «верить в себя».

После получения результата Claude начал дополнительно проверять собственную работу. Субагенты искали контрпримеры, скачали 54 научные статьи с arXiv, чтобы выяснить, не было ли аналогичного открытия ранее, и независимо воспроизводили полученный результат.

Модель также предложила оформить выводы в виде научной статьи и привлечь специалистов по теории чисел. В итоге математики из Anthropic Левент Альпоге и Ральф Фурман проанализировали работу Claude и её связь с предыдущими исследованиями.

В ходе работы Claude сначала скептически оценивала возможность получения значимого результата. В Anthropic предполагают, что это могло быть связано с информацией, усвоенной моделью в процессе обучения, о сложности нерешенных математических задач и ограниченности возможностей современного ИИ. Однако после дополнительных подсказок модель продолжила поиск и в итоге получила новую оценку.

В Anthropic считают, что этот случай может свидетельствовать о том, что математические возможности современных моделей развиваются быстрее, чем они сами ожидают. Это подтверждает также недавнее открытие невыпущенной модели ИИ Astra от OpenAI. Она за 2000 долларов решила десять открытых математических задач, которые оставались нерешенными десятилетиями, предоставив проверенные и открытые доказательства.

Источник материала
loader