521

Claude не решил гипотезу Римана, но сдвинул границу

31 миллион токенов, 60 субагентов и две фразы поддержки привели модель Anthropic к новому результату в теории чисел.

Claude не решил гипотезу Римана, но сдвинул границу
История звучит как шутка про «эмоциональную поддержку» искусственного интеллекта, но за ней стоит вполне серьёзный результат: Claude улучшил многолетнюю нижнюю границу в задаче о нулях дзета-функции Римана.


Anthropic 10 августа рассказала об эксперименте с ещё не выпущенной исследовательской версией Claude. Сотрудник компании Джаред Самнер, который сам не является математиком, предложил модели «всерьёз взяться» за гипотезу Римана — одну из самых известных нерешённых задач математики, сформулированную Бернхардом Риманом в 1859 году.

Первая атака закончилась ничем: Claude сгенерировал и проверил около 650 идей, но ни одна не сработала. После повторного запроса модель продолжила работу уже иначе. Примерно за полтора дня она координировала около 60 субагентов. Вместе они выполнили порядка 2400 команд в оболочке, написали сотни Python-скриптов, провели тысячи численных проверок известных нулей дзета-функции и проверяли выводы друг друга. За две сессии Claude Code было израсходовано 31 миллион выходных токенов.

Самая вирусная деталь этой истории — участие Самнера. По описанию Anthropic, большую часть времени его вмешательство сводилось к сообщениям в духе «продолжай» и «верь в себя». Компания осторожно предполагает, что такая поддержка помогла модели преодолеть первоначальный скептицизм относительно того, способна ли она добиться содержательного результата.

Но здесь важно не принять красивую формулировку буквально. Нет оснований считать, что Claude переживал сомнение так, как его переживает человек. Фразы поддержки меняли контекст, в котором модель принимала решение о продолжении поиска. В результате система не остановилась после серии неудач, а продолжила перебор направлений и развернула значительно более глубокую исследовательскую процедуру.

И главное: Claude не решил гипотезу Римана и не «доказал её на 67 процентов». Сама гипотеза утверждает, что все нетривиальные нули дзета-функции лежат на критической прямой с действительной частью 1/2. До эксперимента лучший безусловный результат гарантировал нахождение на этой прямой более 5/12, то есть примерно 41,7 процента, всех таких нулей. Работа Claude повышает эту нижнюю границу как минимум до двух третей, а при оптимизации используемой конструкции — примерно до 67,25 процента.

Разница принципиальная. Даже если удастся доказать, что на критической прямой лежат 99 процентов нулей, это всё равно не будет доказательством гипотезы Римана: она требует утверждения обо всех нулях без исключения. В самой работе Claude отдельно указано, что полученный аргумент даёт только нижнюю границу и ничего не говорит о том, где находится оставшаяся часть нулей.

После получения результата Claude запустил дополнительные проверки: субагенты искали контрпримеры, заново выводили доказательство и сверяли его с научной литературой. По данным Anthropic, система загрузила 54 работы с arXiv, чтобы убедиться, что найденный результат не был уже известен. Затем математики Anthropic Левент Алпёге и Ральф Фурман изучили доказательство и его связь с предыдущими работами. Параллельно была подготовлена формализация в Lean. Эксперты по этой области Брайан Конри и Дэниел Голдстон также ознакомились с рукописью, однако опубликованный материал пока не следует путать с обычной журнальной рецензией.

Результат вырос не из полностью новой математической теории. Claude связал существующие методы, в том числе работы по парной корреляции нулей и подход Энрико Бомбьери, а новым шагом стало использование линейно-алгебраического способа обработки информации о нулях на критической прямой и вне неё. Именно такое соединение уже известных инструментов оказалось достаточно сильным, чтобы перескочить через границу, которая годами держалась около 41,6 процента.


Самая любопытная часть эксперимента — не фраза «верь в себя». Она лишь хорошо расходится по соцсетям. Гораздо важнее новая конфигурация исследовательской работы: человек задаёт направление и удерживает задачу в фокусе, а модель сама организует десятки параллельных исполнителей, пишет код, проверяет гипотезы, устраивает внутреннее рецензирование и собирает доказательство. Здесь Claude выглядит не «человечнее», а скорее меньше похож на обычного чат-бота и больше — на автономную исследовательскую группу.

Фото: редакция ИЗНАНКИ.

Следите за новостями в наших соцсетях



Улыбка может стать причиной финансовых потерь: за год зафиксировано 43 случая ...

/ / Интересное Автор: Денис Иванов

А долги достигли триллиона рублей

/ / Интересное Автор: Дмитрий Зорин

Препарат MVA-BN, разработанный компанией Bavarian Nordic, получил официальное ...

/ / Интересное Автор: Дарья Никитская