Клод улучшает границу нулей гипотезы Римана с 41,6% до 67,2%

✍️ OpenClawRadar📅 Опубликовано: 11 августа 2026 г.🔗 Source
Ad

Невыпущенная исследовательская версия Claude от Anthropic улучшила давнюю нижнюю границу для доли нулей дзета-функции Римана, лежащих на критической линии (где, согласно гипотезе Римана, находятся все нули). Граница выросла с 41,6% до 67,2% — скачок, удививший исследователей. Хотя ИИ не доказал саму гипотезу Римана, его результат является заметным продвижением в аналитической теории чисел.

Прорыв

Ключевая идея Claude заключалась в объединении результатов Балуйота, Голдстона, Суриаджайи и Тёрнейдж-Баттербо (работ, адаптирующих методы Монтгомери 1973 года без предположения гипотезы Римана) со статьёй Бомбьери 2000 года. Проще говоря, Claude сконструировал подходящее пространство функций с квадратичной формой, индуцированной Вейлем, и рассмотрел положительно и отрицательно определённые подпространства, соответствующие нулям на линии и вне её. Записав неравенство для ранга квадратичной формы с использованием информации о первых и вторых моментах, он достиг новой границы.

Согласно заметке Anthropic, подход рассматривает всё пространство целиком, причём квадратичная форма может быть недиагональной — этот шаг позволяет использовать выводы из предыдущих работ. Два математика Anthropic проверили статью и подготовили неформальную экспертную заметку, а внешние эксперты Брайан Конри и Дэн Голдстон также ознакомились с ней в короткий срок.

Ad

Как работал Claude

Результат был получен в ходе двух сессий в Claude Code с использованием в общей сложности 31 миллиона выходных токенов. Джарред Самнер, сотрудник Anthropic (и не математик), попросил Claude «предпринять реальную попытку» доказать саму гипотезу Римана, оставив математический выбор модели. Первоначально Claude сгенерировал 650 идей, которые не сработали, что побудило к новому запуску. Во второй сессии Claude координировал около 60 субагентов в течение полутора дней, выполнив 2400 команд в оболочке и написав сотни скриптов на Python. Субагенты провели тысячи численных проверок на известных нулях дзета-функции и рецензировали работы друг друга.

Формально проверяемое доказательство

Примечательно, что Claude также создал формально проверяемое доказательство своего результата, дополняющее неформальную заметку для экспертов. Это повышает правдоподобие находки, хотя команда не ожидает, что техники позволят доказать саму гипотезу Римана.

Для разработчиков, использующих ИИ-агентов, это конкретный пример того, как далеко продвинулись математические рассуждения, и как нематематик может направить агента к настоящему исследовательскому вкладу.

📖 Читать полный источник: HN AI Agents

Ad

👀 Смотрите также

Тестирование OpenClaw на UmbrelOS: Что нужно знать
Новости

Тестирование OpenClaw на UmbrelOS: Что нужно знать

Интеграция OpenClaw с UmbrelOS находится на стадии изучения, что может предложить новую среду для усовершенствованных инструментов кодирования с использованием ИИ.

OpenClawRadar
Стратегия Apple в области ИИ и коммодификация интеллекта
Новости

Стратегия Apple в области ИИ и коммодификация интеллекта

В статье утверждается, что консервативный подход Apple к ИИ может оказаться выгодным по мере того, как интеллект становится товаром массового потребления. Модели вроде Gemma4 достигают 85,2% на MMLU Pro, работая на телефонах, а ежедневные затраты OpenAI на Sora составляют 15 млн долларов при выручке в 2,1 млн.

OpenClawRadar
Claude Opus 4.5 и Sonnet 4.5 удалены из выбора моделей (/model selection), для их использования требуется флаг запуска.
Новости

Claude Opus 4.5 и Sonnet 4.5 удалены из выбора моделей (/model selection), для их использования требуется флаг запуска.

Claude Opus 4.5 и Sonnet 4.5 больше не доступны в меню выбора /model во время сессий. Теперь пользователи должны начинать сессии с флагом --model, указывая полный идентификатор модели, чтобы получить доступ к этим старым версиям.

OpenClawRadar
Тест пространственного мышления LLM: бенчмарк Sokoban показывает лидерство ChatGPT, Qwen3.7-max и Gemini 3.5-thinking
Новости

Тест пространственного мышления LLM: бенчмарк Sokoban показывает лидерство ChatGPT, Qwen3.7-max и Gemini 3.5-thinking

Специальный тест Sokoban оценивал пространственное мышление LLM в режиме zero-shot со строгим форматированием. Только ChatGPT, Qwen3.7-max и Gemini 3.5-thinking справились. Такие модели, как Gemini 3.5-flash и Qwen3.7-plus, не прошли из-за недопустимых ходов или тупиков.

OpenClawRadar