AlphaEvolve: агент на базе Gemini от DeepMind оптимизирует алгоритмы в геномике, энергосетях и цепях TPC

Google DeepMind поделился информацией о AlphaEvolve, своем кодирующем агенте на базе Gemini для разработки алгоритмов. Первоначально представленный год назад, теперь он применяется в геномике, оптимизации энергосетей, науках о Земле, квантовых вычислениях, математике и инфраструктуре ИИ.
Ключевые результаты из источника
- Геномика: AlphaEvolve улучшил DeepConsensus (модель исправления ошибок секвенирования ДНК Google), добившись снижения ошибок обнаружения вариантов на 30%. PacBio сообщает о более высокой точности приборов для секвенирования, что потенциально позволяет обнаруживать ранее скрытые мутации, вызывающие заболевания.
- Оптимизация сетей: Применительно к задаче AC Optimal Power Flow агент повысил уровень осуществимости обученной модели GNN с 14% до более чем 88%, сократив дорогостоящую постобработку для электрических сетей.
- Науки о Земле: Автоматическая оптимизация моделей Earth AI повысила точность прогнозирования рисков стихийных бедствий (лесные пожары, наводнения, торнадо) на 5% по 20 категориям.
- Квантовая физика: Предложены квантовые схемы для процессора Google Willow с ошибкой в 10 раз ниже по сравнению с обычными базовыми показателями, что позволило провести первые в своем роде экспериментальные демонстрации.
- Математика: В сотрудничестве с Теренсом Тао AlphaEvolve помог решить задачи Эрдёша, улучшить нижние границы для задачи коммивояжера и чисел Рамсея, а также внести вклад в задачу Таммеса (пример оптимизации показан в галерее).
- Инфраструктура: Оптимизированы конструкции TPU следующего поколения и обнаружены более эффективные политики замещения кэша за два дня — задачи, которые ранее требовали месяцев человеческого труда.
- Другие области: Обнаружены интерпретируемые нейронаучные модели, доказаны пределы микроэкономических рынков, улучшены строительные блоки нейронных сетей, криптография, синтез данных и меры безопасности для передовых моделей ИИ.
Для кого это
Разработчики и исследователи, создающие оптимизационные конвейеры на основе ИИ или работающие над открытием алгоритмов в научных вычислениях, проектировании аппаратного обеспечения или крупномасштабной инфраструктуре.
📖 Читайте полный источник: HN AI Agents
👀 Смотрите также

Sakana AI запускает лабораторию RSI: рекурсивное самосовершенствование с фундаментальными моделями
Sakana AI официально запускает лабораторию рекурсивного самосовершенствования, опираясь на опубликованные исследования, такие как LLM-Squared, Darwin Gödel Machine и The AI Scientist, для создания автономных, самосовершенствующихся систем ИИ.
Мнение UX-дизайнера: Дизайн Claude не может заменить опытных дизайнеров
UX-дизайнер утверждает, что Claude Design переоценен и полезен только для не-дизайнеров, чтобы прототипировать идеи, начинающих стартапов и портфолио для новичков.

Клод превосходит Gemini, ChatGPT и Grok в соревновании по программированию на Python в реальном времени.
Разработчик протестировал Claude, Gemini, ChatGPT и Grok в турнире по программированию на Python в реальном времени, где ИИ-боты соревновались в поиске слов на сетке 15×15 букв. Claude одержал решительную победу.

Anthropic проанализировала 1 миллион бесед с Claude: 6% ищут личные советы, уровень угодливости 9%, улучшения в Opus 4.7
Анализ 1 миллиона диалогов с Claude показывает, что 6% запросов касаются личных советов, причем в теме отношений уровень подобострастия (угодливости) самый высокий — 25%. Opus 4.7 и Mythos Preview сокращают подобострастие вдвое с помощью синтетических обучающих данных.