AI Подпрограммы: Детерминированная автоматизация браузера с нулевой стоимостью токенов

✍️ OpenClawRadar📅 Опубликовано: 19 апреля 2026 г.🔗 Source
AI Подпрограммы: Детерминированная автоматизация браузера с нулевой стоимостью токенов
Ad

Что делают AI Subroutines

AI Subroutines записывают действия в браузере один раз и сохраняют их как вызываемые инструменты, которые воспроизводятся с нулевой стоимостью токенов, нулевой задержкой LLM-инференса и со 100% детерминизмом. Сгенерированный скрипт выполняется внутри самой веб-страницы, а не через прокси, headless-воркер или внешнее решение.

Ключевое архитектурное решение

Скрипт выполняется в контексте исполнения веб-страницы, что означает автоматическое добавление всех аутентификационных данных, CSRF-токенов, TLS-сессий и подписанных заголовков в запросы. Не требуется установка сертификатов, модификация TLS-отпечатков или поддержка отдельного стека аутентификации.

Механизм записи

Во время записи расширение перехватывает сетевые запросы с использованием двух уровней:

  • PATCH для fetch/XHR в MAIN-мире, устанавливаемый до запуска любых скриптов страницы
  • API webRequest Chrome в качестве коррелированного резервного варианта для CORS и путей service-worker

Захватываются тела запросов, включая FormData, Blob и сырые байты, а не только JSON.

Обработка сетевого захвата

Система оценивает и сокращает примерно 300 запросов до около 5 на основе нескольких сигналов:

  • Источник первого лица против третьего лица (+20 / −15)
  • Известные хосты телеметрии (Sentry, Segment, Hotjar, RUM): −80
  • Временная корреляция с DOM-событиями (+28 в пределах 800 мс, +16 в пределах 2,5 с)
  • Метод и структура полезной нагрузки (изменяющие POST/PUT/PATCH/DELETE: +35; GET: +5; с телом запроса: +8)
  • Качество ответа (2xx: +12; 4xx+: −25; непустое тело: +4)
  • Волатильные идентификаторы операций (−18) для GraphQL queryId, doc_id, operationHash

Волатильные идентификаторы операций GraphQL активируют резервный вариант только с DOM, прежде чем они молча сломаются при следующем запуске.

Ad

Структура сгенерированного кода

Сгенерированный код объединяет сетевые вызовы с DOM-действиями (клик, ввод, поиск) в одной функции через пространство имён помощника rtrvr.*. Пять лучших ранжированных запросов плюс DOM-взаимодействия формируют контекст объёмом 12 000 символов для генератора.

Паттерн использования

Направьте AI-агент на таблицу из 500 строк, и всего одним вызовом LLM параметры назначаются, а 500 Subroutines запускаются.

Ключевые сценарии использования

  • Запишите отправку DM в Instagram, затем используйте переиспользуемую рутину для отправки DM с нулевой стоимостью токенов
  • Создайте рутину для получения последних продуктов в каталоге сайта, вызывайте её для получения тысяч продуктов через прямые GraphQL-запросы
  • Настройте рутину для заполнения EHR-форм на основе параметров, с AI, выводящим параметры из текущего контекста страницы
  • Переиспользуйте рутины ежедневно для синхронизации исходящих сообщений в LinkedIn/Slack/Gmail с CRM через MCP-сервер

Почему это важно

Фундаментальная проблема с браузерными агентами для повторяющихся задач заключается в том, что проходить через цикл инференса не нужно. Запись один раз и генерация LLM скрипта, который использует все возможные методы взаимодействия (прямые API-вызовы, DOM-взаимодействия, сторонние инструменты/API/MCP-серверы), обеспечивает детерминированную и экономичную автоматизацию.

📖 Read the full source: HN LLM Tools

Ad

👀 Смотрите также

Сервер MCP для контекста кодовой базы с упаковкой по глубине
Инструменты

Сервер MCP для контекста кодовой базы с упаковкой по глубине

Новый MCP-сервер упаковывает контекст кодовой базы на 5 уровнях глубины в рамках лимита токенов, решая проблему, когда ИИ-агенты для программирования либо загружают слишком мало файлов, либо получают плоскую карту репозитория без фактического содержимого.

OpenClawRadar
Настройка локального голосового управления для AI-агентов на Apple Silicon
Инструменты

Настройка локального голосового управления для AI-агентов на Apple Silicon

Настройка локального голосового управления для ИИ-агентов с использованием Parakeet STT и Kokoro TTS на Apple Silicon для быстрого и независимого от облака взаимодействия.

OpenClawRadar
Дживс: Текстовый интерфейс для просмотра и возобновления сессий ИИ-агентов
Инструменты

Дживс: Текстовый интерфейс для просмотра и возобновления сессий ИИ-агентов

Jeeves — это интерфейс командной строки, который позволяет вам искать, просматривать и возобновлять сессии ИИ-агентов из Claude Code, Codex и OpenCode в едином представлении. Он написан на Go и доступен через несколько менеджеров пакетов, включая Homebrew, Nix и Go install.

OpenClawRadar
hipEngine:面向RDNA3(Strix Halo、7900 XTX)的快速原生Qwen 3.6推理
Инструменты

hipEngine:面向RDNA3(Strix Halo、7900 XTX)的快速原生Qwen 3.6推理

hipEngine — это новый открытый (AGPLv3) нативный движок вывода для Qwen 3.6 MoE на графических процессорах RDNA3, основанный на ROCm. Тесты показывают скорость префилла до 2718 ток/с на 7900 XTX, конкурентоспособную с llama.cpp, и кэш KV в INT8, позволяющий разместить полный контекст 256K менее чем в 24 ГБ.

OpenClawRadar