Тестирование показывает, что инструменты автоматизации браузера на основе ИИ различаются в 2,6 раза по стоимости токенов при одинаковой точности.

✍️ OpenClawRadar📅 Опубликовано: 17 марта 2026 г.🔗 Source
Тестирование показывает, что инструменты автоматизации браузера на основе ИИ различаются в 2,6 раза по стоимости токенов при одинаковой точности.
Ad

Результаты бенчмарка: одинаковая точность, разные затраты

Бенчмарк протестировал 4 инструмента автоматизации браузера через CLI с использованием одной и той же модели (Claude Sonnet 4.6) на 6 реальных задачах на живых сайтах. Все инструменты показали 100% точность в 18 выполнениях задач, но использование токенов значительно различалось:

  • openbrowser-ai: 36 010 токенов / 84,8 с / 15,3 вызова инструментов
  • browser-use: 77 123 токена / 106,0 с / 20,7 вызова инструментов
  • playwright-cli (Microsoft): 94 130 токенов / 118,3 с / 25,7 вызова инструментов
  • agent-browser (Vercel): 90 107 токенов / 99,0 с / 25,0 вызова инструментов

Openbrowser-ai использовал в 2,1–2,6 раза меньше токенов, чем другие инструменты. Бенчмарк показал, что количество вызовов инструментов является самым сильным предиктором стоимости токенов, потому что каждый вызов заставляет LLM заново обрабатывать всю историю диалога.

Ad

Как инструменты различаются в реализации

Все четыре инструмента поддерживают постоянные сессии браузера через фоновые демоны, могут выполнять JavaScript на стороне сервера и возвращать только результат, работают над сжатием состояния страницы и поддерживают некоторую форму выполнения кода.

browser-use предоставляет отдельные команды CLI: open, click, input, scroll, state, eval. LLM отправляет одну команду за вызов инструмента. eval выполняет JavaScript в контексте страницы. Состояние страницы — это расширенное DOM-дерево с индексами [N] примерно по 880 символов на страницу. Он общается с Chrome напрямую через CDP с помощью их библиотеки cdp-use.

agent-browser следует аналогичной схеме: open, click, fill, snapshot, eval. Это нативный бинарный файл на Rust, который напрямую общается с Chrome через CDP. Состояние страницы — это дерево доступности с ссылками u/eN. Флаг -i создаёт компактный вывод только для интерактивных элементов объёмом около 590 символов. Команды можно объединять с помощью &&, но каждая из них всё равно является отдельным запросом к демону.

playwright-cli предлагает отдельные команды плюс run-code, который принимает произвольный JavaScript Playwright с полным доступом к API. LLM может написать код вроде run-code "async page => { await page.goto('url'); await page.click('.btn'); return await page.title(); }" и выполнить несколько операций за один вызов. Состояние страницы — это дерево доступности, сохраняемое в файлы .yml объёмом примерно 1 420 символов, с инкрементальными снимками, которые отправляют только различия после первого чтения.

openbrowser-ai вообще не имеет отдельных команд. Единственный интерфейс — это код на Python через -c:

openbrowser-ai -c 'await navigate("https://en.wikipedia.org/wiki/Python") info = await evaluate("document.querySelector('.infobox')?.innerText") print(info)'

navigate, click, input_text, evaluate, scroll — это асинхронные функции Python в постоянном пространстве имён. Состояние страницы — это DOM с индексами [i_N] объёмом примерно 450 символов. Переменные сохраняются между вызовами, как в блокноте Jupyter.

Бенчмарк показал, что LLM совершал меньше вызовов инструментов с OpenBrowser (15,3 против 20–26 у других инструментов), что авторы объясняют тем, что интерфейс только с кодом естественным образом поощряет группировку операций.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

Выпущен OpenClaw Optimizer v1.18.0 с синхронизацией OpenClaw v2026.3.7.
Инструменты

Выпущен OpenClaw Optimizer v1.18.0 с синхронизацией OpenClaw v2026.3.7.

Навык OpenClaw Optimizer версии 1.18.0 теперь совместим с OpenClaw v2026.3.7, добавив поддержку новых AI-провайдеров, включая Google Gemini 3.1 Flash-Lite и OpenAI gpt-5.4, а также новых CLI-команд, таких как /session idle и /usage cost.

OpenClawRadar
Тестирование ИИ-агентов с реальными API с помощью d3 Labs
Инструменты

Тестирование ИИ-агентов с реальными API с помощью d3 Labs

d3 labs предлагает 10 бесплатных производственных API, чтобы помочь разработчикам тестировать AI-агентов в реальных сценариях, а не полагаться на нереалистичные макеты.

OpenClawRadar
Создание языка программирования с помощью Claude Code: эксперимент Cutlet
Инструменты

Создание языка программирования с помощью Claude Code: эксперимент Cutlet

Анкур Сети создал полноценный язык программирования под названием Cutlet с помощью Claude Code за четыре недели, при этом ИИ генерировал каждую строку кода, а разработчик сосредоточился на создании защитных механизмов и тестировании. Язык обладает динамической типизацией, векторными операциями и REPL, работает на macOS и Linux.

OpenClawRadar
Фабрика агентов: Автономная система создает ИИ-агентов из онлайн-обсуждений проблем
Инструменты

Фабрика агентов: Автономная система создает ИИ-агентов из онлайн-обсуждений проблем

Agent Factory — это автономная система, которая собирает данные с Reddit, HN, GitHub и Twitter о реальных проблемах, оценивает их по спросу, рыночному разрыву и выполнимости, а затем создаёт автономные ИИ-агенты для перспективных идей. Система использует минимальный шаблон Next.js с 7 инструментами и запускает Claude Code в фоновом режиме через shell-скрипт.

OpenClawRadar