Oodle.ai запускает Observability для агентов по цене $10 за миллион трейсов

Oodle.ai (от Кирана и Виджая) запустил продукт для наблюдаемости агентов по цене $10 за миллион спанов, с задержкой запросов P99 менее секунды и нулевой дискретизацией. Сервис хранит трейсы в S3, используя собственный столбцовый формат, подобный Parquet, с запросами через AWS Lambda.
Ключевые детали из запуска на HN:
- Собственный движок столбцового хранения, разрабатывавшийся два года для логов, метрик и трейсов, теперь применяется к трейсам LLM-агентов.
- Трейсы могут быть от МБ до ГБ; хранятся в S3 в собственном формате, подобном parquet, запросы выполняются бессерверно с Lambda.
- Детерминированный анализ каждого спана до LLM-оценок: обнаруживает сбои инструментов, повторные попытки, циклы, аномальное использование токенов, регрессии задержки, нарушения схемы, тональность и другие сигналы продакшна.
- Ценообразование: $10 за миллион спанов. Прием $0.30/ГБ, хранение $0.001/ГБ/мес (пример: 1200 ГБ/мес + 90 дней хранения = $362/мес).
- Готовые инсайты: ошибки восстановления, высокая длительность, низкая удовлетворенность пользователей, оптимизация стоимости модели, неэффективность кэширования, чрезмерное количество обращений к LLM.
- Авторы ранее использовали Langfuse (в 6 раз дороже). В настоящее время обрабатывают 3M+ трейсов агентов в день с нулевой дискретизацией.
Как это работает: Oodle хранит все трейсы без дискретизации, анализирует каждый спан детерминированно на предмет сигналов сбоя, затем опционально запускает LLM-оценки на отмеченных трейсах. Запросы ко всем сохраненным данным одинаково быстры — нет теплых/холодных уровней.
Для кого это: Для инженерных команд, запускающих AI-агентов в продакшн, которым нужно доступное полнодетальное трассирование без дискретизации.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

Смрити: Git-подобная система для управления состоянием рассуждений LLM, предотвращающая смещение диалога.
Smriti — это инструмент с открытым исходным кодом, который позволяет разработчикам сохранять, восстанавливать, ветвить и сравнивать состояния рассуждений в диалогах с LLM, чтобы предотвратить дрейф. Он рассматривает взаимодействия как состояние, а не как историю чата, что позволяет выполнять чистые откаты и исследовать альтернативные пути без загрязнения основного потока.

Обновление Ollama добавляет поддержку OpenClaw для облачной модели Kimi k2.5
Ollama выпустила обновление, которое интегрирует поддержку OpenClaw для облачных моделей, включая бесплатный доступ к модели Kimi k2.5 с функцией веб-поиска, работающей в дата-центрах NVIDIA.

Плагин Godmode добавляет автономный цикл итераций в Claude Code и другие AI-агенты для программирования.
Godmode — это плагин с открытым исходным кодом, который добавляет в Claude Code автономный цикл «измерить-изменить-проверить» с параллельными агентами, памятью о неудачах и 126 навыками, включая оптимизацию, аудит безопасности и TDD. Работает с Cursor, Codex, Gemini CLI и OpenCode.

Параллельные агенты кодирования с использованием tmux и спецификаций в Markdown
Мануэль Шиппер описывает систему для запуска 4-8 параллельных кодирующих агентов с использованием tmux, файлов Markdown, bash-алиасов и шести слэш-команд. Настройка использует спецификации Feature Design (FD) в формате Markdown, отслеживаемые через 8-этапный жизненный цикл.