Oodle.ai가 에이전트 관측 가능성 서비스를 트레이스 100만 개당 10달러에 출시

Oodle.ai (Kiran과 Vijay가 창업)는 에이전트 옵저버빌리티 제품을 스팬 100만 개당 10달러, 서브초 P99 쿼리 지연 시간, 제로 샘플링으로 출시했습니다. 이 서비스는 S3에 커스텀 Parquet 유사 컬럼 포맷으로 트레이스를 저장하며, AWS Lambda를 통해 쿼리합니다.
HN 런칭 주요 내용:
- 로그, 메트릭, 트레이스를 위해 2년간 개발된 커스텀 컬럼 스토리지 엔진을 LLM 에이전트 트레이스에 적용.
- 트레이스는 MB에서 GB까지 가능하며, 독점 Parquet 유사 포맷으로 S3에 저장되고 Lambda로 서버리스 쿼리됨.
- LLM 평가 전에 각 스팬에 대한 결정론적 분석: 도구 실패, 재시도, 루프, 비정상 토큰 사용, 지연 시간 회귀, 스키마 위반, 감성 및 기타 프로덕션 신호 감지.
- 가격: 스팬 100만 개당 10달러. 수집 $0.30/GB, 보관 $0.001/GB/월 (예시: 월 1200GB + 90일 보관 = 월 $362).
- 기본 제공 인사이트: 오류 복구 실패, 높은 지속 시간, 낮은 사용자 만족도, 모델 비용 최적화, 캐싱 비효율, 과도한 LLM 턴.
- 저자는 이전에 Langfuse를 사용했으나 (6배 비쌈). 현재 하루 300만 개 이상의 에이전트 트레이스를 제로 샘플링으로 처리 중.
작동 방식: Oodle은 모든 트레이스를 샘플링 없이 저장하고, 각 스팬을 결정론적으로 분석하여 실패 신호를 찾은 후, 플래그된 트레이스에 대해 선택적으로 LLM 기반 평가를 실행합니다. 보존된 모든 데이터에 대한 쿼리는 균일하게 빠르며, 웜/콜드 티어가 없습니다.
대상: 프로덕션에서 AI 에이전트를 출시하는 엔지니어링 팀으로, 샘플링 없이 저렴한 전체 충실도 트레이싱이 필요합니다.
📖 전체 출처 읽기: HN AI Agents
👀 See Also

Claude Code로 구축한 로컬 음성-텍스트 macOS 앱: Vext 사례 연구
한 개발자가 3개월 동안 Apple Neural Engine에서 Whisper를 사용하는 macOS 음성-텍스트 앱 Vext를 만들었습니다. Claude Code가 Rust/Swift FFI, Core ML 최적화 및 단축키 아키텍처를 도왔습니다. 이 앱은 완전히 오프라인에서 실행되며 60초 오디오를 약 400ms에 변환합니다.

클로드 코드, 엔비디아 NIM 게이트웨이를 통해 네모트론-3 120B 등 240개 이상 모델 지원
Claude Code는 /model 명령어로 세션 중간에 240개 이상의 NVIDIA NIM 모델로 전환할 수 있습니다. Nemotron-3 Super 120B 생각 모드 변형은 다중 파일 리팩토링 및 에이전트 작업에서 강력한 결과를 보여줍니다.

클로드 코드가 코딩 작업을 미스트랄/딥시크에 위임: 5700만 토큰 절약, 비용 90-100% 감소
vibe-skill이라는 Claude Code 스킬이 Claude의 계획 수립 기능은 유지하면서 저수준 코딩을 Mistral 또는 DeepSeek 같은 저렴한 모델에 위임합니다. 10일간 254회 실행 결과 5700만 토큰을 절약하고 90~100%의 비용 절감 효과를 달성했으며, 성공률은 98%입니다.

Mnemos: 코딩 에이전트를 위한 오픈소스 로컬-퍼스트 메모리 레이어
Mnemos는 스코프 블리드, 오래된 사실, 무제한 전사본 증가와 같은 일반적인 메모리 시스템 실패를 해결하는 솔로 코딩 에이전트 워크플로우를 위한 로컬-퍼스트 메모리 레이어입니다. 공개 베타에는 SQLite 스타터 프로필, Claude Code/Desktop용 MCP 지원, SurprisalGate 및 MutableRAG와 같은 구성 요소를 포함한 생체 모방 파이프라인이 포함되어 있습니다.