Oodle.ai가 에이전트 관측 가능성 서비스를 트레이스 100만 개당 10달러에 출시

Oodle.ai (Kiran과 Vijay가 창업)는 에이전트 옵저버빌리티 제품을 스팬 100만 개당 10달러, 서브초 P99 쿼리 지연 시간, 제로 샘플링으로 출시했습니다. 이 서비스는 S3에 커스텀 Parquet 유사 컬럼 포맷으로 트레이스를 저장하며, AWS Lambda를 통해 쿼리합니다.
HN 런칭 주요 내용:
- 로그, 메트릭, 트레이스를 위해 2년간 개발된 커스텀 컬럼 스토리지 엔진을 LLM 에이전트 트레이스에 적용.
- 트레이스는 MB에서 GB까지 가능하며, 독점 Parquet 유사 포맷으로 S3에 저장되고 Lambda로 서버리스 쿼리됨.
- LLM 평가 전에 각 스팬에 대한 결정론적 분석: 도구 실패, 재시도, 루프, 비정상 토큰 사용, 지연 시간 회귀, 스키마 위반, 감성 및 기타 프로덕션 신호 감지.
- 가격: 스팬 100만 개당 10달러. 수집 $0.30/GB, 보관 $0.001/GB/월 (예시: 월 1200GB + 90일 보관 = 월 $362).
- 기본 제공 인사이트: 오류 복구 실패, 높은 지속 시간, 낮은 사용자 만족도, 모델 비용 최적화, 캐싱 비효율, 과도한 LLM 턴.
- 저자는 이전에 Langfuse를 사용했으나 (6배 비쌈). 현재 하루 300만 개 이상의 에이전트 트레이스를 제로 샘플링으로 처리 중.
작동 방식: Oodle은 모든 트레이스를 샘플링 없이 저장하고, 각 스팬을 결정론적으로 분석하여 실패 신호를 찾은 후, 플래그된 트레이스에 대해 선택적으로 LLM 기반 평가를 실행합니다. 보존된 모든 데이터에 대한 쿼리는 균일하게 빠르며, 웜/콜드 티어가 없습니다.
대상: 프로덕션에서 AI 에이전트를 출시하는 엔지니어링 팀으로, 샘플링 없이 저렴한 전체 충실도 트레이싱이 필요합니다.
📖 전체 출처 읽기: HN AI Agents
👀 See Also

Creation OS: 모델이 환각 대신 '모르겠습니다'라고 말할 수 있게 하는 로컬 σ-게이트 LLM 런타임
Creation OS는 로컬 LLM(BitNet, Qwen, Gemma, 모든 GGUF)을 σ-게이트로 감싸서 여러 불확실성 채널을 측정하고 출력마다 ACCEPT, RETHINK 또는 ABSTAIN을 결정합니다. 클라우드나 API가 필요 없습니다. 선택적 재생성을 통해 TruthfulQA 정확도가 약 29% 향상되었습니다.

파일럿 프로토콜: Claude로 구축된 AI 에이전트용 P2P 네트워크 스택
개발자가 자율 AI 에이전트를 위해 특별히 설계된 순수 사용자 공간 피어투피어 가상 네트워크 스택인 Pilot Protocol을 Go 언어로 구축했습니다. 이 프로토콜은 중앙 집중식 인프라 없이 직접 통신을 가능하게 합니다. UDP 멀티플렉싱, NAT 트래버설 및 종단 간 암호화를 사용하며, 벤치마크 결과 로컬 처리량 89 MB/s, 대륙 간 WAN 처리량 2.1 MB/s를 보여줍니다.

OpenClawDreams: OpenClaw 에이전트를 위한 꿈 시뮬레이터 확장
OpenClawDreams는 OpenClaw 에이전트에 배경 반성 프로세스와 야간 꿈 주기를 추가하는 확장 기능입니다. 이는 암호화된 대화 요약을 로컬 SQLite 데이터베이스에 캡처하고, 배경 주기 동안 이를 처리하며, 통합된 통찰력을 생성하여 에이전트의 지속적 메모리에 푸시합니다.

로컬-클라우드 하이브리드 AI 아키텍처: r/LocalLLaMA에서 영감 받은 실용적 패턴
원본 게시글은 로컬 모델이 일상적인 작업을 처리하고, 복잡한 추론이 필요할 때 단일 API 호출을 통해 클라우드 모델에 위임하는 하이브리드 AI 모델을 제안합니다. 또한 안전 장치 역할을 하는 결정론적 '하이퍼바이저'를 포함합니다.