Voker lance sa plateforme d'analyse d'agents avec les primitives Intention/Correction/Résolution
Voker.ai, une startup YC S24, a lancé une plateforme d'analyse conçue spécifiquement pour les agents IA. Le produit principal est un SDK léger (Python & TypeScript) qui encapsule les appels LLM vers OpenAI, Anthropic et Gemini, collectant automatiquement les données de conversation et annotant trois primitives : Intentions, Corrections et Résolutions.
Ce qu'il fait
Voker traite les appels LLM en classifiant automatiquement les objectifs des utilisateurs (intentions), en détectant quand les utilisateurs corrigent l'agent (corrections) et en mesurant quand l'agent résout l'intention (résolutions). Il utilise ensuite une classification hiérarchique de texte (pas de LLM pour le data engineering) pour les agréger en catégories dynamiques, offrant aux équipes produit des insights en libre-service sans avoir à lire des traces individuelles.
Détails clés du lancement
- Intégration SDK : Deux lignes pour installer :
pip install vokeret encapsuler le fournisseur LLM (par ex.,from voker.ai.provider_openai import OpenAI). - Indépendant de la pile LLM : Fonctionne avec OpenAI, Anthropic, Gemini, Langchain, CrewAI et Vercel AI SDK.
- Tarification : Niveau gratuit — 2 000 événements/mois (inscription par email requise). Les plans payants commencent à 80 $/mois avec un essai gratuit de 30 jours.
- Philosophie du data engineering : Voker évite explicitement d'utiliser des LLM pour le traitement central des données afin de garantir des statistiques cohérentes, reproductibles et précises. Les co-fondateurs notent que le téléchargement de logs dans ChatGPT donne souvent des insights surajustés ou incohérents.
Pourquoi ça existe
Selon une enquête auprès des fondateurs YC, 90 %+ ont déclaré que la seule façon de savoir que les agents échouent est via les plaintes des clients. Les outils existants sont insuffisants : l'observabilité (par ex., Langfuse, Langsmith) est bonne pour le débogage de traces mais pas accessible aux non-ingénieurs ; les évaluations testent les problèmes connus mais manquent les tendances inattendues ; les analyses traditionnelles (PostHog, Mixpanel) ne sont pas conçues pour les données conversationnelles non structurées.
À qui ça s'adresse
Équipes gérant des agents conversationnels à fort volume (1 000+ sessions de chat par mois) avec des interactions complexes à plusieurs tours, ayant besoin d'insights que les équipes transverses (PMs, ingénieurs, analystes) peuvent utiliser en libre-service.
📖 Lire la source complète : HN AI Agents
👀 See Also

Portage de l'Autoresearch de Karpathy sur le Neural Engine d'Apple pour une meilleure efficacité énergétique par watt
Un prototype combine le projet autoresearch d'Andrej Karpathy avec les performances rétro-ingéniérées du Neural Engine d'Apple, visant un meilleur débit par watt par rapport aux API officielles. Le projet est construit sur des dépôts GitHub existants et reconnaît les contributions de plusieurs développeurs.

Claude Skill Structurée pour les Workflows de Croissance B2B SaaS
Un développeur a open-sourcé une Skill Claude qui structure les connaissances sur la croissance des SaaS B2B en playbooks et études de cas pour améliorer la qualité des sorties de Claude. Le dépôt comprend 5 études de cas SaaS, une roue de croissance en 4 étapes et 6 playbooks structurés.

Éditeur Vidéo Crée Treelo, un Outil de Transcription Gratuit en Utilisant le Code de Claude
Un éditeur vidéo a créé Treelo, un outil web gratuit qui transcrit des fichiers audio/vidéo en blocs horodatés éditables avec des préréglages de sous-titres et exporte aux formats SRT, VTT, ASS et WAV. L'outil a été construit via des conversations itératives avec Claude Code.

Titre : Claude Design vs Huashu-Design : Face-à-face sur les mises en page HTML et les limites de taux
Claude Design crée rapidement des prototypes HTML mais atteint vite ses limites de taux. Huashu-Design, une compétence open-source Claude Code, fonctionne sur l'abonnement normal sans limite de taux séparée—mais prend 20 minutes contre 5.