Análisis de las Capacidades de Instrumentación y Telemetría de Claude Code

Un análisis reciente del código fuente de Claude Code revela un sistema altamente instrumentado que rastrea las interacciones de los usuarios y los detalles del entorno más allá de la funcionalidad típica de un chatbot. El sistema implementa múltiples capas de observación y clasificación.
Clasificación de Lenguaje y Seguimiento de Sentimientos
Claude Code utiliza detección simple de palabras clave en lugar de comprensión profunda de IA para la clasificación de lenguaje. Mantiene listas literales de palabras clave que incluyen términos como "wtf", "esto apesta", "frustrante", "mierda", "joder" y "cabreado" que activan banderas de sentimiento negativo. Incluso frases como "continúa", "sigue adelante" y "sigue" son rastreadas. Esta clasificación ocurre a nivel de expresiones regulares antes de que el modelo responda.
Seguimiento del Comportamiento en Solicitudes de Permisos
El sistema rastrea el comportamiento detallado de los usuarios durante las solicitudes de permisos, no solo las decisiones finales. Monitorea si los usuarios abren la caja de comentarios, la cierran, presionan escape sin escribir, o escriben algo y luego cancelan. Los eventos internos tienen nombres como tengu_accept_feedback_mode_entered, tengu_reject_feedback_mode_entered y tengu_permission_request_escape. Incluso cuenta los intentos de escape, distinguiendo entre rechazos rápidos y comportamientos vacilantes donde los usuarios escriben antes de rechazar.
Diseño del Sistema de Comentarios
El sistema de comentarios se activa según reglas de ritmo, tiempos de espera y probabilidad en lugar de aleatoriamente. Cuando los usuarios marcan algo como malo, puede pedirles que ejecuten /issue y animarlos a compartir transcripciones de sesión. Si aceptan, puede incluir transcripciones principales, transcripciones de subagentes y, a veces, registros JSONL crudos con redacción.
Comandos Ocultos y Cambios de Comportamiento
Algunos comandos no son obvios sin leer el código. Ejemplos incluyen:
ultrathink→ aumenta el nivel de esfuerzo y cambia el estilo de la interfazultraplan→ inicia un modo de planificación remotaultrareview→ idea similar para flujos de trabajo de revisión/btw→ activa un agente secundario para que el flujo principal continúe
El cuadro de entrada analiza estos en vivo mientras se escribe.
Telemetría y Creación de Huellas Digitales del Entorno
Cada sesión registra datos extensos que incluyen ID de sesión, ID de contenedor, rutas del espacio de trabajo, hashes de repositorio, detalles de tiempo de ejecución/plataforma, contexto de GitHub Actions e ID de sesión remota. Con ciertas banderas activadas, también puede registrar las indicaciones de los usuarios y las salidas de herramientas. Esto crea una huella digital detallada del entorno más allá de las analíticas básicas de uso.
Exposición de Datos de Comandos MCP
Ejecutar claude mcp get <nombre> puede devolver URL de servidores, encabezados, sugerencias de OAuth y bloques completos de entorno para servidores stdio. Si las variables de entorno incluyen secretos, pueden aparecer en la salida de la terminal.
Instrumentación Interna de Construcción
Hay un modo (USER_TYPE=ant) donde recopila datos adicionales que incluyen espacio de nombres de Kubernetes, ID exacto del contenedor y contexto completo de permisos con rutas, reglas de sandbox y omisiones. Todo esto se registra bajo eventos de telemetría interna, permitiendo que el comportamiento se vincule a entornos de implementación específicos.
El análisis concluye que Claude Code no es solo un chatbot sino un sistema altamente instrumentado que observa cómo interactúan los usuarios con él. El nivel de seguimiento y clasificación es más profundo de lo que la mayoría de los usuarios esperaría, aunque el análisis no afirma intenciones maliciosas.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Usuario de OpenClaw Agrega TOTP 2FA Después de que Agente Expusiera Claves API en Texto Plano
Un usuario de OpenClaw creó una habilidad de seguridad llamada 'Secure Reveal' que requiere autenticación TOTP a través de Telegram antes de mostrar las credenciales almacenadas, después de que su agente de IA filtrara accidentalmente claves API y contraseñas en texto plano durante una demostración.

Investigación: Los Caracteres Unicode Invisibles Pueden Secuestrar Agentes de LLM a través del Acceso a Herramientas
Un estudio evaluó si los modelos de lenguaje grandes (LLM) siguen instrucciones ocultas en caracteres Unicode invisibles incrustados en texto normal, utilizando dos esquemas de codificación en cinco modelos y 8,308 salidas calificadas. Hallazgo clave: el acceso a herramientas amplifica el cumplimiento de menos del 17% a 98-100%, con modelos escribiendo scripts en Python para decodificar los caracteres ocultos.

Solución arquitectónica para la sobrecentralización de agentes de IA: separación de memoria, ejecución y acciones de salida.
Un desarrollador se dio cuenta de que su asistente de IA se estaba convirtiendo en un 'autócrata interno' al manejar la memoria a largo plazo, el acceso a herramientas y las decisiones autónomas en un solo componente. La solución consistió en separar el sistema en tres roles: controlador privado, trabajadores con alcance limitado y puerta de salida.

OneCLI: Bóveda de Credenciales de Código Abierto para Agentes de IA
OneCLI es una puerta de enlace de código abierto escrita en Rust que se sitúa entre los agentes de IA y los servicios externos, inyectando credenciales reales en el momento de la solicitud mientras que los agentes solo ven claves de marcador de posición. Proporciona almacenamiento cifrado AES-256-GCM, se ejecuta en un único contenedor Docker con PGlite integrado y funciona con cualquier framework de agentes que pueda configurar un HTTPS_PROXY.