Arquitectura de Prompt de Claude Code Ingeniería Inversa para Modelos Locales

Un repositorio de GitHub contiene una reimplementación completa y legalmente limpia de la arquitectura de prompts de Claude Code, diseñada para desarrolladores que construyen agentes de codificación en modelos locales.
Detalles clave
El repositorio documenta la arquitectura completa de prompts que utiliza Claude Code, originalmente obtenida de un breve lanzamiento público en npm. El autor estudió cada prompt y utilizó al propio Claude para ayudar a reescribir toda la colección desde cero. El resultado son 26 prompts en total que cubren:
- Estructura del prompt del sistema que realmente controla el comportamiento (no solo "eres un asistente útil")
- Prompts de herramientas que evitan que el modelo use la terminal cuando existe una herramienta dedicada
- Reglas de seguridad que limitan acciones destructivas sin ser demasiado restrictivas
- Compresión de memoria para sesiones largas (crítico para ventanas de contexto más pequeñas)
- Patrones de verificación que detectan cuando el modelo está racionalizando en lugar de probar
Los prompts están organizados en categorías: sistema, herramientas, agentes, memoria, coordinación y utilidades. Los patrones de prompts son independientes del modelo y pueden adaptarse para cualquier modelo que admita el uso de herramientas.
Estado legal
Cada prompt está escrito de forma independiente con redacción diferente. El autor verificó que no hubiera copia textual mediante controles automatizados. El repositorio incluye un descargo de responsabilidad legal completo que cubre el uso nominativo justo, la no afiliación con Anthropic y una política de respuesta a DMCA. Esto se describe como una reimplementación de estilo sala limpia, no una copia.
El proyecto tiene licencia MIT y está disponible en https://github.com/swati510/claude-code-prompts.
Esta arquitectura es particularmente útil para construir flujos de trabajo agenticos con Ollama, llama.cpp o vLLM.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Cull: Motor de código abierto para la curación de conjuntos de datos en pipelines de imágenes de IA
Cull extrae imágenes de más de 340 fuentes, incluyendo Civitai, X/Twitter, Reddit, Discord y sitios booru, las clasifica con un modelo de lenguaje visual a través de LM Studio local o Groq, y las organiza en carpetas por categoría con prompts de SD y registros de auditoría.

Heren Godot MCP: Daemon WebSocket Persistente Reduce la Latencia de Interacción AI–Godot a ~20ms
Heren es un nuevo servidor MCP para Godot que mantiene un demonio WebSocket ligero activo, logrando operaciones de ~20ms en lugar de esperar arranques completos del motor. Proporciona 15 herramientas para gestión de escenas, depuración, capturas de pantalla aceleradas por GPU y apagado automático tras 3 minutos de inactividad.

Desarrollador de OpenClaw construye sistema de memoria unificada para agentes de IA.
Un desarrollador ha creado un sistema de memoria unificado de 15 herramientas para agentes de IA OpenClaw que combina hechos estructurados, búsqueda vectorial, grafos de entidades, líneas de tiempo de episodios, compresión jerárquica y coordinación basada en eventos. El sistema funciona localmente sin dependencias en la nube ni tarifas mensuales.

ClawCall obtiene números telefónicos dedicados: los agentes ahora pueden reservar un número para llamadas salientes
ClawCall, la habilidad de llamadas telefónicas con IA para agentes OpenClaw, ahora te permite reservar un número de teléfono por código de área. Tu agente lo usa por defecto al hacer llamadas. 10k descargas, 300 llamadas/día.