SubQ: Un LLM Subcuadrático con Ventana de Contexto de 12M de Tokens

SubQ de Subquadratic es un LLM listo para producción construido sobre una arquitectura de atención dispersa totalmente subcuadrática. Maneja hasta 12 millones de tokens en una sola indicación, funciona a 150 tokens por segundo y cuesta aproximadamente 1/5 de los modelos líderes como GPT-5 u Opus.
Arquitectura y Benchmarks
A diferencia de los transformadores estándar con atención O(n²), SubQ utiliza un mecanismo de atención dispersa subcuadrático que solo procesa relaciones de tokens relevantes. Con 12 millones de tokens, esto reduce el cómputo de atención en casi 1000×. Benchmarks (validados por terceros):
- SWE-Bench Verified (codificación del mundo real): 81.8%
- RULER @ 128K (precisión en contexto largo): 95.0%
- MRCR v2 (8 agujas, 1M): 65.9%
Para comparar, la puntuación SWE-Bench de SubQ se sitúa entre Gemini 3.1 Pro (80.6%) y Opus 4.6 (80.8%). El modelo también supera a Opus 4.7 (87.6%? – no reportado en el momento) y GPT-5.5 (n/r) en MRCR v2.
Productos e Integración
Dos opciones de acceso:
- API de Contexto Completo: Contexto de 12M tokens, streaming, uso de herramientas, endpoints compatibles con OpenAI. Procesa repositorios enteros en una sola llamada a costo lineal.
- SubQ Code (capa de contexto largo para agentes de codificación): Conéctalo a Claude Code, Codex o Cursor. ~25% menos de factura, exploración 10× más rápida, redirige automáticamente turnos de modelos costosos. Instalación de una línea.
Para Quién Es
Desarrolladores y equipos que ejecutan agentes de IA que necesitan razonar sobre bases de código completas, historiales largos de PR o estado persistente sin pérdida de calidad.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Memtrace: Memoria persistente y consciente del tiempo para agentes de código Claude
Memtrace proporciona instantáneas siempre actualizadas y reproducción bi-temporal para agentes de Claude Code, utilizando análisis sintáctico Tree-sitter y recuperación híbrida (BM25 + embeddings Jina-code) sin costo de inferencia de LLM durante la indexación.

Centro de Comandos: Entorno de Codificación con IA para Quienes Se Preocupan por la Calidad
Command Center es un entorno de codificación agéntico enfocado en las partes difíciles del código generado por IA: revisar, refactorizar y desplegar con disciplina de ingeniería tradicional. Incluye walkthroughs, agentes de refactorización y recuperación de instantáneas.

Tokenmeter: Aplicación gratuita de Windows para rastrear el uso de tokens de Claude Code sin conexión
Tokenmeter es una aplicación gratuita de código abierto para Windows que lee archivos locales .jsonl de Claude Code para mostrar el uso de tokens, costos estimados, ahorros en caché y un mapa de calor de actividad de 90 días, todo sin conexión.

Agente-fábrica: Un Complemento de Código Claude para Equipos de Subagentes de IA Persistentes
Agent-factory es un complemento de Claude Code que crea equipos de subagentes persistentes con personalidades distintas y memoria basada en archivos. Genera de 2 a 5 agentes por proyecto mediante un proceso de entrevista conversacional, donde cada agente tiene roles específicos como revisión de código, seguimiento de deuda técnica o estrategia.