Subquadratic presenta una ventana de contexto de 12 millones de tokens para modelos de IA

Subquadratic ha anunciado una ventana de contexto de 12 millones de tokens, afirmando un avance en mecanismos de atención subcuadráticos. Esto se compara con ventanas típicas de 128K-1M tokens en modelos actuales. La técnica permite que los modelos manejen contextos mucho más grandes sin escalamiento cuadrático de cómputo o memoria.
Detalles clave
- Ventana de contexto: 12 millones de tokens (12 veces más grande que los 128K tokens de GPT-4)
- Basada en atención subcuadrática, probablemente usando complejidad lineal o casi lineal en la longitud de la secuencia
- Permite procesar bases de código completas, documentos largos o transcripciones de video de varias horas en una sola pasada hacia adelante
- Aplicaciones potenciales: revisión de repositorios completos, análisis de documentos largos, diálogo multi-turno con historial completo
- Compatible con LLMs existentes basados en transformadores mediante reemplazo de atención plug-and-play
El enfoque reduce la atención O(n²) a casi O(n) usando técnicas como modelos de espacio de estados o factorizaciones de bajo rango. No se proporcionan números de referencia específicos en la fuente, pero se afirma que esto hace que las ventanas de 12M tokens sean prácticas en una sola GPU.
Para quién es
Ingenieros de IA que trabajan en análisis de código, procesamiento de documentos o cualquier tarea que requiera comprensión de contextos largos sin fragmentación costosa o recuperación.
📖 Leer la fuente completa: HN AI Agents
👀 Ver también
Claude Code v2.1.259: Servidores MCP gestionados, modo de permisos sin interfaz y correcciones de concurrencia
Claude Code v2.1.259 añade despliegue de servidores MCP gestionados para organizaciones, una bandera `--permission-prompts none` para hosts desatendidos, y corrige la corrupción silenciosa del estado en sesiones concurrentes.

Código Filtrado de Claude Revela el Sistema KAIROS y la Brecha de Verificación en Agentes de IA
Un mapa de código fuente filtrado de Claude Code reveló 512 mil líneas de TypeScript, 44 banderas de características y KAIROS, un agente en segundo plano que consolida la memoria durante el tiempo de inactividad. Un desarrollador independiente creó un demonio similar para encadenar sesiones en campañas de varios días, pero descubrió que una compilación exitosa no garantiza un código funcional.

VS Code habilitará por defecto el tráiler de Copilot coautorado
El PR #310226 de VS Code de Microsoft cambia el valor predeterminado de la configuración git.addAICoAuthor de 'off' a 'all', añadiendo automáticamente un trailer de Co-authored-by para contribuciones generadas por IA. El PR también revela una discrepancia en el fallback en tiempo de ejecución en repository.ts.

Ajuste fino de Qwen2.5-7B al 96% de Claude Haiku con $3 y cero etiquetadores humanos
Un desarrollador ajustó Qwen2.5-7B al 96% del rendimiento de Claude Haiku en una tarea de razonamiento de decisiones específica del dominio usando solo $3 en llamadas API y cero etiquetadores humanos, mediante un novedoso método DV-DPO.