Subquadratic presenta una ventana de contexto de 12 millones de tokens para modelos de IA

✍️ OpenClawRadar📅 Publicado: 10 de mayo de 2026🔗 Source
Subquadratic presenta una ventana de contexto de 12 millones de tokens para modelos de IA
Ad

Subquadratic ha anunciado una ventana de contexto de 12 millones de tokens, afirmando un avance en mecanismos de atención subcuadráticos. Esto se compara con ventanas típicas de 128K-1M tokens en modelos actuales. La técnica permite que los modelos manejen contextos mucho más grandes sin escalamiento cuadrático de cómputo o memoria.

Detalles clave

  • Ventana de contexto: 12 millones de tokens (12 veces más grande que los 128K tokens de GPT-4)
  • Basada en atención subcuadrática, probablemente usando complejidad lineal o casi lineal en la longitud de la secuencia
  • Permite procesar bases de código completas, documentos largos o transcripciones de video de varias horas en una sola pasada hacia adelante
  • Aplicaciones potenciales: revisión de repositorios completos, análisis de documentos largos, diálogo multi-turno con historial completo
  • Compatible con LLMs existentes basados en transformadores mediante reemplazo de atención plug-and-play

El enfoque reduce la atención O(n²) a casi O(n) usando técnicas como modelos de espacio de estados o factorizaciones de bajo rango. No se proporcionan números de referencia específicos en la fuente, pero se afirma que esto hace que las ventanas de 12M tokens sean prácticas en una sola GPU.

Ad

Para quién es

Ingenieros de IA que trabajan en análisis de código, procesamiento de documentos o cualquier tarea que requiera comprensión de contextos largos sin fragmentación costosa o recuperación.

📖 Leer la fuente completa: HN AI Agents

Ad

👀 Ver también

🦀
Noticias

Claude Code v2.1.259: Servidores MCP gestionados, modo de permisos sin interfaz y correcciones de concurrencia

Claude Code v2.1.259 añade despliegue de servidores MCP gestionados para organizaciones, una bandera `--permission-prompts none` para hosts desatendidos, y corrige la corrupción silenciosa del estado en sesiones concurrentes.

OpenClawRadar
Código Filtrado de Claude Revela el Sistema KAIROS y la Brecha de Verificación en Agentes de IA
Noticias

Código Filtrado de Claude Revela el Sistema KAIROS y la Brecha de Verificación en Agentes de IA

Un mapa de código fuente filtrado de Claude Code reveló 512 mil líneas de TypeScript, 44 banderas de características y KAIROS, un agente en segundo plano que consolida la memoria durante el tiempo de inactividad. Un desarrollador independiente creó un demonio similar para encadenar sesiones en campañas de varios días, pero descubrió que una compilación exitosa no garantiza un código funcional.

OpenClawRadar
VS Code habilitará por defecto el tráiler de Copilot coautorado
Noticias

VS Code habilitará por defecto el tráiler de Copilot coautorado

El PR #310226 de VS Code de Microsoft cambia el valor predeterminado de la configuración git.addAICoAuthor de 'off' a 'all', añadiendo automáticamente un trailer de Co-authored-by para contribuciones generadas por IA. El PR también revela una discrepancia en el fallback en tiempo de ejecución en repository.ts.

OpenClawRadar
Ajuste fino de Qwen2.5-7B al 96% de Claude Haiku con $3 y cero etiquetadores humanos
Noticias

Ajuste fino de Qwen2.5-7B al 96% de Claude Haiku con $3 y cero etiquetadores humanos

Un desarrollador ajustó Qwen2.5-7B al 96% del rendimiento de Claude Haiku en una tarea de razonamiento de decisiones específica del dominio usando solo $3 en llamadas API y cero etiquetadores humanos, mediante un novedoso método DV-DPO.

OpenClawRadar