SubQ : Un LLM sous-quadratique avec une fenêtre de contexte de 12 millions de tokens

✍️ OpenClawRadar📅 Publié: May 6, 2026🔗 Source
SubQ : Un LLM sous-quadratique avec une fenêtre de contexte de 12 millions de tokens
Ad

SubQ de Subquadratic est un LLM prêt pour la production, construit sur une architecture d'attention creuse entièrement sous-quadratique. Il gère jusqu'à 12 millions de tokens dans une seule invite, fonctionne à 150 tokens par seconde et coûte environ 1/5 des modèles leaders comme GPT-5 ou Opus.

Architecture et benchmarks

Contrairement aux transformeurs standards avec une attention en O(n²), SubQ utilise un mécanisme d'attention creuse sous-quadratique qui ne traite que les relations de tokens pertinentes. À 12 millions de tokens, cela réduit le calcul de l'attention de près de 1000×. Benchmarks (validés par des tiers) :

  • SWE-Bench Verified (codage réel) : 81,8%
  • RULER @ 128K (précision en contexte long) : 95,0%
  • MRCR v2 (8-aiguilles, 1M) : 65,9%

À titre de comparaison, le score SWE-Bench de SubQ se situe entre Gemini 3.1 Pro (80,6%) et Opus 4.6 (80,8%). Le modèle surpasse également Opus 4.7 (87,6% ? – non rapporté à l'époque) et GPT-5.5 (n/r) sur MRCR v2.

Ad

Produits et intégration

Deux options d'accès :

  • API Full-Context : Contexte de 12M tokens, streaming, utilisation d'outils, endpoints compatibles OpenAI. Traitez des dépôts entiers en un seul appel à un coût linéaire.
  • SubQ Code (couche de contexte long pour agents de codage) : Branchez-le sur Claude Code, Codex ou Cursor. Facture réduite d'environ 25%, exploration 10× plus rapide, redirige automatiquement les tours de modèles coûteux. Installation en une ligne.

À qui s'adresse-t-il

Développeurs et équipes qui exécutent des agents IA devant raisonner sur l'ensemble des bases de code, de longs historiques de PR ou un état persistant sans perte de qualité.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Matrice LLM : Comparaisons de modèles votées par la communauté, construites avec Claude Code
Tools

Matrice LLM : Comparaisons de modèles votées par la communauté, construites avec Claude Code

Un data scientist a créé llm-matrix.vercel.app pour comparer les scores des LLM sur plusieurs dimensions simultanément, les votes de la communauté façonnant les classements. Le site a été entièrement développé avec Claude Code en utilisant deux plugins spécifiques.

OpenClawRadar
Agent MCP Studio: Construisez des systèmes multi-agents MCP entièrement dans un navigateur via WASM
Tools

Agent MCP Studio: Construisez des systèmes multi-agents MCP entièrement dans un navigateur via WASM

Agent MCP Studio vous permet de concevoir, orchestrer et exporter des systèmes d'agents MCP à partir d'un seul fichier HTML statique utilisant WebAssembly – sans backend, sans Docker, sans serveur.

OpenClawRadar
Outils CLI avec Compatibilité Agent IA : Approche par Répertoire de Compétences
Tools

Outils CLI avec Compatibilité Agent IA : Approche par Répertoire de Compétences

Un utilisateur de Reddit partage une méthode pour faire fonctionner les outils CLI avec des agents de codage IA comme Claude Code en créant des fichiers SKILL.md qui enseignent aux agents l'installation, l'authentification et l'utilisation. L'approche aborde les problèmes courants comme les invites interactives, la sortie JSON et les méthodes d'authentification.

OpenClawRadar
Claude Desktop + Blender via MCP : boucle de rétroaction en temps réel pour les workflows 3D
Tools

Claude Desktop + Blender via MCP : boucle de rétroaction en temps réel pour les workflows 3D

Un add-on Blender open-source exécute un serveur MCP dans Blender, permettant à Claude Desktop d'inspecter des scènes, créer des objets, rendre des images et lire les résultats—fermant la boucle de feedback du copier-coller de scripts.

OpenClawRadar