Subquadratic lance une fenêtre de contexte de 12 millions de tokens pour les modèles d'IA

✍️ OpenClawRadar📅 Publié: May 10, 2026🔗 Source
Subquadratic lance une fenêtre de contexte de 12 millions de tokens pour les modèles d'IA
Ad

Subquadratic a annoncé une fenêtre de contexte de 12 millions de tokens, revendiquant une percée dans les mécanismes d'attention subquadratiques. Cela se compare aux fenêtres typiques de 128K à 1M de tokens dans les modèles actuels. La technique permet aux modèles de traiter des contextes beaucoup plus volumineux sans mise à l'échelle quadratique du calcul ou de la mémoire.

Détails clés

  • Fenêtre de contexte : 12 millions de tokens (12 fois plus grande que les 128K tokens de GPT-4)
  • Basé sur une attention subquadratique, utilisant probablement une complexité linéaire ou quasi-linéaire en fonction de la longueur de la séquence
  • Permet de traiter des codebases entières, de longs documents ou des transcriptions vidéo de plusieurs heures en un seul passage avant
  • Applications potentielles : revue de code de dépôts entiers, analyse de documents longs, dialogues multi-tours avec historique complet
  • Compatible avec les LLM existants basés sur les transformeurs via un remplacement d'attention plug-and-play

L'approche réduit l'attention O(n²) à quasi-O(n) grâce à des techniques comme les modèles d'espace d'état ou les factorisations de bas rang. Aucun chiffre de référence spécifique n'est fourni dans la source, mais l'affirmation est que cela rend les fenêtres de 12M de tokens pratiques sur un seul GPU.

Ad

À qui cela s'adresse

Ingénieurs IA travaillant sur l'analyse de code, le traitement de documents ou toute tâche nécessitant une compréhension en long contexte sans découpage coûteux ou recherche d'information.

📖 Read the full source: HN AI Agents

Ad

👀 See Also

PostmarketOS Mise à jour de février 2026 : Noyaux génériques et politique d'IA
News

PostmarketOS Mise à jour de février 2026 : Noyaux génériques et politique d'IA

PostmarketOS propose désormais des paquets de noyau génériques (linux-postmarketos-mainline, -stable, -lts) et a mis à jour sa politique d'IA pour interdire explicitement l'IA générative. Le projet a également connu des changements de contributeurs et des améliorations de l'intégration continue matérielle.

OpenClawRadar
Anthropic appelle à une pause mondiale dans le développement de l'IA, signale un risque d'auto-amélioration
News

Anthropic appelle à une pause mondiale dans le développement de l'IA, signale un risque d'auto-amélioration

Anthropic appelle à une pause mondiale dans le développement des modèles d'IA de pointe, invoquant les risques liés à l'auto-amélioration des systèmes avancés. L'article du WSJ détaille la portée et les raisons de cette proposition.

OpenClawRadar
🦀
News

La Nouvelle-Orléans teste l'IA Carbyne pour le triage des appels 911 — ce que cela signifie pour la technologie d'urgence

Nouvelle-Orléans teste le système de triage des appels d'urgence IA de Carbyne pour le 911. L'IA gère les appels répétés concernant un même incident et dirige les autres vers des humains, réduisant ainsi la charge des répartiteurs.

OpenClawRadar
Quand le code devient bon marché, la compréhension devient coûteuse
News

Quand le code devient bon marché, la compréhension devient coûteuse

Markus Poppastring établit des parallèles entre la vague d'externalisation des années 2000 et la génération de code par IA aujourd'hui : le coût passe de l'écriture du code à sa compréhension, et avec l'IA, l'intention peut ne plus exister nulle part.

OpenClawRadar