Subquadratic lance une fenêtre de contexte de 12 millions de tokens pour les modèles d'IA

✍️ OpenClawRadar📅 Publié: May 10, 2026🔗 Source
Subquadratic lance une fenêtre de contexte de 12 millions de tokens pour les modèles d'IA
Ad

Subquadratic a annoncé une fenêtre de contexte de 12 millions de tokens, revendiquant une percée dans les mécanismes d'attention subquadratiques. Cela se compare aux fenêtres typiques de 128K à 1M de tokens dans les modèles actuels. La technique permet aux modèles de traiter des contextes beaucoup plus volumineux sans mise à l'échelle quadratique du calcul ou de la mémoire.

Détails clés

  • Fenêtre de contexte : 12 millions de tokens (12 fois plus grande que les 128K tokens de GPT-4)
  • Basé sur une attention subquadratique, utilisant probablement une complexité linéaire ou quasi-linéaire en fonction de la longueur de la séquence
  • Permet de traiter des codebases entières, de longs documents ou des transcriptions vidéo de plusieurs heures en un seul passage avant
  • Applications potentielles : revue de code de dépôts entiers, analyse de documents longs, dialogues multi-tours avec historique complet
  • Compatible avec les LLM existants basés sur les transformeurs via un remplacement d'attention plug-and-play

L'approche réduit l'attention O(n²) à quasi-O(n) grâce à des techniques comme les modèles d'espace d'état ou les factorisations de bas rang. Aucun chiffre de référence spécifique n'est fourni dans la source, mais l'affirmation est que cela rend les fenêtres de 12M de tokens pratiques sur un seul GPU.

Ad

À qui cela s'adresse

Ingénieurs IA travaillant sur l'analyse de code, le traitement de documents ou toute tâche nécessitant une compréhension en long contexte sans découpage coûteux ou recherche d'information.

📖 Read the full source: HN AI Agents

Ad

👀 See Also

Uber a épuisé son budget annuel de Claude Code en 4 mois — Voici ce que cela signifie
News

Uber a épuisé son budget annuel de Claude Code en 4 mois — Voici ce que cela signifie

Uber aurait épuisé son budget annuel pour Claude Code au quatrième mois. L'article explique pourquoi les schémas d'utilisation ont fait voler en éclats le modèle d'abonnement et ce que les développeurs peuvent apprendre sur la fixation de limites avec les agents de codage IA.

OpenClawRadar
Croissance de l'écosystème OpenClaw et cartographie des acteurs clés
News

Croissance de l'écosystème OpenClaw et cartographie des acteurs clés

Un membre de la communauté a cartographié l'expansion rapide de l'écosystème OpenClaw, notant plus de 230 000 étoiles sur GitHub, plus de 116 000 membres sur Discord, et l'émergence de sociétés dans l'hébergement géré, le routage LLM et les couches de sécurité dans les 60 jours suivant le lancement.

OpenClawRadar
L'UE oblige Google à partager les données de recherche et à ouvrir Android aux IA tierces
News

L'UE oblige Google à partager les données de recherche et à ouvrir Android aux IA tierces

Les nouvelles mesures de spécification du DMA exigent que Google partage ses données de recherche avec ses concurrents et ouvre Android aux assistants IA tiers avec une intégration système complète d'ici mi-2027.

OpenClawRadar
Annotations Amazon S3 : 1 Go de métadonnées par objet pour les workflows d'agents IA
News

Annotations Amazon S3 : 1 Go de métadonnées par objet pour les workflows d'agents IA

AWS annonce les annotations S3 — jusqu'à 1 000 annotations par objet, chacune jusqu'à 1 Mo, totalisant 1 Go. Modifiables, interrogeables via Athena, sans frais de récupération pour Glacier.

OpenClawRadar