Subquadratic stellt 12 Millionen Token Kontextfenster für KI-Modelle vor

Subquadratic hat ein 12-Millionen-Token-Kontextfenster angekündigt und behauptet einen Durchbruch bei subquadratischen Aufmerksamkeitsmechanismen. Dies steht im Vergleich zu typischen 128K-1M-Token-Fenstern aktueller Modelle. Die Technik ermöglicht es Modellen, weitaus größere Kontexte ohne quadratische Skalierung von Rechenleistung oder Speicher zu verarbeiten.
Wichtige Details
- Kontextfenster: 12 Millionen Token (12x größer als GPT-4s 128K Token)
- Basiert auf subquadratischer Attention, wahrscheinlich mit linearer oder nahezu linearer Komplexität in der Sequenzlänge
- Ermöglicht die Verarbeitung gesamter großer Codebasen, langer Dokumente oder mehrstündiger Videotranskripte in einem einzigen Durchlauf
- Potenzielle Anwendungen: Code-Review ganzer Repos, Langdokument-Analyse, mehrschrittige Dialoge mit vollständigem Verlauf
- Kompatibel mit bestehenden transformerbasierten LLMs durch Drop-in-Attention-Austausch
Der Ansatz reduziert O(n²) Attention auf nahezu O(n) mithilfe von Techniken wie State-Space-Modellen oder Low-Rank-Faktorisierungen. In der Quelle werden keine spezifischen Benchmark-Zahlen genannt, aber die Behauptung lautet, dass dies 12M-Token-Fenster auf einer einzelnen GPU praktikabel macht.
Für wen es gedacht ist
KI-Ingenieure, die an Code-Analyse, Dokumentenverarbeitung oder Aufgaben arbeiten, die ein langes Kontextverständnis ohne teures Chunking oder Retrieval erfordern.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Drei inverse Gesetze der Robotik: Menschliche Leitlinien für die KI-Nutzung
Susam Pal schlägt drei inverse Gesetze der Robotik für Menschen vor: KI nicht vermenschlichen, ihre Ausgaben nicht blind vertrauen und vollständig verantwortlich bleiben. Praktische Warnungen vor übermäßigem Vertrauen in generative KI.

Anthropics Claude-Mythos: Angstmacherei oder reale Gefahr?
Anthropic behauptet, dass sein Claude Mythos-Modell bei der Suche nach Cybersicherheitsfehlern hervorragend sei, aber Kritiker argumentieren, dass die Warnungen des Unternehmens vor einer Katastrophe ein Marketing-Trick seien, um von aktuellen Schäden abzulenken und Regulierungsbehörden zu beeinflussen.

Anthropics neues Claude-Abonnement-Guthaben: Agent SDK und claude -p erhalten ab 15. Juni getrennte gedeckelte Pools
Ab dem 15. Juni erhalten Claude-Abonnenten ein separates monatliches Guthaben für die Nutzung des Agent SDK und von claude -p: 200 $/Monat für Max 20x, 100 $ für Max 5x, 20 $ für Pro. Die Nutzung stoppt, wenn das Guthaben aufgebraucht ist, es sei denn, es wird eine zusätzliche Abrechnung aktiviert. Die interaktive Nutzung von Claude Code und Chat bleibt im Abonnement-Pool.

Google spendet Agentenzahlungsprotokoll (AP2) an FIDO Alliance, veröffentlicht Version 0.2 mit „Human Not Present"-Zahlungen
Google spendet das Agent Payments Protocol (AP2) an die FIDO Alliance und veröffentlicht Version 0.2 mit Unterstützung für autonome ‚Human Not Present‘-Zahlungen und einen neuen Standard für verifizierte Absichten, der gemeinsam mit Mastercard entwickelt wurde.