Claude Opus 4.6 und Sonnet 4.6 bieten jetzt einen 1-Millionen-Token-Kontext zum Standardpreis an.

✍️ OpenClawRadar📅 Veröffentlicht: 14. März 2026🔗 Source
Claude Opus 4.6 und Sonnet 4.6 bieten jetzt einen 1-Millionen-Token-Kontext zum Standardpreis an.
Ad

Was jetzt verfügbar ist

Claude Opus 4.6 und Sonnet 4.6 bieten jetzt das vollständige 1-Millionen-Kontextfenster zum Standardpreis auf der Claude-Plattform. Der Standardpreis gilt für das gesamte Fenster – 5$/25$ pro Million Tokens für Opus 4.6 und 3$/15$ für Sonnet 4.6. Es gibt keinen Multiplikator: Eine 900K-Token-Anfrage wird mit dem gleichen Preis pro Token abgerechnet wie eine 9K-Anfrage.

Wichtige Änderungen mit der allgemeinen Verfügbarkeit

  • Ein Preis für das gesamte Kontextfenster ohne Aufpreis für lange Kontexte
  • Volle Ratenlimits bei jeder Kontextlänge – Ihre Standardkontokapazität gilt für das gesamte Fenster
  • 6-mal mehr Medien pro Anfrage: bis zu 600 Bilder oder PDF-Seiten, statt bisher 100
  • Ab sofort nativ auf der Claude-Plattform, Microsoft Azure Foundry und Google Clouds Vertex AI verfügbar
  • Kein Beta-Header erforderlich – Anfragen über 200K Tokens funktionieren automatisch
  • Wenn Sie bereits den Beta-Header senden, wird er ignoriert, sodass keine Codeänderungen nötig sind

Integration mit Claude Code

Das 1-Millionen-Kontextfenster ist jetzt in Claude Code für Max-, Team- und Enterprise-Nutzer mit Opus 4.6 enthalten. Opus 4.6-Sitzungen können das gesamte 1-Millionen-Kontextfenster automatisch nutzen, was weniger Komprimierungen und mehr erhaltene Konversation bedeutet.

Ad

Leistungsbenchmarks

Opus 4.6 erreicht 78,3 % auf MRCR v2, die höchste Punktzahl unter den Spitzenmodellen bei dieser Kontextlänge. Claude Opus 4.6 und Sonnet 4.6 behalten ihre Genauigkeit über das gesamte 1-Millionen-Fenster bei. Die Langkontext-Retrieval-Fähigkeit hat sich mit jeder Modellgeneration verbessert.

Praktische Auswirkungen für Entwickler

Das bedeutet, Sie können eine gesamte Codebasis, tausende Seiten von Verträgen oder den vollständigen Verlauf eines langlaufenden Agenten – Tool-Aufrufe, Beobachtungen, Zwischenüberlegungen – laden und direkt nutzen. Die technische Arbeit, verlustbehaftete Zusammenfassung und Kontextbereinigung, die Langkontext-Arbeiten bisher erforderten, sind nicht mehr nötig.

Laut Nutzerfeedback:

  • Softwareentwickler berichten, dass sie suchen, erneut suchen, Randfälle aggregieren und Korrekturen vorschlagen können, ohne den Kontext zu verlieren
  • Teams verzeichneten einen Rückgang von 15 % bei Komprimierungsereignissen, wobei Agenten Kontext über Stunden halten können, ohne anfängliche Inhalte zu vergessen
  • Agentensysteme können jetzt vollständige Diffs ohne Aufteilung verarbeiten, was zu höherwertigen Reviews durch einfachere, token-effizientere Harnesses führt
  • Wissenschaftliche Forschungssysteme können hunderte Papiere, Beweise und Codebasen in einem Durchgang synthetisieren

📖 Read the full source: HN AI Agents

Ad

👀 Siehe auch

Claude Code AFK Auto-Continue: Anatomie einer Fehlfunktion
Nachrichten

Claude Code AFK Auto-Continue: Anatomie einer Fehlfunktion

Im Juli 2026 lieferte Anthropic ein Easter Egg in Claude Code v2.1.198 aus: einen 60-Sekunden-AFK-Timer, der automatisch fortsetzt, wenn man das Eingabefenster verpasst. Kein Changelog-Eintrag. In v2.1.200 rückgängig gemacht.

OpenClawRadar
Längsschnittstudie findet KI-Produktivitätssteigerungen bei 10 %, nicht 10-fach
Nachrichten

Längsschnittstudie findet KI-Produktivitätssteigerungen bei 10 %, nicht 10-fach

Eine Längsschnittstudie, die 40 Unternehmen von November 2024 bis Februar 2026 verfolgte, ergab, dass die KI-Nutzung im Durchschnitt um 65 % zunahm, der Durchsatz von Pull Requests jedoch nur um 9,97 %. Die Daten deuten darauf hin, dass das Programmieren nie der primäre Engpass in der Softwareentwicklung war.

OpenClawRadar
Mit $3 und ohne menschliche Annotatoren feinabgestimmter Qwen2.5-7B erreicht 96% von Claude Haiku
Nachrichten

Mit $3 und ohne menschliche Annotatoren feinabgestimmter Qwen2.5-7B erreicht 96% von Claude Haiku

Ein Entwickler hat Qwen2.5-7B mit nur 3 $ API-Kosten und ohne menschliche Annotatoren auf 96 % der Leistung von Claude Haiku bei einer domänenspezifischen Entscheidungsaufgabe gebracht – mittels einer neuartigen DV-DPO-Methode.

OpenClawRadar
Anthropic verdoppelt Claude Code-Ratenlimits, entfernt Spitzen-Drosselung für kostenpflichtige Pläne
Nachrichten

Anthropic verdoppelt Claude Code-Ratenlimits, entfernt Spitzen-Drosselung für kostenpflichtige Pläne

Anthropic hat die 5-Stunden-Ratenlimits für Claude Code bei den Plänen Pro, Max, Team und Enterprise verdoppelt, die Drosselung während der Spitzenzeiten aufgehoben und die API-Ratenlimits für Opus-Modelle erhöht.

OpenClawRadar