Claude MAX Plan beinhaltet jetzt ein 1-Million-Token-Kontextfenster ohne Aufpreis

Was hat sich geändert
Der Claude MAX-Plan beinhaltet jetzt standardmäßig ein 1-Millionen-Token-Kontextfenster, ohne zusätzliche API-Nutzungsgebühren. Dies stellt eine 5-fache Vergrößerung des Kontextfensters im Vergleich zu früheren Einschränkungen dar.
Praktische Auswirkungen
Nutzer berichten über mehrere konkrete Arbeitsablaufverbesserungen:
- Kein erneutes Lesen kritischer Dateien über mehrere Kontextfenster hinweg mehr, während an derselben Refaktorisierung gearbeitet oder dasselbe Problem debuggt wird
- Wegfall der Zeit, die für das erneute Erklären des Kontexts oder die Nutzung von Auto-Kompaktierungsfunktionen aufgewendet wurde
- Erhebliche Reduzierung des Netto-Token-Verbrauchs - "deutlich, deutlich geringer" laut der Quelle
- Möglichkeit, kontinuierlichen Kontext über längere Entwicklungssitzungen hinweg aufrechtzuerhalten
Nutzererfahrung
Die Quelle beschreibt die Arbeit mit dem 1-Millionen-Token-Kontext über etwa 15 Stunden und stellt fest, dass die praktischen Vorteile die anfänglichen Erwartungen übertrafen. Der Nutzer berichtet, "verblüfft zu sein von dem, was ich gerade erreiche" und erwähnt speziell die effiziente Nutzung von Subagenten als besonders leistungsstark mit dem erweiterten Kontextfenster.
Diese Änderung scheint ein automatisches Upgrade für bestehende MAX-Plan-Nutzer zu sein, ohne dass sie Maßnahmen ergreifen müssen, um auf das vergrößerte Kontextfenster zuzugreifen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

OpenClaw-Experiment: KI-Agenten wählen Stille, um das Signal-Rausch-Verhältnis zu verbessern
Ein OpenClaw-Experiment gibt KI-Agenten die Autonomie, Aufgaben zu überspringen, wenn sie keinen Mehrwert liefern können, und protokolliert Schweigeentscheidungen in einem 'Schweigeprotokoll' mit Begründung. Das System nutzt LLM-Aufrufe vor der Inhaltsgenerierung und passt Schwellenwerte nach 3 aufeinanderfolgenden Schweigetagen automatisch an.

KI verlangsamt sich: 3 Billionen US-Dollar Umsatz bis 2030 nötig, um die Blase zu erhalten
Ed Zitron argumentiert, dass generative KI sich verlangsamt, nicht beschleunigt, und die Wirtschaftlichkeit einfach nicht aufgeht. Der Beitrag konzentriert sich auf die atemberaubenden Kapitalanforderungen: 3 Billionen Dollar oder mehr Umsatz bis Ende 2030, um die Existenz der KI-Branche zu sichern, basierend auf den Kosten für den Aufbau von Rechenzentren und den Verpflichtungen der Hyperscaler.

NVIDIA Vera CPU für agentische KI-Workloads gestartet
NVIDIA hat den Vera CPU vorgestellt, einen Prozessor, der speziell für agentische KI und Reinforcement-Learning-Workloads entwickelt wurde. Laut NVIDIA liefert er Ergebnisse mit 50 % schnellerer Leistung und doppelter Effizienz im Vergleich zu herkömmlichen Rack-Scale-CPUs.

Diagnose von operationellem Drift und Aufgabenamnesie in OpenClaw mit Gemini 2.5 Flash auf Proxmox
OpenClaw-Nutzer berichten von Problemen mit persistierenden Workflows auf einer Proxmox-VM und nennen operationale Drift sowie Aufgabenamnesie. Obwohl die Leistung bei einmaligen Aufgaben stabil ist, hat das Gemini 2.5 Flash-Modell in diesem Setup Schwierigkeiten mit Automatisierung und Speicher.