Claude Opus 4.8 veröffentlicht: Schnellerer, günstigerer Schnellmodus, dynamische Workflows und Verbesserungen bei der Ehrlichkeit

Anthropic hat heute Claude Opus 4.8 veröffentlicht und aktualisiert damit Opus 4.7 mit Verbesserungen bei Benchmarks in den Bereichen Coding, agentische Fähigkeiten, Reasoning und Wissensarbeit. Die neue Version ist zum gleichen Preis wie das Vorgängermodell erhältlich.
Hauptfunktionen
- Effort Control auf claude.ai – Nutzer können nun festlegen, wie viel Aufwand Claude in eine Aufgabe steckt.
- Dynamische Workflows in Claude Code – ermöglicht dem Modell die Bewältigung sehr großer Probleme.
- Fast Mode läuft mit 2,5-facher Geschwindigkeit und ist jetzt dreimal günstiger als der Fast Mode vorheriger Modelle.
Benchmark-Highlights
Laut Ankündigung ist Claude Opus 4.8 das einzige Modell, das jeden Fall auf dem Super-Agent-Benchmark von Anthropic durchgängig abschließt und damit vorherige Opus-Modelle sowie GPT-5.5 zu gleichen Kosten übertrifft. Im Online-Mind2Web (Computer-Use- und Browser-Agent-Aufgaben) erzielte es 84 % – ein deutlicher Sprung gegenüber Opus 4.7 und GPT-5.5. Bei CursorBench übertrifft es vorherige Opus-Modelle auf allen Aufwandsstufen.
Beim Legal Agent Benchmark ist Opus 4.8 das erste Modell, das insgesamt über 10 % im All-Pass-Standard erreicht. Frühe Tester berichteten zudem von Verbesserungen bei der Tool-Calling-Effizienz (weniger Schritte bei gleicher Intelligenz), der Zitiergenauigkeit und der Token-Effizienz bei Retrieval-Workflows.
Ehrlichkeitstraining
Opus 4.8 führt explizite Ehrlichkeitsverbesserungen ein – das Modell wird darauf trainiert, unbegründete Behauptungen zu vermeiden und Probleme mit Inputs/Outputs proaktiv zu melden. Dies führte in den Bewertungen der Tester zu einer höheren Analysequalität und einem besseren Signal-Rausch-Verhältnis.
Preise
Opus 4.8 ist zum gleichen Preis wie Opus 4.7 erhältlich. Die Preise für den Fast Mode sind 3× günstiger als die vorherigen Fast-Mode-Preise. Die Kosten für multimodale Tokens sind für Genie (Databricks' KI-Agent) 61 % günstiger als bei Opus 4.7.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

Analyse: Die tatsächlichen Rechenkosten von Anthropic für Claude Code-Nutzer liegen weit unter dem genannten Betrag von 5.000 US-Dollar.
Ein kürzlicher Artikel analysiert die Behauptung, dass Anthropics 200-Dollar-pro-Monat-Plan 'Claude Code Max' 5.000 Dollar an Rechenleistung verbraucht, und stellt fest, dass die tatsächlichen Inferenzkosten bei einem Vergleich mit wettbewerbsfähigen Open-Weight-Modellen auf OpenRouter etwa 10 % der API-Preise ausmachen.

Qwen3.5-27B 8-Bit vs. 16-Bit Leistungsvergleich
Ein Reddit-Nutzer testete Qwen3.5-27B mit vLLM und verglich bf16-Gewichte mit 16-Bit-KV-Cache gegen Qwens fp8-Quantisierung mit 8-Bit-KV-Cache. Dabei wurden praktisch identische Ergebnisse im Aider-Benchmark auf einer RTX 6000 Pro festgestellt.

China blockiert Metas Übernahme des KI-Startups Manus
Die chinesische Regierung hat die geplante Übernahme des KI-Startups Manus durch Meta blockiert und beruft sich dabei auf nationale Sicherheitsbedenken. Der Deal war Berichten zufolge mit über einer Milliarde US-Dollar bewertet.

WSJ: CEOs stehen vor einer klaren KI-Entscheidung – Entlassungen oder mehr Arbeit
Das WSJ berichtet, dass CEOs zwischen der Entlassung von Mitarbeitern oder der Zuweisung von mehr Arbeit an sie wählen, da KI-Tools Produktivitätssteigerungen versprechen – 11 Punkte in der HN-Diskussion.