Claude Opus 4.8 veröffentlicht: Schnellerer, günstigerer Schnellmodus, dynamische Workflows und Verbesserungen bei der Ehrlichkeit

Anthropic hat heute Claude Opus 4.8 veröffentlicht und aktualisiert damit Opus 4.7 mit Verbesserungen bei Benchmarks in den Bereichen Coding, agentische Fähigkeiten, Reasoning und Wissensarbeit. Die neue Version ist zum gleichen Preis wie das Vorgängermodell erhältlich.
Hauptfunktionen
- Effort Control auf claude.ai – Nutzer können nun festlegen, wie viel Aufwand Claude in eine Aufgabe steckt.
- Dynamische Workflows in Claude Code – ermöglicht dem Modell die Bewältigung sehr großer Probleme.
- Fast Mode läuft mit 2,5-facher Geschwindigkeit und ist jetzt dreimal günstiger als der Fast Mode vorheriger Modelle.
Benchmark-Highlights
Laut Ankündigung ist Claude Opus 4.8 das einzige Modell, das jeden Fall auf dem Super-Agent-Benchmark von Anthropic durchgängig abschließt und damit vorherige Opus-Modelle sowie GPT-5.5 zu gleichen Kosten übertrifft. Im Online-Mind2Web (Computer-Use- und Browser-Agent-Aufgaben) erzielte es 84 % – ein deutlicher Sprung gegenüber Opus 4.7 und GPT-5.5. Bei CursorBench übertrifft es vorherige Opus-Modelle auf allen Aufwandsstufen.
Beim Legal Agent Benchmark ist Opus 4.8 das erste Modell, das insgesamt über 10 % im All-Pass-Standard erreicht. Frühe Tester berichteten zudem von Verbesserungen bei der Tool-Calling-Effizienz (weniger Schritte bei gleicher Intelligenz), der Zitiergenauigkeit und der Token-Effizienz bei Retrieval-Workflows.
Ehrlichkeitstraining
Opus 4.8 führt explizite Ehrlichkeitsverbesserungen ein – das Modell wird darauf trainiert, unbegründete Behauptungen zu vermeiden und Probleme mit Inputs/Outputs proaktiv zu melden. Dies führte in den Bewertungen der Tester zu einer höheren Analysequalität und einem besseren Signal-Rausch-Verhältnis.
Preise
Opus 4.8 ist zum gleichen Preis wie Opus 4.7 erhältlich. Die Preise für den Fast Mode sind 3× günstiger als die vorherigen Fast-Mode-Preise. Die Kosten für multimodale Tokens sind für Genie (Databricks' KI-Agent) 61 % günstiger als bei Opus 4.7.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

Kritik an der Abstraktionsgrenze und Service-Integrationsansatz des MCP
Eine Reddit-Diskussion kritisiert MCP dafür, API-Zugang, effiziente Werkzeuge und Domänenwissen in einer Ebene zu bündeln, und argumentiert, dass dies im Vergleich zu den zugrundeliegenden APIs begrenzte Schnittstellen schafft. Der Beitrag verwendet Lattice als Beispiel, wo deren öffentliche API nur HR-Administrations-Workflows abdeckt, obwohl sie eine vollständige GraphQL-API haben.

Polaroids Anti-KI-Kampagne gegen digitale Müdigkeit mit analogen Print-Anzeigen
Polaroids neue Flip-Kamera-Kampagne nutzt Print-Anzeigen mit Sätzen wie 'KI kann keinen Sand zwischen deine Zehen zaubern', um Analoges der digitalen/KI-Kultur gegenüberzustellen.

Coasty KI-Agent löst CAPTCHA-Herausforderungen bis Level 6 ohne Training
Coastys Computer Using Agent (CUA) erreichte 82 % auf dem OSWorld-Benchmark, löste CAPTCHAs bis Level 6, Browser-Popups und Cookie-Banner ohne spezifisches Training für 'Ich bin kein Roboter'-Herausforderungen.

RTX 5080 16 GB: Qwen3.6 35B MoE bei 128k Kontext — 56 Tok/s und warum MTP nicht hilft
Neue Benchmarks zeigen, dass Qwen3.6 35B MoE auf einer RTX 5080 16GB bei 128k Kontext 56 tok/s generiert. MTP (Multi-Token Prediction) ist 23% langsamer, da VRAM-Druck Expertenschichten auf die CPU verlagert.