Claude Fable Demo: Unermüdlich proaktive Fehlerbehebung mit Browser-Automatisierung

Simon Willisons Beitrag Claude Fable is relentlessly proactive zeigt, wie Claude Fable 5 eigenständig einen horizontalen Scrollbalken-Fehler in Datasette Agent diagnostizierte. Nach der Aufforderung, Abhängigkeiten zu prüfen, führte Fable unerwartete Aktionen durch – es öffnete Browserfenster, injizierte JavaScript und schrieb sogar einen eigenen CORS-Webserver – alles ohne explizite Anweisungen.
Beobachtete Schlüsselverhaltensweisen
- Browserfenster-Erkennung: Fable verwendete
uv run --with pyobjc-framework-Quartz, um macOS-Fenster aufzulisten und nach Safari-Fenstern mit erwarteten Zeichenfolgen (z. B.textarea) zu filtern. Anschließend nutzte esscreencapture -x -o -l [window_id]für Screenshots. - Template-Injection: Um einen modalen Dialog auszulösen (der normalerweise eine Tastenkombination erfordert), bearbeitete Fable die Vorlagen von Datasette, um
<script>window.addEventListener('load', function() { setTimeout(function() { document.dispatchEvent(new KeyboardEvent('keydown', {key: '/', bubbles:true})); },1200); });</script>zu injizieren. Dies simulierte die Taste/1,2 Sekunden nach dem Seitenaufruf. - Eigener CORS-Webserver: Fable schrieb einen Python-HTTP-Server mit
http.server(Standardbibliothek), der auf127.0.0.1:9999lief. Er akzeptierte POST-Anfragen mit JSON, schrieb in/tmp/diag.jsonund setzteAccess-Control-Allow-Origin: *-Header – so konnte JavaScript auf der Testseite Diagnosedaten an den eigenen Server senden.
Funktionsweise
Fable identifizierte, dass der Scrollbalken-Fehler wahrscheinlich in einer Abhängigkeit (Datasette selbst) lag. Es bearbeitete eine lokale Vorlage, um den Dialog automatisch auszulösen, öffnete Safari mit einer frisch generierten Test-HTML-Seite, machte einen Screenshot über screencapture und führte JavaScript im Browser aus, das Messungen an seinen eigenen lokalen Webserver sendete. All dies geschah autonom – Willison gab nur den ersten Prompt und einen Screenshot.
Dies zeigt Fables unermüdliche Proaktivität: Es erfindet Workarounds, instrumentiert Browser und orchestriert mehrstufige Debugging-Pipelines, ohne dazu aufgefordert zu werden.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Hände an bei Tenvents Modell: Stark für agentische Workflows, schwach für komplexes Coding
Tencents Modell erhält 8/10 für agentische Aufgaben mit geringen Halluzinationsraten, versagt jedoch bei komplexem Code wie Notion-API-Schemas. Für Backend-Logik vermeiden.

OpenProphet: Open-Source Autonomer Handelsagent mit Web-Oberfläche
OpenProphet ist ein Open-Source, autonomer Handelsagent mit einer Web-Oberfläche, die mehrere Alpaca-Konten gleichzeitig unterstützt und auf OpenCode läuft. Es ermöglicht die Konfiguration von Agenten-Personas und Strategien, wobei jeder LLM verwendet werden kann, nicht nur Claude.

Überarbeitung: KI-Editor entwickelt mit agentenbasierten Codierungstools und Y.js CRDT
Revise ist ein KI-Editor für Dokumente, der über 10 Monate hinweg von Grund auf mit agentenbasierten Codierungswerkzeugen entwickelt wurde. Er verfügt über eine eigene Textverarbeitungs-Engine und eine Rendering-Schicht, die nur Y.js für den CRDT-Stack verwendet. Das System integriert mehrere KI-Modelle, darunter GPT-5.4-Varianten und Claude-Modelle, für Korrekturlesen und Überarbeitungen.

Benutzerdefinierte Statuszeile für Claude Code zeigt Kontextnutzung, Kosten und Git-Branch an
Ein Reddit-Nutzer hat ein Bash-Skript erstellt, das die statusLine-Einstellung von Claude Code nutzt, um Echtzeitinformationen anzuzeigen, einschließlich Kontextfenster-Nutzung, Sitzungskosten, aktuellem Modell und aktuellem Git-Branch. Das Skript erfordert jq und ist auf GitHub verfügbar.