Warum Codex für komplexe Python-Monolithen immer noch besser ist als Claude Code

Im letzten Jahr hat ein Entwickler, der an einem komplexen Python-Monolithen arbeitet, hauptsächlich Codex verwendet. Nach einem Monat Test von Claude Code mit Opus 4.6 und 4.7 bevorzugt er für diese Codebasis immer noch Codex. Die Anwendung ist kein einfacher CRUD-Server – sie hat eine neuere DDD-ähnliche Schicht, älteren gut strukturierten Code und fragilen Legacy-Spaghetticode. Das Team vermeidet es, alte Teile neu zu schreiben, es sei denn, es ist notwendig.
Wichtige Vorteile von Codex
- Harness-Engineering-Prinzipien: Codex folgt zuverlässig dem Harness-Engineering-Workflow ohne explizite Anweisungen. Claude tut dies nur, wenn
AGENTS.mdeine Anweisung wie „Lies exec_plan.md und befolge sie“ enthält. - Wiederverwendung vorhandener Tools und Muster: Claude erstellt häufiger neue Tools, anstatt die Codebasis nach vorhandenen zu durchsuchen. In einer Codebasis mit vielen projektspezifischen Helfern ist Wiederverwendung entscheidend.
- Bessere Planung und Kontextbewusstsein: Claude liest oft zu wenig, bevor er neue Funktionalitäten platziert. Der Entwickler musste wiederholt korrigieren:
„Setze diese Funktionalität stattdessen in Modul A, nicht im Controller.“
„Konstruiere das Antwortobjekt nicht mit den Status, die du in der Anfrage gesendet hast. Die API gibt bereits das aktualisierte Objekt zurück – verwende diese Antwort.“
„Validiere es im selben Modul, dem diese Grenze gehört.“
Codex bemerkt häufiger fehlenden Kontext und stellt klärende Fragen, bevor er Architekturänderungen vornimmt.
Wo Claude glänzt
Für Frontend-Arbeiten war Opus 4.6 viel besser als Codex 5.3 und GPT-5.4. Der Entwickler bevorzugt derzeit Claude für UI-Aufgaben. Er hat GPT-5.5 noch nicht bei UI-lastigen Arbeiten getestet.
Tool-Konfiguration
Beide LLMs nutzen eine einzige gemeinsame Fähigkeit: Befehle zum Starten und Stoppen von Docker Compose und zum Ausführen von Tests innerhalb des Containers.
Dies ist kein Benchmark, sondern nur eine Erfahrung aus dem täglichen Gebrauch mit einer Produktionscodebasis.
📖 Read the full source: HN AI Agents
👀 Siehe auch

Claude Code hat Treelo gebaut: Ein kostenloses Videotranskriptions-Tool
Ein Videoeditor nutzte Claude Code, um Treelo zu erstellen – ein kostenloses Tool, das Video-/Audiodateien transkribiert, Füllwörter entfernt, die Platzierung von Soundeffekten (SFX) zu exakten Zeitstempeln ermöglicht und SRT für Premiere oder ASS für DaVinci Resolve exportiert.

LLM-Kostenprofiler: Open-Source-Tool verfolgt API-Ausgaben, um den Einsatz lokaler Modelle zu rechtfertigen
LLM Cost Profiler ist ein Python-Tool, das jeden API-Aufruf an OpenAI/Anthropic verfolgt und genau zeigt, wofür Sie Geld ausgeben. Es deckt Aufgaben auf, die im Verhältnis zu ihrer Komplexität überteuert sind, und liefert konkrete Dollarbeträge, um den Umstieg auf lokale Modelle zu rechtfertigen.

Claude Code v2.1.126: Modellauswahl, Projektbereinigung, OAuth-Korrekturen und Sicherheitsverbesserungen
Claude Code v2.1.126 fügt einen /model-Picker für Anthropic-kompatible Gateways, einen neuen Befehl claude project purge hinzu, behebt den OAuth-Login in WSL2/SSH/Containern und behebt Sicherheitsprobleme mit verwalteten Einstellungen und der Offenlegung der Zwischenablage unter Windows.

Unterstudie: Ein lehrbarer Desktop-Agent, der Aufgaben durch Vorführung lernt
Understudy ist eine lokal-first Desktop-Agenten-Laufzeitumgebung, die GUI-Apps, Browser, Shell-Tools, Dateien und Messaging in einer Sitzung bedienen kann. Sie demonstrieren eine Aufgabe einmal, sie zeichnet Bildschirmvideo und semantische Ereignisse auf, extrahiert die Absicht statt Koordinaten und verwandelt sie in eine wiederverwendbare Fähigkeit.