Multi-Agent-Videoproduktions-Pipeline mit Claude: Skriptvertragsarchitektur und Recherche-Fanout

✍️ OpenClawRadar📅 Veröffentlicht: 6. Mai 2026🔗 Source
Multi-Agent-Videoproduktions-Pipeline mit Claude: Skriptvertragsarchitektur und Recherche-Fanout
Ad

Ein Entwickler hat eine Multi-Agenten-KI-Pipeline gebaut, die ein Thema (z.B. „Ada Lovelace“) und eine Persona (Kanalidentität, Ton, visueller Stil) aufnimmt und ein vollständiges, kapitelstrukturiertes Bildungs-YouTube-Video (15–20 Min.) produziert. Die Pipeline verwendet Claude als Kern-LLM für das Scripting und orchestriert spezialisierte Agenten für Drehbuchschreiben, Asset-Generierung, Rendering (CUDA auf Windows-Host) und YouTube-Upload.

Drehbuchschreiben mittels Vertragsarchitektur

Um ein 20-minütiges KI-geschriebenes Skript narrativ kohärent über Kapitel hinweg zu halten, die in separaten LLM-Aufrufen geschrieben wurden, verwendet das System einen narrativen Vertrag – ein validiertes JSON-Blueprint, das erstellt wird, bevor Skripttext geschrieben wird. Der Vertrag kodiert vier Einschränkungstypen:

  • Threads – Handlungsstränge, die in einem Kapitel beginnen und in einem anderen enden müssen, mit einem deklarierten Auszahlungstyp (gelöst, Tragödie usw.)
  • Entitäten – benannte Personen/Orte mit einem erzwungenen Ersteinführungskapitel, das rückwirkende Erwähnungen verhindert
  • Erforderliche Fakten – Zitate mit Abhängigkeitskette (Fakt B kann erst auftauchen, wenn Fakt A etabliert ist)
  • Zeitliche Anker – zeitliche Referenzpunkte, die eine nichtlineare Struktur (Rückblende, In-medias-res) erlauben, während sie intern konsistent bleiben

Der Vertrag wird durch einen Opus → strukturelle Validierung → Sonnet-Überprüfungszyklus (bis zu 3 Runden) generiert. Sonnet prüft semantische Kohärenz (keine verwaisten Entitäten, Threads schließen tatsächlich); der Strukturvalidator führt einen Pydantic-Parse plus zeitliche Einschränkungsprüfung durch. Nachgelagerte Kapitelschreiber sind an den Vertrag gebunden.

Ad

Research mittels Fanout

Die Research-Pipeline startet N parallele OutlineAgent-Instanzen, die alle mit demselben Research-Paket arbeiten, aber an verschiedenen Thesenkandidaten. Jeder produziert eine dreistufige Hierarchie: These → Kapitelargumente → Szenenbeats. Ein Verankerungs-/Überarbeitungszyklus läuft unabhängig auf jedem Zweig:

  • Verankerungsprüfer (Sonnet) markiert blockierende vs. kosmetische Probleme
  • Revisionsagent wendet Korrekturen an, ohne umzustrukturieren
  • Qualitätsprüfer prüft auf strukturelle Fehler (thematische Kapitellisten, durchhängende Mitten, zusammenfassende Enden)

Bis zu 3 Überarbeitungsrunden pro Zweig, parallel. Dann bewertet ein einzelner Bewertungsagent jede verfeinerte Gliederung in vier Kategorien:

KategorieGewichtWas gemessen wird
Konzept-Hook0,40CTR-Potenzial; Titel-Falsifizierbarkeit
Trap-Auflösung0,30Vollständigkeit der narrativen Auszahlung

Pipeline-Architektur

Die Pipeline ist auf zwei Umgebungen aufgeteilt: Skript- und Asset-Arbeit läuft in einem Linux-Dev-Container (WSL), während das Rendering auf dem Windows-Host läuft, um Zugriff auf CUDA und Videotools zu haben. Agenten kommunizieren über HTTP mit einem leichtgewichtigen Orchestrator. Das System ist phasenbasiert – jeder Schritt (W2.1, W4.3, R3.1 usw.) ist unabhängig wiederholbar. Jede Phase liest und schreibt typisierte Artefaktdateien (JSON-Manifeste, Audiodateien, Bildverzeichnisse), sodass Agenten lose gekoppelt sind.

Integrierte Tools: Live2D, Fish Audio, Sadtalker und andere für Asset-Generierung und Rendering.

📖 Vollständige Quelle lesen: r/ClaudeAI

Ad

👀 Siehe auch

Entwickler erstellte in Wochen 3 iOS-Apps mit Claude AI von der Idee bis zum Debugging
Anwendungsfälle

Entwickler erstellte in Wochen 3 iOS-Apps mit Claude AI von der Idee bis zum Debugging

Ein Entwickler nutzte Claude, um drei iOS-Apps zu entwickeln – Smart Facts, Jar of Joy und Bloom Studio – und deckte damit Ideenfindung, Feature-Verfeinerung, Logikschreiben, Debugging und Iteration ab.

OpenClawRadar
OpenClaw Anwendungsfall: Erstellung eines täglichen persönlichen Nachrichtendigests mit KI
Anwendungsfälle

OpenClaw Anwendungsfall: Erstellung eines täglichen persönlichen Nachrichtendigests mit KI

Ein Entwickler teilt sein OpenClaw-Setup für einen täglichen Nachrichtenüberblick, der einen Cronjob mit einem detaillierten Prompt verwendet, der Nachrichtenquellen, Interessenschwerpunkte und das Ausgabeformat festlegt. Das System ruft RSS-Feeds von vertrauenswürdigen niederländischen Publikationen ab und liefert jeden Morgen 5 kuratierte Geschichten.

OpenClawRadar
Browser-basiertes Curling-Spiel, erstellt mit Claude Sonnet 4.5 von einem Nicht-Programmierer
Anwendungsfälle

Browser-basiertes Curling-Spiel, erstellt mit Claude Sonnet 4.5 von einem Nicht-Programmierer

Ein Entwickler ohne Programmiererfahrung hat mit Claude Sonnet 4.5 ein vollständig spielbares Curling-Browserspiel erstellt. Das Spiel umfasst Physik, Punktestand und einen kompletten Spielablauf, wobei Claude die gesamte Codegenerierung, Fehlerbehebung und Verfeinerung basierend auf einfachem englischem Feedback übernahm.

OpenClawRadar
Benutzer setzt KI-Assistenten 'Elvis' auf VPS für Projektmanagement-Aufgaben ein
Anwendungsfälle

Benutzer setzt KI-Assistenten 'Elvis' auf VPS für Projektmanagement-Aufgaben ein

Ein Entwickler verbrachte drei Tage damit, einen KI-Assistenten namens 'Elvis' auf einem Linux-VPS einzurichten und ihn in Microsoft Teams, JIRA, Asana und E-Mail-Systeme zu integrieren. Der Assistent bewältigte erfolgreich Projektmanagementaufgaben, darunter das Lesen von E-Mails, das Extrahieren von Anforderungen, das Aktualisieren von Änderungsanträgen und die Koordination mit Teammitgliedern.

OpenClawRadar