Mit Claude Code eine Japan-Reiseblog mit KI-generierter Kunst und Videos erstellen

Ein Entwickler dokumentierte seinen Workflow mit Claude Code, um eine vollständige persönliche Essay-Website über Japan zu erstellen, die alles vom Schreiben bis zur visuellen Gestaltung und Bereitstellung umfasste.
Workflow-Details
Das Projekt umfasste mehrere KI-Tools, die durch Claude Code integriert wurden:
- Schreiben: Claude half dabei, die Essay-Struktur und den Ton zu verfeinern, fungierte als Redakteur, während der Autor seinen eigenen Schreibstil beibehielt
- Bildgenerierung: Persönliche Reisefotos wurden mit Nano Banana Pro (Googles Bildmodell) in Aquarellgemälde umgewandelt, wobei eines der bestehenden Gemälde des Autors als Stilreferenz diente
- Videoanimation: Das Hauptbild (ein Ölgemälde des Autors in Samurai-Rüstung, basierend auf einem Foto vom Schwerttraining) wurde mit Veo 3.1 animiert und zeigte schwebende Kirschblüten sowie ein schwingendes Katana
- Zusätzliche Videos: Drei weitere Videos im Artikel wurden aus Aquarellgemälden generiert, die einen Philosophenpfad, Waldgeister und heiße Quellen darstellten
- Technische Umsetzung: Die gesamte Website wurde über Claude Code mit einem Express-Server, Markdown-Rendering und Railway-Hosting erstellt und bereitgestellt
Erkenntnisse zur Tool-Auswahl
Der Entwickler stellte fest, dass das leistungsstärkste Modell nicht immer für jede Aufgabe optimal ist. Veo 3.1 funktionierte gut für die dynamische Samurai-Sequenz, aber "verwüstete die subtilen Waldszenen völlig, indem es alles übermäßig animierte". Für diese Szenen erzielte Veo 3.0-fast mit eingeschränkteren Prompts bessere Ergebnisse.
Claude Code-Integration
Claude Code übernahm die technische Orchestrierung, einschließlich:
- Aufruf der Gemini-API für Bilder
- Aufruf der Veo-API für die Videogenerierung
- Entfernen von Audio mit ffmpeg
- Bereitstellung auf Railway
Das fertige Projekt ist verfügbar unter joostboer.com/a-love-letter-to-japan.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Entwickler erwägt Wechsel von DeepSeek zu Grok für Finanz-KI-Agenten
Ein Entwickler, der eine Finanz-KI-Web-App in FastAPI/Python erstellt, berichtet, dass DeepSeek V3.2 Reasoning eine TTFT von 70 Sekunden und eine Ausgabegeschwindigkeit von ~25 Token/Sekunde hat, was das Streaming-Erlebnis schlecht macht. Er erwägt den Wechsel zu Grok 4.1 Fast Reasoning mit ~15 Sekunden TTFT und ~75 Token/Sekunde.

Lokaler Multi-Agenten-Forschungsassistent spart 15–25 Minuten pro Aufgabe
Ein IT-Administrator hat eine lokale Multi-Agenten-Forschungspipeline mit Ollama-Modellen erstellt, die strukturierte Berichte in etwa 2 Minuten statt in 20-30 Minuten manueller Recherche generiert. Das System läuft auf einer RTX 5090 mit 64 GB RAM und ist in OpenClaw zur Agentenverwaltung integriert.

Hermes vs. OpenClaw: Der Unterschied ist die Persönlichkeit, nicht die Geschwindigkeit
Ein Entwickler vergleicht Hermes und OpenClaw nebeneinander und stellt fest, dass der Hauptunterschied darin liegt, wie jedes Framework mit Identität umgeht: Hermes speichert Erinnerungen, OpenClaw speichert Persönlichkeitsaspekte über soul.md.

Wie ich die Kosten für OpenClaw durch Modell-Routing um 60 % gesenkt habe
Ein OpenClaw-Nutzer senkte die API-Kosten von 420 auf 168 US-Dollar in 20 Tagen, indem er Nutzungsmuster analysierte und Aufgaben an geeignete Modelle weiterleitete, anstatt für alles Claude Opus zu verwenden. Die Aufschlüsselung zeigte, dass 70 % der Aufgaben einfach waren und günstigere Modelle nutzen konnten.