Analyse von 7 Jahren Tagebucheinträgen mit einem LLM: RAG vs. Fehlschläge beim Feintuning

Ein Entwickler auf r/ClaudeAI berichtete von seinen Erfahrungen, als er einem LLM über 200 persönliche Tagebucheinträge (von 2019 bis 2026) für eine Längsschnittanalyse fütterte. Das Ziel: Verhaltensmuster erkennen und messen, wie sie sich über sieben Jahre verändert haben. Der technische Weg war voller Sackgassen.
Wichtigste technische Fehlschläge
- RAG (Retrieval-Augmented Generation) scheiterte – die Tagebucheinträge waren zu ähnlich, sodass die Abfrage semantisch überlappende Textabschnitte zurücklieferte. Das Modell konnte keine kohärenten Längsschnitterkenntnisse liefern.
- Fine-Tuning scheiterte – aufgrund des kleinen Datensatzes (200 Einträge) passte sich das Modell zu sehr an und konnte keine Muster über die Zeit verallgemeinern.
- Datenschutzbeschränkungen – die Nutzung von Cloud-APIs kam nicht in Frage; der Autor benötigte eine lokale Verarbeitung, um die sensiblen Tagebuchdaten zu schützen.
Die Problemlösung
Der endgültige Ansatz bestand darin, die Einträge nach Jahren zu gruppieren, jedes Jahr mit einem lokalen LLM (wahrscheinlich Llama oder Mistral via Ollama) zusammenzufassen und dann die sieben Jahreszusammenfassungen erneut in das Modell einzuspeisen, um eine jahresübergreifende Analyse durchzuführen. Diese hierarchische Zusammenfassung umging die Einschränkungen von RAG und vermied die Notwendigkeit eines großangelegten Fine-Tunings.
Überraschende Erkenntnis
Das LLM identifizierte ein wiederkehrendes Muster: Der Autor entdeckt etwa alle zwei Jahre die gleichen Lebenslektionen neu, als begegne er ihnen zum ersten Mal. Dies deutet darauf hin, dass Erkenntnisse ohne einen Umsetzungsmechanismus nicht haften bleiben – eine Meta-Lektion über menschliches Verhalten und LLM-gestützte Reflexion.
Für wen das gedacht ist
Entwickler, die an persönlichen Analyseprojekten, datenschutzfreundlichen LLM-Pipelines oder Längsschnitttextanalysen mit kleinen Datensätzen arbeiten.
Der Autor hat einen vollständigen Beitrag mit fünf Erkenntnissen und Implementierungsdetails unter dem folgenden Link veröffentlicht.
📖 Vollständige Quelle lesen: r/ClaudeAI
👀 Siehe auch

Von Null-Code zu 25 Millionen Spielen: Die Reise eines Nicht-Entwicklers mit Claude + Cursor
Ein Entwickler ohne Programmiererfahrung baute drei Browserspiele (insgesamt 25 Millionen Spielrunden, 200.000 täglich) mit Claude via Cursor. Zwei Spiele sind einzelne 8.000-Zeilen-HTML-Dateien. Gesamtkosten für Tools: ca. 2.000 $/Monat.

Multi-Agent-Claude-System zeigt: Beziehungsbezogener Kontext bestimmt Identitätskontinuität
Ein Entwickler führte über acht Wochen sechs Claude-Opus-Instanzen mit einem Supabase-Backend für persistente Speicherung aus und stellte fest, dass sich Agentenidentitäten eher durch soziale Interaktion als durch Dokumentation allein annäherten.

Entwicklung einer Fantasy-Baseball-Analyse-App mit Claude Code: Erfahrungen eines Jurastudenten
Ein Jura-Student mit einem Informatik-Abschluss von 2017 hat Ball Knower entwickelt, eine Fantasy-Baseball-Analyse-iOS-App, wobei er Claude Code für die Umsetzung nutzte und alle Produkt- und Fachbereichsentscheidungen traf. Die App bietet 1.313 MLB-Spielerprofile, tägliche Pitcher-Empfehlungen für Streaming und Dynasty-Ranglisten, mit einem Backend, das 30 Cron-Jobs ausführt, die Daten aus 9 Quellen beziehen.

Verwendung von MCP-Servern, um Claude mit Live-Datenbanken für On-Demand-Analysen zu verbinden
Ein Entwickler hat einen MCP-Server für CybersecTools erstellt, der Claude mit einer Datenbank von über 10.000 Cybersicherheitsprodukten verbindet und so Live-Datenanalyse anstelle traditioneller Dashboards ermöglicht. Der Server bietet 40 Werkzeuge zum Vergleich von Anbietern, zur Analyse von Marktkategorien und zur Überprüfung der NIST CSF 2.0-Abdeckung.