AlphaCreek: Ein MCP-Server, der SEC-Einreichungen in Chunks aufteilt, um die Token-Nutzung um 85 % zu reduzieren

AlphaCreek ist ein kostenloser MCP-Server, der eine intelligentere Schnittstelle zu SEC-Einreichungen (10-K, 10-Q; 8-K und Gewinnmitteilungen folgen in Kürze) bietet. Anstatt die gesamte Einreichung (z. B. eine 10-K mit über 80.000 Token) in Claudes Kontext zu laden, wird zuerst get_filing_toc aufgerufen, um ein strukturiertes Inhaltsverzeichnis zurückzugeben. Der Agent navigiert dann zum relevanten Abschnitt und holt nur 2–4 Absätze ab, wobei eine reader_url erhalten bleibt, die direkt zum ursprünglichen EDGAR-HTML für überprüfbare Zitate führt.
Funktionsweise
- Aufteilung der Einreichungen in logische Abschnitte nach Titel und Formatierung (Text unter jeder Überschrift bleibt erhalten)
- Rückgabe einer Navigationskarte (Inhaltsverzeichnis) anstelle von Rohtext
- Der Agent ruft nur die benötigten Abschnitte ab, was den Tokenverbrauch im Vergleich zum vollständigen Abruf um etwa 85 % reduziert
- Jeder Abschnitt enthält einen direkten Link zur Quellenpassage in der EDGAR-Einreichung
Vergleich der Arbeitsabläufe
Vorher: Agent ruft die Einreichungs-API auf → erhält eine Textwand → verbraucht Kontext → gibt eine Antwort ohne nachvollziehbare Quelle zurück.
Nachher: Agent ruft get_filing_toc auf → sieht die Karte → navigiert zum relevanten Knoten → holt 2–4 Absätze → zitiert die genaue Zeile.
Wichtige Details
- Erfasst über 6.000 US-amerikanische börsennotierte Unternehmen
- Unterstützt derzeit 10-K und 10-Q; 8-K und Gewinnmitteilungen sind geplant
- Modellunabhängig (getestet mit Claude und GPT, Gemini nicht getestet)
- Kostenlos nutzbar unter alphacreek.ai
- Der Autor empfiehlt, die benutzerdefinierten Anweisungen von Claude für optimale Ergebnisse zu aktualisieren
Für wen es gedacht ist
Entwickler und Analysten, die KI-Agenten für die Analyse von SEC-Einreichungen einsetzen und Kosten senken, die Antwortgenauigkeit verbessern und die Überprüfbarkeit erhalten möchten.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Einseitige Chatbot-Oberfläche für lokal laufendes Gemma 4 26B A4B
Ein Entwickler hat einen Chatbot auf einer einzelnen HTML-Seite erstellt, der mit lokal laufendem Gemma 4 26B A4B verbunden ist und einen 32K-Kontextfenster mit 50-65 Token/Sekunde nutzt, aufgeteilt zwischen einer 7900 XT und einer 3060 Ti GPU. Die Oberfläche bietet vollständiges Streaming, Markdown-Rendering und Parametersteuerungen.

Mindwalk: Claude-Code/Codex-Sitzungen als Lichtspuren auf einer 3D-Code-Karte wiedergeben
Mindwalk spielt Coding-Agent-Sitzungen auf einer 3D-Karte deiner Codebasis ab. Ein einziges Go-Binary parst Claude Code- und Codex-Logs lokal. Beobachte, wie Dateien beim Suchen/Lesen/Bearbeiten leuchten – unberührte bleiben dunkel.

Hypura: Speicher-Ebenen-bewusster LLM-Inferenz-Planer für Apple Silicon
Hypura ist ein auf Rust basierender Inferenz-Scheduler, der Modelltensoren über GPU-, RAM- und NVMe-Ebenen verteilt, um Modelle auszuführen, die den physischen Speicher auf Apple Silicon Macs übersteigen. Es ermöglicht die Ausführung eines 31 GB großen Mixtral 8x7B auf einem 32 GB Mac Mini mit 2,2 Tok/s und eines 40 GB großen Llama 70B mit 0,3 Tok/s, wo die Standardversion von llama.cpp abstürzt.

Steerling-8B: Ein interpretierbares Sprachmodell mit Token-Level-Attribution
Guide Labs veröffentlichte Steerling-8B, ein Sprachmodell mit 8 Milliarden Parametern, das auf 1,35 Billionen Tokens trainiert wurde und jeden generierten Token auf Eingabekontext, menschenverständliche Konzepte und Trainingsdatenquellen zurückführen kann. Das Modell erreicht eine wettbewerbsfähige Leistung mit Modellen, die auf 2-7× mehr Daten trainiert wurden.