Erstellen einer lokalen Sprache-zu-Text macOS-App mit Claude Code: Vext Fallstudie

✍️ OpenClawRadar📅 Veröffentlicht: 29. April 2026🔗 Source
Erstellen einer lokalen Sprache-zu-Text macOS-App mit Claude Code: Vext Fallstudie
Ad

Ein Entwickler berichtete von seinen Erfahrungen bei der Entwicklung von Vext – einer nativen macOS-Sprache-zu-Text-App, die vollständig auf dem Gerät läuft und Whisper auf dem Apple Neural Engine nutzt. Keine Cloud, keine Konten, kein Abonnement. Die App verwendet einen Rust-Kern mit Swift/SwiftUI-Oberfläche und Core ML für die Inferenz, mit Claude Code als primärem Programmierpartner.

Hauptfunktionen

  • Hotkey gedrückt halten → sprechen → loslassen → Text erscheint an der Cursorposition
  • Transkribiert 60 Sekunden Audio in etwa 400 ms (150-fach Echtzeit)
  • Intelligente Bereinigung: Entfernt Füllwörter, strukturiert Sprache für bessere Lesbarkeit um
  • Echtzeit-Übersetzung in 99+ Sprachen
  • Meeting-Transkription mit Sprechererkennung + automatischen Zusammenfassungen
  • Bildschirmaufnahme während Sprachaufnahmen (Screenshots werden automatisch angehängt)
Ad

Claude Code Stärken

  • Whisper auf Apple Silicon: Half bei der Optimierung von Quantisierungsstrategien, Modell-Chunking und Speicherlayout für die Core ML-Konvertierung, um effizient auf der Neural Engine zu laufen.
  • Hotkey-Systemarchitektur: Schlug die Verwendung eines CGEventTap mit korrekten Bedienungshilfen-Berechtigungen vor und half bei der Fehlerbehebung von Race Conditions zwischen Aufnahmestart/-stopp und Zwischenablage-Einfügung.
  • Rust ↔ Swift FFI: Generierte FFI-Bindungen und erkannte mehrere Speichersicherheitsprobleme in der C-Schnittstellenebene.

Claude Code Einschränkungen

  • Schwierigkeiten mit macOS-spezifischen API-Nuancen, die online nicht gut dokumentiert sind – CGEventTap-Grenzfälle erforderten direktes Nachschlagen in Apples Headern.
  • Das Kontextfenster wurde zu einem Engpass über die gesamte Rust + Swift-Codebasis; der Entwickler teilte das Projekt in Module auf und arbeitete jeweils an einem.

Preise

Kostenlos zum Herunterladen und Ausprobieren unter getvext.app. Einmalig 49 $, um es zu behalten (kein Abonnement). Code VEXT50 für 50 % Rabatt.

📖 Lies den vollständigen Quelltext: r/ClaudeAI

Ad

👀 Siehe auch

Roost: Eine einzelne Go-Binär-Seitenleiste für Claude Code mit klickbarer Eingabehistorie, Dateibaum und Benachrichtigungen
Werkzeuge

Roost: Eine einzelne Go-Binär-Seitenleiste für Claude Code mit klickbarer Eingabehistorie, Dateibaum und Benachrichtigungen

Roost ist ein einzelnes Go-Binary, das Claude Code um eine webbasierte Seitenleiste erweitert: xterm.js-Terminal mit tmux im Hintergrund, Dateibaum, der Ihrem cd folgt, anklickbarer Verlauf aus ~/.claude/projects/*.jsonl und Push-Benachrichtigungen über den Stop-Hook von Claude Code. Läuft über SSH als Single-User-pro-Instanz; kein Build-Schritt im Frontend.

OpenClawRadar
Open-Source-Tool misst Autonomie von KI-Codierungsagenten mit lokaler Datenanalyse
Werkzeuge

Open-Source-Tool misst Autonomie von KI-Codierungsagenten mit lokaler Datenanalyse

Codelens-AI ist ein Open-Source-CLI-Tool, das Claude-Code-Sitzungsdateien zusammen mit dem Git-Verlauf analysiert, um Autonomie-Metriken wie Autopilot-Verhältnis und Self-Heal-Score zu berechnen. Das Tool läuft lokal ohne Einrichtung mit npx claude-roi und behält alle Daten auf Ihrem Rechner.

OpenClawRadar
Claudius: Open-Source Einbettbares KI-Chat-Widget für Claude
Werkzeuge

Claudius: Open-Source Einbettbares KI-Chat-Widget für Claude

Claudius ist ein quelloffenes, selbst gehostetes Chat-Widget, das von Claude angetrieben wird und mit einem einzigen Skript-Tag auf jeder Website eingebettet werden kann. Es läuft auf Cloudflare Workers mit einem React-Frontend und bietet Funktionen wie benutzerdefinierte Systemaufforderungen, Ratenbegrenzung und Barrierefreiheitskonformität.

OpenClawRadar
Netflix veröffentlicht VOID: Video-Objekt- und Interaktionslöschmodell auf Hugging Face
Werkzeuge

Netflix veröffentlicht VOID: Video-Objekt- und Interaktionslöschmodell auf Hugging Face

Netflix hat VOID veröffentlicht, ein Video-Inpainting-Modell, das Objekte aus Videos entfernt, einschließlich aller physischen Interaktionen, die sie auslösen, wie fallende Objekte und verschobene Gegenstände. Das Modell benötigt eine GPU mit 40 GB+ VRAM und verwendet Quadmask-Conditioning mit zwei Checkpoint-Dateien für verschiedene Verfeinerungsstufen.

OpenClawRadar