Création d'une application macOS de transcription vocale locale avec Claude Code : Étude de cas Vext

✍️ OpenClawRadar📅 Publié: April 29, 2026🔗 Source
Création d'une application macOS de transcription vocale locale avec Claude Code : Étude de cas Vext
Ad

Un développeur a partagé son expérience de création de Vext, une application macOS native de dictée vocale qui fonctionne entièrement sur l'appareil à l'aide de Whisper sur Apple Neural Engine. Pas de cloud, pas de comptes, pas d'abonnement. L'application utilise un noyau Rust avec une interface Swift/SwiftUI et Core ML pour l'inférence, avec Claude Code comme partenaire de codage principal.

Fonctionnalités clés

  • Maintenez un raccourci clavier n'importe où → parlez → relâchez → le texte apparaît au curseur
  • Transcrit 60 secondes d'audio en ~400 ms (150x temps réel)
  • Nettoyage intelligent : supprime les mots de remplissage, restructure le discours pour une meilleure lisibilité
  • Traduction en temps réel dans plus de 99 langues
  • Transcription de réunions avec identification des intervenants + résumés automatiques
  • Enregistrement d'écran pendant les enregistrements vocaux (captures d'écran automatiquement jointes)
Ad

Succès de Claude Code

  • Whisper sur Apple Silicon : A aidé à itérer sur les stratégies de quantification, le découpage des modèles et la disposition mémoire pour la conversion Core ML afin de fonctionner efficacement sur le Neural Engine.
  • Architecture du système de raccourcis : A suggéré d'utiliser un CGEventTap avec les autorisations d'accessibilité appropriées, et a aidé à déboguer les conditions de concurrence entre le démarrage/l'arrêt de l'enregistrement et l'injection dans le presse-papiers.
  • FFI Rust ↔ Swift : A généré des liaisons FFI et détecté plusieurs problèmes de sécurité mémoire dans la couche d'interface C.

Limitations de Claude Code

  • A eu du mal avec les nuances spécifiques à macOS mal documentées en ligne — les cas limites de CGEventTap ont nécessité de fouiller directement dans les en-têtes Apple.
  • La fenêtre de contexte est devenue un goulot d'étranglement dans l'ensemble du codebase Rust + Swift ; le développeur a divisé le projet en modules et travaillé sur un à la fois.

Tarifs

Téléchargement et essai gratuits sur getvext.app. 49 $ en paiement unique pour le conserver (sans abonnement). Code VEXT50 pour 50 % de réduction.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

SuperContext : Un Cadre de Mémoire Persistante pour les Agents d'Intelligence Artificielle de Codage
Tools

SuperContext : Un Cadre de Mémoire Persistante pour les Agents d'Intelligence Artificielle de Codage

SuperContext est un framework open-source qui donne aux outils de codage IA comme Claude une mémoire persistante grâce à des fichiers structurés et ciblés, plutôt que de gros documents d'instructions. Il inclut un prompt exécutable qui construit le système en environ 10 minutes sans configuration manuelle.

OpenClawRadar
Lore : Serveur MCP partageant l'historique des sessions d'agents IA entre outils
Tools

Lore : Serveur MCP partageant l'historique des sessions d'agents IA entre outils

Lore est un serveur MCP qui indexe les sessions d'agents IA dans une base SQLite locale, permettant à n'importe quel agent—quel que soit l'outil—d'accéder à l'historique d'un autre. Des sessions fraîches, sans contexte partagé, mais les agents peuvent consulter les conversations passées à la demande.

OpenClawRadar
État des outils de recherche approfondie locale : GPT Researcher et Local Deep Research en tête, projets STORM et LangChain à l'arrêt
Tools

État des outils de recherche approfondie locale : GPT Researcher et Local Deep Research en tête, projets STORM et LangChain à l'arrêt

Un sondage Reddit sur les projets locaux de recherche approfondie en mai 2026 révèle que GPT Researcher et Local Deep Research de LearningCircuit sont les plus actifs ; STORM et Open Deep Research de LangChain sont abandonnés ou semi-abandonnés.

OpenClawRadar
Unsloth Studio permet une vitesse d'entraînement deux fois plus rapide avec une réduction de 70 % de la VRAM pour le réglage fin d'IA en local.
Tools

Unsloth Studio permet une vitesse d'entraînement deux fois plus rapide avec une réduction de 70 % de la VRAM pour le réglage fin d'IA en local.

Unsloth Studio propose des outils pour entraîner et affiner des modèles de langage sur du matériel local avec un entraînement 2 fois plus rapide et une réduction de 70 % de la VRAM. Il prend en charge l'exportation des modèles au format GGUF pour une utilisation avec Ollama et permet des flux de travail de codage IA entièrement locaux sur du matériel 24 Go comme le RTX 4090.

OpenClawRadar