Herramienta de Voz a Texto sin Conexión para macOS Usando Whisper Local mediante MLX

Un desarrollador ha creado whisper-dictate, una herramienta para macOS que permite transcripción de voz a texto completamente offline con capacidades de traducción en tiempo real. La herramienta utiliza Whisper de OpenAI ejecutándose localmente a través de MLX en Apple Silicon, sin que ningún dato abandone tu máquina.
Cómo Funciona
El flujo de trabajo es sencillo: mantén presionada la tecla fn, habla y suéltala. El texto se transcribe y se pega directamente donde estás escribiendo. La herramienta funciona en Slack, VS Code, navegadores, correo electrónico o cualquier otro campo de texto. Una superposición flotante "Escuchando..." proporciona retroalimentación visual durante la grabación.
Detalles Técnicos
- La transcripción toma aproximadamente 500ms después de dejar de hablar
- Utiliza Whisper ejecutándose localmente a través de MLX en Apple Silicon
- El modelo pequeño es sólido para uso diario
- El modelo large-v3-turbo proporciona precisión casi perfecta
- Operación 100% offline - sin cuentas, tokens o datos que abandonen tu máquina
Función de Traducción
Whisper puede traducir sobre la marcha sin modelos adicionales o APIs de traducción. La traducción está integrada en el paso de decodificación de Whisper. Por ejemplo, hablar francés produce texto en inglés. Configuras el idioma de salida a inglés, y maneja la traducción de forma nativa.
Configuración
Al iniciar, la herramienta pregunta en qué idioma hablarás y qué idioma quieres como salida, permitiendo cambiar fácilmente entre transcripción pura y traducción. Toda la configuración no requiere conexión a internet una vez instalada.
Disponibilidad
El proyecto está publicado como código abierto en GitHub para que otros lo usen y adapten a sus flujos de trabajo.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

alogin: Una Puerta de Enlace de Seguridad Basada en Go para Agentes de IA con Participación Humana
alogin es una puerta de enlace de seguridad de código abierto basada en Go que proporciona un conducto seguro entre agentes de IA e infraestructura, con soporte integrado de servidor MCP para Claude Desktop, barreras de seguridad con intervención humana y almacenamiento cifrado de credenciales.

La herramienta Depct recopila datos de tiempo de ejecución para ayudar a Claude a depurar problemas de producción.
Depct es una herramienta que recopila instrumentación en tiempo de ejecución de aplicaciones Node.js, construye gráficos a partir de los datos y los envía a Claude a través de AWS Bedrock para ayudar a depurar fallos intermitentes en producción. También genera diagramas de arquitectura y mapas de dependencias a partir del comportamiento en tiempo de ejecución.

El repositorio de mejores prácticas de Claude Code alcanza 50k estrellas, construido enteramente con agentes de IA
Un repositorio de GitHub lleno de mejores prácticas para Claude, desarrollado y mantenido 100% por flujos de trabajo autónomos de Claude, superó las 50,000 estrellas, convirtiéndose en el repositorio más destacado de Pakistán en 2026.

Qwen 3.6 27B alcanza una velocidad 2.5 veces mayor con decodificación especulativa MTP en llama.cpp
Un usuario de Reddit reporta inferencia 2.5 veces más rápida en Qwen 3.6 27B usando decodificación especulativa MTP con un PR personalizado de llama.cpp, alcanzando 28 tok/s en Mac M2 Max 96GB. Incluye cuantizaciones GGUF preconvertidas y plantillas de chat corregidas.