Herramienta de Voz a Texto sin Conexión para macOS Usando Whisper Local mediante MLX

✍️ OpenClawRadar📅 Publicado: 12 de marzo de 2026🔗 Source
Herramienta de Voz a Texto sin Conexión para macOS Usando Whisper Local mediante MLX
Ad

Un desarrollador ha creado whisper-dictate, una herramienta para macOS que permite transcripción de voz a texto completamente offline con capacidades de traducción en tiempo real. La herramienta utiliza Whisper de OpenAI ejecutándose localmente a través de MLX en Apple Silicon, sin que ningún dato abandone tu máquina.

Cómo Funciona

El flujo de trabajo es sencillo: mantén presionada la tecla fn, habla y suéltala. El texto se transcribe y se pega directamente donde estás escribiendo. La herramienta funciona en Slack, VS Code, navegadores, correo electrónico o cualquier otro campo de texto. Una superposición flotante "Escuchando..." proporciona retroalimentación visual durante la grabación.

Detalles Técnicos

  • La transcripción toma aproximadamente 500ms después de dejar de hablar
  • Utiliza Whisper ejecutándose localmente a través de MLX en Apple Silicon
  • El modelo pequeño es sólido para uso diario
  • El modelo large-v3-turbo proporciona precisión casi perfecta
  • Operación 100% offline - sin cuentas, tokens o datos que abandonen tu máquina
Ad

Función de Traducción

Whisper puede traducir sobre la marcha sin modelos adicionales o APIs de traducción. La traducción está integrada en el paso de decodificación de Whisper. Por ejemplo, hablar francés produce texto en inglés. Configuras el idioma de salida a inglés, y maneja la traducción de forma nativa.

Configuración

Al iniciar, la herramienta pregunta en qué idioma hablarás y qué idioma quieres como salida, permitiendo cambiar fácilmente entre transcripción pura y traducción. Toda la configuración no requiere conexión a internet una vez instalada.

Disponibilidad

El proyecto está publicado como código abierto en GitHub para que otros lo usen y adapten a sus flujos de trabajo.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Ver también

alogin: Una Puerta de Enlace de Seguridad Basada en Go para Agentes de IA con Participación Humana
Herramientas

alogin: Una Puerta de Enlace de Seguridad Basada en Go para Agentes de IA con Participación Humana

alogin es una puerta de enlace de seguridad de código abierto basada en Go que proporciona un conducto seguro entre agentes de IA e infraestructura, con soporte integrado de servidor MCP para Claude Desktop, barreras de seguridad con intervención humana y almacenamiento cifrado de credenciales.

OpenClawRadar
La herramienta Depct recopila datos de tiempo de ejecución para ayudar a Claude a depurar problemas de producción.
Herramientas

La herramienta Depct recopila datos de tiempo de ejecución para ayudar a Claude a depurar problemas de producción.

Depct es una herramienta que recopila instrumentación en tiempo de ejecución de aplicaciones Node.js, construye gráficos a partir de los datos y los envía a Claude a través de AWS Bedrock para ayudar a depurar fallos intermitentes en producción. También genera diagramas de arquitectura y mapas de dependencias a partir del comportamiento en tiempo de ejecución.

OpenClawRadar
El repositorio de mejores prácticas de Claude Code alcanza 50k estrellas, construido enteramente con agentes de IA
Herramientas

El repositorio de mejores prácticas de Claude Code alcanza 50k estrellas, construido enteramente con agentes de IA

Un repositorio de GitHub lleno de mejores prácticas para Claude, desarrollado y mantenido 100% por flujos de trabajo autónomos de Claude, superó las 50,000 estrellas, convirtiéndose en el repositorio más destacado de Pakistán en 2026.

OpenClawRadar
Qwen 3.6 27B alcanza una velocidad 2.5 veces mayor con decodificación especulativa MTP en llama.cpp
Herramientas

Qwen 3.6 27B alcanza una velocidad 2.5 veces mayor con decodificación especulativa MTP en llama.cpp

Un usuario de Reddit reporta inferencia 2.5 veces más rápida en Qwen 3.6 27B usando decodificación especulativa MTP con un PR personalizado de llama.cpp, alcanzando 28 tok/s en Mac M2 Max 96GB. Incluye cuantizaciones GGUF preconvertidas y plantillas de chat corregidas.

OpenClawRadar