Open Speech Studio — tekst-naar-spraak met lokale stemmen
Open Speech Studio — Whisper-spraakmodellen beheren
Open Speech Studio — instellingen met GPU-versnelling

Casos de uso para profesionales AEC

Tanto si estás inspeccionando a pie de obra, redactando el acta de una reunión de proyecto o dictando un correo entre tareas, Open Speech Studio funciona en cualquier lugar, incluso sin conexión.

OBRA

Inspecciones a pie de obra

Dicta las observaciones directamente en Open Field Studio mientras haces fotos. Sin quitarte los guantes, sin teclear en una pantalla diminuta. Solo habla y listo.

REUNIONES

Actas de reunión

Transcripción en tiempo real de reuniones de proyecto in situ. Todo se procesa localmente: sin preocupaciones de privacidad por nombres de clientes, precios o datos confidenciales del proyecto en la nube.

COMUNICACIÓN

Correos rápidos en obra

Dicta en Outlook o Gmail entre tareas. Manos libres cuando tienes las manos sucias, llevas guantes de seguridad o sujetas una escalera.

FLUJO DE TRABAJO CON IA

Redacción de prompts de IA

Dicta un prompt para Claude o ChatGPT mucho más rápido que escribiendo. Hablar es ~3 veces más rápido y a menudo te expresas con más naturalidad: ideal para prompts largos y detallados.

DESARROLLADORES

Comentarios de código y commits

Dicta explicaciones de código, docstrings y mensajes de commit directamente en tu IDE o terminal. Funciona sin problemas en VS Code, Cursor, Neovim: en cualquier lugar donde puedas introducir texto.

ACCESIBILIDAD

Accesibilidad

Para personas con lesiones por esfuerzo repetitivo, con discapacidades motoras o lesiones temporales. Maneja todo tu ordenador sin teclado, conforme al RGPD y sin suscripciones.

¿Por qué local?

El reconocimiento de voz en la nube envía tu voz a servidores de terceros. Open Speech Studio lo hace todo en tu propio PC: más rápido, más seguro y sin costes mensuales.

🔒

Privacidad

Tu voz nunca sale de tu ordenador. Conforme al RGPD de forma automática: sin necesidad de contratos de encargo de tratamiento con proveedores externos, sin riesgo de filtraciones de datos.

💶

Sin suscripción

Otter.ai cobra ~20 €/mes. Dragon NaturallySpeaking ~500 € en un pago único. Open Speech Studio es gratuito para siempre: código abierto LGPL-3.0.

0 € para siempre
♾️

Sin límites de uso

Dicta 10 horas al día si quieres. Sin cuotas de API, sin 'política de uso justo', sin facturas sorpresa. Tu hardware es el único límite.

Característica Open Speech Studio Dragon NaturallySpeaking Otter.ai
Precio €0 (open source) ~€500 one-time ~€20/maand
100 % local No (nube)
Conforme al RGPD sin contrato de encargo No
Idiomas 99 talen (Whisper) ~6 talen ~10 talen
Aceleración GPU (CUDA) No N/D (nube)
Código abierto Ja (LGPL-3.0) No No

Funciones: ¿qué puede hacer?

Open Speech Studio es más que una herramienta de dictado. Es una suite completa de voz a texto con transcripción de archivos de audio, grabación de reuniones, varios modelos Whisper y exportación a formatos de subtítulos estándar.

🎙️

Dicta en cualquier lugar

Dicta texto directamente en cualquier aplicación mediante una superposición a nivel de sistema. Funciona en Outlook, Word, Chrome, VS Code, Slack, Teams: literalmente en cualquier parte de tu sistema operativo.

📂

Transcripción de archivos de audio

Transcribe archivos de audio (.mp3, .wav, .m4a, .ogg) con procesamiento en paralelo. Varios archivos a la vez, rápido y preciso.

👥

Transcripción de reuniones en tiempo real

Graba reuniones de proyecto y observa cómo la transcripción aparece en tiempo real. Actas automáticas, incluso sin conexión a pie de obra.

Aceleración GPU con CUDA

Aceleración GPU con CUDA para resultados más rápidos. En una GPU moderna, Whisper Large funciona casi en tiempo real: uso óptimo de tu hardware.

⌨️

Atajos de teclado

CTRL+Win para la superposición, CTRL+SHIFT+Espacio como alternativa. Sin clics de ratón ni búsquedas por menús: el dictado arranca en <100 ms.

🧠

Modelos Whisper AI

5 modelos: tiny, base, small, medium, large. Elige entre velocidad (tiny) o precisión (large). Uso de memoria de 1 a 10 GB según el modelo.

🌍

99 idiomas

Whisper es compatible con 99 idiomas: neerlandés, inglés, alemán, francés, español, polaco, árabe, chino mandarín y muchos más. Detección automática de idioma.

🎛️

Superposición estilo Spotify

Interfaz de superposición elegante y minimalista con visualización de forma de onda en directo. No estorba y desaparece automáticamente tras insertar el texto.

🕘

Historial

Historial completo de transcripciones: consultable y reutilizable. Todo se guarda localmente, tú mantienes el control.

📄

Exportación a TXT, SRT, VTT

Exporta transcripciones como texto plano (.txt) o como subtítulos (.srt, .vtt) para contenido de vídeo con marcas de tiempo.

📋

Integración con el portapapeles

Integración automática con el portapapeles: dicta y pega directamente, o deja que el texto se inserte automáticamente en la posición del cursor.

🔒

100 % local

Todo se ejecuta localmente en tu propio ordenador. Tus datos nunca salen de tu PC. Sin nube, sin suscripción, sin límites. Conforme al RGPD desde el primer momento.

Atajos de teclado

Inicia la conversión de voz a texto en cualquier parte de tu sistema operativo:

CTRL + Windows o CTRL + SHIFT + Spatie

Configurable en los ajustes: elige tu propio atajo si entra en conflicto con otro software.

Stack tecnológico

Open Speech Studio está construido sobre un stack moderno y de alto rendimiento. OpenAI Whisper para un reconocimiento de voz de última generación. Rust para un backend ligero y rápido (sin necesidad de runtime de Python). Tauri 2 para la aplicación de escritorio, mucho más ligera que Electron (~10 MB en lugar de 200 MB). TypeScript + Svelte para la interfaz. Totalmente de código abierto bajo LGPL-3.0.

Descárgalo ahora - instalación en 30 segundos

1 archivo instalador (.exe), sin registro, sin cuenta, sin tarjeta de crédito. Listo para dictar en <1 minuto. Funciona en Windows 10 y Windows 11.

v0.10.3 estable · LGPL-3.0 · Windows 10/11 · descarga de ~40 MB