Open Speech Studio — tekst-naar-spraak met lokale stemmen
Open Speech Studio — Whisper-spraakmodellen beheren
Open Speech Studio — instellingen met GPU-versnelling

Cas d'usage pour les professionnels AEC

Que vous inspectiez sur site, preniez des notes en réunion de projet ou dictiez un e-mail entre deux tâches — Open Speech Studio fonctionne partout, même hors ligne.

CHANTIER

Inspections sur site

Dictez vos constats directement dans Open Field Studio tout en prenant des photos. Pas besoin d'enlever vos gants, ni de taper sur un petit écran. Parlez — c'est fait.

RÉUNIONS

Comptes rendus de réunion

Transcription en temps réel des réunions de projet sur place. Entièrement traité localement — aucune préoccupation de confidentialité pour les noms de clients, prix ou données de projet.

COMMUNICATION

E-mails rapides sur site

Dictez dans Outlook ou Gmail entre deux tâches. Mains libres quand vos mains sont sales, que vous portez des gants de sécurité ou que vous tenez une échelle.

WORKFLOW IA

Écrire des prompts IA

Dictez un prompt pour Claude ou ChatGPT bien plus vite qu'en tapant. Parler est ~3× plus rapide et l'on formule souvent plus naturellement — idéal pour des prompts longs et détaillés.

DÉVELOPPEURS

Commentaires de code et commits

Dictez explications de code, docstrings et messages de commit directement dans votre IDE ou terminal. Fonctionne dans VS Code, Cursor, Neovim — partout où vous pouvez saisir du texte.

ACCESSIBILITÉ

Accessibilité

Pour les personnes souffrant de TMS, de déficiences motrices ou de blessures temporaires. Utilisez votre ordinateur entièrement sans clavier — conforme RGPD, sans abonnement.

Pourquoi local ?

La reconnaissance vocale cloud envoie votre voix vers des serveurs tiers. Open Speech Studio fait tout sur votre propre PC — plus rapide, plus sûr et sans frais mensuels.

🔒

Vie privée

Votre voix ne quitte jamais votre ordinateur. Conforme RGPD automatiquement — aucun DPA nécessaire avec des prestataires externes, aucun risque de fuite de données.

💶

Sans abonnement

Otter.ai facture ~20 €/mois. Dragon NaturallySpeaking ~500 € en une fois. Open Speech Studio est gratuit pour toujours — open source LGPL-3.0.

0 € pour toujours
♾️

Sans limites d'utilisation

Dictez 10 heures par jour si vous voulez. Pas de quota API, pas de « Fair Use Policy », pas de factures surprise. Seul votre matériel limite.

Fonctionnalité Open Speech Studio Dragon NaturallySpeaking Otter.ai
Prix €0 (open source) ~€500 one-time ~€20/maand
100 % local Oui Oui Non (cloud)
Conforme RGPD sans DPA Oui Oui Non
Langues 99 talen (Whisper) ~6 talen ~10 talen
Accélération GPU (CUDA) Oui Non N/A (cloud)
Open source Ja (LGPL-3.0) Non Non

Fonctionnalités — que peut faire Open Speech Studio ?

Open Speech Studio est plus qu'un outil de dictée. C'est une suite speech-to-text complète avec transcription de fichiers audio, enregistrement de réunions, plusieurs modèles Whisper et export vers les formats de sous-titres standard.

🎙️

Dictez partout

Dictez du texte directement dans n'importe quelle application via une superposition globale au système. Fonctionne dans Outlook, Word, Chrome, VS Code, Slack, Teams — littéralement partout dans votre OS.

📂

Transcription de fichiers audio

Transcrivez des fichiers audio (.mp3, .wav, .m4a, .ogg) avec traitement parallèle. Plusieurs fichiers à la fois, rapide et précis.

👥

Transcription de réunions en temps réel

Enregistrez vos réunions de projet et regardez la transcription apparaître en temps réel. Compte-rendu automatique, même hors ligne sur le chantier.

Accélération GPU CUDA

Accélération GPU CUDA pour des résultats plus rapides. Sur un GPU moderne, Whisper Large tourne quasiment en temps réel — utilisation optimale de votre matériel.

⌨️

Raccourcis clavier

CTRL+Win pour la superposition, CTRL+SHIFT+Espace en alternative. Pas de clic souris nécessaire, pas de recherche dans les menus — la dictée démarre en <100 ms.

🧠

Modèles Whisper AI

5 modèles : tiny, base, small, medium, large. Choisissez entre vitesse (tiny) ou précision (large). Mémoire utilisée 1 à 10 Go selon le modèle.

🌍

99 langues

Whisper prend en charge 99 langues : néerlandais, anglais, allemand, français, espagnol, polonais, arabe, mandarin et bien d'autres. Détection automatique de la langue.

🎛️

Superposition de style Spotify

Interface de superposition élégante et minimaliste avec visualisation en direct de l'onde sonore. Reste discrète, disparaît automatiquement après insertion.

🕘

Historique

Historique complet des transcriptions — interrogeable, réutilisable. Tout stocké localement, vous gardez le contrôle.

📄

Export TXT, SRT, VTT

Exportez les transcriptions en texte brut (.txt) ou en sous-titres (.srt, .vtt) pour du contenu vidéo avec timestamps.

📋

Intégration presse-papiers

Intégration automatique au presse-papiers — dictez et collez directement, ou laissez le texte s'insérer automatiquement à la position du curseur.

🔒

100 % local

Tout fonctionne localement sur votre propre ordinateur. Vos données ne quittent jamais votre PC. Sans cloud, sans abonnement, sans limites. Conforme RGPD prêt à l'emploi.

Raccourcis clavier

Démarrez la reconnaissance vocale partout dans votre système d'exploitation :

CTRL + Windows ou CTRL + SHIFT + Spatie

Configurable dans les paramètres — choisissez votre propre raccourci s'il entre en conflit avec d'autres logiciels.

Stack technique

Open Speech Studio repose sur une stack moderne et performante. OpenAI Whisper pour une reconnaissance vocale à l'état de l'art. Rust pour un backend léger et rapide (sans runtime Python). Tauri 2 pour l'application de bureau — bien plus léger qu'Electron (~10 Mo au lieu de 200 Mo). TypeScript + Svelte pour l'interface. Entièrement open source sous LGPL-3.0.

Téléchargez maintenant — installation en 30 secondes

1 fichier d'installation (.exe), sans inscription, sans compte, sans carte bancaire. Prêt à dicter en <1 minute. Fonctionne sur Windows 10 et Windows 11.

v0.10.3 stable · LGPL-3.0 · Windows 10/11 · téléchargement ~40 Mo