Open Speech Studio — tekst-naar-spraak met lokale stemmen
Open Speech Studio — Whisper-spraakmodellen beheren
Open Speech Studio — instellingen met GPU-versnelling

AEC profesyonelleri için kullanım senaryoları

İster şantiyede inceleme yapın, ister proje toplantısında not alın, ister görevler arasında bir e-posta dikte edin — Open Speech Studio her yerde çalışır, çevrimdışı bile.

ŞANTİYE

Şantiyede incelemeler

Fotoğraf çekerken bulgularınızı doğrudan Open Field Studio'ya dikte edin. Eldiven çıkarmak yok, küçük ekranda yazmak yok. Sadece konuşun — tamam.

TOPLANTILAR

Toplantı tutanakları

Yerinde proje toplantılarının gerçek zamanlı transkripsiyonu. Tamamen yerel işlenir — müşteri isimleri, fiyatlar veya gizli proje verileri için gizlilik kaygısı yok.

İLETİŞİM

Şantiyede hızlı e-postalar

Görevler arasında Outlook veya Gmail'e dikte edin. Elleriniz kirliyken, güvenlik eldivenleri taktığınızda veya merdiven tutarken eller serbest.

AI WORKFLOW

AI prompt'ları yazmak

Claude veya ChatGPT için bir prompt'u yazmaktan çok daha hızlı dikte edin. Konuşmak ~3x daha hızlıdır ve genellikle daha doğal ifade edersiniz — uzun, detaylı prompt'lar için idealdir.

GELİŞTİRİCİLER

Kod yorumları ve commit'ler

Kod açıklamalarını, docstring'leri ve commit mesajlarını doğrudan IDE veya terminalinize dikte edin. VS Code, Cursor, Neovim'de sorunsuz çalışır — metin girebileceğiniz her yerde.

ERİŞİLEBİLİRLİK

Erişilebilirlik

RSI hastaları, motor bozukluğu olan kişiler veya geçici yaralanmalar için. Bilgisayarınızı tamamen klavyesiz kullanın — KVKK güvenli ve aboneliksiz.

Neden yerel?

Bulut ses tanıma sesinizi üçüncü taraf sunuculara gönderir. Open Speech Studio her şeyi kendi PC'nizde yapar — daha hızlı, daha güvenli ve aylık ücret olmadan.

🔒

Gizlilik

Sesiniz bilgisayarınızdan asla ayrılmaz. Otomatik olarak KVKK güvenli — harici sağlayıcılarla DPA gerekmiyor, veri ihlali riski yok.

💶

Abonelik yok

Otter.ai aylık ~20 € ücret alır. Dragon NaturallySpeaking ~500 € bir kez. Open Speech Studio sonsuza dek ücretsiz — açık kaynak LGPL-3.0.

Sonsuza dek 0 €
♾️

Hız sınırı yok

İsterseniz günde 10 saat dikte edin. API kotaları yok, 'Fair Use Policy' yok, sürpriz faturalar yok. Tek sınırınız donanımınız.

Özellik Open Speech Studio Dragon NaturallySpeaking Otter.ai
Fiyat €0 (open source) ~€500 one-time ~€20/maand
%100 yerel Evet Evet Hayır (bulut)
DPA olmadan KVKK güvenli Evet Evet Hayır
Diller 99 talen (Whisper) ~6 talen ~10 talen
GPU hızlandırma (CUDA) Evet Hayır Yok (bulut)
Açık kaynak Ja (LGPL-3.0) Hayır Hayır

Özellikler — bu ne yapabilir?

Open Speech Studio bir dikte aracından daha fazlasıdır. Ses dosyası transkripsiyonu, toplantı kayıtları, birden fazla Whisper modeli ve standart altyazı formatlarına dışa aktarma içeren eksiksiz bir konuşma-metin paketidir.

🎙️

Her yerde dikte edin

Sistem genelinde bir overlay aracılığıyla doğrudan herhangi bir uygulamaya metin dikte edin. Outlook, Word, Chrome, VS Code, Slack, Teams'te çalışır — OS'nizde tam anlamıyla her yerde.

📂

Ses dosyası transkripsiyonu

Paralel işleme ile ses dosyalarını (.mp3, .wav, .m4a, .ogg) transkribe edin. Aynı anda birden fazla dosya, hızlı ve doğru.

👥

Gerçek zamanlı toplantı transkripsiyonu

Proje toplantılarını kaydedin ve transkripsiyonun gerçek zamanlı görünmesini izleyin. Şantiyede çevrimdışı bile otomatik tutanak.

CUDA GPU hızlandırma

Daha hızlı sonuçlar için CUDA GPU hızlandırma. Modern bir GPU'da Whisper Large neredeyse gerçek zamanlı çalışır — donanımınızın optimal kullanımı.

⌨️

Klavye kısayolları

Overlay için CTRL+Win, alternatif olarak CTRL+SHIFT+Space. Fare tıklaması gerekmez, menü aramak yok — dikte <100ms'de başlar.

🧠

Whisper AI modelleri

5 model: tiny, base, small, medium, large. Hız (tiny) veya doğruluk (large) arasında seçim yapın. Modele bağlı olarak 1-10 GB bellek kullanımı.

🌍

99 dil

Whisper 99 dili destekler: Hollandaca, İngilizce, Almanca, Fransızca, İspanyolca, Lehçe, Arapça, Türkçe, Mandarin ve daha fazlası. Otomatik dil algılama.

🎛️

Spotify tarzı overlay

Canlı dalga formu görselleştirmesi olan zarif, minimalist overlay UI. Yoldan çekilir, eklendikten sonra otomatik kaybolur.

🕘

Geçmiş

Transkripsiyonların tam geçmişi — aranabilir, yeniden kullanılabilir. Her şey yerel olarak saklanır, kontrol sizde.

📄

TXT, SRT, VTT dışa aktarma

Transkripsiyonları düz metin (.txt) veya zaman damgalarıyla video içeriği için altyazı (.srt, .vtt) olarak dışa aktarın.

📋

Pano entegrasyonu

Otomatik pano entegrasyonu — dikte edin ve doğrudan yapıştırın veya metnin imleç konumuna otomatik olarak eklenmesine izin verin.

🔒

%100 yerel

Her şey kendi bilgisayarınızda yerel olarak çalışır. Verileriniz PC'nizden asla ayrılmaz. Bulut yok, abonelik yok, sınır yok. KVKK güvenli, kutudan çıkar çıkmaz.

Klavye kısayolları

İşletim sisteminizde her yerde konuşma tanımayı başlatın:

CTRL + Windows veya CTRL + SHIFT + Spatie

Ayarlarda yapılandırılabilir — başka yazılımlarla çakışırsa kendi kısayolunuzu seçin.

Teknoloji stack'i

Open Speech Studio modern, performanslı bir stack üzerine inşa edilmiştir. OpenAI Whisper state-of-the-art ses tanıma için. Rust hafif, hızlı bir backend için (Python runtime gerekmez). Tauri 2 masaüstü uygulaması için — Electron'dan çok daha hafif (~10 MB, 200 MB yerine). UI için TypeScript + Svelte. LGPL-3.0 altında tamamen açık kaynak.

Şimdi indirin — 30 saniye kurulum

1 yükleyici dosyası (.exe), kayıt yok, hesap yok, kredi kartı yok. <1 dakikada dikteye hazır. Windows 10 ve Windows 11'de çalışır.

v0.10.3 stable · LGPL-3.0 · Windows 10/11 · ~40 MB indirme