Ses ve Konuşma hesaplamaları

Ses kaydını yazıya dök

Ses ya da video dosyanı yükle; konuşmayı yazıya dökelim, kaç kelime, kaç ünlü ve ünsüz harf olduğunu sayalım.

Kaydı yazıya dök
Ses ya da video dosyası

MP3, WAV, M4A, OGG, WEBM, MP4. Dosyaların bilgisayarından dışarı gönderilmez; bütün işlem tarayıcında yapılır.

Doğruluk

Yazıya dökme modeli ilk kullanımda tarayıcına indirilir ve sonra hatırlanır. Daha doğru model daha uzun sürer.

Konuşmanın dili
Başlat
Metin

Sonuç burada görünür; düzeltebilirsin, analiz kendiliğinden güncellenir.

Kayıt analizi
–

Dosyanı yükleyip "Yazıya dök" düğmesine bas.

Yapay zekâ modeli (Whisper) tarayıcında çalışır; kaydın hiçbir sunucuya gönderilmez. Uzun kayıtlar bilgisayarın hızına göre birkaç dakika sürebilir. Gürültülü kayıtlarda hatalar olabilir.

Reklam
Bu hesaplama hakkında

Nasıl hesaplanıyor?

Ses dosyası tarayıcıda çözülür, 16 kHz tek kanala çevrilir ve OpenAI'nin açık kaynak Whisper konuşma tanıma modeliyle yazıya dökülür. Model ilk seferde indirilir, sonraki kullanımlarda tarayıcı önbelleğinden açılır.

Metin analizi: kelime, ünlü (a, e, ı, i, o, ö, u, ü) ve ünsüz harf, hece, cümle sayısı ve kaydın süresine göre konuşma hızı (kelime/dakika).

Örnek

2 dakikalık bir konuşmada 260 kelime → konuşma hızı 130 kelime/dk.

Sık sorulanlar

Dosyam bir yere yükleniyor mu?

Hayır. Dosya bilgisayarından ya da telefonundan çıkmaz; yalnızca yazıya dökme modeli internetten indirilir.

Neden ilk seferde uzun sürüyor?

Model dosyası (40–250 MB) ilk kullanımda indirilir. Sonraki kullanımlarda tarayıcıda hazır olduğu için hemen başlar.