90'dan fazla dilde insan seviyesinde doğrulukla ses ve video kayıtlarını dakikalar içinde metne döken, konuşmacı ayrıştırma (speaker diarization) ve özetleme yeteneklerine sahip yapay zekâ transkripsiyon platformu.
What Problem Did We Solve?
Uzun süreli toplantı, röportaj ve podcast ses dosyalarında birden fazla konuşmacıyı birbirinden ayırmak, arka plan gürültüsünü temizlemek ve senkronize bir düzenleme arayüzü sunmak.
How Did We Build It?
Whisper ve Gemini multimodal ses boru hattını paralel işleme kuyruklarıyla birleştirdik ve zaman damgalı dalga formu editörü inşa ettik.
1 Saatlik Ses Dosyasını 90 Saniyede Çözümleme — %99.2 transkripsiyon doğruluğu
Otomatik Konuşmacı Ayrıştırma ile toplantı tutanaklarında %80 zaman tasarrufu
Tek tıkla YouTube ve video kurguları için zaman kodlu SRT/VTT altyazı üretimi