Cara Transkrip Audio · ucapan kepada teks berfungsi
Transkripsi Audio menukar rakaman menjadi teks menggunakan Whisper, model pengecaman pertuturan yang berjalan sepenuhnya dalam tab pelayar anda melalui Transformers.js. Pada kali pertama anda menjalankannya, pelayar anda memuat turun model dan enjin WebAssembly yang diperlukan (kira-kira 68 MB kesemuanya) daripada laman ini, kemudian menyimpannya dalam cache; selepas itu, setiap transkripsi berlaku pada peranti anda tanpa sebarang pelayan dan tanpa audio pernah meninggalkan mesin anda.
Model yang digunakan di sini ialah whisper-tiny.en: varian Whisper yang paling kecil, terkuantisasi dan khusus bahasa Inggeris sahaja. Ia cukup pantas untuk berjalan dalam tab pelayar dan menghasilkan draf pertama yang berguna, tetapi ia bukan perkhidmatan transkripsi profesional. Jangkakan kesilapan pada nama khas, kosa kata teknikal, loghat yang kuat, bunyi latar belakang dan penutur yang bertindih.