Come funziona Trascrizione audio · da voce a testo
Trascrizione Audio trasforma una registrazione in testo usando Whisper, un modello di riconoscimento vocale che funziona interamente nella scheda del tuo browser tramite Transformers.js. La prima volta che lo usi, il browser scarica da questo sito il modello e il motore WebAssembly necessario (circa 68 MB in totale) e li mette in cache; da quel momento ogni trascrizione avviene sul tuo dispositivo, senza alcun server e senza che l'audio lasci mai la tua macchina.
Il modello usato qui è whisper-tiny.en: la variante più piccola di Whisper, quantizzata e limitata all'inglese. È abbastanza veloce da funzionare in una scheda del browser e produce una prima bozza utile, ma non è un servizio di trascrizione professionale. Aspettati errori su nomi propri, vocabolario tecnico, accenti marcati, rumore di fondo e voci sovrapposte.