Cómo funciona Transcripción de audio · voz a texto
Transcripción de Audio convierte una grabación en texto usando Whisper, un modelo de reconocimiento de voz que se ejecuta enteramente en la pestaña de tu navegador mediante Transformers.js. La primera vez que lo uses, tu navegador descarga desde este sitio el modelo y el motor WebAssembly que necesita (unos 68 MB en total) y los guarda en caché; a partir de ahí, cada transcripción ocurre en tu dispositivo sin ningún servidor y sin que el audio salga nunca de tu máquina.
El modelo utilizado es whisper-tiny.en: la variante más pequeña de Whisper, cuantizada y limitada al inglés. Es lo bastante rápida para funcionar en una pestaña del navegador y produce un primer borrador útil, pero no es un servicio de transcripción profesional. Espera errores en nombres propios, vocabulario técnico, acentos marcados, ruido de fondo y voces superpuestas.