Como o Transcrever áudio · fala para texto funciona
Transcrição de Áudio transforma uma gravação em texto usando o Whisper, um modelo de reconhecimento de voz que roda inteiramente na aba do seu navegador via Transformers.js. Na primeira vez que você usar, o navegador baixa deste site o modelo e o mecanismo WebAssembly necessário (cerca de 68 MB no total) e os armazena em cache; depois disso, cada transcrição acontece no seu dispositivo, sem nenhum servidor envolvido e sem que o áudio saia da sua máquina.
O modelo usado aqui é o whisper-tiny.en: a variante menor do Whisper, quantizada e limitada ao inglês. Ele é rápido o suficiente para rodar numa aba do navegador e produz um primeiro rascunho útil, mas não é um serviço de transcrição profissional. Espere erros em nomes próprios, vocabulário técnico, sotaques fortes, ruído de fundo e vozes sobrepostas.