Slik fungerer Lydtranskribering · tale til tekst
Lydtranskribering gjør en opptak om til tekst ved hjelp av Whisper, en talegjenkjenningsmodell som kjører helt inne i nettleserfanen din via Transformers.js. Første gang du bruker den, laster nettleseren din ned modellen og WebAssembly-motoren den trenger fra dette nettstedet (til sammen rundt 68 MB), og lagrer dem i buffer; etter det skjer hver transkribering på enheten din uten noen server, og lyden forlater aldri maskinen din.
Modellen som brukes her, er whisper-tiny.en: den minste, kvantiserte Whisper-varianten som bare gjelder engelsk. Den er rask nok til å kjøre i en nettleserfane og gir et nyttig førsteutkast, men er ingen profesjonell transkriberingstjeneste. Forvent feil i egennavn, teknisk vokabular, sterke aksenter, bakgrunnsstøy og overlappende talere.