Geen upload, 100% lokaal, geen account

Audio transcriberen, spraak naar tekst in je browser

Zet een opname neer en krijg een tekstschrift. Draait op je apparaat met een klein Whisper-model dat één keer van deze site wordt gedownload; je audio wordt nooit geüpload.

Hoe Audio transcriberen · spraak naar tekst werkt

Audiotranscriptie zet een opname om in tekst met Whisper, een spraakherkenningsmodel dat volledig in je browsertab draait via Transformers.js. De eerste keer dat je de tool gebruikt, downloadt je browser het model en de benodigde WebAssembly-engine (in totaal ongeveer 68 MB) van deze site en slaat ze op in de cache; elke transcriptie daarna gebeurt op je eigen toestel, zonder server en zonder dat er ooit audio je apparaat verlaat. Dat is dezelfde afweging als bij de OCR- en audiotools op deze site: een echte eenmalige download voor echte offline verwerking, geen marketingclaim.

Het hier gebruikte model is whisper-tiny.en: de kleinste, gekwantiseerde, alleen-Engelse Whisper-variant. Het is snel genoeg om in een browsertab te draaien en levert een bruikbare eerste versie op, maar het is geen professionele transcriptiedienst. Verwacht fouten bij eigennamen, vaktermen, sterke accenten, achtergrondgeluid en sprekers die door elkaar heen praten. Opnames van meer dan ongeveer 30 seconden worden in overlappende stukken verwerkt zodat het hele bestand wordt getranscribeerd, maar een gesprek van een uur kost nog altijd echte rekentijd, omdat alles op je eigen toestel draait in plaats van in een datacenter.

Hoe je Audio transcriberen · spraak naar tekst gebruikt, stap voor stap

  1. Sleep een audiobestand (MP3, WAV, M4A, OGG of de WebM-opnames van de Voice Recorder van deze site) naar binnen.
  2. Wacht op de eenmalige download van engine en model (ongeveer 68 MB) als dit je eerste transcriptie op dit toestel is.
  3. Kies platte tekst (.txt) of ondertitels met tijdstempels (.srt) als uitvoerformaat.
  4. Klik op transcriberen en laat Whisper de opname volledig in je browsertab verwerken.
  5. Kopieer de tekst rechtstreeks of download het .txt/.srt-bestand zodra het klaar is.

Veelvoorkomende toepassingen

  • Een ruwe schriftelijke versie krijgen van een spraakmemo die op je telefoon is opgenomen, voordat je die met de hand bijwerkt.
  • Een kort opgenomen interview omzetten in doorzoekbare tekst zonder het naar een cloudtranscriptiedienst te uploaden.
  • Een eerste .srt-ondertitelbestand genereren voor een korte clip, dat je achteraf corrigeert.
  • Snel een spraaknotitie opnemen met de Voice Recorder van deze site en die daarna in dezelfde browsertab transcriberen.
  • Een eerste transcript krijgen van een college- of vergaderopname wanneer perfecte nauwkeurigheid niet vereist is.

Veelgestelde vragen

Hoe nauwkeurig is de transcriptie?

Dat hangt sterk af van de audiokwaliteit. Helder Engels van één spreker, dicht bij de microfoon opgenomen met weinig achtergrondgeluid, wordt redelijk goed getranscribeerd. Accenten, door elkaar pratende sprekers, achtergrondmuziek of -geluid, en specifiek vocabulaire (namen, vaktermen, afkortingen) verhogen allemaal het aantal fouten. Dit is een klein, gekwantiseerd model, gekozen zodat het in een browsertab kan draaien, niet het grootste Whisper-model, dus behandel de uitvoer als een bruikbare versie om te controleren en corrigeren, niet als een definitief transcript.

Werkt het ook met andere talen dan Engels?

Nee. Deze tool gebruikt whisper-tiny.en, de alleen-Engelse Whisper-variant, gekozen omdat die kleiner en nauwkeuriger is voor Engels dan het meertalige tiny-model. Audio in andere talen levert slechte of onzinnige resultaten op. Ondersteuning voor andere talen is momenteel niet beschikbaar.

Waarom moet er eerst iets worden gedownload voordat het werkt?

Het spraakherkenningsmodel en de WebAssembly-engine die het uitvoert (samen ongeveer 68 MB) zitten niet standaard in de pagina; ze worden eenmalig van deze site opgehaald en door je browser in de cache opgeslagen, vergelijkbaar met hoe de OCR-tool een taalmodel downloadt. Na die eerste download verloopt transcriptie volledig offline. Er wordt niets opgehaald bij een externe CDN.

Wordt mijn audio ergens naartoe geüpload?

Nee. De opname wordt volledig in je browsertab gedecodeerd en verwerkt met de Web Audio API en een lokaal Whisper-model. Er wordt nooit een audiobestand of getranscribeerde tekst naar een server verzonden. Je kunt de netwerkverbinding verbreken nadat het model is gedownload, en transcriptie blijft dan gewoon werken.

Hoe lang duurt transcriptie?

Dat hangt af van de processor van je toestel en de lengte van de opname, omdat alles lokaal draait en niet op serverhardware. Korte clips (onder een minuut) zijn meestal binnen enkele seconden tot minder dan een minuut klaar. Lange opnames, zoals een interview van een uur, duren verhoudingsgewijs langer en houden je browsertab die hele tijd bezig; laat de tab open staan en navigeer niet weg terwijl de tool bezig is.

Wat is het verschil tussen de .txt- en .srt-uitvoer?

Het .txt-bestand bevat de platte getranscribeerde tekst zonder tijdstempels, handig om te lezen of elders te plakken. Het .srt-bestand is een standaard ondertitelformaat met een tijdstempelbereik voor elk gesproken segment, handig om ondertiteling aan een video toe te voegen. Beide worden uit dezelfde transcriptie gegenereerd; kies wat het beste past bij wat je vervolgens nodig hebt.