Zet video en audio om naar tekst

Sleep een opname erin en krijg een transcriptie die je echt kunt lezen: sprekers onderscheiden, elke regel doorzoekbaar en te corrigeren.

SayToType transcribeert audio- en videobestanden op je Windows-pc of je Mac. Lange opnames worden op natuurlijke pauzes gesplitst en stuk voor stuk getranscribeerd, zodat een interview van twee uur één bestand blijft en geen twaalf.

SayToType downloaden

Gratis om te beginnen, op Windows en macOS.

Van opname naar transcriptie

Vier stappen, allemaal in de desktop-app.

1

Voeg het bestand toe

Elk audio- of videobestand dat de app ondersteunt: een opgenomen vergadering, een college, een interview, een schermopname. Lange bestanden worden op natuurlijke pauzes gesplitst en stuk voor stuk getranscribeerd, met een voortgang die je ziet en op elk moment kunt afbreken.

2

Lees het als een gesprek

Sprekers worden automatisch onderscheiden en gelabeld, zodat een interview of vergadering leest als een dialoog en niet als een muur tekst. Hernoem een spreker overal in één keer, of geef één losse regel aan iemand anders waar de opname onduidelijk was.

3

Corrigeer wat ertoe doet

Speel de opname af terwijl de gesproken regel meeloopt en oplicht, en bewerk elke regel met de hand. Namen, jargon en half ingeslikte woorden zijn precies waar een transcriptie een mens nodig heeft.

4

Bewaren, zoeken, exporteren

Elke transcriptie blijft in de bibliotheek. Zoek in alles tegelijk als je je een zin herinnert maar niet welke opname het was, of binnen één lange. Kopieer de tekst, of exporteer hem als bestand.

Wat je terugkrijgt

Een transcriptie die het lezen waard is, niet zomaar een stapel woorden.

47 talen

De herkenning dekt dezelfde 47 talen als de rest van de app en leidt ze af uit de opname zelf. Een afgeronde transcriptie kun je daarna laten vertalen naar de taal die je kiest.

Sprekerslabels

Wie wat zei, automatisch uitgezocht en achteraf te bewerken. Dat is wat een ruwe opname verandert in iets waaruit je kunt citeren.

Tijdcodes overal

Elke regel is verankerd aan zijn moment in de opname, dus vanaf elke zin in de transcriptie spring je terug naar het geluid.

Zoeken over alles

Eén zoekveld over elke transcriptie die je ooit maakte, en een tweede binnen degene die je nu leest.

Vertaling ingebouwd

Een afgeronde transcriptie vertaal je in een tabblad naast het origineel, met tijdcodes en sprekersnamen die meegaan.

Je eigen API-sleutel

Naast SayToType Cloud kun je OpenAI, Mistral AI, Deepgram of elke OpenAI-compatibele provider koppelen. Een bestand dat via je eigen sleutel loopt, kost geen minuten van je abonnement — je betaalt die provider tegen zijn eigen tarieven.

Welke formaten erin gaan

Audio en video allebei: als het afspeelt, transcribeert het meestal ook.

Audio

  • MP3
  • WAV
  • M4A
  • AAC
  • FLAC
  • OGG
  • OPUS

Video

  • MP4
  • MOV
  • WEBM

…en meer. Een video wordt op zijn geluid gelezen, dus een schermopname transcribeert precies zoals een spraakmemo.

Wie ermee transcribeert

Dezelfde functie, vier verschillende redenen om hem te willen.

Journalistiek en onderzoek

Interviews komen terug als gelabeld gesprek met tijdcodes: iemand citeren wordt de regel zoeken in plaats van door de audio scrubben.

Studie en onderwijs

Een opgenomen college wordt een doorzoekbaar document. Zoek de tien minuten op die ertoe deden in plaats van negentig terug te luisteren.

Teams die vergaderingen opnemen

Een opgenomen vergadering wordt tekst die je kunt scannen, doorzoeken en in je notities plakken, met elke deelnemer op zijn eigen gelabelde regel.

Iedereen met een stapel opnames

Spraakmemo's, oude podcastafleveringen, schermopnames: alles wat al op de schijf staat wordt doorzoekbare tekst.

Vragen over bestandstranscriptie

Welke audio- en videoformaten kan SayToType transcriberen?

MP3, WAV, M4A, AAC, FLAC, OGG, OPUS, MP4, MOV, WEBM en meer. Audio en video werken allebei, en lange opnames worden op natuurlijke pauzes gesplitst en stuk voor stuk getranscribeerd.

Hoe lang mag een opname zijn?

Lange opnames worden op natuurlijke pauzes gesplitst en stuk voor stuk getranscribeerd, met een voortgang die je ziet en kunt afbreken. In de praktijk beperken de transcriptieminuten van je abonnement je, niet de lengte van één bestand.

Onderscheidt het sprekers?

Ja. Sprekers worden onderscheiden en gelabeld, zodat een interview of vergadering leest als een gesprek. Je kunt een spreker overal hernoemen, of één losse regel aan iemand anders geven.

Hoeveel talen herkent het?

47, dezelfde die de rest van de app gebruikt. De gesproken taal wordt uit de opname afgeleid, en een afgeronde transcriptie kun je daarna regel voor regel laten vertalen naar de taal die je kiest — tijdcodes en sprekersnamen blijven werken op de vertaling.

Wordt mijn opname ergens bewaard?

Niet bij ons. De opname wordt in realtime verwerkt en er blijft niets — geen geluid en geen tekst — op onze servers staan, ook niet op gratis abonnementen. De transcriptie die je terugkrijgt leeft alleen op je eigen apparaat, in de bibliotheek van de app.

Kan ik bestanden op mijn telefoon transcriberen?

Nog niet. Bestandstranscriptie draait in de desktop-app voor Windows en macOS. De apps voor iOS en Android doen alleen dictee en zijn in bèta.

Maak van je opnames tekst

SayToType draait op Windows en macOS en transcribeert de bestanden die je al hebt.

Gratis om te beginnen — elk account krijgt 50 minuten cloudtranscriptie per maand gratis, en je hebt geen kaart nodig om je aan te melden.