Lyd/video → tekst og undertekster gratis: transkripsjon i
Du kan nå transkribere lyd eller video til tekst gratis direkte i nettleseren din: i seksjonen "Video" et verktøy dukket opp "Lyd/video → tekst + undertekster (gratis)". Den gjenkjenner tale, viser den i tekst med tidsstempler, og gir ferdige undertekster – og avskriver ikke tokens.

Hvorfor er det gratis
Vanligvis gjøres dekryptering på serveren til en betalt tjeneste: filen lastes ned, minuttene telles, og de betaler for hvert minutt. Her lastes talegjenkjenningsmodellen inn i nettleseren og kjøres på datamaskinen din. Serveren gir bare koden til verktøyet og vekten til modellen: den har ingenting å telle, så tokens blir ikke avskrevet, og antallet dekrypteringer er ikke begrenset.
Derav personvernet: opptaket forlater ikke datamaskinen din. Dette er viktig hvis du transkriberer intervjuer, arbeidssamtaler, forelesninger eller personlige notater.
Hvordan transkribere lyd eller video: trinn for trinn
- Åpne "Video"-delen og velg fra listen over modeller "Lyd/video → tekst + undertekster (gratis)" — Verktøyet er plassert nederst, ved siden av andre gratisverktøy.
- Last opp en fil: klikk på valgfeltet eller dra og slipp lyd eller video direkte inn i den.
- Velg talespråket ditt – eller la det stå ved «Oppdag automatisk». Som standard er språket for nettstedets grensesnitt angitt, men du kan alltid endre det manuelt.
- Klikk "Gjenkjenn tale" og vent til den er klar. Den første lanseringen tar lengre tid: nettleseren laster ned modellen én gang og lagrer den i hurtigbufferen.
- Sjekk teksten, deaktiver tidsstempler om nødvendig, og kopier resultatet.
- Last ned undertekster i ønsket format - TXT, SRT, VTT eller JSON. For en video kan du umiddelbart sette sammen en video med innebrente undertekster.
Hvilke filer passer?
Lyd: MP3, WAV, M4A, AAC, OGG, OPUS, FLAC og andre vanlige formater. Videoer: MP4, MOV, M4V, MKV, AVI, OGV, WebM. Lyden fra videoen trekkes ut direkte i nettleseren; det er ikke nødvendig å konvertere filen separat.
Hva vil du få
- Taletekst — utskrift med tidsstempler, som kan deaktiveres og få klartekst.
- Kopiere — all gjenkjent tekst med én knapp til utklippstavlen.
- TXT — enkel tekst for notater og dokumenter.
- SRT - undertekster for de fleste spillere og videoredigerere.
- VTT — undertekster for web- og HTML-spillere.
- JSON — merkede stykker med timing for manusene deres.
Video med brente undertekster
Hvis du laster opp en video, kan verktøyet brenne undertekster direkte inn i rammene: en slik video spilles av hvor som helst, selv der undertekster ikke støttes. Lyden fra kilden beholdes. Brenning skjer på enheten din, filen sendes ikke noe sted.
Alt teller på enheten din
Tale gjenkjenner modellen Whisper til Transformers.js: først prøver den WebGPU (skjermkort), og hvis det ikke er noen adapter, bytter den ærlig til WASM og stoler på prosessoren. Det er ingen betalte API her, tokens blir ikke avskrevet, og opptaket går ikke til serveren. Lange poster tar lengre tid å behandle - alt beregnes på datamaskinen din.
Hva verktøyet ikke gjør
Ærlig talt om grensene: dette er talegjenkjenning, ikke oversettelse. Verktøyet oversetter ikke tekst til et annet språk eller utfører dubbing. Kvaliteten avhenger av opptaket: med tydelig tale uten mye støy og musikk blir resultatet merkbart bedre. Videoer med brente undertekster krever en moderne nettleser - dette trinnet krever Chrome eller Edge.
Hvem vil finne det nyttig?
Verktøyet er nyttig for alle som jobber med opptak: journalister og podcastere - utskrifter av intervjuer, studenter - forelesningsnotater, redaktører - undertekster til videoer, samt de som fører møtereferat. Hvis du trenger noe annet etter avtale, i seksjonen "Video" Det er det fjerning av bakgrunn, oppskalere Og dybdekart — de regner også direkte i nettleseren.
Ofte stilte spørsmål
Er det virkelig gratis? Ja. Tokens for dette verktøyet debiteres ikke, det har ikke en betalt API - datamaskinen din beregner det.
Går filen til serveren? Nei. Opptaket og resultatet forblir på enheten din; Bare verktøykoden og modellvektene kommer fra serveren.
Hvor mange språk støttes? Whisper gjenkjenner 99 språk. Du kan velge språk manuelt eller stole på automatisk gjenkjenning.
Er det mulig å få undertekster som en fil? Ja. TXT, SRT, VTT og JSON lastes ned ved hjelp av separate knapper.
Oversetter verktøyet tale? Nei. Den gjenkjenner tale på det valgte språket, men oversetter den ikke til et annet.
Hvorfor tar den første lanseringen lengre tid? Nettleseren laster ned gjenkjenningsmodellen én gang og lagrer den i hurtigbufferen – de neste lanseringene starter umiddelbart.