← Все статьи

Lyd/video → tekst og undertekster gratis: transskription i

Lyst studie: bærbar computer med åbent transskriptionsvindue, ved siden af ​​en lydbølge og pæne linjer med undertekster, bløde lyse højdepunkter

Du kan nu transskribere lyd eller video til tekst gratis direkte i din browser: i sektionen "Video" et værktøj dukkede op "Lyd/video → tekst + undertekster (gratis)". Den genkender tale, viser den i tekst med tidsstempler og leverer færdige undertekster – og afskriver ikke tokens.

Videosektion: Lyd/video til tekst + undertekster (gratis) værktøjet med en indlæst video, den genkendte tekst med tidsstempler og knapperne til download af undertekster

Hvorfor er det gratis

Normalt sker dekryptering på serveren til en betalt tjeneste: filen downloades, minutterne tælles, og de betaler for hvert minut. Her indlæses talegenkendelsesmodellen i browseren og kører på din computer. Serveren giver kun værktøjets kode og vægten af ​​modellen: den har intet at tælle, så tokens afskrives ikke, og antallet af dekrypteringer er ikke begrænset.

Derfor privatlivets fred: optagelsen forlader ikke din computer. Dette er vigtigt, hvis du transskriberer interviews, arbejdsopkald, foredrag eller personlige notater.

Sådan transskriberes lyd eller video: trin for trin

  1. Åben "Video" sektion og vælg fra listen over modeller "Lyd/video → tekst + undertekster (gratis)" — værktøjet er placeret i bunden ved siden af ​​andre gratis værktøjer.
  2. Upload en fil: Klik på valgfeltet eller træk og slip lyd eller video direkte ind i den.
  3. Vælg dit talesprog - eller lad det stå ved "Opdag automatisk". Som standard er webstedsgrænsefladesproget indstillet, men du kan altid ændre det manuelt.
  4. Klik på "Genkend tale", og vent, indtil den er klar. Den første lancering tager længere tid: Browseren downloader modellen én gang og gemmer den i cachen.
  5. Tjek teksten, deaktiver om nødvendigt tidsstempler, og kopier resultatet.
  6. Download undertekster i det ønskede format - TXT, SRT, VTT eller JSON. Til en video kan du med det samme samle en video med indbrændte undertekster.

Hvilke filer er egnede?

Lyd: MP3, WAV, M4A, AAC, OGG, OPUS, FLAC og andre almindelige formater. Videoer: MP4, MOV, M4V, MKV, AVI, OGV, WebM. Lyden fra videoen udtrækkes direkte i browseren; der er ingen grund til at konvertere filen separat.

Hvad får du

  • Taletekst — udskrift med tidsstempler, som kan deaktiveres og få klar tekst.
  • Kopi — al genkendt tekst med én knap til udklipsholderen.
  • TXT — enkel tekst til noter og dokumenter.
  • SRT — undertekster til de fleste afspillere og videoredigerere.
  • VTT — undertekster til web- og HTML-afspillere.
  • JSON — markerede stykker med timing for deres manuskripter.

Video med brændte undertekster

Hvis du uploader en video, kan værktøjet brænde undertekster direkte ind i frames: sådan en video afspilles hvor som helst, selv hvor undertekster ikke understøttes. Lyden fra kilden bibeholdes. Brændingen foregår på din enhed, filen sendes ikke nogen steder.

Alt tæller på din enhed

Tale genkender modellen Whisper til Transformers.js: først prøver den WebGPU (skærmkort), og hvis der ikke er nogen adapter, skifter den ærligt til WASM og regner med processoren. Der er ingen betalte API her, tokens afskrives ikke, og optagelsen går ikke til serveren. Lange optegnelser tager længere tid at behandle - alt beregnes på din computer.

Hvad værktøjet ikke gør

Helt ærligt om grænserne: dette er talegenkendelse, ikke oversættelse. Værktøjet oversætter ikke tekst til et andet sprog eller laver eftersynkronisering. Kvaliteten afhænger af optagelsen: med klar tale uden meget støj og musik er resultatet mærkbart bedre. Videoer med brændte undertekster kræver en moderne browser - dette trin kræver Chrome eller Edge.

Hvem vil finde det nyttigt?

Værktøjet er nyttigt for alle, der arbejder med optagelser: journalister og podcastere - transskriptioner af interviews, studerende - forelæsningsnotater, redaktører - undertekster til videoer, samt dem, der fører referater af møder. Hvis du har brug for andet efter aftale, i afsnittet "Video" Der er fjernelse af baggrund, fornemme Og dybde kort — de beregner også direkte i browseren.

Ofte stillede spørgsmål

Er det virkelig gratis? Ja. Tokens for dette værktøj debiteres ikke, det har ikke en betalt API - din computer beregner det.

Går filen til serveren? Nej. Optagelsen og resultatet forbliver på din enhed; Kun værktøjskoden og modelvægtene kommer fra serveren.

Hvor mange sprog understøttes? Whisper genkender 99 sprog. Du kan vælge sproget manuelt eller stole på automatisk registrering.

Er det muligt at få undertekster som en fil? Ja. TXT, SRT, VTT og JSON downloades ved hjælp af separate knapper.

Oversætter værktøjet tale? Nej. Den genkender tale på det valgte sprog, men oversætter den ikke til et andet.

Hvorfor tager den første lancering længere tid? Browseren downloader genkendelsesmodellen én gang og gemmer den i cachen – de næste lanceringer starter med det samme.