← 모든 글

오디오/비디오 → 무료 텍스트 및 자막: 브라우저에서 전사

밝은 스튜디오: 오디오 웨이브와 깔끔한 자막 라인, 부드럽고 밝은 하이라이트 옆에 열려 있는 전사 창이 있는 노트북

이제 브라우저에서 직접 무료로 오디오나 비디오를 텍스트로 변환할 수 있습니다: 섹션 "동영상" 도구가 나타났다 “오디오/비디오 → 텍스트 + 자막(무료)”. 음성을 인식하고 이를 타임스탬프와 함께 텍스트로 표시하며 미리 만들어진 자막을 제공하며 토큰을 기록하지 않습니다.

비디오 섹션: 로드된 비디오, 타임스탬프가 있는 인식된 텍스트 및 자막 다운로드 버튼이 포함된 오디오/비디오를 텍스트 + 자막으로(무료) 도구

왜 무료인가요?

일반적으로 암호 해독은 유료 서비스 서버에서 수행됩니다. 파일이 다운로드되고 시간이 계산되며 분당 비용이 지불됩니다. 여기에서 음성 인식 모델이 브라우저에 로드되어 컴퓨터에서 실행됩니다. 서버는 도구의 코드와 모델의 가중치만 제공합니다. 계산할 항목이 없으므로 토큰이 기록되지 않으며 암호 해독 횟수가 제한되지 않습니다.

따라서 개인 정보 보호: 녹음 내용이 컴퓨터 외부로 유출되지 않습니다. 이는 인터뷰, 업무 통화, 강의 또는 개인 메모를 기록하는 경우 중요합니다.

오디오 또는 비디오를 텍스트로 변환하는 방법: 단계별

  1. 열려 있는 '동영상' 섹션 모델 목록에서 선택하세요. “오디오/비디오 → 텍스트 + 자막(무료)” — 도구는 하단의 다른 무료 도구 옆에 있습니다.
  2. 파일 업로드: 선택 필드를 클릭하거나 오디오 또는 비디오를 직접 끌어다 놓습니다.
  3. 음성 언어를 선택하거나 "자동 감지"로 두십시오. 기본적으로 사이트 인터페이스 언어는 설정되어 있지만 언제든지 수동으로 변경할 수 있습니다.
  4. “음성 인식”을 클릭하고 준비가 될 때까지 기다리세요. 첫 번째 실행에는 시간이 더 오래 걸립니다. 브라우저는 모델을 한 번 다운로드하고 캐시에 저장합니다.
  5. 텍스트를 확인하고 필요한 경우 타임스탬프를 비활성화한 후 결과를 복사하세요.
  6. TXT, SRT, VTT 또는 JSON 등 원하는 형식으로 자막을 다운로드하세요. 비디오의 경우, 번인된 자막이 포함된 비디오를 즉시 조합할 수 있습니다.

어떤 파일이 적합합니까?

오디오: MP3, WAV, M4A, AAC, OGG, OPUS, FLAC 및 기타 일반적인 형식. 동영상: MP4, MOV, M4V, MKV, AVI, OGV, WebM. 비디오의 사운드는 브라우저에서 직접 추출됩니다. 파일을 별도로 변환할 필요가 없습니다.

당신은 무엇을 얻을 것인가

  • 음성 텍스트 — 비활성화하고 일반 텍스트를 얻을 수 있는 타임스탬프가 있는 기록입니다.
  • 복사 — 클립보드에 대한 하나의 버튼으로 인식된 모든 텍스트.
  • TXT — 메모 및 문서에 대한 간단한 텍스트입니다.
  • SRT — 대부분의 플레이어 및 비디오 편집자를 위한 자막.
  • VTT — 웹 및 HTML 플레이어용 자막.
  • JSON — 스크립트 타이밍이 표시된 부분.

자막이 탄 영상

비디오를 업로드하면 도구가 자막을 프레임에 직접 구울 수 있습니다. 이러한 비디오는 자막이 지원되지 않는 곳이라도 어디에서나 재생됩니다. 소스의 사운드가 유지됩니다. 굽기는 장치에서 이루어지며 파일은 어디로도 전송되지 않습니다.

모든 것이 기기에 중요합니다

음성은 Whisper ~ Transformers.js 모델을 인식합니다. 먼저 WebGPU(비디오 카드)를 시도하고 어댑터가 없으면 정직하게 WASM로 전환하고 프로세서에 의존합니다. 여기에는 유료 API가 없으며 토큰이 상각되지 않으며 녹음 내용이 서버로 이동하지 않습니다. 긴 기록은 처리하는 데 시간이 더 오래 걸립니다. 모든 것이 컴퓨터에서 계산됩니다.

도구가 수행하지 않는 작업

솔직히 말해서 이것은 번역이 아니라 음성 인식입니다. 이 도구는 텍스트를 다른 언어로 번역하거나 더빙을 수행하지 않습니다. 품질은 녹음에 따라 달라집니다. 소음과 음악이 많지 않고 선명한 음성을 사용하면 결과가 눈에 띄게 좋아집니다. 자막이 구운 동영상을 보려면 최신 브라우저가 필요합니다. 이 단계에서는 Chrome 또는 Edge가 필요합니다.

누가 그것이 유용하다고 생각할까요?

이 도구는 녹음 작업을 하는 모든 사람에게 유용합니다. 저널리스트 및 팟캐스터 - 인터뷰 녹취록, 학생 - 강의 노트, 편집자 - 비디오 자막, 회의록을 작성하는 사람. 예약을 통해 추가로 필요한 사항이 있는 경우 해당 섹션에서 "동영상" 있다 배경 제거, 고급 그리고 깊이 지도 — 또한 브라우저에서 직접 계산합니다.

자주 묻는 질문

정말 무료인가요? 예. 이 도구의 토큰은 인출되지 않으며 유료 API도 없습니다. 컴퓨터가 이를 계산합니다.

파일이 서버로 이동합니까? 아니요. 녹음 내용과 결과는 귀하의 장치에 남아 있습니다. 도구 코드와 모델 가중치만 서버에서 가져옵니다.

얼마나 많은 언어가 지원되나요? Whisper는 99개 언어를 인식합니다. 언어를 수동으로 선택하거나 자동 감지를 신뢰할 수 있습니다.

자막을 파일로 받을 수 있나요? 예. TXT, SRT, VTT 및 JSON는 별도의 버튼을 사용하여 다운로드됩니다.

도구가 음성을 번역하나요? 아니요. 선택한 언어의 음성을 인식하지만 다른 언어로 번역하지는 않습니다.

첫 번째 출시에 더 오랜 시간이 걸리는 이유는 무엇입니까? 브라우저는 인식 모델을 한 번 다운로드하여 캐시에 저장합니다. 다음 실행은 즉시 시작됩니다.