소개
Transcriber는 어떤 영상 파일에서도 자막을 생성할 수 있는 오프라인 음성‑텍스트 변환 도구입니다. Whisper 기반 모델을 사용하며, 선택적으로 YouTube에 업로드하는 기능도 제공합니다.
상세정보
소개
Transcriber는 어떤 영상 파일에서도 자막을 생성할 수 있는 오프라인 음성‑텍스트 변환 도구입니다. Whisper 기반 모델을 사용하며, 선택적으로 YouTube에 업로드하는 기능도 제공합니다.
핵심 기능
- 영상·오디오 파일을 텍스트로 변환하여 자막 생성
- 오프라인에서 Whisper 모델을 사용한 음성 인식
- 선택적 YouTube 업로드 지원
- ffmpeg을 활용한 미디어 처리
- 광동어(Cantonese) 포함 다국어 지원 가능
지원 환경
Windows 운영 체제에서 winget 패키지 관리자를 통해 설치 및 실행할 수 있습니다.
기본 사용법
- Transcriber를 실행하고 변환할 영상 또는 오디오 파일을 불러옵니다.
- 필요에 따라 언어 모델(예: 광동어) 및 출력 형식을 설정합니다.
- 변환을 시작하면 오프라인에서 음성을 텍스트로 변환하여 자막 파일을 생성합니다.
- 생성된 자막은 SRT 형식 등으로 저장할 수 있으며, 원한다면 YouTube에 직접 업로드할 수 있습니다.
주의 사항 및 제한점
- ffmpeg이 설치되어 있어야 미디어 입출력이 정상적으로 작동합니다.
- 지원 언어는 사용 가능한 Whisper 모델에 따라 달라지며, 광동어는 태그에 명시되어 있습니다.
- YouTube 업로드 기능을 사용할 경우에만 인터넷 연결이 필요하며, 그 외에는完全 오프라인으로 동작합니다.
자주 묻는 질문(FAQ)
- Q: 인터넷 연결이 항상 필요한가요?
A: 핵심 변환 기능은 오프라인으로 작동하며, YouTube 업로드 시에만 인터넷이 필요합니다. - Q: 어떤 자막 파일을 내보낼 수 있나요?
A: SRT 형식 등을 지원하며, source 태그에 srt가 포함되어 있습니다. - Q: Whisper 모델은 어디서 가져오나요?
A: Transcriber 내부에 포함된 Whisper 모델을 사용하며, 별도 다운로드 과정이 필요하지 않습니다.
시스템 요구사항
제공된 증거에 시스템 요구 사항이 명시되어 있지 않습니다.


