AI 음성 텍스트 변환

녹음 파일을 정확하고 편집 가능한 텍스트로 변환하세요.

회의, 인터뷰, 팟캐스트, 강의 또는 영상을 업로드하면 CharaVox가 언어와 화자를 감지하고 문장별 타임스탬프가 포함된 전사를 제공합니다.

음성 텍스트 변환오디오 전사AI 전사영상 자막 생성녹음 텍스트 변환자막 생성기

수동 전사는 수정할 때마다 같은 오디오를 반복 재생해야 해 시간이 오래 걸립니다. CharaVox는 문장별 시간과 선택적 화자 라벨이 포함된 구조화된 초안을 만들어 각 문장의 원본 구간을 바로 확인할 수 있습니다.

일반적인 오디오·비디오 형식과 브라우저 녹음을 지원하며 페이지를 새로 고쳐도 진행 중인 작업을 복구합니다. 완성된 텍스트를 복사하거나 SRT 자막으로 내려받을 수 있습니다.

charavox.com/app/speech-to-text

업로드와 녹음은 로그인 후 사용할 수 있으며, 이 미리보기는 오디오를 전송하지 않습니다.

언어
자동 감지
화자 분리
전사 타임라인00:00 — 00:08
00:00.4화자 1 환영합니다. 이 녹음을 편집 가능한 텍스트로 변환합니다.

기능

업로드 또는 녹음

기존 오디오·비디오를 끌어놓거나 기기에서 선택하고 마이크로 직접 녹음할 수 있습니다.

언어 감지

Fun-ASR가 언어를 자동으로 감지하거나 녹음 언어를 알고 있을 때 힌트를 지정할 수 있습니다.

화자 분리

회의와 인터뷰에서 화자 분리를 켜고 2명부터 100명까지 예상 화자 수를 지정할 수 있습니다.

자막 내보내기

전체 전사를 복사하거나 문장별 타임라인을 사용해 TXT와 SRT를 다운로드합니다.

크리에이터가 선택하는 이유

01

페이지를 닫거나 새로 고쳐도 긴 전사 작업을 다시 불러옵니다.

02

각 문장을 원본 녹음의 정확한 위치에서 검토할 수 있습니다.

03

다중 화자 대화를 문장마다 수동으로 표시할 필요가 없습니다.

04

실제 음성 길이만 초당 1 credit으로 결제합니다.

활용 사례

회의록과 통화 기록
팟캐스트와 인터뷰 전사
영상 자막과 접근성 콘텐츠
강의 및 연구 녹음 정리
사용자 조사 분석
샘플 프롬프트
회의 녹음을 업로드하고 화자 분리
팟캐스트를 텍스트와 SRT로 변환
음성 메모를 녹음해 TXT로 저장

자주 묻는 질문

MP3, WAV, M4A, MP4, WebM, OGG, FLAC, AAC, Opus, AMR 등을 지원합니다. 작업을 만들기 전에 실제 파일 크기와 미디어 길이를 확인합니다.

예. 회의나 인터뷰에서 화자 분리를 켜고 2명부터 100명까지 예상 인원을 입력할 수 있으며 문장별 구간에 화자 라벨이 유지됩니다.

처리 전에 원본 길이를 기준으로 credits를 예약하고 완료 후 Fun-ASR의 실제 음성 길이에 따라 초당 1 credit을 정산합니다. 남은 예약분은 자동 반환됩니다.

예. 완료된 작업은 TXT 또는 SubRip SRT로 다운로드할 수 있고 SRT는 문장별 타임라인을 사용합니다.

전사 텍스트는 삭제하거나 계정을 종료할 때까지 보관됩니다. 원본 파일은 Free 7일, Creator 30일, Pro 90일 동안 유지됩니다.

관련 AI 도구

제작 시작

지금 바로 아이디어를 오디오로.

생성기를 열면 1분 이내에 다운로드 가능한 오디오를 출하할 수 있습니다. 악기도 DAW도 설정도 필요 없습니다.