AI 音声文字起こし

録音を正確で編集しやすいテキストに変換。

会議、インタビュー、ポッドキャスト、講義、動画をアップロードすると、CharaVox が言語と話者を識別し、文単位のタイムスタンプ付き文字起こしを作成します。

音声文字起こし音声 テキスト化AI 文字起こし動画 文字起こし字幕生成録音 テキスト

手作業の文字起こしは、修正のたびに同じ音声を再生するため時間がかかります。CharaVox は文単位の時刻と任意の話者ラベルを含む下書きを作り、各行の元音声をすぐ確認できます。

一般的な音声・動画形式とブラウザ録音に対応し、ページを更新しても進行中のジョブを復元できます。完成したテキストはコピーするか、SRT 字幕として書き出せます。

charavox.com/app/speech-to-text

アップロードや録音にはログインが必要です。このプレビューは音声を送信しません。

言語
自動検出
話者分離
文字起こしタイムライン00:00 — 00:08
00:00.4話者 1 ようこそ。この録音を編集可能な文字起こしに変換します。

機能

アップロードと録音

既存の音声・動画をドラッグするか端末から選択し、マイクから直接録音することもできます。

言語検出

Fun-ASR に言語を自動判定させるか、録音言語が分かる場合はヒントを指定できます。

話者分離

会議やインタビューで話者分離を有効にし、2〜100 人の想定人数を指定できます。

字幕書き出し

文字起こしをコピーし、文単位の時刻から TXT と SRT をダウンロードできます。

クリエイターが選ぶ理由

01

ページを閉じても長い文字起こしジョブを再開できます。

02

各文を元録音の正確な位置ですぐ確認できます。

03

複数話者の会話を手作業で行ごとに分類する必要がありません。

04

有効な発話時間だけを 1 秒 1 credit で課金します。

ユースケース

会議メモと通話記録
ポッドキャストとインタビュー
動画字幕とアクセシビリティ
講義や研究録音の整理
ユーザー調査の分析
サンプルプロンプト
会議録音をアップロードして話者を分離
ポッドキャストをテキストと SRT に変換
音声メモを録音して TXT で保存

よくある質問

MP3、WAV、M4A、MP4、WebM、OGG、FLAC、AAC、Opus、AMR などに対応します。ジョブ作成前に実際のファイルサイズとメディア時間を確認します。

はい。会議やインタビューでは話者分離を有効にでき、2〜100 人の想定人数も指定できます。文単位の区間に話者ラベルが保持されます。

処理前に元ファイルの長さで credits を予約し、完了時に Fun-ASR が返す有効発話時間を 1 秒 1 credit で精算します。差額は自動的に返却されます。

はい。完成したジョブは TXT または SubRip SRT でダウンロードでき、SRT は文単位のタイムラインを使用します。

文字起こしは削除または退会まで保持されます。元ファイルは Free で 7 日、Creator で 30 日、Pro で 90 日保存されます。

関連 AI ツール

制作を始める

アイデアを今すぐ音声に。

ジェネレーターを開けば、1 分以内にダウンロード可能なオーディオを出荷できます。楽器も DAW も設定も不要。