録音を正確で編集しやすいテキストに変換。
会議、インタビュー、ポッドキャスト、講義、動画をアップロードすると、CharaVox が言語と話者を識別し、文単位のタイムスタンプ付き文字起こしを作成します。
手作業の文字起こしは、修正のたびに同じ音声を再生するため時間がかかります。CharaVox は文単位の時刻と任意の話者ラベルを含む下書きを作り、各行の元音声をすぐ確認できます。
一般的な音声・動画形式とブラウザ録音に対応し、ページを更新しても進行中のジョブを復元できます。完成したテキストはコピーするか、SRT 字幕として書き出せます。
アップロードや録音にはログインが必要です。このプレビューは音声を送信しません。
機能
アップロードと録音
既存の音声・動画をドラッグするか端末から選択し、マイクから直接録音することもできます。
言語検出
Fun-ASR に言語を自動判定させるか、録音言語が分かる場合はヒントを指定できます。
話者分離
会議やインタビューで話者分離を有効にし、2〜100 人の想定人数を指定できます。
字幕書き出し
文字起こしをコピーし、文単位の時刻から TXT と SRT をダウンロードできます。
クリエイターが選ぶ理由
ページを閉じても長い文字起こしジョブを再開できます。
各文を元録音の正確な位置ですぐ確認できます。
複数話者の会話を手作業で行ごとに分類する必要がありません。
有効な発話時間だけを 1 秒 1 credit で課金します。
ユースケース
よくある質問
MP3、WAV、M4A、MP4、WebM、OGG、FLAC、AAC、Opus、AMR などに対応します。ジョブ作成前に実際のファイルサイズとメディア時間を確認します。
はい。会議やインタビューでは話者分離を有効にでき、2〜100 人の想定人数も指定できます。文単位の区間に話者ラベルが保持されます。
処理前に元ファイルの長さで credits を予約し、完了時に Fun-ASR が返す有効発話時間を 1 秒 1 credit で精算します。差額は自動的に返却されます。
はい。完成したジョブは TXT または SubRip SRT でダウンロードでき、SRT は文単位のタイムラインを使用します。
文字起こしは削除または退会まで保持されます。元ファイルは Free で 7 日、Creator で 30 日、Pro で 90 日保存されます。
関連 AI ツール
AIボイスチェンジャー
音声をアップロードまたは録音し、Fun-ASRで文字起こしして、別のAI音声による非公開WAVを生成します。
見るAI 音声生成器
50以上の言語、27,000以上のコミュニティボイスで、あらゆる原稿を自然な AI 音声に。ボイスを選んでテキストを貼り付け、数秒でスタジオ品質のナレーションをダウンロード。
見るAI ストーリーテラー
任何の台本をマルチボイスのオーディオストーリーに。各キャラクターに声を割り当て、ナレーターを追加し、数分で完成したボイスドラマを書き出し。スタジオもキャスティングも編集も不要。
見るボイスクローニング
30 秒の音声サンプルをアップロードして、カスタム AI ボイスモデルを作成。6 言語での音声合成、ライセンス安全な透かし、商用利用ライセンス付き。
見るアイデアを今すぐ音声に。
ジェネレーターを開けば、1 分以内にダウンロード可能なオーディオを出荷できます。楽器も DAW も設定も不要。