セクション その他
カテゴリ YMM4機能
概要 音声からテキストを自動生成する「文字起こし」機能についてまとめたページ
最終更新日 2026/08/08
更新元バージョン v4.55.1.0
ステータス 確認済み

<aside> ⚠️

この機能は実機で軽く確認できた範囲のみ記載しています。エンジンごとの詳細な設定項目については、今後実際の使用感を踏まえて追記予定です。

</aside>

音声ファイルの内容を自動でテキスト化する機能です。標準ではWhisperベースのエンジンが使われます。セリフの下書きを作る、既存の音声から字幕データを起こす、といった用途に使えます。

モード

文字起こしの動作モードを選択できます。文字起こしエンジンとして「Whisper(ローカル)」を利用します。言語・モデル(モデルサイズ)・発話区間検出(VAD)の閾値など、書き起こし精度に関わる項目を設定できます。

活用例

音声アイテムやボイスアイテムの音声を文字起こしすれば、テキストアイテム・ボイスアイテムのセリフ入力の下書きとして使えます。手打ちで全て入力するより、文字起こし結果を修正する方が早い場合があります。