| セクション | その他 |
|---|---|
| カテゴリ | YMM4機能 |
| 概要 | 音声からテキストを自動生成する「文字起こし」機能についてまとめたページ |
| 最終更新日 | 2026/08/08 |
| 更新元バージョン | v4.55.1.0 |
| ステータス | 確認済み |
<aside> ⚠️
この機能は実機で軽く確認できた範囲のみ記載しています。エンジンごとの詳細な設定項目については、今後実際の使用感を踏まえて追記予定です。
</aside>
音声ファイルの内容を自動でテキスト化する機能です。標準ではWhisperベースのエンジンが使われます。セリフの下書きを作る、既存の音声から字幕データを起こす、といった用途に使えます。
文字起こしの動作モードを選択できます。文字起こしエンジンとして「Whisper(ローカル)」を利用します。言語・モデル(モデルサイズ)・発話区間検出(VAD)の閾値など、書き起こし精度に関わる項目を設定できます。
音声アイテムやボイスアイテムの音声を文字起こしすれば、テキストアイテム・ボイスアイテムのセリフ入力の下書きとして使えます。手打ちで全て入力するより、文字起こし結果を修正する方が早い場合があります。