長いファイルの場合、ウェブ変換ツールは完全に避けるべきです。サイズ制限と広告はそこにあります。本当に無料な方法は2つあります:
1. FFmpeg(無料、制限なし、最高品質)。 1行で済み、既存の音声ストリームを再エンコードするのではなくコピーするため、瞬時に完了します:
ffmpeg -i input.mp4 -vn -acodec copy output.m4a
これにより、元の音声がそのまま保持されます(通常は.m4aのAAC形式)。特にMP3が必要な場合:
ffmpeg -i input.mp4 -vn -q:a 2 output.mp3
-q:a 2 は高品質可変ビットレート。スピーチと音楽の両方に最適なデフォルトです。1時間のファイルは数秒から1分で完了します。
2. コマンドラインが得意でない場合のGUIオプション:
- VLC(無料):メディア → 変換/保存 → 音声プロファイルを選択します。動作しますが、インターフェースは悪名高く複雑です。初回はスクリーンショットガイドに従いましょう。
- Audacity(無料):ビデオの音声をインポートして、MP3/WAVでエクスポートします。編集もしたい場合(無音をカット、静かなスピーカーを増幅、ノイズを除去)に最適です。
- Handbrake はビデオ用です。音声のみのファイルを生成しないため、ここではスキップしてください。
フォーマットの選択方法: 音声が文字起こしツールに入る場合、MP3に変換しないでください — 元のストリームをコピー(-acodec copy)するか、WAVでエクスポートしてください。ロスレス再エンコードはわずかに認識器が聞く内容を低下させます。(Whisperを使った無料文字起こしについて別スレッドがあります:https://nattzy.com/t/free-way-to-transcribe-recorded-audio-to-text-interviews-meetings/575 )
静かなインタビュー録音の場合: リスニング前にAudacityの正規化またはFFmpegのloudnormフィルターで1パス実行してください。スマートフォンのビデオ音声は通常、あるべき値より10~15 dB静かく、これは「録音が聞きにくい」という背後にある実際の不満であることがほとんどです。
ファイルはどのくらいの長さですか?また、人間または文字起こしツールに入りますか?それが理想的なフォーマットを決めます。