音声変換の基本
音声変換は -i(入力)と出力ファイル名さえあれば始められます。拡張子で出力形式が決まります。
ffmpeg -i input.wav output.mp3
これだけでWAV→MP3に変換できます。FFmpegが拡張子.mp3から自動でエンコーダを選びます。
ビットレートを指定する
MP3など非可逆圧縮では、品質=ビットレートを -b:a で指定します。
# 192kbps(音楽でよく使う品質)
ffmpeg -i input.wav -b:a 192k output.mp3
# 320kbps(高音質)
ffmpeg -i input.wav -b:a 320k output.mp3
サンプルレート・チャンネルを変える
# 44.1kHz・ステレオに統一
ffmpeg -i input.wav -ar 44100 -ac 2 output.mp3
# 16kHz・モノラル(音声認識向け)
ffmpeg -i input.wav -ar 16000 -ac 1 output.wav
-ar がサンプルレート、-ac がチャンネル数(1=モノラル, 2=ステレオ)です。
音声を一部だけ切り出す
# 開始10秒地点から30秒間を切り出し
ffmpeg -ss 00:00:10 -t 30 -i input.mp3 output.mp3ヒント
-ss を -i の前に置くと高速にシークできます。無劣化でコンテナだけ変える
再エンコードせずに包み(コンテナ)だけ変えたいときは -c copy を使います。
ffmpeg -i input.m4a -c copy output.mp4
形式ごとの使い分けはMP3 / WAV / M4A の違いを参照。