動画から音声を抽出する方法
更新
動画から音声を取り出すのは、最もよくあるメディア作業の1つです。録画した講義やインタビューの音声を保存する、ミュージックビデオをスマートフォンで聴く曲にする、文字起こし用にクリアな音声を用意する、編集で使う効果音を手に入れる、といった用途があります。
技術的には、動画ファイルにはもともと、映像とは別のストリームとして音声が入っています。抽出とは、そのストリームを読み取って、音声のみのファイルに書き出すことです。実際に決めることは、どの形式で保存するかと、どの音質にするかだけです。
手順
最も手早いのは、出力形式が選択済みの変換ページを使う方法です。MP4の動画ならMP4をMP3に変換、MP4をWAVに変換、MP4をM4Aに変換があり、MOVをMP3に変換、MKVをMP3に変換、WebMをMP3に変換のページもあります。
- 動画の形式と、希望する音声形式に対応したページを開きます。
- 動画を追加します。動画はブラウザ内で読み込まれて処理されるため、アップロードされません。
- 別の言語や解説など、動画に複数の音声トラックがある場合は、使いたいものを選びます。
- ビットレートとサンプルレートを選ぶか、既定値(元のファイルに合わせた値)のままにします。
- 変換して、音声ファイルをダウンロードします。
どの音声形式を選ぶべきか
形式は、次に音声をどう使うかに合わせて選びましょう。当サイトの音声形式のガイドで、それぞれをさらに詳しく説明しています。
- MP3:共有や、古いデバイス、カーオーディオ、シンプルなプレーヤー向けの最も無難な選択肢です。
- M4A(AAC):ほとんどのスマートフォン動画がすでに音声に使っている形式で、Apple製品や音楽ライブラリに適しています。
- WAV:非圧縮。AudacityのようなソフトやDAWで音声を編集する場合や、文字起こしソフトに読み込ませる場合に最適です。ファイルは大きくなります。
- FLAC:ロスレスかつ圧縮。コンサートの録音のアーカイブや、あとで再エンコードする可能性のあるものに適しています。
- OpusまたはOGG:話し声の圧縮効率が非常に高く、サイズが重要な音声メッセージやWebでの利用に適しています。
期待できる音質
動画の音声は、ほぼ必ずすでに圧縮されています。通常は96〜320 kbps程度のAACです。変換しても、その元の音声より良くなることはありません。WAVやFLACを選べば圧縮による劣化がそれ以上加わらないため、編集には適していますが、元のエンコーダーが捨てたディテールが戻るわけではありません。1点補足すると、当サイトの変換ツールはWAVを16ビットのPCMで書き出すため、まれにある24ビットのサウンドトラック(非圧縮の音声を保存するカメラや画面録画ツールのもの)は16ビットに下げられます。通常のAACのサウンドトラックなら、聞いてわかる違いはありません。
MP3などの別の非可逆圧縮形式に変換すると、非可逆圧縮が2回目に行われることになります。元と同程度かそれ以上のビットレートなら違いを聞き分けるのは非常に困難ですが、はるかに低いビットレートにすると聞いてわかるようになります。当サイトの変換ツールは、元のストリームをコピーするのではなく、選んだ形式に音声を再エンコードするため、音楽ならビットレートを元の100%のままにするのが最も安全な設定です。話し声なら、ビットレートを下げても通常は問題なく聞こえ、容量も節約できます。
音声変換ツールを直接使う
逆に音声を削除する
うまく抽出するためのヒント
いくつかの細かな点が、使える音声になるか、がっかりする結果になるかを分けます。
- 先にトリミングする:長い動画のうち数分だけが必要なら、抽出する前に動画カットツールでその部分を切り出すか、あとで音声をトリミングしましょう。
- サンプルレートはそのままに:既定値は元のファイルに合わせた値で、通常は44.1 kHzか48 kHzです。変更してもほとんど効果はありません。
- 複数のトラックを確認する:映画や画面録画には、マイクとシステム音声が別々のトラックで入っていることがあります。変換する前に正しいほうを選びましょう。
- 著作権を尊重する:個人的な利用のために音声を抽出するのは一般的ですが、他人の音楽や録音を再配布するには許可が必要な場合があります。
このガイドで使うツール
よくある質問
01
02
03