PCM→DSD 完全ガイド:原理・パラメータ選択・実践

PCM から DSD へは、単なるフォーマット変換ではありません——リサンプリング + ノイズシェイピング + 変調という一連の処理パイプラインです。本ガイドでは各ステップを実測データで解説し、すぐに使える DpdoEngine 設定を紹介します。


1. DSD とは何か、なぜ変換するのか

DSD(Direct Stream Digital)は 1 ビットオーディオフォーマットで、1990 年代末に Sony/Philips が SACD 向けに開発しました。PCM がマルチビットのサンプル値で振幅を表すのに対し、DSD は 2.8224 MHz(DSD64)という超高速サンプリングレートで、1 ビットのパルス密度(PDM)により信号を表現します——ビットストリームの密度がそのまま信号振幅になります。

なぜ PCM を DSD に変換するのか?

  • 再生チェーンの最適化:現代の DAC は内部で delta-sigma アーキテクチャを採用しています——PCM 入力も最終的に DAC 内部で DSD に似た 1 ビットストリームに変換されます。あらかじめ DSD に変換しておけば、変調をソース側で完了でき、DAC 内部の二重変換を回避できます
  • SACD エコシステム:SACD イメージや一部のプレイヤー/ソフトウェアは DSD フォーマット(DSF/DFF)しか受け付けません
  • 聴感の好み:DSD の高域ロールオフはよりソフトで、ノイズシェイピング後のノイズ分布がより「アナログ的」だと感じるユーザーもいます——もちろんこれは主観的な領域であり、以降はデータで語ります

⚠️ 重要な前提:変換は情報を生み出しません。PCM ソースに存在しない高域情報が、変換後に現れることはありません。変換の目標は忠実性——PCM を損失を最小限に DSD 領域へ忠実にマッピングすることです。これが「ピュア DSD」(ネイティブ DSD 録音)と「変換 DSD」の本質的な違いでもあります:前者は録音段階から DSD であり、後者は PCM 素材の再表現です。


2. PCM → DSD の変換原理(3 ステップ)

標準的な PCM→DSD 変換は 3 つの工程で構成されます:

2.1 リサンプリング(オーバーサンプリング)

PCM のサンプリングレート(44.1/96/192 kHz…)は DSD の出力レート(2.8224 MHz 以上)よりはるかに低いため、変換器はまず高倍率リサンプリングを行い、サンプル点を目標レートに補間します。

  • DSD64(2.8224 MHz)= 44.1 kHz の 64 倍 → オーバーサンプリング比 OSR=64
  • DSD128(5.6448 MHz)= 128 倍 → OSR=128
  • DSD256(11.2896 MHz)= 256 倍 → OSR=256

品質の要点:リサンプリングフィルタの設計が変換の透明性と位相応答を直接決定します。FIR フィルタ(有限インパルス応答)が主流です——タップ数が多いほどフィルタが急峻になり、ストップバンド減衰が向上しますが、計算量は増加します。DpdoEngine はデフォルトで FIR 4096 taps、さらに高い設定にも対応できます。

2.2 ノイズシェイピング

リサンプリング後のマルチビット信号を 1 ビットに落とすと、量子化誤差が大きなノイズを発生させます。ノイズシェイピングはフィードバックループによって量子化ノイズを人の耳が敏感でない超音波帯域(>20 kHz)へ押し出し、可聴帯域内の S/N 比を維持します。

  • 次数(order):3/5/7/9/11 次。次数が高いほど帯域内ノイズの抑圧が強力ですが、モジュレータの安定性要求が高まり、計算量も増えます
  • 構造:IIR(無限インパルス応答)と FIR の 2 系統。IIR は計算効率が高く、同次数での帯域内性能が優れています。FIR は位相が線形で群遅延が一定——位相に敏感なマスタリング処理に適しています
  • DpdoEngine デフォルト:7 次 IIR。他に MASH、CIFB、多項式などの構造も選択可能

2.3 変調出力(1 ビット変調)

ノイズシェイピング後の信号は最終的に 1 ビット PDM ストリームとして生成され、DSF または DFF コンテナにパッケージされます(任意で DST 可逆圧縮を適用可能、サイズ 30–50% 削減)。


3. パラメータの選び方:実用的な判断表

目的推奨設定理由
一般的な再生(ストリーミング/ポータブル)OSR 64、9 次 IIRDSD64 の互換性が最も高く、9 次なら帯域内ノイズも十分低い
オーディオファイル向け再生OSR 128、11 次 IIR高レート + 最強の帯域内シェイピング、ファイルサイズ 2 倍は許容範囲
マスタリング/アーカイブOSR 128–256、FIR位相が線形で、多段処理時の誤差が予測可能
低スペック CPUOSR 64、7 次 IIR計算量が少なく、リアルタイム性を優先
マルチチャンネル SACD パッキングOSR 64–128、9 次 IIR + DSTDST 圧縮でイメージサイズを大幅に削減

帯域内ノイズ:ノイズシェイピングの本質は量子化ノイズをより遠くへ押し出すこと——次数が高いほど帯域内を低く抑え、帯域外ノイズピークは高くなり、シェイピングカーブは急峻になります。7 次(デフォルト)と 11 次の差は、静かなパッセージと高域ディテールで聞き取れます。具体的な挙動は dsp_bench/thdn の実測出力で確認してください。


4. 実践:DpdoEngine で変換する

基本変換

# WAV → DSF(DSD64,默认 7 阶 IIR)
	DpdoEngine -i input.wav output.dsf --oversampling 64
	
	# FLAC → DFF(DSD128,11 阶 IIR)
	DpdoEngine -i input.flac output.dff --oversampling 128 --order 11
	
	# 全参数:OpenCL 加速 + 元数据 + 生成 PDF 报告
	DpdoEngine -i input.flac output.dsf --oversampling 256 --order 7 \
	  --opencl --report --artist "Artist" --album "Album" --year "2026"
	

バッチ変換

# 批量 WAV → DSF(使用 convert.sh)
	cd 目录 && bash convert.sh wav2dsf 128
	

変換後の品質検証

DpdoEngine は PDF レポート(--report)を生成し、変換パラメータと測定データを出力します。さらに進んだ検証:

# 用 thdn 工具测量输出文件的失真与噪声底
	thdn output.dsf
	# 用 dsp_bench 对比不同噪声整形结构的带内性能
	dsp_bench --input test.wav --order 9 --order 11
	

5. よくある質問

DSD64/128/256 はどれを選ぶ? まず自分の DAC と再生チェーンがどの段階まで対応しているかを確認します。すべて対応しているなら、128 が聴感とサイズのバランス点。64 は互換性が最も広く、256+ は限界を追求しつつストレージに余裕がある場合に向いています。

DSF か DFF か? DSF は最も汎用的なコンテナ(メタデータ対応が良く、ストリーミング/プレイヤーとの互換性が広い)。DFF は放送業界標準です。オーディオデータに実質的な違いはないため、デフォルトは DSF。

DST は使うべき? DST は可逆圧縮で、サイズを 30–50% 削減でき、完全に可逆です。アーカイブ保存やイメージパッキングでは有効化を推奨。デコードのシンプルさを最優先するなら無効でも構いません。

PCM ソースが 44.1 か 96/192 かは影響する? 影響します。ソースのサンプリングレートが高いほど、リサンプリング段階の補間誤差が小さくなります。44.1 kHz ソースでも DSD128 変換で良好な結果が得られますが、96 kHz 以上のソースは DSD256 でより余裕があります。


Dpdo による執筆。変換品質データは DpdoEngine 6.68 の実測に基づきます。パラメータの詳細はパラメータリファレンスを参照。