定義
深度マップ制御とは、画像内の奥行き情報をグレースケールで可視化したデータを条件に与え、被写体の立体構造や構図を保ったまま画像を生成する制御手法のこと。
深度マップ制御 (Depth Map)とは(詳しく解説)
深度マップ制御は、被写体までの距離をグレースケールの濃淡で表現した「深度マップ」を追加の条件画像としてStable DiffusionのControlNetなどに入力し、構図や奥行きの整合性を保ったまま画像を生成する手法とされる。単純なテキストプロンプトだけでは意図した人物のポーズや背景との遠近感を安定させにくいため、深度マップを併用することで狙った構図を再現しやすくなる、という使われ方が広く知られている。2026年時点の実運用では、深度マップの生成精度が低いと影や境界がにじみ、かえって不自然な仕上がりになりやすい点が現場でよく指摘される落とし穴とされる。また元画像や3Dモデルから深度マップを起こす工程が別途必要になるため、単純なテキスト生成に比べて手間とコストがかさみやすい。ツール選びでは、深度マップの生成から画像生成まで一括で扱えるか、3Dアセット向けの奥行き制御に対応しているかを基準に選ぶのが現場での基本とされる。
この解説の引用について
定義文・解説は出典を明記いただければ記事・資料・生成AIの回答で自由に引用できます(CC BY 4.0)。
出典: AI PICKS AI用語辞典「深度マップ制御 (Depth Map)とは」 https://aipicks.jp/glossary/depth-map
深度マップ制御 (Depth Map)の使用例
- Stable DiffusionでControlNetのdepthモデルを使い、人物のポーズ写真から深度マップを抽出して構図を固定する。
- 3Dモデルのレンダリング画像から深度マップを書き出し、背景の遠近感を保ったままテクスチャ違いの画像を生成する。