拡散モデルとは【図解でわかりやすく】

最終更新日:2026年7月15日

30秒でわかる結論

拡散モデルは「きれいな画像にノイズを加え続けて完全なランダムノイズにする(前向き拡散)」過程を学習し、その逆向き(ノイズから少しずつ除去して画像を復元する)ができるようになる生成モデルです。Stable Diffusion・Midjourney・DALL-Eがこの系統。GANより安定して高品質な画像を生成できることから、現在の画像生成AIの主流技術となっています。

拡散モデル=ノイズから少しずつノイズを除去して画像を生成。現在の画像生成AIの主流。

拡散モデルはG検定で「GANとの対比」で問われます。「彫刻家がノイズという石から画像を彫り出す」というイメージで覚えましょう。

図解

前向き拡散(学習):画像 → ノイズきれいな画像+ノイズ少しノイズ+ノイズ多くノイズ+ノイズ完全なランダム逆拡散(生成):ノイズ → 画像ランダムノイズ除去うっすら輪郭除去ほぼ完成除去生成完成

解説

学習時は、きれいな画像に少しずつノイズを加えて完全なノイズにする過程を学び、生成時はその逆——ランダムなノイズから少しずつ除去して画像を浮かび上がらせます。彫刻家が石から形を彫り出すイメージ。Stable DiffusionやMidjourneyがこの系統。GAN(生成器と識別器の競争)との対比で問われることが多く、生成が安定して高品質という強みで主流の座についています。

具体例

①Stable Diffusion(オープンソース):テキストプロンプトから高品質な画像を生成。②Midjourney:芸術的スタイルの高品質画像生成サービス。③OpenAIのDALL-E 3:GPT-4と連携したテキスト→画像変換。④Adobe Firefly:デザインツールに統合された商用利用可能な画像生成AI。

間違えやすい類似用語

覚え方

GAN=競争で生成/拡散モデル=ノイズを彫って生成(現在の主流)

試験での問われ方

G検定・生成AIパスポートでは「①拡散モデルの仕組み(ノイズ→除去で生成)」「②GANとの比較(現在の主流はなぜ拡散モデルか)」「③代表的な拡散モデルサービス(Stable Diffusion等)」が頻出。また「前向き拡散(ノイズ追加)と逆拡散(ノイズ除去)」という2段階の構造も押さえておきましょう。

確認問題

拡散モデルが画像を生成する際の基本的な仕組みとして正しいものはどれですか?

正解:B. ランダムノイズから段階的にノイズを除去して画像を生成する

拡散モデルは「前向き拡散(きれいな画像に少しずつノイズを加える)」の逆プロセス「逆拡散(ランダムノイズから少しずつノイズを除去する)」を学習します。「彫刻家が石から形を彫り出す」ようなイメージ。AはGAN、CはVAEの説明です。Stable Diffusion・Midjourneyなどが代表的な拡散モデル実装です。

拡散モデルの問題を解いてみる →

関連用語

出典・参考資料

監修:横浜ITコンサル合同会社

AI用語集の一覧に戻る

運営者情報

編集ポリシー

提供:横浜ITコンサル合同会社