「うちの飼い犬を、雪山の写真や油絵風に描いてほしい」——テキストから画像を作る拡...
Sora(動画生成)やStable Diffusion 3 など、2024年以降...
拡散モデル(Diffusion Model)は、近年の画像生成 AI の中核をな...
U-Netは、もともと医用画像のセグメンテーションのために2015年に提案された...
Classifier-Free Guidance(CFG)は、2022年にHo ...
ControlNetは、2023年にZhangらが発表した、拡散モデルに空間的な...
Imagen(Google)とDALL-E(OpenAI)は、テキストから画像を...
Stable Diffusionは、2022年にStability AI、Com...
スコアベース生成モデル(Score-based Generative Model...