扩散模型的原理很优雅:先把图像逐步加噪变成纯噪声,再训练模型一步步把噪声“去噪”回图像。生成时从随机噪声出发,就能“雕刻”出全新的画面。Stable Diffusion、Midjourney、DALL-E 背后都是它。
扩散模型的哲学极富诗意:先让事物完全归于混沌,再从混沌中重新塑形。这几乎是人类创作过程的隐喻——打碎既有结构,在无序中寻找新的秩序。技术之美,往往来自对自然过程的深刻模仿。
## 核心要点
![图片[1]-扩散模型:AI 绘画的真正引擎-子比笔记](https://zibi.1ddc.com/wp-content/uploads/2026/09/ai-pool-21-0-37838435935_6be48ae44e_b-912x800.jpg)
图片来源:Openverse / Daniel Ari Friedman(https://www.flickr.com/photos/43693624@N07/37838435935)
1. 扩散模型的生成质量与多样性远超 GAN,已成主流。
2. 潜扩散把过程放到低维潜空间,大幅降低算力需求。
3. 文本条件控制让“文生图”成为可能,引爆了创作生态。
4. 其核心思想正向视频、3D、音频等模态扩展。
![图片[2]-扩散模型:AI 绘画的真正引擎-子比笔记](https://zibi.1ddc.com/wp-content/uploads/2026/09/ai-pool-6-7-5335758324_1479f5b578_b.jpg)
图片来源:Openverse / Chris Spiegl(https://www.flickr.com/photos/25188624@N02/5335758324)
## 写在最后
以上是关于「扩散模型」的科普介绍。人工智能正在快速发展,相关概念和方法也在不断演进。希望本文能帮你建立对这一主题的基本认识。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END













请登录后查看评论内容