扩散模型
Parent: ai_keywords
扩散模型(Diffusion Models)
核心定义
扩散模型是一类受非平衡热力学启发的生成式概率模型,通过逐步向数据添加高斯噪声(前向过程)直至完全破坏原始分布,再训练一个神经网络学习逆向去噪过程,从纯噪声中逐步恢复出目标数据。其核心思想在于将复杂的真实分布转化为简单的高斯分布,再逆变换回数据空间。代表性工作为DDPM(Denoising Diffusion Probabilistic Models)。
关键技术点
-
前向扩散过程
定义马尔可夫链,每步按预定方差调度向样本添加噪声,最终逼近标准正态分布。该过程无参数,仅需固定噪声调度。 -
逆向去噪过程
学习参数化的去噪网络(常用U-Net),预测当前步添加的噪声或原始数据。训练目标为最小化预测噪声与真实噪声之间的均方误差,等价于优化变分下界。 -
采样与加速策略
原始DDPM需千步迭代,计算昂贵。DDIM(Denoising Diffusion Implicit Models) 通过非马尔可夫过程实现少步采样(如50步),潜在扩散模型(LDM) 将扩散过程压缩至低维潜在空间,极大提升效率。 -
条件生成与引导
通过交叉注意力机制引入类别标签、文本或图像条件,实现可控生成(如文本到图像)。分类器引导与无分类器引导进一步调节生成内容的保真度与多样性。
医学/神经科学应用场景
以首都医科大学神经病学重点研究方向为例:脑卒中早期精准诊断。
临床常因磁共振成像(MRI)数据不足(如急性期梗死样本稀缺)导致深度学习分割模型泛化性差。扩散模型可基于少量真实T1/T2或DWI影像,合成高质量、病理可变异的脑卒中病变影像,用于训练数据扩增。具体地:采用条件扩散模型,以患者年龄、病灶位置及NIHSS评分为条件,生成逼真梗死区域,帮助训练模型在罕见亚型(如脑干梗死)上提升检测灵敏度。此外,扩散模型还可用于扩散张量成像(DTI)的超分辨率重建,从低分辨率DW图像恢复高分辨率纤维束追踪结果,辅助评估卒中后皮质脊髓束损伤程度,指导康复方案制定。