基于跨模态级联扩散模型的图像描述方法
陈巧红,郭孟浩,方贤,孙麒

Image captioning based on cross-modal cascaded diffusion model
Qiaohong CHEN,Menghao GUO,Xian FANG,Qi SUN
图 4 扩散模型不同层参数的文本生成描述结果
Fig.4 Results of text generation by different layer parameters of diffusion model