创新点:
①多尺度图像多路径的Transformer,最后汇总以保证局部和全局特征提取
②每个stage多粒度从局部到整体的推理
CNN的多粒度连接:

- 每个阶段分辨率除以4(2*2),channel乘以2,最后输出H/32*W/32
- 在经过LN层之后,分别通过三个路径降采样,之后每个特征图都采用基于窗口的多头自注意方法进行处理,并采用移动窗口划分(SW-MSA)(来自swin Transformer)

实验:用于图像分类和语义分割
创新点:
①多尺度图像多路径的Transformer,最后汇总以保证局部和全局特征提取
②每个stage多粒度从局部到整体的推理
CNN的多粒度连接:


实验:用于图像分类和语义分割
创新点: ①不需要干净样本的图片降噪 ②可以仅仅通过无标签的噪声信号重建无噪的信号,而不需要干净的样本,并且性能上超越了运用干净数据进行训练的性能。 ③具有一定的统计学原理 ...
基础知识:基于3DMM的三维人脸重建技术总结 (潜码和噪声的概念见StyleGAN) (GAN逆转的文章见In-Domain GAN Inversion for Real Image Editing) 大部分的3d人脸重建因为隐私问...
创新点: ①两个循环协作的网络,一个恢复图像,一个评估landmark ②注意力融合模块 解决的痛点:通过低分辨率图片 LR 或者粗超分辨率图片 SR 得到的人脸先验信息不一定准确 大部分...
创新点: ①提出了一种自监督训练去噪模型的方法,可以在不需要干净目标的情况下训练 ②只有一张噪声图像就可以训练(解决N2N需要一对噪声图像来训练的问题) 噪声图像的构成 \text...
创新点: ①协同尺度的卷积注意力机制(并行、串行) ②通过卷积实现embedding的相对位置(减少计算量) 基于卷积的的注意力模块总体结构 分析自注意力机制 在自注意力计算中 softmax逻...
StyleGAN StyleGAN是由Nvidia研究人员于2018年12月推出的生成对抗网络,并于2019年2月可用。 StyleGAN依赖于Nvidia的CUDA软件,GPU和Google的TensorFlow。 StyleGAN的第二个版本(...
创新点: ①训练一个生成高质量人脸的GAN网络,然后放到U型结构的解码侧,再通过低分辨率图像输入U型结构中进行微调(以前的工作没有微调,指pixel2style2pixel)。 ②以前的工作没...