Real-ESRGAN
AI图像超分辨率工具,将模糊/低质量图片智能修复为高清版本,支持通用图像和动漫专用模型
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
AI图像超分辨率工具,将模糊/低质量图片智能修复为高清版本,支持通用图像和动漫专用模型
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。

想象一个场景: 你翻出10年前的旧相册,照片已经发黄模糊、人脸模糊不清,你特别想把它修复清晰发到朋友圈。Real-ESRGAN 就是帮你做这件事的 AI 工具——只不过它不是简单的放大像素,而是用深度学习"脑补"出真实的细节纹理。
Real-ESRGAN 诞生于对经典 ESRGAN 的深度改进。其核心作者是腾讯ARC Lab(腾讯AI实验室)的研究员 Xintao Wang,团队专注于底层视觉任务(Low-Level Vision)。2021年,他们发表了论文《Real-ESRGAN: Training Real-World Blind Super-Resolution with Pure Synthetic Data》,解决了传统超分辨率模型在真实场景中"水土不服"的问题。
为什么这项研究重要? 早期的超分辨率模型(如ESRGAN)大多在理想数据集上训练,效果看起来很好,但一到真实场景(手机拍摄的照片、网络压缩图、老旧扫描件)就失效了——容易产生过度平滑、伪影等问题。Real-ESRGAN 的关键创新在于:用纯合成数据训练出能应对真实退化(噪声、模糊、压缩伪影)的模型,无需收集大量真实退化图像也能泛化到真实场景。

图1:Real-ESRGAN 处理前后对比(左:原图,右:处理后)
Real-ESRGAN 的核心价值不是简单地将图像放大4倍,而是对各种真实退化图像进行智能修复:
实际测试数据也印证了效果:Real-ESRGAN 在盲超分辨率测试中,PSNR 达到 24.97 dB,SSIM 为 0.76,相比原始 ESRGAN 在真实场景中有显著提升,在学术对比研究中也优于同期多个竞品模型。
Real-ESRGAN 的技术栈建立在 BasicSR(Basic Super Restoration)开源框架之上,这是一个专门为底层图像修复任务设计的 PyTorch 训练框架。
核心模型架构采用了两套网络设计:
推理流程高度模块化:inference_realesrgan.py 负责加载模型、自动检测图像类型(通用/动漫)、调用对应的预/后处理管道。预处理器会处理 alpha 通道、灰度图等特殊情况,后处理器包含 GFPGAN 人脸增强(可选)集成。
# 核心推理调用示例(摘自项目代码)
from basicsr.archs.rrdbnet_arch import RRDBNet
from realesrgan import RealESRGANer
from realesrgan.archs.srvgg_arch import SRVGGNetCompact
# 加载模型
model = RRDBNet(num_in_ch=3, num_out_ch=3, ...)
upsampler = RealESRGANer(scale=4, model_path='weights/RealESRGAN_x4plus.pth', ...)
# 输入模糊图片,输出高清图片
output = upsampler.enhance(input_image)
项目依赖清晰:PyTorch >= 1.7、OpenCV、Pillow 图像处理库、facexlib(人脸检测,集成 GFPGAN 能力)。所有模型权重托管在 HuggingFace 或百度网盘,通过 load_file_from_url 自动下载。
Real-ESRGAN 没有 Web 界面,完全通过命令行调用,这符合其作为"专业工具"的定位。不过使用门槛并不高:
方式一:pip 一键安装(最简单)
pip install realesrgan
realesrgan -i input.jpg -o output.png
一行命令即可处理单张图片,适合快速试用。
方式二:Python 脚本调用(最灵活) 直接 import 库函数,在自己的 Python 脚本/服务中集成,适合开发者二次开发。
方式三:Cog 镜像(无需本地环境) 通过 replicate.com 云端 API 调用,无需安装任何依赖,按次计费约 $0.0025/次,适合偶尔用一次的用户。
硬件要求:必须使用 NVIDIA GPU(显存 >= 4GB),纯 CPU 推理速度极慢,不推荐。推荐 CUDA 11 以上环境。
Real-ESRGAN 并非万能,存在以下局限:
Real-ESRGAN 在 GitHub 上积累的 35,000+ stars 和持续活跃的社区反馈(issues、PR)证明了它的实用价值。它不仅被广泛应用于个人照片修复,还被集成到多个商业图像处理工具中。更重要的是,它证明了"纯合成数据训练"策略的有效性,直接推动了后续 Real-ESRGAN+、HAT 等一系列更强模型的研究。图像超分辨率领域正从"学术刷榜"走向"工业落地",Real-ESRGAN 是这一趋势的标志性项目之一。
