返回全部动态
FlashVSR v1.1:实时扩散视频超分模型发布
原标题:JunhaoZhuang/FlashVSR-v1.1
AI 摘要
FlashVSR v1.1 是一个基于扩散模型的实时视频超分辨率模型,由 Junhao Zhuang 等人发布,支持 4 倍超分,在单个 A100 GPU 上可实现约 17 FPS 的 768×1408 视频处理。该模型通过三阶段蒸馏、局部约束稀疏注意力和轻量条件解码器实现高效推理,相比先前的一步扩散 VSR 模型速度提升约 12 倍。模型权重和推理代码已开源,但 VSR-120K 数据集尚未发布。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
--- license: apache-2.0 pipeline_tag: video-to-video --- # ⚡ FlashVSR **Towards Real-Time Diffusion-Based Streaming Video Super-Resolution** **Authors:** Junhao Zhuang, Shi Guo, Xin Cai, Xiaohui Li, Yihao Liu, Chun Yuan, Tianfan Xue <a href='http://zhuang2002.github.io/FlashVSR'><img src='https://img.shields.io/badge/Project-Page-Green'></a> <a href="https://github.com/OpenImagingLab/FlashVSR"><img src="https://img.shields.io/badge/GitHub-Repository-black?logo=github"></a> <a h
发布时间:2026-08-15 12:38
抓取时间:2026-08-15 12:41
来源机构:Hugging Face