SoL-Refiner:一步把低分辨率视频精修成 4K,NVIDIA 的光速视频精修器

视频加载中
视频加载中NVIDIA Research(Efficient AI Team 与新加坡实验室,arXiv:2609.37969,Haozhe Liu 等)提出 SoL-Refiner:高分辨率视频生成成本随时空 token 数急剧上升,先生成低分辨率再用精修器是务实做法,但传统多步精修又引入第二个采样瓶颈。SoL-Refiner 用**单步去噪**就把任意生成器的低分辨率输出转成 4K 视频,训练配方三阶段——高分辨率持续训练、帧级 RL 后训练、一步分布匹配蒸馏(支持双向与流式推理)。同时提出 Refiner-Bench(用不同视频生成器输出构建的精修基准)与共享输入协议,在约 2K 输出分辨率下对比精修器:2K 下单步 SoL-Refiner 在 VBench 与 UniPercept 均值上超过所有外部精修器;3840×2176 下两项指标均优于三步的 LTX-2.3 Refiner;完整加速栈在 2K 延迟设置下比同基线精修延迟快 8.91×。项目页实测:MiniMax H3 部署管线 152.3s → 5.64s(27.03×,五秒 1344×768@24fps,GB200);SANA-Video 计算管线 20.04s → 12.54s(1.60×,单张 H100,81 帧@16fps)。
SoL-Refiner英伟达视频精修Video Refinement一步生成One-Step扩散蒸馏Diffusion Distillation4K 视频高分辨率视频VBenchLTXSANA-Video世界模型RL 后训练
Category: world-model
Author: @HaoZhe65347
Date: 2026-09-30T00:00:00
Duration: 56.0s
Reference: https://nvlabs.github.io/Sana/Sol-Refiner/





