DiffVC-ONE:基于扩散的一步式视频生成压缩框架
生成式视频压缩能在低码率下恢复丰富视觉细节,但同时实现高时间一致性和低推理成本具有挑战。本文提出DiffVC-ONE框架,基于一步视频扩散变换器,通过统一单向潜在压缩器压缩潜在切片,并用视频DiT的一步扩散增强器对图像组进行空间-时间感知增强。同时,通过混合条件生成器提取结构、强度和语义信息,提升细节和控制生成过程。多基准实验证明该方法在感知质量和时间一致性上达最优,且推理成本低。
这条 研究论文 信号说明,来自 arXiv cs.CV 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。