先手 SENTE · 周报阅读清单 · 速读 · arXiv 2608.20335
4DAnyone:一段手机视频,重建可自由换视角的 4D 人体
4DAnyone: Create Anyone in 4D from a Casual Monocular Video
Yudong Jin,Tao Xie,Qihang Zhang,Zehong Shen 等 9 位作者 · 2026-08-20
先生成几十个一致的新视角视频,再拼成 4D 高斯人体
打开交互式解读 →三个要点
- 问题:用相机可控的视频扩散模型生成新视角视频,扩展到 4D 高斯重建需要的几十个视角时会失去一致性:视角太多只能分组生成,参考上下文越来越长,组与组之间也无法直接交换信息。
- 方法:参考上下文打包(RCP)把不断增长的参考视角压缩成固定长度的混合分辨率上下文;目标上下文路由(TCR)在去噪过程中轮换分组,高噪声阶段跨组共享信息、低噪声阶段稳定细节。另用自研游戏引擎构建多视角人体数据集 MVGameHuman。
- 结果:在 DNA-Rendering 和 DyMVHumans 上,新视角视频质量和下游 4D 高斯重建都优于以往方法,并能泛化到真实拍摄视频(作者自报)。
38k 自研游戏引擎采集的多视角人体视频数(MVGameHuman)
适合谁读:做数字人、虚拟制作和 3D / 4D 内容生成的团队。
AI 解读 · 基于原文:本页由 AI 根据论文原文整理,所有数字均可在原文中找到出处;引用前请核对原文。