HyperAI
Command Palette
Search for a command to run...
DynPose-100K 动态相机姿态数据集
DynPose-100K 是由 NVIDIA 于 2025 年发布的一个包含 10 万段多样化动态视频及其精确相机标注的大规模数据集,相关论文成果为「Dynamic Camera Poses and Where to Find Them」,旨在解决动态视频中相机内参与位姿准确估计的挑战,通过筛选适合相机估计的视频并改进动态视频相机估计算法,为计算机视觉研究提供高质量的数据支持。
该数据集从 320 万候选视频中精选而出,包含动态内容丰富的视频片段,所有视频均标注了世界到相机的相机位姿(poses)和相机内参(intrinsics)。
数据集组成
数据集主要包含以下部分和字段:
- 视频数据:约 10 万段 MP4 格式视频,分辨率为 1280×720 (720p),总大小约 200 GB。
- 帧数据:从视频中提取的 JPG 格式帧,帧率为 12 fps,总大小约 400 GB。
- 相机标注数据:PKL 格式文件,包含以下字段:
- poses:相机位姿矩阵(N',3,4)
- intrinsics:相机内参矩阵(3,3)
- frame_idxs:对应的帧索引列表
- mean_reproj_error:平均重投影误差
- num_points:重投影点的数量
- num_frames:视频帧总数
- 元数据文件:
- metadata.csv:包含视频 ID、URL、时间戳、描述等信息,用于下载视频和提取帧。
- uid_mapping.csv:UID 映射文件。
- Lightspeed 基准测试集:包含带真实相机位姿的短视频片段,用于验证 DynPose-100K 的标注方法,总大小约 8.1 GB。
Citation
@inproceedings{rockwell2025dynpose,
author = {Rockwell, Chris and Tung, Joseph and Lin, Tsung-Yi and Liu, Ming-Yu and Fouhey, David F. and Lin, Chen-Hsuan},
title = {Dynamic Camera Poses and Where to Find Them},
booktitle = {CVPR},
year = 2025
}
此数据集由社区用户贡献,仅用于教育和信息目的。如有任何内容涉及版权侵权,请通过 [email protected] 联系我们,我们将及时审核并删除。