HyperAIHyperAI

Command Palette

Search for a command to run...

DynPose-100K 动态相机姿态数据集

日期

数据集组织

英伟达

论文 URL

2504.17788

许可证

Other

DynPose-100K 是由 NVIDIA 于 2025 年发布的一个包含 10 万段多样化动态视频及其精确相机标注的大规模数据集,相关论文成果为「Dynamic Camera Poses and Where to Find Them」,旨在解决动态视频中相机内参与位姿准确估计的挑战,通过筛选适合相机估计的视频并改进动态视频相机估计算法,为计算机视觉研究提供高质量的数据支持。

该数据集从 320 万候选视频中精选而出,包含动态内容丰富的视频片段,所有视频均标注了世界到相机的相机位姿(poses)和相机内参(intrinsics)。

数据集组成

数据集主要包含以下部分和字段:

  • 视频数据:约 10 万段 MP4 格式视频,分辨率为 1280×720 (720p),总大小约 200 GB。
  • 帧数据:从视频中提取的 JPG 格式帧,帧率为 12 fps,总大小约 400 GB。
  • 相机标注数据:PKL 格式文件,包含以下字段:
  • poses:相机位姿矩阵(N',3,4)
  • intrinsics:相机内参矩阵(3,3)
  • frame_idxs:对应的帧索引列表
  • mean_reproj_error:平均重投影误差
  • num_points:重投影点的数量
  • num_frames:视频帧总数
  • 元数据文件:
  • metadata.csv:包含视频 ID、URL、时间戳、描述等信息,用于下载视频和提取帧。
  • uid_mapping.csv:UID 映射文件。
  • Lightspeed 基准测试集:包含带真实相机位姿的短视频片段,用于验证 DynPose-100K 的标注方法,总大小约 8.1 GB。
数据集示例
数据集示例

Citation

@inproceedings{rockwell2025dynpose,
    author = {Rockwell, Chris and Tung, Joseph and Lin, Tsung-Yi and Liu, Ming-Yu and Fouhey, David F. and Lin, Chen-Hsuan},
    title = {Dynamic Camera Poses and Where to Find Them},
    booktitle = {CVPR},
    year = 2025
}

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码
开箱即用的 GPU
最优定价

HyperAI Newsletters

订阅我们的最新资讯
我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新
邮件发送服务由 MailChimp 提供