Harmony4D: A Video Dataset for In-The-Wild Close Human Interactions
Fuente:
arXiv
Salvato in:
| Autori principali: | Khirodkar, Rawal, Song, Jyun-Ting, Cao, Jinkun, Luo, Zhengyi, Kitani, Kris |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Real-Time Simulated Avatar from Head-Mounted Sensors
di: Luo, Zhengyi, et al.
Pubblicazione: (2024)
di: Luo, Zhengyi, et al.
Pubblicazione: (2024)
Ground Reaction Inertial Poser: Physics-based Human Motion Capture from Sparse IMUs and Insole Pressure Sensors
di: Hori, Ryosuke, et al.
Pubblicazione: (2026)
di: Hori, Ryosuke, et al.
Pubblicazione: (2026)
Generalizable Neural Human Renderer
di: Masuda, Mana, et al.
Pubblicazione: (2024)
di: Masuda, Mana, et al.
Pubblicazione: (2024)
Multi-Person 3D Pose Estimation from Multi-View Uncalibrated Depth Cameras
di: Li, Yu-Jhe, et al.
Pubblicazione: (2024)
di: Li, Yu-Jhe, et al.
Pubblicazione: (2024)
Multi-Object Tracking by Hierarchical Visual Representations
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
CacheFlow: Fast Human Motion Prediction by Cached Normalizing Flow
di: Maeda, Takahiro, et al.
Pubblicazione: (2025)
di: Maeda, Takahiro, et al.
Pubblicazione: (2025)
Joint Diffusion for Universal Hand-Object Grasp Generation
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
Universal Humanoid Motion Representations for Physics-Based Control
di: Luo, Zhengyi, et al.
Pubblicazione: (2023)
di: Luo, Zhengyi, et al.
Pubblicazione: (2023)
MGF: Mixed Gaussian Flow for Diverse Trajectory Prediction
di: Chen, Jiahe, et al.
Pubblicazione: (2024)
di: Chen, Jiahe, et al.
Pubblicazione: (2024)
ATLAS: Decoupling Skeletal and Shape Parameters for Expressive Parametric Human Modeling
di: Park, Jinhyung, et al.
Pubblicazione: (2025)
di: Park, Jinhyung, et al.
Pubblicazione: (2025)
DuoMo: Dual Motion Diffusion for World-Space Human Reconstruction
di: Wang, Yufu, et al.
Pubblicazione: (2026)
di: Wang, Yufu, et al.
Pubblicazione: (2026)
GenLCA: 3D Diffusion for Full-Body Avatars from In-the-Wild Videos
di: Wu, Yiqian, et al.
Pubblicazione: (2026)
di: Wu, Yiqian, et al.
Pubblicazione: (2026)
G-HOP: Generative Hand-Object Prior for Interaction Reconstruction and Grasp Synthesis
di: Ye, Yufei, et al.
Pubblicazione: (2024)
di: Ye, Yufei, et al.
Pubblicazione: (2024)
DyaDiT: A Multi-Modal Diffusion Transformer for Socially Favorable Dyadic Gesture Generation
di: Peng, Yichen, et al.
Pubblicazione: (2026)
di: Peng, Yichen, et al.
Pubblicazione: (2026)
ExpertAF: Expert Actionable Feedback from Video
di: Ashutosh, Kumar, et al.
Pubblicazione: (2024)
di: Ashutosh, Kumar, et al.
Pubblicazione: (2024)
SAM 3D Body: Robust Full-Body Human Mesh Recovery
di: Yang, Xitong, et al.
Pubblicazione: (2026)
di: Yang, Xitong, et al.
Pubblicazione: (2026)
SMPLOlympics: Sports Environments for Physically Simulated Humanoids
di: Luo, Zhengyi, et al.
Pubblicazione: (2024)
di: Luo, Zhengyi, et al.
Pubblicazione: (2024)
Sapiens: Foundation for Human Vision Models
di: Khirodkar, Rawal, et al.
Pubblicazione: (2024)
di: Khirodkar, Rawal, et al.
Pubblicazione: (2024)
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image
di: Ma, Xiaoxuan, et al.
Pubblicazione: (2026)
di: Ma, Xiaoxuan, et al.
Pubblicazione: (2026)
Sapiens2
di: Khirodkar, Rawal, et al.
Pubblicazione: (2026)
di: Khirodkar, Rawal, et al.
Pubblicazione: (2026)
Interactive Video Generation via Domain Adaptation
di: Rawal, Ishaan, et al.
Pubblicazione: (2025)
di: Rawal, Ishaan, et al.
Pubblicazione: (2025)
OmniH2O: Universal and Dexterous Human-to-Humanoid Whole-Body Teleoperation and Learning
di: He, Tairan, et al.
Pubblicazione: (2024)
di: He, Tairan, et al.
Pubblicazione: (2024)
NovaPlan: Zero-Shot Long-Horizon Manipulation via Closed-Loop Video Language Planning
di: Fu, Jiahui, et al.
Pubblicazione: (2026)
di: Fu, Jiahui, et al.
Pubblicazione: (2026)
URAvatar: Universal Relightable Gaussian Codec Avatars
di: Li, Junxuan, et al.
Pubblicazione: (2024)
di: Li, Junxuan, et al.
Pubblicazione: (2024)
Pippo: High-Resolution Multi-View Humans from a Single Image
di: Kant, Yash, et al.
Pubblicazione: (2025)
di: Kant, Yash, et al.
Pubblicazione: (2025)
AvatarPose: Avatar-guided 3D Pose Estimation of Close Human Interaction from Sparse Multi-view Videos
di: Lu, Feichi, et al.
Pubblicazione: (2024)
di: Lu, Feichi, et al.
Pubblicazione: (2024)
Propose, Assess, Search: Harnessing LLMs for Goal-Oriented Planning in Instructional Videos
di: Islam, Md Mohaiminul, et al.
Pubblicazione: (2024)
di: Islam, Md Mohaiminul, et al.
Pubblicazione: (2024)
HarmonySet: A Comprehensive Dataset for Understanding Video-Music Semantic Alignment and Temporal Synchronization
di: Zhou, Zitang, et al.
Pubblicazione: (2025)
di: Zhou, Zitang, et al.
Pubblicazione: (2025)
CORE4D: A 4D Human-Object-Human Interaction Dataset for Collaborative Object REarrangement
di: Liu, Yun, et al.
Pubblicazione: (2024)
di: Liu, Yun, et al.
Pubblicazione: (2024)
HUMOTO: A 4D Dataset of Mocap Human Object Interactions
di: Lu, Jiaxin, et al.
Pubblicazione: (2025)
di: Lu, Jiaxin, et al.
Pubblicazione: (2025)
Don't Look Twice: Faster Video Transformers with Run-Length Tokenization
di: Choudhury, Rohan, et al.
Pubblicazione: (2024)
di: Choudhury, Rohan, et al.
Pubblicazione: (2024)
Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
SportsHHI: A Dataset for Human-Human Interaction Detection in Sports Videos
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
Unified Human-Scene Interaction via Prompted Chain-of-Contacts
di: Xiao, Zeqi, et al.
Pubblicazione: (2023)
di: Xiao, Zeqi, et al.
Pubblicazione: (2023)
HOI4D: A 4D Egocentric Dataset for Category-Level Human-Object Interaction
di: Liu, Yunze, et al.
Pubblicazione: (2022)
di: Liu, Yunze, et al.
Pubblicazione: (2022)
Emergent Active Perception and Dexterity of Simulated Humanoids from Visual Reinforcement Learning
di: Luo, Zhengyi, et al.
Pubblicazione: (2025)
di: Luo, Zhengyi, et al.
Pubblicazione: (2025)
HOIGen-1M: A Large-scale Dataset for Human-Object Interaction Video Generation
di: Liu, Kun, et al.
Pubblicazione: (2025)
di: Liu, Kun, et al.
Pubblicazione: (2025)
S2GO: Streaming Sparse Gaussian Occupancy Prediction
di: Park, Jinhyung, et al.
Pubblicazione: (2025)
di: Park, Jinhyung, et al.
Pubblicazione: (2025)
Joint Optimization for 4D Human-Scene Reconstruction in the Wild
di: Liu, Zhizheng, et al.
Pubblicazione: (2025)
di: Liu, Zhizheng, et al.
Pubblicazione: (2025)
Vidu4D: Single Generated Video to High-Fidelity 4D Reconstruction with Dynamic Gaussian Surfels
di: Wang, Yikai, et al.
Pubblicazione: (2024)
di: Wang, Yikai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Real-Time Simulated Avatar from Head-Mounted Sensors
di: Luo, Zhengyi, et al.
Pubblicazione: (2024) -
Ground Reaction Inertial Poser: Physics-based Human Motion Capture from Sparse IMUs and Insole Pressure Sensors
di: Hori, Ryosuke, et al.
Pubblicazione: (2026) -
Generalizable Neural Human Renderer
di: Masuda, Mana, et al.
Pubblicazione: (2024) -
Multi-Person 3D Pose Estimation from Multi-View Uncalibrated Depth Cameras
di: Li, Yu-Jhe, et al.
Pubblicazione: (2024) -
Multi-Object Tracking by Hierarchical Visual Representations
di: Cao, Jinkun, et al.
Pubblicazione: (2024)