EgoTwin: Dreaming Body and View in First Person
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiu, Jingqiao, Hong, Fangzhou, Li, Yicong, Li, Mengze, Wang, Wentao, Han, Sirui, Pan, Liang, Liu, Ziwei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EgoLM: Multi-Modal Language Model of Egocentric Motions
par: Hong, Fangzhou, et autres
Publié: (2024)
par: Hong, Fangzhou, et autres
Publié: (2024)
DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
par: Cao, Ziang, et autres
Publié: (2024)
par: Cao, Ziang, et autres
Publié: (2024)
PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
EgoSelf: From Memory to Personalized Egocentric Assistant
par: Wang, Yanshuo, et autres
Publié: (2026)
par: Wang, Yanshuo, et autres
Publié: (2026)
GeneMAN: Generalizable Single-Image 3D Human Reconstruction from Multi-Source Human Data
par: Wang, Wentao, et autres
Publié: (2024)
par: Wang, Wentao, et autres
Publié: (2024)
SurMo: Surface-based 4D Motion Modeling for Dynamic Human Rendering
par: Hu, Tao, et autres
Publié: (2024)
par: Hu, Tao, et autres
Publié: (2024)
StructLDM: Structured Latent Diffusion for 3D Human Generation
par: Hu, Tao, et autres
Publié: (2024)
par: Hu, Tao, et autres
Publié: (2024)
Sequence-Based Identification of First-Person Camera Wearers in Third-Person Views
par: Zhao, Ziwei, et autres
Publié: (2025)
par: Zhao, Ziwei, et autres
Publié: (2025)
CityDreamer: Compositional Generative Model of Unbounded 3D Cities
par: Xie, Haozhe, et autres
Publié: (2023)
par: Xie, Haozhe, et autres
Publié: (2023)
Generative Gaussian Splatting for Unbounded 3D City Generation
par: Xie, Haozhe, et autres
Publié: (2024)
par: Xie, Haozhe, et autres
Publié: (2024)
Compositional Generative Model of Unbounded 4D Cities
par: Xie, Haozhe, et autres
Publié: (2025)
par: Xie, Haozhe, et autres
Publié: (2025)
FashionEngine: Interactive 3D Human Generation and Editing via Multimodal Controls
par: Hu, Tao, et autres
Publié: (2024)
par: Hu, Tao, et autres
Publié: (2024)
IC-Portrait: In-Context Matching for View-Consistent Personalized Portrait
par: Yang, Han, et autres
Publié: (2025)
par: Yang, Han, et autres
Publié: (2025)
EgoPrivacy: What Your First-Person Camera Says About You?
par: Li, Yijiang, et autres
Publié: (2025)
par: Li, Yijiang, et autres
Publié: (2025)
PhysX-Omni: Unified Simulation-Ready Physical 3D Generation for Rigid, Deformable, and Articulated Objects
par: Cao, Ziang, et autres
Publié: (2026)
par: Cao, Ziang, et autres
Publié: (2026)
EgoThink: Evaluating First-Person Perspective Thinking Capability of Vision-Language Models
par: Cheng, Sijie, et autres
Publié: (2023)
par: Cheng, Sijie, et autres
Publié: (2023)
DreamJourney: Perpetual View Generation with Video Diffusion Models
par: Pan, Bo, et autres
Publié: (2025)
par: Pan, Bo, et autres
Publié: (2025)
EgoLife: Towards Egocentric Life Assistant
par: Yang, Jingkang, et autres
Publié: (2025)
par: Yang, Jingkang, et autres
Publié: (2025)
DreamShot: Personalized Storyboard Synthesis with Video Diffusion Prior
par: Huang, Junjia, et autres
Publié: (2026)
par: Huang, Junjia, et autres
Publié: (2026)
HSImul3R: Physics-in-the-Loop Reconstruction of Simulation-Ready Human-Scene Interactions
par: Cao, Yukang, et autres
Publié: (2026)
par: Cao, Yukang, et autres
Publié: (2026)
DreamGaussian4D: Generative 4D Gaussian Splatting
par: Ren, Jiawei, et autres
Publié: (2023)
par: Ren, Jiawei, et autres
Publié: (2023)
MonoArt: Progressive Structural Reasoning for Monocular Articulated 3D Reconstruction
par: Li, Haitian, et autres
Publié: (2026)
par: Li, Haitian, et autres
Publié: (2026)
Monocular Person Localization under Camera Ego-motion
par: Zhan, Yu, et autres
Publié: (2025)
par: Zhan, Yu, et autres
Publié: (2025)
3D Scene Generation: A Survey
par: Wen, Beichen, et autres
Publié: (2025)
par: Wen, Beichen, et autres
Publié: (2025)
EgoExoBench: A Benchmark for First- and Third-person View Video Understanding in MLLMs
par: He, Yuping, et autres
Publié: (2025)
par: He, Yuping, et autres
Publié: (2025)
Omni-Scene: Omni-Gaussian Representation for Ego-Centric Sparse-View Scene Reconstruction
par: Wei, Dongxu, et autres
Publié: (2024)
par: Wei, Dongxu, et autres
Publié: (2024)
4DNeX: Feed-Forward 4D Generative Modeling Made Easy
par: Chen, Zhaoxi, et autres
Publié: (2025)
par: Chen, Zhaoxi, et autres
Publié: (2025)
DreamEdit3D: Personalization of Multi-View Diffusion Models for 3D Editing
par: Ai, Jinxin, et autres
Publié: (2026)
par: Ai, Jinxin, et autres
Publié: (2026)
SignEye: Traffic Sign Interpretation from Vehicle First-Person View
par: Yang, Chuang, et autres
Publié: (2024)
par: Yang, Chuang, et autres
Publié: (2024)
The Invisible EgoHand: 3D Hand Forecasting through EgoBody Pose Estimation
par: Hatano, Masashi, et autres
Publié: (2025)
par: Hatano, Masashi, et autres
Publié: (2025)
EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering
par: Zhou, Sheng, et autres
Publié: (2025)
par: Zhou, Sheng, et autres
Publié: (2025)
DanceEditor: Towards Iterative Editable Music-driven Dance Generation with Open-Vocabulary Descriptions
par: Zhang, Hengyuan, et autres
Publié: (2025)
par: Zhang, Hengyuan, et autres
Publié: (2025)
Causality Model for Semantic Understanding on Videos
par: Yicong, Li
Publié: (2025)
par: Yicong, Li
Publié: (2025)
SAVA-X: Ego-to-Exo Imitation Error Detection via Scene-Adaptive View Alignment and Bidirectional Cross View Fusion
par: Li, Xiang, et autres
Publié: (2026)
par: Li, Xiang, et autres
Publié: (2026)
Estimating Body and Hand Motion in an Ego-sensed World
par: Yi, Brent, et autres
Publié: (2024)
par: Yi, Brent, et autres
Publié: (2024)
MultiEgo: A Multi-View Egocentric Video Dataset for 4D Scene Reconstruction
par: Li, Bate, et autres
Publié: (2025)
par: Li, Bate, et autres
Publié: (2025)
EgoMe: A New Dataset and Challenge for Following Me via Egocentric View in Real World
par: Qiu, Heqian, et autres
Publié: (2025)
par: Qiu, Heqian, et autres
Publié: (2025)
Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives
par: Grauman, Kristen, et autres
Publié: (2023)
par: Grauman, Kristen, et autres
Publié: (2023)
DreamVTON: Customizing 3D Virtual Try-on with Personalized Diffusion Models
par: Xie, Zhenyu, et autres
Publié: (2024)
par: Xie, Zhenyu, et autres
Publié: (2024)
DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation
par: Tang, Jiaxiang, et autres
Publié: (2023)
par: Tang, Jiaxiang, et autres
Publié: (2023)
Documents similaires
-
EgoLM: Multi-Modal Language Model of Egocentric Motions
par: Hong, Fangzhou, et autres
Publié: (2024) -
DiffTF++: 3D-aware Diffusion Transformer for Large-Vocabulary 3D Generation
par: Cao, Ziang, et autres
Publié: (2024) -
PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
par: Cao, Ziang, et autres
Publié: (2025) -
EgoSelf: From Memory to Personalized Egocentric Assistant
par: Wang, Yanshuo, et autres
Publié: (2026) -
GeneMAN: Generalizable Single-Image 3D Human Reconstruction from Multi-Source Human Data
par: Wang, Wentao, et autres
Publié: (2024)