EgoSim: Egocentric World Simulator for Embodied Interaction Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Hao, Jinkun, Jia, Mingda, Wang, Ruiyan, Liu, Xihui, Yi, Ran, Ma, Lizhuang, Pang, Jiangmiao, Xu, Xudong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EgoSim: An Egocentric Multi-view Simulator and Real Dataset for Body-worn Cameras during Motion and Activity
di: Hollidt, Dominik, et al.
Pubblicazione: (2025)
di: Hollidt, Dominik, et al.
Pubblicazione: (2025)
MesaTask: Towards Task-Driven Tabletop Scene Generation via 3D Spatial Reasoning
di: Hao, Jinkun, et al.
Pubblicazione: (2025)
di: Hao, Jinkun, et al.
Pubblicazione: (2025)
EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT
di: Pei, Baoqi, et al.
Pubblicazione: (2025)
di: Pei, Baoqi, et al.
Pubblicazione: (2025)
EgoForge: Goal-Directed Egocentric World Simulator
di: Shen, Yifan, et al.
Pubblicazione: (2026)
di: Shen, Yifan, et al.
Pubblicazione: (2026)
STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics-Physics Dual System
di: Luo, Zhen, et al.
Pubblicazione: (2026)
di: Luo, Zhen, et al.
Pubblicazione: (2026)
RoboVIP: Multi-View Video Generation with Visual Identity Prompting Augments Robot Manipulation
di: Wang, Boyang, et al.
Pubblicazione: (2026)
di: Wang, Boyang, et al.
Pubblicazione: (2026)
Multi-Object Tracking by Hierarchical Visual Representations
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
PoseAnything: Universal Pose-guided Video Generation with Part-aware Temporal Coherence
di: Wang, Ruiyan, et al.
Pubblicazione: (2025)
di: Wang, Ruiyan, et al.
Pubblicazione: (2025)
Reconstructing Topology-Consistent Face Mesh by Volume Rendering from Multi-View Images
di: Wang, Yating, et al.
Pubblicazione: (2024)
di: Wang, Yating, et al.
Pubblicazione: (2024)
EgoInteract: Synthetic Egocentric Videos Generation for Interaction Understanding and Anticipation
di: Leonardi, Rosario, et al.
Pubblicazione: (2026)
di: Leonardi, Rosario, et al.
Pubblicazione: (2026)
WorldSimBench: Towards Video Generation Models as World Simulators
di: Qin, Yiran, et al.
Pubblicazione: (2024)
di: Qin, Yiran, et al.
Pubblicazione: (2024)
EgoPro-Bench: Benchmarking Personalized Proactive Interaction in Egocentric Video Streams
di: Ran, Dongchuan, et al.
Pubblicazione: (2026)
di: Ran, Dongchuan, et al.
Pubblicazione: (2026)
EgoLCD: Egocentric Video Generation with Long Context Diffusion
di: Zhang, Liuzhou, et al.
Pubblicazione: (2025)
di: Zhang, Liuzhou, et al.
Pubblicazione: (2025)
EgoLoc: A Generalizable Solution for Temporal Interaction Localization in Egocentric Videos
di: Ma, Junyi, et al.
Pubblicazione: (2025)
di: Ma, Junyi, et al.
Pubblicazione: (2025)
MGF: Mixed Gaussian Flow for Diverse Trajectory Prediction
di: Chen, Jiahe, et al.
Pubblicazione: (2024)
di: Chen, Jiahe, et al.
Pubblicazione: (2024)
CaRe-Ego: Contact-aware Relationship Modeling for Egocentric Interactive Hand-object Segmentation
di: Su, Yuejiao, et al.
Pubblicazione: (2024)
di: Su, Yuejiao, et al.
Pubblicazione: (2024)
EgoGrasp: World-Space Hand-Object Interaction Estimation from Egocentric Videos
di: Fu, Hongming, et al.
Pubblicazione: (2026)
di: Fu, Hongming, et al.
Pubblicazione: (2026)
LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness
di: Zhu, Chenming, et al.
Pubblicazione: (2024)
di: Zhu, Chenming, et al.
Pubblicazione: (2024)
PlayerOne: Egocentric World Simulator
di: Tu, Yuanpeng, et al.
Pubblicazione: (2025)
di: Tu, Yuanpeng, et al.
Pubblicazione: (2025)
ENACT: Evaluating Embodied Cognition with World Modeling of Egocentric Interaction
di: Wang, Qineng, et al.
Pubblicazione: (2025)
di: Wang, Qineng, et al.
Pubblicazione: (2025)
VidEgoThink: Assessing Egocentric Video Understanding Capabilities for Embodied AI
di: Cheng, Sijie, et al.
Pubblicazione: (2024)
di: Cheng, Sijie, et al.
Pubblicazione: (2024)
ID-Sculpt: ID-aware 3D Head Generation from Single In-the-wild Portrait Image
di: Hao, Jinkun, et al.
Pubblicazione: (2024)
di: Hao, Jinkun, et al.
Pubblicazione: (2024)
EgoGen: An Egocentric Synthetic Data Generator
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
AdR-Gaussian: Accelerating Gaussian Splatting with Adaptive Radius
di: Wang, Xinzhe, et al.
Pubblicazione: (2024)
di: Wang, Xinzhe, et al.
Pubblicazione: (2024)
TeleEgo: Benchmarking Egocentric AI Assistants in the Wild
di: Yan, Jiaqi, et al.
Pubblicazione: (2025)
di: Yan, Jiaqi, et al.
Pubblicazione: (2025)
Unified Human-Scene Interaction via Prompted Chain-of-Contacts
di: Xiao, Zeqi, et al.
Pubblicazione: (2023)
di: Xiao, Zeqi, et al.
Pubblicazione: (2023)
EgoPrompt: Prompt Learning for Egocentric Action Recognition
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
di: Lyu, Huaihai, et al.
Pubblicazione: (2025)
EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds
di: Chen, Lu, et al.
Pubblicazione: (2025)
di: Chen, Lu, et al.
Pubblicazione: (2025)
MA-EgoQA: Question Answering over Egocentric Videos from Multiple Embodied Agents
di: Kim, Kangsan, et al.
Pubblicazione: (2026)
di: Kim, Kangsan, et al.
Pubblicazione: (2026)
EgoVerse: An Egocentric Human Dataset for Robot Learning from Around the World
di: Punamiya, Ryan, et al.
Pubblicazione: (2026)
di: Punamiya, Ryan, et al.
Pubblicazione: (2026)
Estimating Ego-Body Pose from Doubly Sparse Egocentric Video Data
di: Chi, Seunggeun, et al.
Pubblicazione: (2024)
di: Chi, Seunggeun, et al.
Pubblicazione: (2024)
EgoMotion: Hierarchical Reasoning and Diffusion for Egocentric Vision-Language Motion Generation
di: Hou, Ruibing, et al.
Pubblicazione: (2026)
di: Hou, Ruibing, et al.
Pubblicazione: (2026)
ComSim: Building Scalable Real-World Robot Data Generation via Compositional Simulation
di: Qin, Yiran, et al.
Pubblicazione: (2026)
di: Qin, Yiran, et al.
Pubblicazione: (2026)
World-Ego Modeling for Long-Horizon Evolution in Hybrid Embodied Tasks
di: Lin, Zuyao, et al.
Pubblicazione: (2026)
di: Lin, Zuyao, et al.
Pubblicazione: (2026)
EgoExoBench: A Benchmark for First- and Third-person View Video Understanding in MLLMs
di: He, Yuping, et al.
Pubblicazione: (2025)
di: He, Yuping, et al.
Pubblicazione: (2025)
EgoIntrospect: An Egocentric Dataset and Benchmark for User-Centric Internal State Reasoning
di: Wang, Zeyu, et al.
Pubblicazione: (2026)
di: Wang, Zeyu, et al.
Pubblicazione: (2026)
Yume-1.5: A Text-Controlled Interactive World Generation Model
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025)
di: Mao, Xiaofeng, et al.
Pubblicazione: (2025)
EgoLM: Multi-Modal Language Model of Egocentric Motions
di: Hong, Fangzhou, et al.
Pubblicazione: (2024)
di: Hong, Fangzhou, et al.
Pubblicazione: (2024)
EgoAVU: Egocentric Audio-Visual Understanding
di: Seth, Ashish, et al.
Pubblicazione: (2026)
di: Seth, Ashish, et al.
Pubblicazione: (2026)
EgoLife: Towards Egocentric Life Assistant
di: Yang, Jingkang, et al.
Pubblicazione: (2025)
di: Yang, Jingkang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
EgoSim: An Egocentric Multi-view Simulator and Real Dataset for Body-worn Cameras during Motion and Activity
di: Hollidt, Dominik, et al.
Pubblicazione: (2025) -
MesaTask: Towards Task-Driven Tabletop Scene Generation via 3D Spatial Reasoning
di: Hao, Jinkun, et al.
Pubblicazione: (2025) -
EgoThinker: Unveiling Egocentric Reasoning with Spatio-Temporal CoT
di: Pei, Baoqi, et al.
Pubblicazione: (2025) -
EgoForge: Goal-Directed Egocentric World Simulator
di: Shen, Yifan, et al.
Pubblicazione: (2026) -
STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics-Physics Dual System
di: Luo, Zhen, et al.
Pubblicazione: (2026)