Salvato in:
| Autori principali: | Ge, Mengmeng, Isobe, Takashi, Jia, Xu, Sun, Yanan, Yang, Zetong, Wang, Weinong, Zhou, Dong, Li, Dong, Lu, Huchuan, Barsoum, Emad |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.17749 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AMD-Hummingbird: Towards an Efficient Text-to-Video Model
di: Isobe, Takashi, et al.
Pubblicazione: (2025)
di: Isobe, Takashi, et al.
Pubblicazione: (2025)
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
di: Zheng, Zirui, et al.
Pubblicazione: (2025)
di: Zheng, Zirui, et al.
Pubblicazione: (2025)
ReNeg: Learning Negative Embedding with Reward Guidance
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
di: Hao, Shengyu, et al.
Pubblicazione: (2024)
di: Hao, Shengyu, et al.
Pubblicazione: (2024)
ECHO: Ego-Centric modeling of Human-Object interactions
di: Petrov, Ilya A., et al.
Pubblicazione: (2025)
di: Petrov, Ilya A., et al.
Pubblicazione: (2025)
EgoLog: Ego-Centric Fine-Grained Daily Log with Ubiquitous Wearables
di: He, Lixing, et al.
Pubblicazione: (2025)
di: He, Lixing, et al.
Pubblicazione: (2025)
EgoIntrospect: An Egocentric Dataset and Benchmark for User-Centric Internal State Reasoning
di: Wang, Zeyu, et al.
Pubblicazione: (2026)
di: Wang, Zeyu, et al.
Pubblicazione: (2026)
ObjectRelator: Enabling Cross-View Object Relation Understanding Across Ego-Centric and Exo-Centric Perspectives
di: Fu, Yuqian, et al.
Pubblicazione: (2024)
di: Fu, Yuqian, et al.
Pubblicazione: (2024)
EgoExOR: An Ego-Exo-Centric Operating Room Dataset for Surgical Activity Understanding
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
di: Özsoy, Ege, et al.
Pubblicazione: (2025)
Ego-Alter Ego
di: Pizer, John
Pubblicazione: (2020)
di: Pizer, John
Pubblicazione: (2020)
LADDER: An Efficient Framework for Video Frame Interpolation
di: Shen, Tong, et al.
Pubblicazione: (2024)
di: Shen, Tong, et al.
Pubblicazione: (2024)
EgoExo-Gen: Ego-centric Video Prediction by Watching Exo-centric Videos
di: Xu, Jilan, et al.
Pubblicazione: (2025)
di: Xu, Jilan, et al.
Pubblicazione: (2025)
EgoSound: Benchmarking Sound Understanding in Egocentric Videos
di: Zhu, Bingwen, et al.
Pubblicazione: (2026)
di: Zhu, Bingwen, et al.
Pubblicazione: (2026)
EgoExo-WM: Unlocking Exo Video for Ego World Models
di: Tran, Danny, et al.
Pubblicazione: (2026)
di: Tran, Danny, et al.
Pubblicazione: (2026)
EgoDyn-Bench: Evaluating Ego-Motion Understanding in Vision-Centric Foundation Models for Autonomous Driving
di: Schäfer, Finn Rasmus, et al.
Pubblicazione: (2026)
di: Schäfer, Finn Rasmus, et al.
Pubblicazione: (2026)
Intention-driven Ego-to-Exo Video Generation
di: Luo, Hongchen, et al.
Pubblicazione: (2024)
di: Luo, Hongchen, et al.
Pubblicazione: (2024)
Contour Errors: An Ego-Centric Metric for Reliable 3D Multi-Object Tracking
di: Kaul, Sharang, et al.
Pubblicazione: (2025)
di: Kaul, Sharang, et al.
Pubblicazione: (2025)
Gaze-Regularized VLMs for Ego-Centric Behavior Understanding
di: Pani, Anupam, et al.
Pubblicazione: (2026)
di: Pani, Anupam, et al.
Pubblicazione: (2026)
EgoLoc: A Generalizable Solution for Temporal Interaction Localization in Egocentric Videos
di: Ma, Junyi, et al.
Pubblicazione: (2025)
di: Ma, Junyi, et al.
Pubblicazione: (2025)
EgoExoLearn: A Dataset for Bridging Asynchronous Ego- and Exo-centric View of Procedural Activities in Real World
di: Huang, Yifei, et al.
Pubblicazione: (2024)
di: Huang, Yifei, et al.
Pubblicazione: (2024)
MSWA: Refining Local Attention with Multi-ScaleWindow Attention
di: Xu, Yixing, et al.
Pubblicazione: (2025)
di: Xu, Yixing, et al.
Pubblicazione: (2025)
E-MMDiT: Revisiting Multimodal Diffusion Transformer Design for Fast Image Synthesis under Limited Resources
di: Shen, Tong, et al.
Pubblicazione: (2025)
di: Shen, Tong, et al.
Pubblicazione: (2025)
Spatial Reasoning with Vision-Language Models in Ego-Centric Multi-View Scenes
di: Gholami, Mohsen, et al.
Pubblicazione: (2025)
di: Gholami, Mohsen, et al.
Pubblicazione: (2025)
EgoFSD: Ego-Centric Fully Sparse Paradigm with Uncertainty Denoising and Iterative Refinement for Efficient End-to-End Self-Driving
di: Su, Haisheng, et al.
Pubblicazione: (2024)
di: Su, Haisheng, et al.
Pubblicazione: (2024)
Ego Group Partition: A Novel Framework for Improving Ego Experiments in Social Networks
di: Deng, Lu, et al.
Pubblicazione: (2024)
di: Deng, Lu, et al.
Pubblicazione: (2024)
Edit as You See: Image-guided Video Editing via Masked Motion Modeling
di: Huang, Zhi-Lin, et al.
Pubblicazione: (2025)
di: Huang, Zhi-Lin, et al.
Pubblicazione: (2025)
EgoVideo: Exploring Egocentric Foundation Model and Downstream Adaptation
di: Pei, Baoqi, et al.
Pubblicazione: (2024)
di: Pei, Baoqi, et al.
Pubblicazione: (2024)
EC-IoU: Orienting Safety for Object Detectors via Ego-Centric Intersection-over-Union
di: Liao, Brian Hsuan-Cheng, et al.
Pubblicazione: (2024)
di: Liao, Brian Hsuan-Cheng, et al.
Pubblicazione: (2024)
VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026
di: Chu, Qiaohui, et al.
Pubblicazione: (2026)
di: Chu, Qiaohui, et al.
Pubblicazione: (2026)
HCQA @ Ego4D EgoSchema Challenge 2024
di: Zhang, Haoyu, et al.
Pubblicazione: (2024)
di: Zhang, Haoyu, et al.
Pubblicazione: (2024)
EgoLCD: Egocentric Video Generation with Long Context Diffusion
di: Zhang, Liuzhou, et al.
Pubblicazione: (2025)
di: Zhang, Liuzhou, et al.
Pubblicazione: (2025)
EgoSonics: Generating Synchronized Audio for Silent Egocentric Videos
di: Rai, Aashish, et al.
Pubblicazione: (2024)
di: Rai, Aashish, et al.
Pubblicazione: (2024)
DL-QAT: Weight-Decomposed Low-Rank Quantization-Aware Training for Large Language Models
di: Ke, Wenjin, et al.
Pubblicazione: (2025)
di: Ke, Wenjin, et al.
Pubblicazione: (2025)
MonoGS++: Fast and Accurate Monocular RGB Gaussian SLAM
di: Li, Renwu, et al.
Pubblicazione: (2025)
di: Li, Renwu, et al.
Pubblicazione: (2025)
Short-term Object Interaction Anticipation with Disentangled Object Detection @ Ego4D Short Term Object Interaction Anticipation Challenge
di: Cho, Hyunjin, et al.
Pubblicazione: (2024)
di: Cho, Hyunjin, et al.
Pubblicazione: (2024)
Understanding Dynamic Scenes in Ego Centric 4D Point Clouds
di: Huang, Junsheng, et al.
Pubblicazione: (2025)
di: Huang, Junsheng, et al.
Pubblicazione: (2025)
EgoSim: Egocentric World Simulator for Embodied Interaction Generation
di: Hao, Jinkun, et al.
Pubblicazione: (2026)
di: Hao, Jinkun, et al.
Pubblicazione: (2026)
EgoGraph: Temporal Knowledge Graph for Egocentric Video Understanding
di: Sun, Shitong, et al.
Pubblicazione: (2026)
di: Sun, Shitong, et al.
Pubblicazione: (2026)
MoTrans: Customized Motion Transfer with Text-driven Video Diffusion Models
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
EgoReAct: Egocentric Video-Driven 3D Human Reaction Generation
di: Zhang, Libo, et al.
Pubblicazione: (2025)
di: Zhang, Libo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AMD-Hummingbird: Towards an Efficient Text-to-Video Model
di: Isobe, Takashi, et al.
Pubblicazione: (2025) -
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
di: Zheng, Zirui, et al.
Pubblicazione: (2025) -
ReNeg: Learning Negative Embedding with Reward Guidance
di: Li, Xiaomin, et al.
Pubblicazione: (2024) -
Ego3DT: Tracking Every 3D Object in Ego-centric Videos
di: Hao, Shengyu, et al.
Pubblicazione: (2024) -
ECHO: Ego-Centric modeling of Human-Object interactions
di: Petrov, Ilya A., et al.
Pubblicazione: (2025)