OmniEgo-R$^2$: A Routed Reasoning Framework for the 1st Cross-Domain EgoCross Challenge at CVPR 2026
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zixu, Chen, Zhiwei, Fu, Zhiheng, Wang, Wenbo, Hu, Yupeng, Guan, Weili, Nie, Liqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EgoAdapt: A Multi-Scene Egocentric Adaptation Method for CVPR 2026 HD-EPIC VQA Challenge
di: Chen, Zhiwei, et al.
Pubblicazione: (2026)
di: Chen, Zhiwei, et al.
Pubblicazione: (2026)
EgoAction: Egocentric Action Composition with Reliability-Aware Temporal Fusion for the EPIC-KITCHENS Action Detection Challenge at CVPR 2026
di: Fu, Zhiheng, et al.
Pubblicazione: (2026)
di: Fu, Zhiheng, et al.
Pubblicazione: (2026)
TempRet: Temporal Enhancement and Two-Stage Reranking for CVPR 2026 EPIC-KITCHENS-100 Multi-Instance Retrieval Challenge
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
R^3: Composed Video Retrieval via Reasoning-Guided Recalling and Re-ranking
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
EgoCross: Benchmarking Multimodal Large Language Models for Cross-Domain Egocentric Video Question Answering
di: Li, Yanjun, et al.
Pubblicazione: (2025)
di: Li, Yanjun, et al.
Pubblicazione: (2025)
MARS: Technical Report for the CASTLE Challenge at EgoVis 2026
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
HCQA-1.5 @ Ego4D EgoSchema Challenge 2025
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026
di: Chu, Qiaohui, et al.
Pubblicazione: (2026)
di: Chu, Qiaohui, et al.
Pubblicazione: (2026)
The Right Inference Strategy Is All You Need: Nearly Training-Free Domain-Wise Inference for EgoCross Challenge
di: Wu, Leyi, et al.
Pubblicazione: (2026)
di: Wu, Leyi, et al.
Pubblicazione: (2026)
OSGNet with MLLM Reranking @ Ego4D Episodic Memory Challenge 2026
di: Feng, Yisen, et al.
Pubblicazione: (2026)
di: Feng, Yisen, et al.
Pubblicazione: (2026)
JFAA: Technical Report for the EPIC-KITCHENS-100 Action Anticipation Challenge at EgoVis 2026
di: Chu, Qiaohui, et al.
Pubblicazione: (2026)
di: Chu, Qiaohui, et al.
Pubblicazione: (2026)
OSGNet @ Ego4D Episodic Memory Challenge 2025
di: Feng, Yisen, et al.
Pubblicazione: (2025)
di: Feng, Yisen, et al.
Pubblicazione: (2025)
HCQA @ Ego4D EgoSchema Challenge 2024
di: Zhang, Haoyu, et al.
Pubblicazione: (2024)
di: Zhang, Haoyu, et al.
Pubblicazione: (2024)
Technical Report for Ego4D Long-Term Action Anticipation Challenge 2025
di: Chu, Qiaohui, et al.
Pubblicazione: (2025)
di: Chu, Qiaohui, et al.
Pubblicazione: (2025)
OFFSET: Segmentation-based Focus Shift Revision for Composed Image Retrieval
di: Chen, Zhiwei, et al.
Pubblicazione: (2025)
di: Chen, Zhiwei, et al.
Pubblicazione: (2025)
FineCIR: Explicit Parsing of Fine-Grained Modification Semantics for Composed Image Retrieval
di: Li, Zixu, et al.
Pubblicazione: (2025)
di: Li, Zixu, et al.
Pubblicazione: (2025)
TEMA: Anchor the Image, Follow the Text for Multi-Modification Composed Image Retrieval
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
ConeSep: Cone-based Robust Noise-Unlearning Compositional Network for Composed Image Retrieval
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
STABLE: Efficient Hybrid Nearest Neighbor Search via Magnitude-Uniformity and Cardinality-Robustness
di: Yang, Qianyun, et al.
Pubblicazione: (2026)
di: Yang, Qianyun, et al.
Pubblicazione: (2026)
HUD: Hierarchical Uncertainty-Aware Disambiguation Network for Composed Video Retrieval
di: Chen, Zhiwei, et al.
Pubblicazione: (2025)
di: Chen, Zhiwei, et al.
Pubblicazione: (2025)
StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval
di: Wang, Shaokun, et al.
Pubblicazione: (2026)
di: Wang, Shaokun, et al.
Pubblicazione: (2026)
ObjectNLQ @ Ego4D Episodic Memory Challenge 2024
di: Feng, Yisen, et al.
Pubblicazione: (2024)
di: Feng, Yisen, et al.
Pubblicazione: (2024)
Cross-View Multi-Modal Segmentation @ Ego-Exo4D Challenges 2025
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
Omni-R1: Towards the Unified Generative Paradigm for Multimodal Reasoning
di: Cheng, Dongjie, et al.
Pubblicazione: (2026)
di: Cheng, Dongjie, et al.
Pubblicazione: (2026)
EPD: Long-term Memory Extraction, Context-awared Planning and Multi-iteration Decision @ EgoPlan Challenge ICML 2024
di: Shi, Letian, et al.
Pubblicazione: (2024)
di: Shi, Letian, et al.
Pubblicazione: (2024)
HABIT: Chrono-Synergia Robust Progressive Learning Framework for Composed Image Retrieval
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
CuriosAI Submission to the CASTLE Challenge at EgoVis 2026
di: Kanda, Yuto, et al.
Pubblicazione: (2026)
di: Kanda, Yuto, et al.
Pubblicazione: (2026)
Ego-Alter Ego
di: Pizer, John
Pubblicazione: (2020)
di: Pizer, John
Pubblicazione: (2020)
Air-Know: Arbiter-Calibrated Knowledge-Internalizing Robust Network for Composed Image Retrieval
di: Fu, Zhiheng, et al.
Pubblicazione: (2026)
di: Fu, Zhiheng, et al.
Pubblicazione: (2026)
Advancing Complex Video Object Segmentation via Tracking-Enhanced Prompt: The 1st Winner for 5th PVUW MOSE Challenge
di: Zhang, Jinrong, et al.
Pubblicazione: (2026)
di: Zhang, Jinrong, et al.
Pubblicazione: (2026)
The 1st Winner for 5th PVUW MeViS-Text Challenge: Strong MLLMs Meet SAM3 for Referring Video Object Segmentation
di: He, Xusheng, et al.
Pubblicazione: (2026)
di: He, Xusheng, et al.
Pubblicazione: (2026)
ViSAGE @ NTIRE 2026 Challenge on Video Saliency Prediction
di: Wang, Kun, et al.
Pubblicazione: (2026)
di: Wang, Kun, et al.
Pubblicazione: (2026)
HINT: Composed Image Retrieval with Dual-path Compositional Contextualized Network
di: Zhang, Mingyu, et al.
Pubblicazione: (2026)
di: Zhang, Mingyu, et al.
Pubblicazione: (2026)
Exo2Ego: Exocentric Knowledge Guided MLLM for Egocentric Video Understanding
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
di: Zhang, Haoyu, et al.
Pubblicazione: (2025)
Omni-Scene: Omni-Gaussian Representation for Ego-Centric Sparse-View Scene Reconstruction
di: Wei, Dongxu, et al.
Pubblicazione: (2024)
di: Wei, Dongxu, et al.
Pubblicazione: (2024)
Applying the Ego Network Model to Cross-Target Stance Detection
di: Tacchi, Jack, et al.
Pubblicazione: (2024)
di: Tacchi, Jack, et al.
Pubblicazione: (2024)
EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos
di: Liu, Ruiping, et al.
Pubblicazione: (2026)
di: Liu, Ruiping, et al.
Pubblicazione: (2026)
ReTrack: Evidence-Driven Dual-Stream Directional Anchor Calibration Network for Composed Video Retrieval
di: Li, Zixu, et al.
Pubblicazione: (2026)
di: Li, Zixu, et al.
Pubblicazione: (2026)
INTENT: Invariance and Discrimination-aware Noise Mitigation for Robust Composed Image Retrieval
di: Chen, Zhiwei, et al.
Pubblicazione: (2026)
di: Chen, Zhiwei, et al.
Pubblicazione: (2026)
MELT: Improve Composed Image Retrieval via the Modification Frequentation-Rarity Balance Network
di: Qiu, Guozhi, et al.
Pubblicazione: (2026)
di: Qiu, Guozhi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
EgoAdapt: A Multi-Scene Egocentric Adaptation Method for CVPR 2026 HD-EPIC VQA Challenge
di: Chen, Zhiwei, et al.
Pubblicazione: (2026) -
EgoAction: Egocentric Action Composition with Reliability-Aware Temporal Fusion for the EPIC-KITCHENS Action Detection Challenge at CVPR 2026
di: Fu, Zhiheng, et al.
Pubblicazione: (2026) -
TempRet: Temporal Enhancement and Two-Stage Reranking for CVPR 2026 EPIC-KITCHENS-100 Multi-Instance Retrieval Challenge
di: Li, Zixu, et al.
Pubblicazione: (2026) -
R^3: Composed Video Retrieval via Reasoning-Guided Recalling and Re-ranking
di: Li, Zixu, et al.
Pubblicazione: (2026) -
EgoCross: Benchmarking Multimodal Large Language Models for Cross-Domain Egocentric Video Question Answering
di: Li, Yanjun, et al.
Pubblicazione: (2025)