Enregistré dans:
| Auteurs principaux: | Luo, Yuanhao, Wen, Di, Peng, Kunyu, Liu, Ruiping, Zheng, Junwei, Chen, Yufan, Wei, Jiale, Stiefelhage, Rainer |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.10397 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RoHOI: Robustness Benchmark for Human-Object Interaction Detection
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
Graph-based Document Structure Analysis
par: Chen, Yufan, et autres
Publié: (2025)
par: Chen, Yufan, et autres
Publié: (2025)
MICA: Multi-Agent Industrial Coordination Assistant
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels
par: Wang, Kening, et autres
Publié: (2026)
par: Wang, Kening, et autres
Publié: (2026)
Snap, Segment, Deploy: A Visual Data and Detection Pipeline for Wearable Industrial Assistants
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos
par: Liu, Ruiping, et autres
Publié: (2026)
par: Liu, Ruiping, et autres
Publié: (2026)
SGR3 Model: Scene Graph Retrieval-Reasoning Model in 3D
par: Wang, Zirui, et autres
Publié: (2026)
par: Wang, Zirui, et autres
Publié: (2026)
Skeleton-Based Human Action Recognition with Noisy Labels
par: Xu, Yi, et autres
Publié: (2024)
par: Xu, Yi, et autres
Publié: (2024)
RoDLA: Benchmarking the Robustness of Document Layout Analysis Models
par: Chen, Yufan, et autres
Publié: (2024)
par: Chen, Yufan, et autres
Publié: (2024)
HybriDLA: Hybrid Generation for Document Layout Analysis
par: Chen, Yufan, et autres
Publié: (2025)
par: Chen, Yufan, et autres
Publié: (2025)
Exploring Video-Based Driver Activity Recognition under Noisy Labels
par: Fan, Linjuan, et autres
Publié: (2025)
par: Fan, Linjuan, et autres
Publié: (2025)
Referring Atomic Video Action Recognition
par: Peng, Kunyu, et autres
Publié: (2024)
par: Peng, Kunyu, et autres
Publié: (2024)
IMPACT-CYCLE: A Contract-Based Multi-Agent System for Claim-Level Supervisory Correction of Long-Video Semantic Memory
par: Kong, Weitong, et autres
Publié: (2026)
par: Kong, Weitong, et autres
Publié: (2026)
$M^2$-Occ: Resilient 3D Semantic Occupancy Prediction for Autonomous Driving with Incomplete Camera Inputs
par: Lin, Kaixin, et autres
Publié: (2026)
par: Lin, Kaixin, et autres
Publié: (2026)
IMPACT-HOI: Supervisory Control for Onset-Anchored Partial HOI Event Construction
par: Zhang, Haoshen, et autres
Publié: (2026)
par: Zhang, Haoshen, et autres
Publié: (2026)
IMPACT-Scribe: Interactive Temporal Action Segmentation with Boundary Scribbles and Query Planning
par: Yin, Qian, et autres
Publié: (2026)
par: Yin, Qian, et autres
Publié: (2026)
Not an Obstacle for Dog, but a Hazard for Human: A Co-Ego Navigation System for Guide Dog Robots
par: Liu, Ruiping, et autres
Publié: (2026)
par: Liu, Ruiping, et autres
Publié: (2026)
Open Panoramic Segmentation
par: Zheng, Junwei, et autres
Publié: (2024)
par: Zheng, Junwei, et autres
Publié: (2024)
What if? Emulative Simulation with World Models for Situated Reasoning
par: Liu, Ruiping, et autres
Publié: (2026)
par: Liu, Ruiping, et autres
Publié: (2026)
Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model
par: Liu, Ruiping, et autres
Publié: (2025)
par: Liu, Ruiping, et autres
Publié: (2025)
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
par: Wei, Yiping, et autres
Publié: (2023)
par: Wei, Yiping, et autres
Publié: (2023)
EReLiFM: Evidential Reliability-Aware Residual Flow Meta-Learning for Open-Set Domain Generalization under Noisy Labels
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
Fourier Prompt Tuning for Modality-Incomplete Scene Segmentation
par: Liu, Ruiping, et autres
Publié: (2024)
par: Liu, Ruiping, et autres
Publié: (2024)
Mitigating Label Noise using Prompt-Based Hyperbolic Meta-Learning in Open-Set Domain Generalization
par: Peng, Kunyu, et autres
Publié: (2024)
par: Peng, Kunyu, et autres
Publié: (2024)
HopaDIFF: Holistic-Partial Aware Fourier Conditioned Diffusion for Referring Human Action Segmentation in Multi-Person Scenarios
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
Exploring Self-supervised Skeleton-based Action Recognition in Occluded Environments
par: Chen, Yifei, et autres
Publié: (2023)
par: Chen, Yifei, et autres
Publié: (2023)
RHO: Robust Holistic OSM-Based Metric Cross-View Geo-Localization
par: Zheng, Junwei, et autres
Publié: (2026)
par: Zheng, Junwei, et autres
Publié: (2026)
Segment-to-Act: Label-Noise-Robust Action-Prompted Video Segmentation Towards Embodied Intelligence
par: Li, Wenxin, et autres
Publié: (2025)
par: Li, Wenxin, et autres
Publié: (2025)
Go Beyond Earth: Understanding Human Actions and Scenes in Microgravity Environments
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
InterEdit: Navigating Text-Guided Multi-Human 3D Motion Editing
par: Yang, Yebin, et autres
Publié: (2026)
par: Yang, Yebin, et autres
Publié: (2026)
Comb, Prune, Distill: Towards Unified Pruning for Vision Model Compression
par: Schmitt, Jonas, et autres
Publié: (2024)
par: Schmitt, Jonas, et autres
Publié: (2024)
Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise
par: Li, Wenxin, et autres
Publié: (2026)
par: Li, Wenxin, et autres
Publié: (2026)
Advancing Open-Set Domain Generalization Using Evidential Bi-Level Hardest Domain Scheduler
par: Peng, Kunyu, et autres
Publié: (2024)
par: Peng, Kunyu, et autres
Publié: (2024)
Leveraging Gaze and Set-of-Mark in VLLMs for Human-Object Interaction Anticipation from Egocentric Videos
par: Materia, Daniele, et autres
Publié: (2026)
par: Materia, Daniele, et autres
Publié: (2026)
OneBEV: Using One Panoramic Image for Bird's-Eye-View Semantic Mapping
par: Wei, Jiale, et autres
Publié: (2024)
par: Wei, Jiale, et autres
Publié: (2024)
ObjectFinder: An Open-Vocabulary Assistive System for Interactive Object Search by Blind People
par: Liu, Ruiping, et autres
Publié: (2024)
par: Liu, Ruiping, et autres
Publié: (2024)
Scene-agnostic Pose Regression for Visual Localization
par: Zheng, Junwei, et autres
Publié: (2025)
par: Zheng, Junwei, et autres
Publié: (2025)
More than the Sum: Panorama-Language Models for Adverse Omni-Scenes
par: Fan, Weijia, et autres
Publié: (2026)
par: Fan, Weijia, et autres
Publié: (2026)
MateRobot: Material Recognition in Wearable Robotics for People with Visual Impairments
par: Zheng, Junwei, et autres
Publié: (2023)
par: Zheng, Junwei, et autres
Publié: (2023)
Documents similaires
-
RoHOI: Robustness Benchmark for Human-Object Interaction Detection
par: Wen, Di, et autres
Publié: (2025) -
Graph-based Document Structure Analysis
par: Chen, Yufan, et autres
Publié: (2025) -
MICA: Multi-Agent Industrial Coordination Assistant
par: Wen, Di, et autres
Publié: (2025) -
Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels
par: Wang, Kening, et autres
Publié: (2026) -
Snap, Segment, Deploy: A Visual Data and Detection Pipeline for Wearable Industrial Assistants
par: Wen, Di, et autres
Publié: (2025)