One-Shot Affordance Grounding of Deformable Objects in Egocentric Organizing Scenes
Fuente:
arXiv
Salvato in:
| Autori principali: | Jia, Wanjun, Yang, Fan, Duan, Mengfei, Chen, Xianchi, Wang, Yinxi, Jiang, Yiming, Chen, Wenrui, Yang, Kailun, Li, Zhiyong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
Resource-Efficient Affordance Grounding with Complementary Depth and Semantic Prompts
di: Huang, Yizhou, et al.
Pubblicazione: (2025)
di: Huang, Yizhou, et al.
Pubblicazione: (2025)
Learning Granularity-Aware Affordances from Human-Object Interaction for Tool-Based Functional Dexterous Grasping
di: Yang, Fan, et al.
Pubblicazione: (2024)
di: Yang, Fan, et al.
Pubblicazione: (2024)
Multi-Keypoint Affordance Representation for Functional Dexterous Grasping
di: Yang, Fan, et al.
Pubblicazione: (2025)
di: Yang, Fan, et al.
Pubblicazione: (2025)
TRACER: Texture-Robust Affordance Chain-of-Thought for Deformable-Object Refinement
di: Jia, Wanjun, et al.
Pubblicazione: (2026)
di: Jia, Wanjun, et al.
Pubblicazione: (2026)
Learning Fine-Grained Correspondence with Cross-Perspective Perception for Open-Vocabulary 6D Object Pose Estimation
di: Qin, Yu, et al.
Pubblicazione: (2026)
di: Qin, Yu, et al.
Pubblicazione: (2026)
UniFucGrasp: Human-Hand-Inspired Unified Functional Grasp Annotation Strategy and Dataset for Diverse Dexterous Hands
di: Lin, Haoran, et al.
Pubblicazione: (2025)
di: Lin, Haoran, et al.
Pubblicazione: (2025)
S$^3$-MonoDETR: Supervised Shape&Scale-perceptive Deformable Transformer for Monocular 3D Object Detection
di: He, Xuan, et al.
Pubblicazione: (2023)
di: He, Xuan, et al.
Pubblicazione: (2023)
O3N: Omnidirectional Open-Vocabulary Occupancy Prediction
di: Duan, Mengfei, et al.
Pubblicazione: (2026)
di: Duan, Mengfei, et al.
Pubblicazione: (2026)
OneOcc: Semantic Occupancy Prediction for Legged Robots with a Single Panoramic Camera
di: Shi, Hao, et al.
Pubblicazione: (2025)
di: Shi, Hao, et al.
Pubblicazione: (2025)
Omnidirectional Multi-Object Tracking
di: Luo, Kai, et al.
Pubblicazione: (2025)
di: Luo, Kai, et al.
Pubblicazione: (2025)
Panoramic Out-of-Distribution Segmentation
di: Duan, Mengfei, et al.
Pubblicazione: (2025)
di: Duan, Mengfei, et al.
Pubblicazione: (2025)
Language-Driven Dual Style Mixing for Single-Domain Generalized Object Detection
di: Qin, Hongda, et al.
Pubblicazione: (2025)
di: Qin, Hongda, et al.
Pubblicazione: (2025)
OccTrack360: 4D Panoptic Occupancy Tracking from Surround-View Fisheye Cameras
di: Lin, Yongzhi, et al.
Pubblicazione: (2026)
di: Lin, Yongzhi, et al.
Pubblicazione: (2026)
Out-of-Distribution Semantic Occupancy Prediction
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
di: Zhang, Yuheng, et al.
Pubblicazione: (2025)
NOVA: Next-step Open-Vocabulary Autoregression for 3D Multi-Object Tracking in Autonomous Driving
di: Luo, Kai, et al.
Pubblicazione: (2026)
di: Luo, Kai, et al.
Pubblicazione: (2026)
Panoramic Multimodal Semantic Occupancy Prediction for Quadruped Robots
di: Zhao, Guoqiang, et al.
Pubblicazione: (2026)
di: Zhao, Guoqiang, et al.
Pubblicazione: (2026)
Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise
di: Li, Wenxin, et al.
Pubblicazione: (2026)
di: Li, Wenxin, et al.
Pubblicazione: (2026)
EgoEV-HandPose: Egocentric 3D Hand Pose Estimation and Gesture Recognition with Stereo Event Cameras
di: Wang, Luming, et al.
Pubblicazione: (2026)
di: Wang, Luming, et al.
Pubblicazione: (2026)
LF Tracy: A Unified Single-Pipeline Approach for Salient Object Detection in Light Field Cameras
di: Teng, Fei, et al.
Pubblicazione: (2024)
di: Teng, Fei, et al.
Pubblicazione: (2024)
EgoEvGesture: Gesture Recognition Based on Egocentric Event Camera
di: Wang, Luming, et al.
Pubblicazione: (2025)
di: Wang, Luming, et al.
Pubblicazione: (2025)
Event-aided Semantic Scene Completion
di: Guo, Shangwei, et al.
Pubblicazione: (2025)
di: Guo, Shangwei, et al.
Pubblicazione: (2025)
Segment-to-Act: Label-Noise-Robust Action-Prompted Video Segmentation Towards Embodied Intelligence
di: Li, Wenxin, et al.
Pubblicazione: (2025)
di: Li, Wenxin, et al.
Pubblicazione: (2025)
EchoTrack: Auditory Referring Multi-Object Tracking for Autonomous Driving
di: Lin, Jiacheng, et al.
Pubblicazione: (2024)
di: Lin, Jiacheng, et al.
Pubblicazione: (2024)
Spherical-GOF: Geometry-Aware Panoramic Gaussian Opacity Fields for 3D Scene Reconstruction
di: Yang, Zhe, et al.
Pubblicazione: (2026)
di: Yang, Zhe, et al.
Pubblicazione: (2026)
Fourier Prompt Tuning for Modality-Incomplete Scene Segmentation
di: Liu, Ruiping, et al.
Pubblicazione: (2024)
di: Liu, Ruiping, et al.
Pubblicazione: (2024)
DepTR-MOT: Unveiling the Potential of Depth-Informed Trajectory Refinement for Multi-Object Tracking
di: Deng, Buyin, et al.
Pubblicazione: (2025)
di: Deng, Buyin, et al.
Pubblicazione: (2025)
PVPUFormer: Probabilistic Visual Prompt Unified Transformer for Interactive Image Segmentation
di: Zhang, Xu, et al.
Pubblicazione: (2023)
di: Zhang, Xu, et al.
Pubblicazione: (2023)
GenMapping: Unleashing the Potential of Inverse Perspective Mapping for Robust Online HD Map Construction
di: Li, Siyu, et al.
Pubblicazione: (2024)
di: Li, Siyu, et al.
Pubblicazione: (2024)
CoBEVMoE: Heterogeneity-aware Feature Fusion with Dynamic Mixture-of-Experts for Collaborative Perception
di: Kong, Lingzhao, et al.
Pubblicazione: (2025)
di: Kong, Lingzhao, et al.
Pubblicazione: (2025)
NRSeg: Noise-Resilient Learning for BEV Semantic Segmentation via Driving World Models
di: Li, Siyu, et al.
Pubblicazione: (2025)
di: Li, Siyu, et al.
Pubblicazione: (2025)
MambaMOS: LiDAR-based 3D Moving Object Segmentation with Motion-aware State Space Model
di: Zeng, Kang, et al.
Pubblicazione: (2024)
di: Zeng, Kang, et al.
Pubblicazione: (2024)
E-VLA: Event-Augmented Vision-Language-Action Model for Dark and Blurred Scenes
di: Zhai, Jiajun, et al.
Pubblicazione: (2026)
di: Zhai, Jiajun, et al.
Pubblicazione: (2026)
Event-guided 3D Gaussian Splatting for Dynamic Human and Scene Reconstruction
di: Yin, Xiaoting, et al.
Pubblicazione: (2025)
di: Yin, Xiaoting, et al.
Pubblicazione: (2025)
Towards Consistent Object Detection via LiDAR-Camera Synergy
di: Luo, Kai, et al.
Pubblicazione: (2024)
di: Luo, Kai, et al.
Pubblicazione: (2024)
CFMW: Cross-modality Fusion Mamba for Robust Object Detection under Adverse Weather
di: Li, Haoyuan, et al.
Pubblicazione: (2024)
di: Li, Haoyuan, et al.
Pubblicazione: (2024)
ProOOD: Prototype-Guided Out-of-Distribution 3D Occupancy Prediction
di: Zhang, Yuheng, et al.
Pubblicazione: (2026)
di: Zhang, Yuheng, et al.
Pubblicazione: (2026)
Unveiling the Potential of Segment Anything Model 2 for RGB-Thermal Semantic Segmentation with Language Guidance
di: Zhao, Jiayi, et al.
Pubblicazione: (2025)
di: Zhao, Jiayi, et al.
Pubblicazione: (2025)
TS-CGNet: Temporal-Spatial Fusion Meets Centerline-Guided Diffusion for BEV Mapping
di: Hong, Xinying, et al.
Pubblicazione: (2025)
di: Hong, Xinying, et al.
Pubblicazione: (2025)
HierDAMap: Towards Universal Domain Adaptive BEV Mapping via Hierarchical Perspective Priors
di: Li, Siyu, et al.
Pubblicazione: (2025)
di: Li, Siyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
di: Zhu, Guoliang, et al.
Pubblicazione: (2026) -
Resource-Efficient Affordance Grounding with Complementary Depth and Semantic Prompts
di: Huang, Yizhou, et al.
Pubblicazione: (2025) -
Learning Granularity-Aware Affordances from Human-Object Interaction for Tool-Based Functional Dexterous Grasping
di: Yang, Fan, et al.
Pubblicazione: (2024) -
Multi-Keypoint Affordance Representation for Functional Dexterous Grasping
di: Yang, Fan, et al.
Pubblicazione: (2025) -
TRACER: Texture-Robust Affordance Chain-of-Thought for Deformable-Object Refinement
di: Jia, Wanjun, et al.
Pubblicazione: (2026)