Salvato in:
| Autori principali: | Jiang, Dengyang, Wang, Zanyi, Li, Hengzhuang, Dang, Sizhe, Ma, Teli, Wei, Wei, Dai, Guang, Zhang, Lei, Wang, Mengmeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2504.15650 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Deforming Videos to Masks: Flow Matching for Referring Video Segmentation
di: Wang, Zanyi, et al.
Pubblicazione: (2025)
di: Wang, Zanyi, et al.
Pubblicazione: (2025)
Unlocking the Potential of Grounding DINO in Videos: Parameter-Efficient Adaptation for Limited-Data Spatial-Temporal Localization
di: Wang, Zanyi, et al.
Pubblicazione: (2026)
di: Wang, Zanyi, et al.
Pubblicazione: (2026)
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
di: Ma, Teli, et al.
Pubblicazione: (2024)
di: Ma, Teli, et al.
Pubblicazione: (2024)
Exploring Time Conditioning in Diffusion Generative Models from Disjoint Noisy Data Manifolds
di: Li, Liuzhuozheng, et al.
Pubblicazione: (2026)
di: Li, Liuzhuozheng, et al.
Pubblicazione: (2026)
Low-Biased General Annotated Dataset Generation
di: Jiang, Dengyang, et al.
Pubblicazione: (2024)
di: Jiang, Dengyang, et al.
Pubblicazione: (2024)
Learning 2D Invariant Affordance Knowledge for 3D Affordance Grounding
di: Gao, Xianqiang, et al.
Pubblicazione: (2024)
di: Gao, Xianqiang, et al.
Pubblicazione: (2024)
GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic Manipulation
di: Ma, Teli, et al.
Pubblicazione: (2025)
di: Ma, Teli, et al.
Pubblicazione: (2025)
TriCLIP-3D: A Unified Parameter-Efficient Framework for Tri-Modal 3D Visual Grounding based on CLIP
di: Li, Fan, et al.
Pubblicazione: (2025)
di: Li, Fan, et al.
Pubblicazione: (2025)
AffordanceLLM: Grounding Affordance from Vision Language Models
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
No Other Representation Component Is Needed: Diffusion Transformers Can Provide Representation Guidance by Themselves
di: Jiang, Dengyang, et al.
Pubblicazione: (2025)
di: Jiang, Dengyang, et al.
Pubblicazione: (2025)
Closed-Loop Transfer for Weakly-supervised Affordance Grounding
di: Tang, Jiajin, et al.
Pubblicazione: (2025)
di: Tang, Jiajin, et al.
Pubblicazione: (2025)
Distribution Matching Distillation Meets Reinforcement Learning
di: Jiang, Dengyang, et al.
Pubblicazione: (2025)
di: Jiang, Dengyang, et al.
Pubblicazione: (2025)
Visual-Geometric Collaborative Guidance for Affordance Learning
di: Luo, Hongchen, et al.
Pubblicazione: (2024)
di: Luo, Hongchen, et al.
Pubblicazione: (2024)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
I-MedSAM: Implicit Medical Image Segmentation with Segment Anything
di: Wei, Xiaobao, et al.
Pubblicazione: (2023)
di: Wei, Xiaobao, et al.
Pubblicazione: (2023)
Unlocking 3D Affordance Segmentation with 2D Semantic Knowledge
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
Grounding 3D Scene Affordance From Egocentric Interactions
di: Liu, Cuiyu, et al.
Pubblicazione: (2024)
di: Liu, Cuiyu, et al.
Pubblicazione: (2024)
JoDiffusion: Jointly Diffusing Image with Pixel-Level Annotations for Semantic Segmentation Promotion
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
Learning Visual Affordance from Audio
di: Lu, Lidong, et al.
Pubblicazione: (2025)
di: Lu, Lidong, et al.
Pubblicazione: (2025)
Segmenting Object Affordances: Reproducibility and Sensitivity to Scale
di: Apicella, Tommaso, et al.
Pubblicazione: (2024)
di: Apicella, Tommaso, et al.
Pubblicazione: (2024)
RemoteSAM: Towards Segment Anything for Earth Observation
di: Yao, Liang, et al.
Pubblicazione: (2025)
di: Yao, Liang, et al.
Pubblicazione: (2025)
Affostruction: 3D Affordance Grounding with Generative Reconstruction
di: Park, Chunghyun, et al.
Pubblicazione: (2026)
di: Park, Chunghyun, et al.
Pubblicazione: (2026)
AffordanceGrasp-R1:Leveraging Reasoning-Based Affordance Segmentation with Reinforcement Learning for Robotic Grasping
di: Zhou, Dingyi, et al.
Pubblicazione: (2026)
di: Zhou, Dingyi, et al.
Pubblicazione: (2026)
SPDA-SAM: A Self-prompted Depth-Aware Segment Anything Model for Instance Segmentation
di: Shang, Yihan, et al.
Pubblicazione: (2026)
di: Shang, Yihan, et al.
Pubblicazione: (2026)
RobustSAM: Segment Anything Robustly on Degraded Images
di: Chen, Wei-Ting, et al.
Pubblicazione: (2024)
di: Chen, Wei-Ting, et al.
Pubblicazione: (2024)
Self-Explainable Affordance Learning with Embodied Caption
di: Zhang, Zhipeng, et al.
Pubblicazione: (2024)
di: Zhang, Zhipeng, et al.
Pubblicazione: (2024)
InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing
di: Zhang, Jinlu, et al.
Pubblicazione: (2025)
di: Zhang, Jinlu, et al.
Pubblicazione: (2025)
Leverage Task Context for Object Affordance Ranking
di: Huang, Haojie, et al.
Pubblicazione: (2024)
di: Huang, Haojie, et al.
Pubblicazione: (2024)
HOI-PAGE: Zero-Shot Human-Object Interaction Generation with Part Affordance Guidance
di: Li, Lei, et al.
Pubblicazione: (2025)
di: Li, Lei, et al.
Pubblicazione: (2025)
SAM3-I: Segment Anything with Instructions
di: Li, Jingjing, et al.
Pubblicazione: (2025)
di: Li, Jingjing, et al.
Pubblicazione: (2025)
Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances
di: Wang, Qirui, et al.
Pubblicazione: (2026)
di: Wang, Qirui, et al.
Pubblicazione: (2026)
X-SAM: From Segment Anything to Any Segmentation
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
SAM Audio: Segment Anything in Audio
di: Shi, Bowen, et al.
Pubblicazione: (2025)
di: Shi, Bowen, et al.
Pubblicazione: (2025)
INTRA: Interaction Relationship-aware Weakly Supervised Affordance Grounding
di: Jang, Ji Ha, et al.
Pubblicazione: (2024)
di: Jang, Ji Ha, et al.
Pubblicazione: (2024)
SlimSAM: 0.1% Data Makes Segment Anything Slim
di: Chen, Zigeng, et al.
Pubblicazione: (2023)
di: Chen, Zigeng, et al.
Pubblicazione: (2023)
HAMMER: Harnessing MLLM via Cross-Modal Integration for Intention-Driven 3D Affordance Grounding
di: Yao, Lei, et al.
Pubblicazione: (2026)
di: Yao, Lei, et al.
Pubblicazione: (2026)
Selective Contrastive Learning for Weakly Supervised Affordance Grounding
di: Moon, WonJun, et al.
Pubblicazione: (2025)
di: Moon, WonJun, et al.
Pubblicazione: (2025)
DeSAM: Decoupled Segment Anything Model for Generalizable Medical Image Segmentation
di: Gao, Yifan, et al.
Pubblicazione: (2023)
di: Gao, Yifan, et al.
Pubblicazione: (2023)
One-Shot Affordance Grounding of Deformable Objects in Egocentric Organizing Scenes
di: Jia, Wanjun, et al.
Pubblicazione: (2025)
di: Jia, Wanjun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Deforming Videos to Masks: Flow Matching for Referring Video Segmentation
di: Wang, Zanyi, et al.
Pubblicazione: (2025) -
Unlocking the Potential of Grounding DINO in Videos: Parameter-Efficient Adaptation for Limited-Data Spatial-Temporal Localization
di: Wang, Zanyi, et al.
Pubblicazione: (2026) -
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
di: Ma, Teli, et al.
Pubblicazione: (2024) -
Exploring Time Conditioning in Diffusion Generative Models from Disjoint Noisy Data Manifolds
di: Li, Liuzhuozheng, et al.
Pubblicazione: (2026) -
Low-Biased General Annotated Dataset Generation
di: Jiang, Dengyang, et al.
Pubblicazione: (2024)