Enregistré dans:
| Auteurs principaux: | Mao, Aihua, Huang, Kaihang, Liu, Yong-Jin, Chan, Chee Seng, He, Ying |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.20608 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VideoAfford: Grounding 3D Affordance from Human-Object-Interaction Videos via Multimodal Large Language Model
par: Wang, Hanqing, et autres
Publié: (2026)
par: Wang, Hanqing, et autres
Publié: (2026)
OneHOI: Unifying Human-Object Interaction Generation and Editing
par: Hoe, Jiun Tian, et autres
Publié: (2026)
par: Hoe, Jiun Tian, et autres
Publié: (2026)
Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025)
par: Hoe, Jiun Tian, et autres
Publié: (2025)
VAGNet: Vision-based Accident Anticipation with Global Features
par: Vipulananthan, Vipooshan, et autres
Publié: (2026)
par: Vipulananthan, Vipooshan, et autres
Publié: (2026)
Grounding 3D Scene Affordance From Egocentric Interactions
par: Liu, Cuiyu, et autres
Publié: (2024)
par: Liu, Cuiyu, et autres
Publié: (2024)
DMF-Net: Image-Guided Point Cloud Completion with Dual-Channel Modality Fusion and Shape-Aware Upsampling Transformer
par: Mao, Aihua, et autres
Publié: (2024)
par: Mao, Aihua, et autres
Publié: (2024)
InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing
par: Zhang, Jinlu, et autres
Publié: (2025)
par: Zhang, Jinlu, et autres
Publié: (2025)
Learning 2D Invariant Affordance Knowledge for 3D Affordance Grounding
par: Gao, Xianqiang, et autres
Publié: (2024)
par: Gao, Xianqiang, et autres
Publié: (2024)
H2OFlow: Grounding Human-Object Affordances with 3D Generative Models and Dense Diffused Flows
par: Zhang, Harry, et autres
Publié: (2025)
par: Zhang, Harry, et autres
Publié: (2025)
IAAO: Interactive Affordance Learning for Articulated Objects in 3D Environments
par: Zhang, Can, et autres
Publié: (2025)
par: Zhang, Can, et autres
Publié: (2025)
Gorgeous: Create Your Desired Character Facial Makeup from Any Ideas
par: Sii, Jia Wei, et autres
Publié: (2024)
par: Sii, Jia Wei, et autres
Publié: (2024)
Protégé: Learn and Generate Basic Makeup Styles with Generative Adversarial Networks (GANs)
par: Sii, Jia Wei, et autres
Publié: (2024)
par: Sii, Jia Wei, et autres
Publié: (2024)
Yuan: Yielding Unblemished Aesthetics Through A Unified Network for Visual Imperfections Removal in Generated Images
par: Yu, Zhenyu, et autres
Publié: (2025)
par: Yu, Zhenyu, et autres
Publié: (2025)
Object Affordance Recognition and Grounding via Multi-scale Cross-modal Representation Learning
par: Wan, Xinhang, et autres
Publié: (2025)
par: Wan, Xinhang, et autres
Publié: (2025)
CompassAD: Intent-Driven 3D Affordance Grounding in Functionally Competing Objects
par: Li, Jingliang, et autres
Publié: (2026)
par: Li, Jingliang, et autres
Publié: (2026)
O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation
par: Tian, Tongxuan, et autres
Publié: (2025)
par: Tian, Tongxuan, et autres
Publié: (2025)
Affostruction: 3D Affordance Grounding with Generative Reconstruction
par: Park, Chunghyun, et autres
Publié: (2026)
par: Park, Chunghyun, et autres
Publié: (2026)
Grounding by Remembering: Cross-Scene and In-Scene Memory for 3D Functional Affordances
par: Wang, Qirui, et autres
Publié: (2026)
par: Wang, Qirui, et autres
Publié: (2026)
Interacted Object Grounding in Spatio-Temporal Human-Object Interactions
par: Liu, Xiaoyang, et autres
Publié: (2024)
par: Liu, Xiaoyang, et autres
Publié: (2024)
HAMMER: Harnessing MLLM via Cross-Modal Integration for Intention-Driven 3D Affordance Grounding
par: Yao, Lei, et autres
Publié: (2026)
par: Yao, Lei, et autres
Publié: (2026)
InteractDiffusion: Interaction Control in Text-to-Image Diffusion Models
par: Hoe, Jiun Tian, et autres
Publié: (2023)
par: Hoe, Jiun Tian, et autres
Publié: (2023)
Part-Aware Open-Vocabulary 3D Affordance Grounding via Prototypical Semantic and Geometric Alignment
par: Gou, Dongqiang, et autres
Publié: (2026)
par: Gou, Dongqiang, et autres
Publié: (2026)
Populate-A-Scene: Affordance-Aware Human Video Generation
par: Shan, Mengyi, et autres
Publié: (2025)
par: Shan, Mengyi, et autres
Publié: (2025)
INTRA: Interaction Relationship-aware Weakly Supervised Affordance Grounding
par: Jang, Ji Ha, et autres
Publié: (2024)
par: Jang, Ji Ha, et autres
Publié: (2024)
Chirpy3D: Part-Aware Multi-View Diffusion for Creative Fine-Grained Object Generation
par: Ng, Kam Woh, et autres
Publié: (2025)
par: Ng, Kam Woh, et autres
Publié: (2025)
DAViD: Modeling Dynamic Affordance of 3D Objects Using Pre-trained Video Diffusion Models
par: Kim, Hyeonwoo, et autres
Publié: (2025)
par: Kim, Hyeonwoo, et autres
Publié: (2025)
GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding
par: Shao, Yawen, et autres
Publié: (2024)
par: Shao, Yawen, et autres
Publié: (2024)
HOI-PAGE: Zero-Shot Human-Object Interaction Generation with Part Affordance Guidance
par: Li, Lei, et autres
Publié: (2025)
par: Li, Lei, et autres
Publié: (2025)
DAG: Unleash the Potential of Diffusion Model for Open-Vocabulary 3D Affordance Grounding
par: Wang, Hanqing, et autres
Publié: (2025)
par: Wang, Hanqing, et autres
Publié: (2025)
InteractMove: Text-Controlled Human-Object Interaction Generation in 3D Scenes with Movable Objects
par: Cai, Xinhao, et autres
Publié: (2025)
par: Cai, Xinhao, et autres
Publié: (2025)
DO3D: Self-supervised Learning of Decomposed Object-aware 3D Motion and Depth from Monocular Videos
par: Wu, Xiuzhe, et autres
Publié: (2024)
par: Wu, Xiuzhe, et autres
Publié: (2024)
AffordanceSAM: Segment Anything Once More in Affordance Grounding
par: Jiang, Dengyang, et autres
Publié: (2025)
par: Jiang, Dengyang, et autres
Publié: (2025)
SceneTeract: Agentic Functional Affordances and VLM Grounding in 3D Scenes
par: Maillard, Léopold, et autres
Publié: (2026)
par: Maillard, Léopold, et autres
Publié: (2026)
Leverage Task Context for Object Affordance Ranking
par: Huang, Haojie, et autres
Publié: (2024)
par: Huang, Haojie, et autres
Publié: (2024)
Integrating Affordances and Attention models for Short-Term Object Interaction Anticipation
par: Labadia, Lorenzo Mur, et autres
Publié: (2026)
par: Labadia, Lorenzo Mur, et autres
Publié: (2026)
ArtHOI: Articulated Human-Object Interaction Synthesis by 4D Reconstruction from Video Priors
par: Huang, Zihao, et autres
Publié: (2026)
par: Huang, Zihao, et autres
Publié: (2026)
AffordanceLLM: Grounding Affordance from Vision Language Models
par: Qian, Shengyi, et autres
Publié: (2024)
par: Qian, Shengyi, et autres
Publié: (2024)
Towards Affordance-Aware Articulation Synthesis for Rigged Objects
par: Yu, Yu-Chu, et autres
Publié: (2025)
par: Yu, Yu-Chu, et autres
Publié: (2025)
Harnessing Object Grounding for Time-Sensitive Video Understanding
par: Wu, Tz-Ying, et autres
Publié: (2025)
par: Wu, Tz-Ying, et autres
Publié: (2025)
Documents similaires
-
VideoAfford: Grounding 3D Affordance from Human-Object-Interaction Videos via Multimodal Large Language Model
par: Wang, Hanqing, et autres
Publié: (2026) -
OneHOI: Unifying Human-Object Interaction Generation and Editing
par: Hoe, Jiun Tian, et autres
Publié: (2026) -
Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions
par: Zhu, He, et autres
Publié: (2025) -
InteractEdit: Zero-Shot Editing of Human-Object Interactions in Images
par: Hoe, Jiun Tian, et autres
Publié: (2025) -
VAGNet: Vision-based Accident Anticipation with Global Features
par: Vipulananthan, Vipooshan, et autres
Publié: (2026)