Human-Object Interaction Detection Collaborated with Large Relation-driven Diffusion Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Liulei, Wang, Wenguan, Yang, Yi |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DIFFVSGG: Diffusion-Driven Online Video Scene Graph Generation
par: Chen, Mu, et autres
Publié: (2025)
par: Chen, Mu, et autres
Publié: (2025)
Clustering Propagation for Universal Medical Image Segmentation
par: Ding, Yuhang, et autres
Publié: (2024)
par: Ding, Yuhang, et autres
Publié: (2024)
PKINet-v2: Towards Powerful and Efficient Poly-Kernel Remote Sensing Object Detection
par: Cai, Xinhao, et autres
Publié: (2026)
par: Cai, Xinhao, et autres
Publié: (2026)
Unbiased Object Detection Beyond Frequency with Visually Prompted Image Synthesis
par: Cai, Xinhao, et autres
Publié: (2025)
par: Cai, Xinhao, et autres
Publié: (2025)
Learning Human-Object Interaction as Groups
par: Hong, Jiajun, et autres
Publié: (2025)
par: Hong, Jiajun, et autres
Publié: (2025)
General and Task-Oriented Video Segmentation
par: Chen, Mu, et autres
Publié: (2024)
par: Chen, Mu, et autres
Publié: (2024)
IS-Fusion: Instance-Scene Collaborative Fusion for Multimodal 3D Object Detection
par: Yin, Junbo, et autres
Publié: (2024)
par: Yin, Junbo, et autres
Publié: (2024)
Nonverbal Interaction Detection
par: Wei, Jianan, et autres
Publié: (2024)
par: Wei, Jianan, et autres
Publié: (2024)
Navigation Instruction Generation with BEV Perception and Large Language Models
par: Fan, Sheng, et autres
Publié: (2024)
par: Fan, Sheng, et autres
Publié: (2024)
Bilateral Collaboration with Large Vision-Language Models for Open Vocabulary Human-Object Interaction Detection
par: Hu, Yupeng, et autres
Publié: (2025)
par: Hu, Yupeng, et autres
Publié: (2025)
CORE4D: A 4D Human-Object-Human Interaction Dataset for Collaborative Object REarrangement
par: Liu, Yun, et autres
Publié: (2024)
par: Liu, Yun, et autres
Publié: (2024)
Hydra-SGG: Hybrid Relation Assignment for One-stage Scene Graph Generation
par: Chen, Minghan, et autres
Publié: (2024)
par: Chen, Minghan, et autres
Publié: (2024)
Psychometry: An Omnifit Model for Image Reconstruction from Human Brain Activity
par: Quan, Ruijie, et autres
Publié: (2024)
par: Quan, Ruijie, et autres
Publié: (2024)
Rethinking Cross-modal Interaction from a Top-down Perspective for Referring Video Object Segmentation
par: Liang, Chen, et autres
Publié: (2021)
par: Liang, Chen, et autres
Publié: (2021)
THOR: Text to Human-Object Interaction Diffusion via Relation Intervention
par: Wu, Qianyang, et autres
Publié: (2024)
par: Wu, Qianyang, et autres
Publié: (2024)
Scalable Video Object Segmentation with Identification Mechanism
par: Yang, Zongxin, et autres
Publié: (2022)
par: Yang, Zongxin, et autres
Publié: (2022)
DoraemonGPT: Toward Understanding Dynamic Scenes with Large Language Models (Exemplified as A Video Agent)
par: Yang, Zongxin, et autres
Publié: (2024)
par: Yang, Zongxin, et autres
Publié: (2024)
A Survey of World Models for Autonomous Driving
par: Feng, Tuo, et autres
Publié: (2025)
par: Feng, Tuo, et autres
Publié: (2025)
LSK3DNet: Towards Effective and Efficient 3D Perception with Large Sparse Kernels
par: Feng, Tuo, et autres
Publié: (2024)
par: Feng, Tuo, et autres
Publié: (2024)
Incremental Human-Object Interaction Detection with Invariant Relation Representation Learning
par: Wei, Yana, et autres
Publié: (2025)
par: Wei, Yana, et autres
Publié: (2025)
Scene Graph Generation with Role-Playing Large Language Models
par: Chen, Guikun, et autres
Publié: (2024)
par: Chen, Guikun, et autres
Publié: (2024)
Mutual Learning for Acoustic Matching and Dereverberation via Visual Scene-driven Diffusion
par: Ma, Jian, et autres
Publié: (2024)
par: Ma, Jian, et autres
Publié: (2024)
Volumetric Environment Representation for Vision-Language Navigation
par: Liu, Rui, et autres
Publié: (2024)
par: Liu, Rui, et autres
Publié: (2024)
Vision-Language Navigation with Energy-Based Policy
par: Liu, Rui, et autres
Publié: (2024)
par: Liu, Rui, et autres
Publié: (2024)
An Image-like Diffusion Method for Human-Object Interaction Detection
par: Hui, Xiaofei, et autres
Publié: (2025)
par: Hui, Xiaofei, et autres
Publié: (2025)
SinkTrack: Attention Sink based Context Anchoring for Large Language Models
par: Liu, Xu, et autres
Publié: (2026)
par: Liu, Xu, et autres
Publié: (2026)
Egocentric Human-Object Interaction Detection: A New Benchmark and Method
par: Deng, Kunyuan, et autres
Publié: (2025)
par: Deng, Kunyuan, et autres
Publié: (2025)
Contextualized Representation Learning for Effective Human-Object Interaction Detection
par: Li, Zhehao, et autres
Publié: (2025)
par: Li, Zhehao, et autres
Publié: (2025)
Multimodal Graph Network Modeling for Human-Object Interaction Detection with PDE Graph Diffusion
par: Ji, Wenxuan, et autres
Publié: (2025)
par: Ji, Wenxuan, et autres
Publié: (2025)
Moving Beyond Diffusion: Hierarchy-to-Hierarchy Autoregression for fMRI-to-Image Reconstruction
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
Neural Clustering based Visual Representation Learning
par: Chen, Guikun, et autres
Publié: (2024)
par: Chen, Guikun, et autres
Publié: (2024)
RegFormer: Transferable Relational Grounding for Efficient Weakly-Supervised Human-Object Interaction Detection
par: Park, Jihwan, et autres
Publié: (2026)
par: Park, Jihwan, et autres
Publié: (2026)
Disentangled Pre-training for Human-Object Interaction Detection
par: Li, Zhuolong, et autres
Publié: (2024)
par: Li, Zhuolong, et autres
Publié: (2024)
No More Sibling Rivalry: Debiasing Human-Object Interaction Detection
par: Yang, Bin, et autres
Publié: (2025)
par: Yang, Bin, et autres
Publié: (2025)
Geometric Features Enhanced Human-Object Interaction Detection
par: Zhu, Manli, et autres
Publié: (2024)
par: Zhu, Manli, et autres
Publié: (2024)
Frequency-based Matcher for Long-tailed Semantic Segmentation
par: Li, Shan, et autres
Publié: (2024)
par: Li, Shan, et autres
Publié: (2024)
Guiding Human-Object Interactions with Rich Geometry and Relations
par: Xue, Mengqing, et autres
Publié: (2025)
par: Xue, Mengqing, et autres
Publié: (2025)
Uncertainty Aware Human-machine Collaboration in Camouflaged Object Detection
par: Yang, Ziyue, et autres
Publié: (2025)
par: Yang, Ziyue, et autres
Publié: (2025)
Visual Knowledge in the Big Model Era: Retrospect and Prospect
par: Wang, Wenguan, et autres
Publié: (2024)
par: Wang, Wenguan, et autres
Publié: (2024)
Open-World Human-Object Interaction Detection via Multi-modal Prompts
par: Yang, Jie, et autres
Publié: (2024)
par: Yang, Jie, et autres
Publié: (2024)
Documents similaires
-
DIFFVSGG: Diffusion-Driven Online Video Scene Graph Generation
par: Chen, Mu, et autres
Publié: (2025) -
Clustering Propagation for Universal Medical Image Segmentation
par: Ding, Yuhang, et autres
Publié: (2024) -
PKINet-v2: Towards Powerful and Efficient Poly-Kernel Remote Sensing Object Detection
par: Cai, Xinhao, et autres
Publié: (2026) -
Unbiased Object Detection Beyond Frequency with Visually Prompted Image Synthesis
par: Cai, Xinhao, et autres
Publié: (2025) -
Learning Human-Object Interaction as Groups
par: Hong, Jiajun, et autres
Publié: (2025)