Beyond Sequences: A Benchmark for Atomic Hand-Object Interaction Using a Static RNN Encoder
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Movahed, Yousef Azizi, Ziaeetabar, Fatemeh |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Why Relational Graphs Will Save the Next Generation of Vision Foundation Models?
par: Ziaeetabar, Fatemeh
Publié: (2025)
par: Ziaeetabar, Fatemeh
Publié: (2025)
EfficientGFormer: Multimodal Brain Tumor Segmentation via Pruned Graph-Augmented Transformer
par: Ziaeetabar, Fatemeh
Publié: (2025)
par: Ziaeetabar, Fatemeh
Publié: (2025)
Neuro-Symbolic Manipulation Understanding with Enriched Semantic Event Chains
par: Ziaeetabar, Fatemeh
Publié: (2026)
par: Ziaeetabar, Fatemeh
Publié: (2026)
Leveraging Foundation Models for Multimodal Graph-Based Action Recognition
par: Ziaeetabar, Fatemeh, et autres
Publié: (2025)
par: Ziaeetabar, Fatemeh, et autres
Publié: (2025)
DRL-Guided Neural Batch Sampling for Semi-Supervised Pixel-Level Anomaly Detection
par: Noghredeh, Amirhossein Khadivi, et autres
Publié: (2025)
par: Noghredeh, Amirhossein Khadivi, et autres
Publié: (2025)
HOIGPT: Learning Long Sequence Hand-Object Interaction with Language Models
par: Huang, Mingzhen, et autres
Publié: (2025)
par: Huang, Mingzhen, et autres
Publié: (2025)
Benchmarks and Challenges in Pose Estimation for Egocentric Hand Interactions with Objects
par: Fan, Zicong, et autres
Publié: (2024)
par: Fan, Zicong, et autres
Publié: (2024)
DynaHOI: Benchmarking Hand-Object Interaction for Dynamic Target
par: Hu, BoCheng, et autres
Publié: (2026)
par: Hu, BoCheng, et autres
Publié: (2026)
MEgoHand: Multimodal Egocentric Hand-Object Interaction Motion Generation
par: Zhou, Bohan, et autres
Publié: (2025)
par: Zhou, Bohan, et autres
Publié: (2025)
Occlusion-Aware 3D Hand-Object Pose Estimation with Masked AutoEncoders
par: Yang, Hui, et autres
Publié: (2025)
par: Yang, Hui, et autres
Publié: (2025)
HanDyVQA: A Video QA Benchmark for Fine-Grained Hand-Object Interaction Dynamics
par: Tateno, Masatoshi, et autres
Publié: (2025)
par: Tateno, Masatoshi, et autres
Publié: (2025)
A Versatile and Differentiable Hand-Object Interaction Representation
par: Morales, Théo, et autres
Publié: (2024)
par: Morales, Théo, et autres
Publié: (2024)
HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness
par: Xue, Zihui, et autres
Publié: (2024)
par: Xue, Zihui, et autres
Publié: (2024)
PEAR: Phrase-Based Hand-Object Interaction Anticipation
par: Zhang, Zichen, et autres
Publié: (2024)
par: Zhang, Zichen, et autres
Publié: (2024)
HandBooster: Boosting 3D Hand-Mesh Reconstruction by Conditional Synthesis and Sampling of Hand-Object Interactions
par: Xu, Hao, et autres
Publié: (2024)
par: Xu, Hao, et autres
Publié: (2024)
Reconstructing Objects along Hand Interaction Timelines in Egocentric Video
par: Zhu, Zhifan, et autres
Publié: (2025)
par: Zhu, Zhifan, et autres
Publié: (2025)
Gaze-guided Hand-Object Interaction Synthesis: Dataset and Method
par: Tian, Jie, et autres
Publié: (2024)
par: Tian, Jie, et autres
Publié: (2024)
HOI-Ref: Hand-Object Interaction Referral in Egocentric Vision
par: Bansal, Siddhant, et autres
Publié: (2024)
par: Bansal, Siddhant, et autres
Publié: (2024)
Are Synthetic Data Useful for Egocentric Hand-Object Interaction Detection?
par: Leonardi, Rosario, et autres
Publié: (2023)
par: Leonardi, Rosario, et autres
Publié: (2023)
HandNeRF: Learning to Reconstruct Hand-Object Interaction Scene from a Single RGB Image
par: Choi, Hongsuk, et autres
Publié: (2023)
par: Choi, Hongsuk, et autres
Publié: (2023)
MiniGPT-Reverse-Designing: Predicting Image Adjustments Utilizing MiniGPT-4
par: Azizi, Vahid, et autres
Publié: (2024)
par: Azizi, Vahid, et autres
Publié: (2024)
Benchmarking Interaction, Beyond Policy: a Reproducible Benchmark for Collaborative Instance Object Navigation
par: Zorzi, Edoardo, et autres
Publié: (2026)
par: Zorzi, Edoardo, et autres
Publié: (2026)
Efficient Masked AutoEncoder for Video Object Counting and A Large-Scale Benchmark
par: Cao, Bing, et autres
Publié: (2024)
par: Cao, Bing, et autres
Publié: (2024)
Interaction-Aware 4D Gaussian Splatting for Dynamic Hand-Object Interaction Reconstruction
par: Tian, Hao, et autres
Publié: (2025)
par: Tian, Hao, et autres
Publié: (2025)
LION: Linear Group RNN for 3D Object Detection in Point Clouds
par: Liu, Zhe, et autres
Publié: (2024)
par: Liu, Zhe, et autres
Publié: (2024)
HandsOnVLM: Vision-Language Models for Hand-Object Interaction Prediction
par: Bao, Chen, et autres
Publié: (2024)
par: Bao, Chen, et autres
Publié: (2024)
CHOIR: Contact-aware 4D Hand-Object Interaction Reconstruction
par: Xu, Hao, et autres
Publié: (2026)
par: Xu, Hao, et autres
Publié: (2026)
HOIDiffusion: Generating Realistic 3D Hand-Object Interaction Data
par: Zhang, Mengqi, et autres
Publié: (2024)
par: Zhang, Mengqi, et autres
Publié: (2024)
Grasp in Gaussians: Fast Monocular Reconstruction of Dynamic Hand-Object Interactions
par: Aytekin, Ayce Idil, et autres
Publié: (2026)
par: Aytekin, Ayce Idil, et autres
Publié: (2026)
Leveraging Synthetic Data for Enhancing Egocentric Hand-Object Interaction Detection
par: Leonardi, Rosario, et autres
Publié: (2026)
par: Leonardi, Rosario, et autres
Publié: (2026)
GraspDiffusion: Synthesizing Realistic Whole-body Hand-Object Interaction
par: Kwon, Patrick, et autres
Publié: (2024)
par: Kwon, Patrick, et autres
Publié: (2024)
GenHOI: Towards Object-Consistent Hand-Object Interaction with Temporally Balanced and Spatially Selective Object Injection
par: Huang, Xuan, et autres
Publié: (2026)
par: Huang, Xuan, et autres
Publié: (2026)
HOIGaze: Gaze Estimation During Hand-Object Interactions in Extended Reality Exploiting Eye-Hand-Head Coordination
par: Hu, Zhiming, et autres
Publié: (2025)
par: Hu, Zhiming, et autres
Publié: (2025)
Hand-Centric Motion Refinement for 3D Hand-Object Interaction via Hierarchical Spatial-Temporal Modeling
par: Hao, Yuze, et autres
Publié: (2024)
par: Hao, Yuze, et autres
Publié: (2024)
A Real-Time System for Egocentric Hand-Object Interaction Detection in Industrial Domains
par: Finocchiaro, Antonio, et autres
Publié: (2025)
par: Finocchiaro, Antonio, et autres
Publié: (2025)
From Filters to VLMs: Benchmarking Defogging Methods through Object Detection and Segmentation Performance
par: Aryashad, Ardalan, et autres
Publié: (2025)
par: Aryashad, Ardalan, et autres
Publié: (2025)
TexHOI: Reconstructing Textures of 3D Unknown Objects in Monocular Hand-Object Interaction Scenes
par: Aggarwal, Alakh, et autres
Publié: (2025)
par: Aggarwal, Alakh, et autres
Publié: (2025)
Egocentric World Model for Photorealistic Hand-Object Interaction Synthesis
par: Li, Dayou, et autres
Publié: (2026)
par: Li, Dayou, et autres
Publié: (2026)
Towards Realistic Hand-Object Interaction with Gravity-Field Based Diffusion Bridge
par: Xu, Miao, et autres
Publié: (2025)
par: Xu, Miao, et autres
Publié: (2025)
Follow My Hold: Hand-Object Interaction Reconstruction through Geometric Guidance
par: Aytekin, Ayce Idil, et autres
Publié: (2025)
par: Aytekin, Ayce Idil, et autres
Publié: (2025)
Documents similaires
-
Why Relational Graphs Will Save the Next Generation of Vision Foundation Models?
par: Ziaeetabar, Fatemeh
Publié: (2025) -
EfficientGFormer: Multimodal Brain Tumor Segmentation via Pruned Graph-Augmented Transformer
par: Ziaeetabar, Fatemeh
Publié: (2025) -
Neuro-Symbolic Manipulation Understanding with Enriched Semantic Event Chains
par: Ziaeetabar, Fatemeh
Publié: (2026) -
Leveraging Foundation Models for Multimodal Graph-Based Action Recognition
par: Ziaeetabar, Fatemeh, et autres
Publié: (2025) -
DRL-Guided Neural Batch Sampling for Semi-Supervised Pixel-Level Anomaly Detection
par: Noghredeh, Amirhossein Khadivi, et autres
Publié: (2025)