HOI-Swap: Swapping Objects in Videos with Hand-Object Interaction Awareness
Fuente:
arXiv
Guardado en:
| Autores principales: | Xue, Zihui, Luo, Mi, Chen, Changan, Grauman, Kristen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning Object State Changes in Videos: An Open-World Perspective
por: Xue, Zihui, et al.
Publicado: (2023)
por: Xue, Zihui, et al.
Publicado: (2023)
Seeing the Arrow of Time in Large Multimodal Models
por: Xue, Zihui, et al.
Publicado: (2025)
por: Xue, Zihui, et al.
Publicado: (2025)
Put Myself in Your Shoes: Lifting the Egocentric Perspective from Exocentric Videos
por: Luo, Mi, et al.
Publicado: (2024)
por: Luo, Mi, et al.
Publicado: (2024)
Progress-Aware Video Frame Captioning
por: Xue, Zihui, et al.
Publicado: (2024)
por: Xue, Zihui, et al.
Publicado: (2024)
SPOC: Spatially-Progressing Object State Change Segmentation in Video
por: Mandikal, Priyanka, et al.
Publicado: (2025)
por: Mandikal, Priyanka, et al.
Publicado: (2025)
When Thinking Drifts: Evidential Grounding for Robust Video Reasoning
por: Luo, Mi, et al.
Publicado: (2025)
por: Luo, Mi, et al.
Publicado: (2025)
Don't Let the Video Speak: Audio-Contrastive Preference Optimization for Audio-Visual Language Models
por: Baid, Ami, et al.
Publicado: (2026)
por: Baid, Ami, et al.
Publicado: (2026)
Detours for Navigating Instructional Videos
por: Ashutosh, Kumar, et al.
Publicado: (2024)
por: Ashutosh, Kumar, et al.
Publicado: (2024)
Personal Visual Context Learning in Large Multimodal Models
por: Xue, Zihui, et al.
Publicado: (2026)
por: Xue, Zihui, et al.
Publicado: (2026)
ForeHOI: Feed-forward 3D Object Reconstruction from Daily Hand-Object Interaction Videos
por: Chen, Yuantao, et al.
Publicado: (2026)
por: Chen, Yuantao, et al.
Publicado: (2026)
Towards Source-Aware Object Swapping with Initial Noise Perturbation
por: Zhan, Jiahui, et al.
Publicado: (2026)
por: Zhan, Jiahui, et al.
Publicado: (2026)
HOI-Ref: Hand-Object Interaction Referral in Egocentric Vision
por: Bansal, Siddhant, et al.
Publicado: (2024)
por: Bansal, Siddhant, et al.
Publicado: (2024)
SwapAnything: Enabling Arbitrary Object Swapping in Personalized Visual Editing
por: Gu, Jing, et al.
Publicado: (2024)
por: Gu, Jing, et al.
Publicado: (2024)
Action2Sound: Ambient-Aware Generation of Action Sounds from Egocentric Videos
por: Chen, Changan, et al.
Publicado: (2024)
por: Chen, Changan, et al.
Publicado: (2024)
GenHOI: Towards Object-Consistent Hand-Object Interaction with Temporally Balanced and Spatially Selective Object Injection
por: Huang, Xuan, et al.
Publicado: (2026)
por: Huang, Xuan, et al.
Publicado: (2026)
GenHOI: Generalized Hand-Object Pose Estimation with Occlusion Awareness
por: Yang, Hui, et al.
Publicado: (2026)
por: Yang, Hui, et al.
Publicado: (2026)
DynaHOI: Benchmarking Hand-Object Interaction for Dynamic Target
por: Hu, BoCheng, et al.
Publicado: (2026)
por: Hu, BoCheng, et al.
Publicado: (2026)
TexHOI: Reconstructing Textures of 3D Unknown Objects in Monocular Hand-Object Interaction Scenes
por: Aggarwal, Alakh, et al.
Publicado: (2025)
por: Aggarwal, Alakh, et al.
Publicado: (2025)
iDiT-HOI: Inpainting-based Hand Object Interaction Reenactment via Video Diffusion Transformer
por: Shen, Zhelun, et al.
Publicado: (2025)
por: Shen, Zhelun, et al.
Publicado: (2025)
GaussianSwap: Animatable Video Face Swapping with 3D Gaussian Splatting
por: Cheng, Xuan, et al.
Publicado: (2026)
por: Cheng, Xuan, et al.
Publicado: (2026)
ExpertEdit: Learning Skill-Aware Motion Editing from Expert Videos
por: Somayazulu, Arjun, et al.
Publicado: (2026)
por: Somayazulu, Arjun, et al.
Publicado: (2026)
Ins-HOI: Instance Aware Human-Object Interactions Recovery
por: Zhang, Jiajun, et al.
Publicado: (2023)
por: Zhang, Jiajun, et al.
Publicado: (2023)
SwapAnyone: Consistent and Realistic Video Synthesis for Swapping Any Person into Any Video
por: Zhao, Chengshu, et al.
Publicado: (2025)
por: Zhao, Chengshu, et al.
Publicado: (2025)
EasyHOI: Unleashing the Power of Large Models for Reconstructing Hand-Object Interactions in the Wild
por: Liu, Yumeng, et al.
Publicado: (2024)
por: Liu, Yumeng, et al.
Publicado: (2024)
CanonSwap: High-Fidelity and Consistent Video Face Swapping via Canonical Space Modulation
por: Luo, Xiangyang, et al.
Publicado: (2025)
por: Luo, Xiangyang, et al.
Publicado: (2025)
PartHOI: Part-based Hand-Object Interaction Transfer via Generalized Cylinders
por: Wang, Qiaochu, et al.
Publicado: (2025)
por: Wang, Qiaochu, et al.
Publicado: (2025)
PA-HOI: A Physics-Aware Human and Object Interaction Dataset
por: Wang, Ruiyan, et al.
Publicado: (2025)
por: Wang, Ruiyan, et al.
Publicado: (2025)
RoboSwap: A GAN-driven Video Diffusion Framework For Unsupervised Robot Arm Swapping
por: Bai, Yang, et al.
Publicado: (2025)
por: Bai, Yang, et al.
Publicado: (2025)
Text2HOI: Text-guided 3D Motion Generation for Hand-Object Interaction
por: Cha, Junuk, et al.
Publicado: (2024)
por: Cha, Junuk, et al.
Publicado: (2024)
OpenHOI: Open-World Hand-Object Interaction Synthesis with Multimodal Large Language Model
por: Zhang, Zhenhao, et al.
Publicado: (2025)
por: Zhang, Zhenhao, et al.
Publicado: (2025)
DreamSwapV: Mask-guided Subject Swapping for Any Customized Video Editing
por: Wang, Weitao, et al.
Publicado: (2025)
por: Wang, Weitao, et al.
Publicado: (2025)
HieraMamba: Video Temporal Grounding via Hierarchical Anchor-Mamba Pooling
por: An, Joungbin, et al.
Publicado: (2025)
por: An, Joungbin, et al.
Publicado: (2025)
FIction: 4D Future Interaction Prediction from Video
por: Ashutosh, Kumar, et al.
Publicado: (2024)
por: Ashutosh, Kumar, et al.
Publicado: (2024)
ViewBridge: Curriculum Knowledge Distillation for Activity View-Invariance Under Extreme Viewpoint Changes
por: Somayazulu, Arjun, et al.
Publicado: (2025)
por: Somayazulu, Arjun, et al.
Publicado: (2025)
MaskHOI: Robust 3D Hand-Object Interaction Estimation via Masked Pre-training
por: Xie, Yuechen, et al.
Publicado: (2025)
por: Xie, Yuechen, et al.
Publicado: (2025)
ArtHOI: Taming Foundation Models for Monocular 4D Reconstruction of Hand-Articulated-Object Interactions
por: Wang, Zikai, et al.
Publicado: (2026)
por: Wang, Zikai, et al.
Publicado: (2026)
AGSwap: Overcoming Category Boundaries in Object Fusion via Adaptive Group Swapping
por: Zhang, Zedong, et al.
Publicado: (2025)
por: Zhang, Zedong, et al.
Publicado: (2025)
Seeing without Pixels: Perception from Camera Trajectories
por: Xue, Zihui, et al.
Publicado: (2025)
por: Xue, Zihui, et al.
Publicado: (2025)
Few-View Object Reconstruction with Unknown Categories and Camera Poses
por: Jiang, Hanwen, et al.
Publicado: (2022)
por: Jiang, Hanwen, et al.
Publicado: (2022)
Learning Skill-Attributes for Transferable Assessment in Video
por: Ashutosh, Kumar, et al.
Publicado: (2025)
por: Ashutosh, Kumar, et al.
Publicado: (2025)
Ejemplares similares
-
Learning Object State Changes in Videos: An Open-World Perspective
por: Xue, Zihui, et al.
Publicado: (2023) -
Seeing the Arrow of Time in Large Multimodal Models
por: Xue, Zihui, et al.
Publicado: (2025) -
Put Myself in Your Shoes: Lifting the Egocentric Perspective from Exocentric Videos
por: Luo, Mi, et al.
Publicado: (2024) -
Progress-Aware Video Frame Captioning
por: Xue, Zihui, et al.
Publicado: (2024) -
SPOC: Spatially-Progressing Object State Change Segmentation in Video
por: Mandikal, Priyanka, et al.
Publicado: (2025)