From Camera to World: A Plug-and-Play Module for Human Mesh Transformation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ma, Changhai, Wu, Ziyu, Zhang, Yunkang, Ying, Qijun, Liu, Boyan, Cai, Xiaohui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PI-HMR: Towards Robust In-bed Temporal Human Shape Reconstruction with Contact Pressure Sensing
par: Wu, Ziyu, et autres
Publié: (2025)
par: Wu, Ziyu, et autres
Publié: (2025)
PressTrack-HMR: Pressure-Based Top-Down Multi-Person Global Human Mesh Recovery
par: Yuan, Jiayue, et autres
Publié: (2025)
par: Yuan, Jiayue, et autres
Publié: (2025)
WATCH: World-aware Allied Trajectory and pose reconstruction for Camera and Human
par: Ying, Qijun, et autres
Publié: (2025)
par: Ying, Qijun, et autres
Publié: (2025)
Score-Based Turbo Message Passing for Plug-and-Play Compressive Imaging
par: Cai, Chang, et autres
Publié: (2025)
par: Cai, Chang, et autres
Publié: (2025)
Multi-RoI Human Mesh Recovery with Camera Consistency and Contrastive Losses
par: Nie, Yongwei, et autres
Publié: (2024)
par: Nie, Yongwei, et autres
Publié: (2024)
T-Pixel2Mesh: Combining Global and Local Transformer for 3D Mesh Generation from a Single Image
par: Zhang, Shijie, et autres
Publié: (2024)
par: Zhang, Shijie, et autres
Publié: (2024)
Humans as Checkerboards: Calibrating Camera Motion Scale for World-Coordinate Human Mesh Recovery
par: Yang, Fengyuan, et autres
Publié: (2024)
par: Yang, Fengyuan, et autres
Publié: (2024)
GS-Net: Generalizable Plug-and-Play 3D Gaussian Splatting Module
par: Zhang, Yichen, et autres
Publié: (2024)
par: Zhang, Yichen, et autres
Publié: (2024)
ARM: A Learnable, Plug-and-Play Module for CLIP-based Open-vocabulary Semantic Segmentation
par: Liu, Ziquan, et autres
Publié: (2025)
par: Liu, Ziquan, et autres
Publié: (2025)
Video Compression Commander: Plug-and-Play Inference Acceleration for Video Large Language Models
par: Liu, Xuyang, et autres
Publié: (2025)
par: Liu, Xuyang, et autres
Publié: (2025)
Plug-and-Play Diffusion Distillation
par: Hsiao, Yi-Ting, et autres
Publié: (2024)
par: Hsiao, Yi-Ting, et autres
Publié: (2024)
Vote&Mix: Plug-and-Play Token Reduction for Efficient Vision Transformer
par: Peng, Shuai, et autres
Publié: (2024)
par: Peng, Shuai, et autres
Publié: (2024)
Fancy123: One Image to High-Quality 3D Mesh Generation via Plug-and-Play Deformation
par: Yu, Qiao, et autres
Publié: (2024)
par: Yu, Qiao, et autres
Publié: (2024)
P$^2$HCT: Plug-and-Play Hierarchical C2F Transformer for Multi-Scale Feature Fusion
par: Hu, Junyi, et autres
Publié: (2025)
par: Hu, Junyi, et autres
Publié: (2025)
A Plug-and-Play Method for Rare Human-Object Interactions Detection by Bridging Domain Gap
par: Zhang, Lijun, et autres
Publié: (2024)
par: Zhang, Lijun, et autres
Publié: (2024)
ModalPatch: A Plug-and-Play Module for Robust Multi-Modal 3D Object Detection under Modality Drop
par: Li, Shuangzhi, et autres
Publié: (2026)
par: Li, Shuangzhi, et autres
Publié: (2026)
RAG-Adapter: A Plug-and-Play RAG-enhanced Framework for Long Video Understanding
par: Tan, Xichen, et autres
Publié: (2025)
par: Tan, Xichen, et autres
Publié: (2025)
Text-to-Image Rectified Flow as Plug-and-Play Priors
par: Yang, Xiaofeng, et autres
Publié: (2024)
par: Yang, Xiaofeng, et autres
Publié: (2024)
Plug, Play, and Fortify: A Low-Cost Module for Robust Multimodal Image Understanding Models
par: Lu, Siqi, et autres
Publié: (2026)
par: Lu, Siqi, et autres
Publié: (2026)
Plug-and-Play Context Feature Reuse for Efficient Masked Generation
par: Liu, Xuejie, et autres
Publié: (2025)
par: Liu, Xuejie, et autres
Publié: (2025)
Segmentation as A Plug-and-Play Capability for Frozen Multimodal LLMs
par: Liu, Jiazhen, et autres
Publié: (2025)
par: Liu, Jiazhen, et autres
Publié: (2025)
The Loupe: A Plug-and-Play Attention Module for Amplifying Discriminative Features in Vision Transformers
par: Sengodan, Naren
Publié: (2025)
par: Sengodan, Naren
Publié: (2025)
Flash-VAED: Plug-and-Play VAE Decoders for Efficient Video Generation
par: Zhu, Lunjie, et autres
Publié: (2026)
par: Zhu, Lunjie, et autres
Publié: (2026)
Plug-and-Play Fidelity Optimization for Diffusion Transformer Acceleration via Cumulative Error Minimization
par: Shao, Tong, et autres
Publié: (2025)
par: Shao, Tong, et autres
Publié: (2025)
ConvRot: Rotation-Based Plug-and-Play 4-bit Quantization for Diffusion Transformers
par: Huang, Feice, et autres
Publié: (2025)
par: Huang, Feice, et autres
Publié: (2025)
BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion
par: Ju, Xuan, et autres
Publié: (2024)
par: Ju, Xuan, et autres
Publié: (2024)
A Plug-and-Play Multi-Criteria Guidance for Diverse In-Betweening Human Motion Generation
par: Yu, Hua, et autres
Publié: (2025)
par: Yu, Hua, et autres
Publié: (2025)
Score-Based Turbo Message Passing for Plug-and-Play Compressive Image Recovery
par: Cai, Chang, et autres
Publié: (2025)
par: Cai, Chang, et autres
Publié: (2025)
Plug-and-Play Versatile Compressed Video Enhancement
par: Zeng, Huimin, et autres
Publié: (2025)
par: Zeng, Huimin, et autres
Publié: (2025)
MotionCraft: Crafting Whole-Body Motion with Plug-and-Play Multimodal Controls
par: Bian, Yuxuan, et autres
Publié: (2024)
par: Bian, Yuxuan, et autres
Publié: (2024)
Multi-Human Mesh Recovery with Transformers
par: Wang, Zeyu, et autres
Publié: (2024)
par: Wang, Zeyu, et autres
Publié: (2024)
QEMesh: Employing A Quadric Error Metrics-Based Representation for Mesh Generation
par: Li, Jiaqi, et autres
Publié: (2025)
par: Li, Jiaqi, et autres
Publié: (2025)
ReMA: A Training-Free Plug-and-Play Mixing Augmentation for Video Behavior Recognition
par: Cui, Feng-Qi, et autres
Publié: (2026)
par: Cui, Feng-Qi, et autres
Publié: (2026)
From Virtual Games to Real-World Play
par: Sun, Wenqiang, et autres
Publié: (2025)
par: Sun, Wenqiang, et autres
Publié: (2025)
Towards Metric-Aware Multi-Person Mesh Recovery by Jointly Optimizing Human Crowd in Camera Space
par: Wang, Kaiwen, et autres
Publié: (2025)
par: Wang, Kaiwen, et autres
Publié: (2025)
Simultaneously Recovering Multi-Person Meshes and Multi-View Cameras with Human Semantics
par: Huang, Buzhen, et autres
Publié: (2024)
par: Huang, Buzhen, et autres
Publié: (2024)
Enhancing Logits Distillation with Plug\&Play Kendall's $τ$ Ranking Loss
par: Guan, Yuchen, et autres
Publié: (2024)
par: Guan, Yuchen, et autres
Publié: (2024)
PIA: Your Personalized Image Animator via Plug-and-Play Modules in Text-to-Image Models
par: Zhang, Yiming, et autres
Publié: (2023)
par: Zhang, Yiming, et autres
Publié: (2023)
Momentum Guidance: Plug-and-Play Guidance for Flow Models
par: Liao, Runlong, et autres
Publié: (2026)
par: Liao, Runlong, et autres
Publié: (2026)
WorldCraft: From Camera Navigation to Object Manipulation in Interactive Video World Models
par: Gu, Bohai, et autres
Publié: (2026)
par: Gu, Bohai, et autres
Publié: (2026)
Documents similaires
-
PI-HMR: Towards Robust In-bed Temporal Human Shape Reconstruction with Contact Pressure Sensing
par: Wu, Ziyu, et autres
Publié: (2025) -
PressTrack-HMR: Pressure-Based Top-Down Multi-Person Global Human Mesh Recovery
par: Yuan, Jiayue, et autres
Publié: (2025) -
WATCH: World-aware Allied Trajectory and pose reconstruction for Camera and Human
par: Ying, Qijun, et autres
Publié: (2025) -
Score-Based Turbo Message Passing for Plug-and-Play Compressive Imaging
par: Cai, Chang, et autres
Publié: (2025) -
Multi-RoI Human Mesh Recovery with Camera Consistency and Contrastive Losses
par: Nie, Yongwei, et autres
Publié: (2024)