End-to-End HOI Reconstruction Transformer with Graph-based Encoding
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zhenrong, Zheng, Qi, Ma, Sihan, Ye, Maosheng, Zhan, Yibing, Li, Dongjiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
End-to-End Spatial-Temporal Transformer for Real-time 4D HOI Reconstruction
por: Zhang, Haoyu, et al.
Publicado: (2026)
por: Zhang, Haoyu, et al.
Publicado: (2026)
Towards Efficient and Effective Multi-Camera Encoding for End-to-End Driving
por: Yang, Jiawei, et al.
Publicado: (2025)
por: Yang, Jiawei, et al.
Publicado: (2025)
MoCha:End-to-End Video Character Replacement without Structural Guidance
por: Xu, Zhengbo, et al.
Publicado: (2026)
por: Xu, Zhengbo, et al.
Publicado: (2026)
PPAD: Iterative Interactions of Prediction and Planning for End-to-end Autonomous Driving
por: Chen, Zhili, et al.
Publicado: (2023)
por: Chen, Zhili, et al.
Publicado: (2023)
Puzzles: Unbounded Video-Depth Augmentation for Scalable End-to-End 3D Reconstruction
por: Ma, Jiahao, et al.
Publicado: (2025)
por: Ma, Jiahao, et al.
Publicado: (2025)
DLAFormer: An End-to-End Transformer For Document Layout Analysis
por: Wang, Jiawei, et al.
Publicado: (2024)
por: Wang, Jiawei, et al.
Publicado: (2024)
AlphaVAE: Unified End-to-End RGBA Image Reconstruction and Generation with Alpha-Aware Representation Learning
por: Wang, Zile, et al.
Publicado: (2025)
por: Wang, Zile, et al.
Publicado: (2025)
SDformer: Efficient End-to-End Transformer for Depth Completion
por: Qian, Jian, et al.
Publicado: (2024)
por: Qian, Jian, et al.
Publicado: (2024)
OED: Towards One-stage End-to-End Dynamic Scene Graph Generation
por: Wang, Guan, et al.
Publicado: (2024)
por: Wang, Guan, et al.
Publicado: (2024)
MeanFuser: Fast One-Step Multi-Modal Trajectory Generation and Adaptive Reconstruction via MeanFlow for End-to-End Autonomous Driving
por: Wang, Junli, et al.
Publicado: (2026)
por: Wang, Junli, et al.
Publicado: (2026)
End to End Face Reconstruction via Differentiable PnP
por: Lu, Yiren, et al.
Publicado: (2024)
por: Lu, Yiren, et al.
Publicado: (2024)
On the Road to Portability: Compressing End-to-End Motion Planner for Autonomous Driving
por: Feng, Kaituo, et al.
Publicado: (2024)
por: Feng, Kaituo, et al.
Publicado: (2024)
SimpleLLM4AD: An End-to-End Vision-Language Model with Graph Visual Question Answering for Autonomous Driving
por: Zheng, Peiru, et al.
Publicado: (2024)
por: Zheng, Peiru, et al.
Publicado: (2024)
OVTR: End-to-End Open-Vocabulary Multiple Object Tracking with Transformer
por: Li, Jinyang, et al.
Publicado: (2025)
por: Li, Jinyang, et al.
Publicado: (2025)
Unleashing Generalization of End-to-End Autonomous Driving with Controllable Long Video Generation
por: Ma, Enhui, et al.
Publicado: (2024)
por: Ma, Enhui, et al.
Publicado: (2024)
Exploring the Causality of End-to-End Autonomous Driving
por: Li, Jiankun, et al.
Publicado: (2024)
por: Li, Jiankun, et al.
Publicado: (2024)
End-to-End Action Segmentation Transformer
por: Wang, Tieqiao, et al.
Publicado: (2025)
por: Wang, Tieqiao, et al.
Publicado: (2025)
PAVE: An End-to-End Dataset for Production Autonomous Vehicle Evaluation
por: Li, Xiangyu, et al.
Publicado: (2025)
por: Li, Xiangyu, et al.
Publicado: (2025)
End-to-End Multi-Person Pose Estimation with Pose-Aware Video Transformer
por: Yu, Yonghui, et al.
Publicado: (2025)
por: Yu, Yonghui, et al.
Publicado: (2025)
Ultra-Efficient Decoding for End-to-End Neural Compression and Reconstruction
por: Rogers, Ethan G., et al.
Publicado: (2025)
por: Rogers, Ethan G., et al.
Publicado: (2025)
EA-RAS: Towards Efficient and Accurate End-to-End Reconstruction of Anatomical Skeleton
por: Peng, Zhiheng, et al.
Publicado: (2024)
por: Peng, Zhiheng, et al.
Publicado: (2024)
Leverage Cross-Attention for End-to-End Open-Vocabulary Panoptic Reconstruction
por: Yu, Xuan, et al.
Publicado: (2025)
por: Yu, Xuan, et al.
Publicado: (2025)
Real2Sim in HOI: Toward Physically Plausible HOI Reconstruction from Monocular Videos
por: Zhao, Yubo, et al.
Publicado: (2026)
por: Zhao, Yubo, et al.
Publicado: (2026)
SGTR+: End-to-end Scene Graph Generation with Transformer
por: Li, Rongjie, et al.
Publicado: (2024)
por: Li, Rongjie, et al.
Publicado: (2024)
Active Learning from Scene Embeddings for End-to-End Autonomous Driving
por: Jiang, Wenhao, et al.
Publicado: (2025)
por: Jiang, Wenhao, et al.
Publicado: (2025)
SparseWorld: Enhancing End-to-End Autonomous Driving via World Models with Sparse Scene Representation
por: Wang, Ruoyu, et al.
Publicado: (2026)
por: Wang, Ruoyu, et al.
Publicado: (2026)
RQFormer: Rotated Query Transformer for End-to-End Oriented Object Detection
por: Zhao, Jiaqi, et al.
Publicado: (2023)
por: Zhao, Jiaqi, et al.
Publicado: (2023)
AutoMoT: A Unified Vision-Language-Action Model with Asynchronous Mixture-of-Transformers for End-to-End Autonomous Driving
por: Huang, Wenhui, et al.
Publicado: (2026)
por: Huang, Wenhui, et al.
Publicado: (2026)
Towards Fully Decoupled End-to-End Person Search
por: Zhang, Pengcheng, et al.
Publicado: (2023)
por: Zhang, Pengcheng, et al.
Publicado: (2023)
DSGG: Dense Relation Transformer for an End-to-end Scene Graph Generation
por: Hayder, Zeeshan, et al.
Publicado: (2024)
por: Hayder, Zeeshan, et al.
Publicado: (2024)
GraphAD: Interaction Scene Graph for End-to-end Autonomous Driving
por: Zhang, Yunpeng, et al.
Publicado: (2024)
por: Zhang, Yunpeng, et al.
Publicado: (2024)
DeCo: Frequency-Decoupled Pixel Diffusion for End-to-End Image Generation
por: Ma, Zehong, et al.
Publicado: (2025)
por: Ma, Zehong, et al.
Publicado: (2025)
End-to-End QGAN-Based Image Synthesis via Neural Noise Encoding and Intensity Calibration
por: Yang, Xue, et al.
Publicado: (2026)
por: Yang, Xue, et al.
Publicado: (2026)
ChartE$^{3}$: A Comprehensive Benchmark for End-to-End Chart Editing
por: Li, Shuo, et al.
Publicado: (2026)
por: Li, Shuo, et al.
Publicado: (2026)
Driving with A Thousand Faces: A Benchmark for Closed-Loop Personalized End-to-End Autonomous Driving
por: Dong, Xiaoru, et al.
Publicado: (2026)
por: Dong, Xiaoru, et al.
Publicado: (2026)
FastDriveVLA: Efficient End-to-End Driving via Plug-and-Play Reconstruction-based Token Pruning
por: Cao, Jiajun, et al.
Publicado: (2025)
por: Cao, Jiajun, et al.
Publicado: (2025)
GenAD: Generative End-to-End Autonomous Driving
por: Zheng, Wenzhao, et al.
Publicado: (2024)
por: Zheng, Wenzhao, et al.
Publicado: (2024)
End4: End-to-end Denoising Diffusion for Diffusion-Based Inpainting Detection
por: Wang, Fei, et al.
Publicado: (2025)
por: Wang, Fei, et al.
Publicado: (2025)
End-to-End Vision Tokenizer Tuning
por: Wang, Wenxuan, et al.
Publicado: (2025)
por: Wang, Wenxuan, et al.
Publicado: (2025)
OpenHOI: Open-World Hand-Object Interaction Synthesis with Multimodal Large Language Model
por: Zhang, Zhenhao, et al.
Publicado: (2025)
por: Zhang, Zhenhao, et al.
Publicado: (2025)
Ejemplares similares
-
End-to-End Spatial-Temporal Transformer for Real-time 4D HOI Reconstruction
por: Zhang, Haoyu, et al.
Publicado: (2026) -
Towards Efficient and Effective Multi-Camera Encoding for End-to-End Driving
por: Yang, Jiawei, et al.
Publicado: (2025) -
MoCha:End-to-End Video Character Replacement without Structural Guidance
por: Xu, Zhengbo, et al.
Publicado: (2026) -
PPAD: Iterative Interactions of Prediction and Planning for End-to-end Autonomous Driving
por: Chen, Zhili, et al.
Publicado: (2023) -
Puzzles: Unbounded Video-Depth Augmentation for Scalable End-to-End 3D Reconstruction
por: Ma, Jiahao, et al.
Publicado: (2025)