Decomposed Vector-Quantized Variational Autoencoder for Human Grasp Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Zhe, Qi, Mengshi, Ma, Huadong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-Stage Contrastive Regression for Action Quality Assessment
par: An, Qi, et autres
Publié: (2024)
par: An, Qi, et autres
Publié: (2024)
Global-Local Tree Search in VLMs for 3D Indoor Scene Generation
par: Deng, Wei, et autres
Publié: (2025)
par: Deng, Wei, et autres
Publié: (2025)
Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction
par: Qi, Mengshi, et autres
Publié: (2024)
par: Qi, Mengshi, et autres
Publié: (2024)
Question-Aware Evidence Ledgers for Video Relational Reasoning
par: Ou, Yilin, et autres
Publié: (2026)
par: Ou, Yilin, et autres
Publié: (2026)
Robust Disentangled Counterfactual Learning for Physical Audiovisual Commonsense Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
A New Teacher-Reviewer-Student Framework for Semi-supervised 2D Human Pose Estimation
par: Yun, Wulian, et autres
Publié: (2025)
par: Yun, Wulian, et autres
Publié: (2025)
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Human Grasp Generation for Rigid and Deformable Objects with Decomposed VQ-VAE
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
T2SG: Traffic Topology Scene Graph for Topology Reasoning in Autonomous Driving
par: Lv, Changsheng, et autres
Publié: (2024)
par: Lv, Changsheng, et autres
Publié: (2024)
Towards Efficient Object Re-Identification with A Novel Cloud-Edge Collaborative Framework
par: Wang, Chuanming, et autres
Publié: (2024)
par: Wang, Chuanming, et autres
Publié: (2024)
Improving Batch Normalization with TTA for Robust Object Detection in Self-Driving
par: Liao, Dacheng, et autres
Publié: (2024)
par: Liao, Dacheng, et autres
Publié: (2024)
Semi-Supervised Teacher-Reference-Student Architecture for Action Quality Assessment
par: Yun, Wulian, et autres
Publié: (2024)
par: Yun, Wulian, et autres
Publié: (2024)
Uncovering the human motion pattern: Pattern Memory-based Diffusion Model for Trajectory Prediction
par: Yang, Yuxin, et autres
Publié: (2024)
par: Yang, Yuxin, et autres
Publié: (2024)
Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
VLM-Assisted Continual learning for Visual Question Answering in Self-Driving
par: Lin, Yuxin, et autres
Publié: (2025)
par: Lin, Yuxin, et autres
Publié: (2025)
Multiscale Vector-Quantized Variational Autoencoder for Endoscopic Image Synthesis
par: Diamantis, Dimitrios E., et autres
Publié: (2025)
par: Diamantis, Dimitrios E., et autres
Publié: (2025)
Towards Robust Unsupervised Attention Prediction in Autonomous Driving
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Action Quality Assessment via Hierarchical Pose-guided Multi-stage Contrastive Regression
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Mutual Distillation Learning For Person Re-Identification
par: Fu, Huiyuan, et autres
Publié: (2024)
par: Fu, Huiyuan, et autres
Publié: (2024)
Chain-of-Evidence Multimodal Reasoning for Few-shot Temporal Action Localization
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
VIoTGPT: Learning to Schedule Vision Tools in LLMs towards Intelligent Video Internet of Things
par: Zhong, Yaoyao, et autres
Publié: (2023)
par: Zhong, Yaoyao, et autres
Publié: (2023)
DC-SAM: In-Context Segment Anything in Images and Videos via Dual Consistency
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
Disentanglement with Factor Quantized Variational Autoencoders
par: Baykal, Gulcin, et autres
Publié: (2024)
par: Baykal, Gulcin, et autres
Publié: (2024)
Modality-Aware and Anatomical Vector-Quantized Autoencoding for Multimodal Brain MRI
par: Li, Mingjie, et autres
Publié: (2026)
par: Li, Mingjie, et autres
Publié: (2026)
Autoregressive Video Generation without Vector Quantization
par: Deng, Haoge, et autres
Publié: (2024)
par: Deng, Haoge, et autres
Publié: (2024)
CIVQLLIE: Causal Intervention with Vector Quantization for Low-Light Image Enhancement
par: Zhang, Tongshun, et autres
Publié: (2025)
par: Zhang, Tongshun, et autres
Publié: (2025)
Autoregressive Image Generation without Vector Quantization
par: Li, Tianhong, et autres
Publié: (2024)
par: Li, Tianhong, et autres
Publié: (2024)
VQRAE: Representation Quantization Autoencoders for Multimodal Understanding, Generation and Reconstruction
par: Du, Sinan, et autres
Publié: (2025)
par: Du, Sinan, et autres
Publié: (2025)
Purrception: Variational Flow Matching for Vector-Quantized Image Generation
par: Matişan, Răzvan-Andrei, et autres
Publié: (2025)
par: Matişan, Răzvan-Andrei, et autres
Publié: (2025)
Active Exploring like a Pigeon: Reinforcing Spatial Reasoning via Agentic Vision-Language Models
par: Deng, Wei, et autres
Publié: (2026)
par: Deng, Wei, et autres
Publié: (2026)
Robo-SGG: Exploiting Layout-Oriented Normalization and Restitution Can Improve Robust Scene Graph Generation
par: Lv, Changsheng, et autres
Publié: (2025)
par: Lv, Changsheng, et autres
Publié: (2025)
Frugal Incremental Generative Modeling using Variational Autoencoders
par: Enescu, Victor, et autres
Publié: (2025)
par: Enescu, Victor, et autres
Publié: (2025)
EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
par: Zhu, Yufei, et autres
Publié: (2025)
par: Zhu, Yufei, et autres
Publié: (2025)
Single-View Scene Point Cloud Human Grasp Generation
par: Wang, Yan-Kang, et autres
Publié: (2024)
par: Wang, Yan-Kang, et autres
Publié: (2024)
EFF-Grasp: Energy-Field Flow Matching for Physics-Aware Dexterous Grasp Generation
par: Zhao, Yukun, et autres
Publié: (2026)
par: Zhao, Yukun, et autres
Publié: (2026)
Codebook Transfer with Part-of-Speech for Vector-Quantized Image Modeling
par: Zhang, Baoquan, et autres
Publié: (2024)
par: Zhang, Baoquan, et autres
Publié: (2024)
Vector-Quantized Vision Foundation Models for Object-Centric Learning
par: Zhao, Rongzhen, et autres
Publié: (2025)
par: Zhao, Rongzhen, et autres
Publié: (2025)
VQ-HPS: Human Pose and Shape Estimation in a Vector-Quantized Latent Space
par: Fiche, Guénolé, et autres
Publié: (2023)
par: Fiche, Guénolé, et autres
Publié: (2023)
AnyDexGrasp: General Dexterous Grasping for Different Hands with Human-level Learning Efficiency
par: Fang, Hao-Shu, et autres
Publié: (2025)
par: Fang, Hao-Shu, et autres
Publié: (2025)
Differentiable Vector Quantization for Rate-Distortion Optimization of Generative Image Compression
par: Jiang, Shiyin, et autres
Publié: (2026)
par: Jiang, Shiyin, et autres
Publié: (2026)
Documents similaires
-
Multi-Stage Contrastive Regression for Action Quality Assessment
par: An, Qi, et autres
Publié: (2024) -
Global-Local Tree Search in VLMs for 3D Indoor Scene Generation
par: Deng, Wei, et autres
Publié: (2025) -
Learning Group Interactions and Semantic Intentions for Multi-Object Trajectory Prediction
par: Qi, Mengshi, et autres
Publié: (2024) -
Question-Aware Evidence Ledgers for Video Relational Reasoning
par: Ou, Yilin, et autres
Publié: (2026) -
Robust Disentangled Counterfactual Learning for Physical Audiovisual Commonsense Reasoning
par: Qi, Mengshi, et autres
Publié: (2025)