PEAR: Pixel-aligned Expressive humAn mesh Recovery
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Jiahao, Liu, Yunfei, Lin, Lijian, Zhu, Ye, Zhu, Lei, Li, Jingyi, Li, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
par: Chen, Ming, et autres
Publié: (2025)
par: Chen, Ming, et autres
Publié: (2025)
MANGO:Natural Multi-speaker 3D Talking Head Generation via 2D-Lifted Enhancement
par: Zhu, Lei, et autres
Publié: (2026)
par: Zhu, Lei, et autres
Publié: (2026)
Mixed Prototype Consistency Learning for Semi-supervised Medical Image Segmentation
par: Li, Lijian
Publié: (2024)
par: Li, Lijian
Publié: (2024)
Complementarity-driven Representation Learning for Multi-modal Knowledge Graph Completion
par: Li, Lijian
Publié: (2025)
par: Li, Lijian
Publié: (2025)
iPEAR: Iterative Pyramid Estimation with Attention and Residuals for Deformable Medical Image Registration
par: Wu, Heming, et autres
Publié: (2025)
par: Wu, Heming, et autres
Publié: (2025)
TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction
par: Liu, Yunfei, et autres
Publié: (2025)
par: Liu, Yunfei, et autres
Publié: (2025)
Qffusion: Controllable Portrait Video Editing via Quadrant-Grid Attention Learning
par: Li, Maomao, et autres
Publié: (2025)
par: Li, Maomao, et autres
Publié: (2025)
Uncertainty-aware Evidential Fusion-based Learning for Semi-supervised Medical Image Segmentation
par: He, Yuanpeng, et autres
Publié: (2024)
par: He, Yuanpeng, et autres
Publié: (2024)
Towards Realistic Long-tailed Semi-supervised Learning in an Open World
par: He, Yuanpeng, et autres
Publié: (2024)
par: He, Yuanpeng, et autres
Publié: (2024)
Towards Efficient Pixel Labeling for Industrial Anomaly Detection and Localization
par: Wu, Jingqi, et autres
Publié: (2025)
par: Wu, Jingqi, et autres
Publié: (2025)
The Thinking Pixel: Recursive Sparse Reasoning in Multimodal Diffusion Latents
par: Sun, Yuwei, et autres
Publié: (2026)
par: Sun, Yuwei, et autres
Publié: (2026)
XHand: Real-time Expressive Hand Avatar
par: Gan, Qijun, et autres
Publié: (2024)
par: Gan, Qijun, et autres
Publié: (2024)
UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
par: Liu, Ye, et autres
Publié: (2025)
par: Liu, Ye, et autres
Publié: (2025)
Versatile Multimodal Controls for Expressive Talking Human Animation
par: Qin, Zheng, et autres
Publié: (2025)
par: Qin, Zheng, et autres
Publié: (2025)
Towards Dynamic and Small Objects Refinement for Unsupervised Domain Adaptative Nighttime Semantic Segmentation
par: Pan, Jingyi, et autres
Publié: (2023)
par: Pan, Jingyi, et autres
Publié: (2023)
Pixels, Patterns, but No Poetry: To See The World like Humans
par: Gao, Hongcheng, et autres
Publié: (2025)
par: Gao, Hongcheng, et autres
Publié: (2025)
From Pixels to Predicates Structuring urban perception with scene graphs
par: Liu, Yunlong, et autres
Publié: (2025)
par: Liu, Yunlong, et autres
Publié: (2025)
From Pixels to Words -- Towards Native Vision-Language Primitives at Scale
par: Diao, Haiwen, et autres
Publié: (2025)
par: Diao, Haiwen, et autres
Publié: (2025)
Phantom: Subject-consistent video generation via cross-modal alignment
par: Liu, Lijie, et autres
Publié: (2025)
par: Liu, Lijie, et autres
Publié: (2025)
Cycle Pixel Difference Network for Crisp Edge Detection
par: Liu, Changsong, et autres
Publié: (2024)
par: Liu, Changsong, et autres
Publié: (2024)
Beyond Pixels: Vector-to-Graph Transformation for Reliable Schematic Auditing
par: Ma, Chengwei, et autres
Publié: (2026)
par: Ma, Chengwei, et autres
Publié: (2026)
DP-MDM: Detail-Preserving MR Reconstruction via Multiple Diffusion Models
par: Geng, Mengxiao, et autres
Publié: (2024)
par: Geng, Mengxiao, et autres
Publié: (2024)
Think-Before-Draw: Decomposing Emotion Semantics & Fine-Grained Controllable Expressive Talking Head Generation
par: Shi, Hanlei, et autres
Publié: (2025)
par: Shi, Hanlei, et autres
Publié: (2025)
From Pixels to Progress: Generating Road Network from Satellite Imagery for Socioeconomic Insights in Impoverished Areas
par: Xi, Yanxin, et autres
Publié: (2024)
par: Xi, Yanxin, et autres
Publié: (2024)
PixelSmile: Toward Fine-Grained Facial Expression Editing
par: Hua, Jiabin, et autres
Publié: (2026)
par: Hua, Jiabin, et autres
Publié: (2026)
Quaternion-Based Robust PCA for Efficient Moving Target Detection and Background Recovery in Color Videos
par: Wang, Liyang, et autres
Publié: (2025)
par: Wang, Liyang, et autres
Publié: (2025)
MHLA: Restoring Expressivity of Linear Attention via Token-Level Multi-Head
par: Zhang, Kewei, et autres
Publié: (2026)
par: Zhang, Kewei, et autres
Publié: (2026)
DreamActor-M1: Holistic, Expressive and Robust Human Image Animation with Hybrid Guidance
par: Luo, Yuxuan, et autres
Publié: (2025)
par: Luo, Yuxuan, et autres
Publié: (2025)
Residual Feature-Reutilization Inception Network for Image Classification
par: He, Yuanpeng, et autres
Publié: (2024)
par: He, Yuanpeng, et autres
Publié: (2024)
TC-SSA: Token Compression via Semantic Slot Aggregation for Gigapixel Pathology Reasoning
par: Chen, Zhuo, et autres
Publié: (2026)
par: Chen, Zhuo, et autres
Publié: (2026)
L2P: Unlocking Latent Potential for Pixel Generation
par: Chen, Zhennan, et autres
Publié: (2026)
par: Chen, Zhennan, et autres
Publié: (2026)
Towards aligned body representations in vision models
par: Gizdov, Andrey, et autres
Publié: (2025)
par: Gizdov, Andrey, et autres
Publié: (2025)
PixelGen: Improving Pixel Diffusion with Perceptual Supervision
par: Ma, Zehong, et autres
Publié: (2026)
par: Ma, Zehong, et autres
Publié: (2026)
EmotiveTalk: Expressive Talking Head Generation through Audio Information Decoupling and Emotional Video Diffusion
par: Wang, Haotian, et autres
Publié: (2024)
par: Wang, Haotian, et autres
Publié: (2024)
Generalized Uncertainty-Based Evidential Fusion with Hybrid Multi-Head Attention for Weak-Supervised Temporal Action Localization
par: He, Yuanpeng, et autres
Publié: (2024)
par: He, Yuanpeng, et autres
Publié: (2024)
Improving vision-language alignment with graph spiking hybrid Networks
par: Zhang, Siyu, et autres
Publié: (2025)
par: Zhang, Siyu, et autres
Publié: (2025)
Parasite: A Steganography-based Backdoor Attack Framework for Diffusion Models
par: Chen, Jiahao, et autres
Publié: (2025)
par: Chen, Jiahao, et autres
Publié: (2025)
Towards High-Order Mean Flow Generative Models: Feasibility, Expressivity, and Provably Efficient Criteria
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
ReFlow: Self-correction Motion Learning for Dynamic Scene Reconstruction
par: Liang, Yanzhe, et autres
Publié: (2026)
par: Liang, Yanzhe, et autres
Publié: (2026)
Proposing an intelligent mesh smoothing method with graph neural networks
par: Wang, Zhichao, et autres
Publié: (2023)
par: Wang, Zhichao, et autres
Publié: (2023)
Documents similaires
-
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
par: Chen, Ming, et autres
Publié: (2025) -
MANGO:Natural Multi-speaker 3D Talking Head Generation via 2D-Lifted Enhancement
par: Zhu, Lei, et autres
Publié: (2026) -
Mixed Prototype Consistency Learning for Semi-supervised Medical Image Segmentation
par: Li, Lijian
Publié: (2024) -
Complementarity-driven Representation Learning for Multi-modal Knowledge Graph Completion
par: Li, Lijian
Publié: (2025) -
iPEAR: Iterative Pyramid Estimation with Attention and Residuals for Deformable Medical Image Registration
par: Wu, Heming, et autres
Publié: (2025)