Category-Agnostic Neural Object Rigging
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | He, Guangzhao, Geng, Chen, Wu, Shangzhe, Wu, Jiajun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Birth and Death of a Rose
par: Geng, Chen, et autres
Publié: (2024)
par: Geng, Chen, et autres
Publié: (2024)
Web-Scale Collection of Video Data for 4D Animal Reconstruction
par: Zhao, Brian Nlong, et autres
Publié: (2025)
par: Zhao, Brian Nlong, et autres
Publié: (2025)
ERNet: Efficient Non-Rigid Registration Network for Point Sequences
par: He, Guangzhao, et autres
Publié: (2025)
par: He, Guangzhao, et autres
Publié: (2025)
U-Net-Like Spiking Neural Networks for Single Image Dehazing
par: Li, Huibin, et autres
Publié: (2025)
par: Li, Huibin, et autres
Publié: (2025)
ReLKD: Inter-Class Relation Learning with Knowledge Distillation for Generalized Category Discovery
par: Zhou, Fang, et autres
Publié: (2025)
par: Zhou, Fang, et autres
Publié: (2025)
Hierarchical Feature-level Reverse Propagation for Post-Training Neural Networks
par: Ding, Ni, et autres
Publié: (2025)
par: Ding, Ni, et autres
Publié: (2025)
Reducing Object Hallucination in LVLMs via Emphasizing Image-negative Tokens
par: Shen, Meng, et autres
Publié: (2026)
par: Shen, Meng, et autres
Publié: (2026)
FocusedAD: Character-centric Movie Audio Description
par: Ye, Xiaojun, et autres
Publié: (2025)
par: Ye, Xiaojun, et autres
Publié: (2025)
Context-Aware Indoor Point Cloud Object Generation through User Instructions
par: Luo, Yiyang, et autres
Publié: (2023)
par: Luo, Yiyang, et autres
Publié: (2023)
Hearing Anything Anywhere
par: Wang, Mason, et autres
Publié: (2024)
par: Wang, Mason, et autres
Publié: (2024)
Adaptive Self-Training for Object Detection
par: Vandeghen, Renaud, et autres
Publié: (2022)
par: Vandeghen, Renaud, et autres
Publié: (2022)
ViG-LRGC: Vision Graph Neural Networks with Learnable Reparameterized Graph Construction
par: Elsharkawi, Ismael, et autres
Publié: (2025)
par: Elsharkawi, Ismael, et autres
Publié: (2025)
Pointing-Based Object Recognition
par: Hajdúch, Lukáš, et autres
Publié: (2026)
par: Hajdúch, Lukáš, et autres
Publié: (2026)
Enhanced Kalman with Adaptive Appearance Motion SORT for Grounded Generic Multiple Object Tracking
par: Anh, Duy Le Dinh, et autres
Publié: (2024)
par: Anh, Duy Le Dinh, et autres
Publié: (2024)
Learning Association via Track-Detection Matching for Multi-Object Tracking
par: Adžemović, Momir
Publié: (2025)
par: Adžemović, Momir
Publié: (2025)
Exploring Surround-View Fisheye Camera 3D Object Detection
par: Li, Changcai, et autres
Publié: (2025)
par: Li, Changcai, et autres
Publié: (2025)
ROSGS: Relightable Outdoor Scenes With Gaussian Splatting
par: Liao, Lianjun, et autres
Publié: (2025)
par: Liao, Lianjun, et autres
Publié: (2025)
VisRL: Intention-Driven Visual Perception via Reinforced Reasoning
par: Chen, Zhangquan, et autres
Publié: (2025)
par: Chen, Zhangquan, et autres
Publié: (2025)
UniQ: Unified Decoder with Task-specific Queries for Efficient Scene Graph Generation
par: Liao, Xinyao, et autres
Publié: (2025)
par: Liao, Xinyao, et autres
Publié: (2025)
CLIP-Joint-Detect: End-to-End Joint Training of Object Detectors with Contrastive Vision-Language Supervision
par: Raoufi, Behnam, et autres
Publié: (2025)
par: Raoufi, Behnam, et autres
Publié: (2025)
4DThinker: Thinking with 4D Imagery for Dynamic Spatial Understanding
par: Chen, Zhangquan, et autres
Publié: (2026)
par: Chen, Zhangquan, et autres
Publié: (2026)
A Challenging Benchmark of Anime Style Recognition
par: Li, Haotang, et autres
Publié: (2022)
par: Li, Haotang, et autres
Publié: (2022)
Towards a Generalizable Fusion Architecture for Multimodal Object Detection
par: Berjawi, Jad, et autres
Publié: (2025)
par: Berjawi, Jad, et autres
Publié: (2025)
Lost in Context: The Influence of Context on Feature Attribution Methods for Object Recognition
par: Adhikari, Sayanta, et autres
Publié: (2024)
par: Adhikari, Sayanta, et autres
Publié: (2024)
Car Object Counting and Position Estimation via Extension of the CLIP-EBC Framework
par: Jung, Seoik, et autres
Publié: (2025)
par: Jung, Seoik, et autres
Publié: (2025)
VIAFormer: Voxel-Image Alignment Transformer for High-Fidelity Voxel Refinement
par: Fang, Tiancheng, et autres
Publié: (2026)
par: Fang, Tiancheng, et autres
Publié: (2026)
Zero-Shot Object Goal Visual Navigation With Class-Independent Relationship Network
par: Li, Xinting, et autres
Publié: (2023)
par: Li, Xinting, et autres
Publié: (2023)
An Evaluation of a Visual Question Answering Strategy for Zero-shot Facial Expression Recognition in Still Images
par: Castrillón-Santana, Modesto, et autres
Publié: (2025)
par: Castrillón-Santana, Modesto, et autres
Publié: (2025)
Textual and Visual Guided Task Adaptation for Source-Free Cross-Domain Few-Shot Segmentation
par: Liu, Jianming, et autres
Publié: (2025)
par: Liu, Jianming, et autres
Publié: (2025)
Escaping The Big Data Paradigm in Self-Supervised Representation Learning
par: García, Carlos Vélez, et autres
Publié: (2025)
par: García, Carlos Vélez, et autres
Publié: (2025)
A self-supervised cyclic neural-analytic approach for novel view synthesis and 3D reconstruction
par: Costea, Dragos, et autres
Publié: (2025)
par: Costea, Dragos, et autres
Publié: (2025)
Co-Speech Gesture and Facial Expression Generation for Non-Photorealistic 3D Characters
par: Omine, Taisei, et autres
Publié: (2025)
par: Omine, Taisei, et autres
Publié: (2025)
MINT: Mitigating Hallucinations in Large Vision-Language Models via Token Reduction
par: Wang, Chao, et autres
Publié: (2025)
par: Wang, Chao, et autres
Publié: (2025)
VeS: Teaching Pixels to Listen Without Supervision
par: Raj, Sajay
Publié: (2025)
par: Raj, Sajay
Publié: (2025)
BlindSight: Harnessing Sparsity for Efficient Vision-Language Models
par: Srikrishnan, Tharun Adithya, et autres
Publié: (2025)
par: Srikrishnan, Tharun Adithya, et autres
Publié: (2025)
Towards Hard and Soft Shadow Removal via Dual-Branch Separation Network and Vision Transformer
par: Liang, Jiajia
Publié: (2025)
par: Liang, Jiajia
Publié: (2025)
FUSE-Flow: Scalable Real-Time Multi-View Point Cloud Reconstruction Using Confidence
par: Sun, Chentian
Publié: (2026)
par: Sun, Chentian
Publié: (2026)
YotoR-You Only Transform One Representation
par: Villa, José Ignacio Díaz, et autres
Publié: (2024)
par: Villa, José Ignacio Díaz, et autres
Publié: (2024)
MSTA3D: Multi-scale Twin-attention for 3D Instance Segmentation
par: Tran, Duc Dang Trung, et autres
Publié: (2024)
par: Tran, Duc Dang Trung, et autres
Publié: (2024)
GMAC: Global Multi-View Constraint for Automatic Multi-Camera Extrinsic Calibration
par: Sun, Chentian
Publié: (2026)
par: Sun, Chentian
Publié: (2026)
Documents similaires
-
Birth and Death of a Rose
par: Geng, Chen, et autres
Publié: (2024) -
Web-Scale Collection of Video Data for 4D Animal Reconstruction
par: Zhao, Brian Nlong, et autres
Publié: (2025) -
ERNet: Efficient Non-Rigid Registration Network for Point Sequences
par: He, Guangzhao, et autres
Publié: (2025) -
U-Net-Like Spiking Neural Networks for Single Image Dehazing
par: Li, Huibin, et autres
Publié: (2025) -
ReLKD: Inter-Class Relation Learning with Knowledge Distillation for Generalized Category Discovery
par: Zhou, Fang, et autres
Publié: (2025)