Towards Multi-Modal Animal Pose Estimation: A Survey and In-Depth Analysis
Fuente:
arXiv
Salvato in:
| Autori principali: | Deng, Qianyi, Deb, Oishi, Patel, Amir, Rupprecht, Christian, Torr, Philip, Trigoni, Niki, Markham, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
di: Deb, Oishi, et al.
Pubblicazione: (2025)
di: Deb, Oishi, et al.
Pubblicazione: (2025)
Dusk Till Dawn: Self-supervised Nighttime Stereo Depth Estimation using Visual Foundation Models
di: Vankadari, Madhu, et al.
Pubblicazione: (2024)
di: Vankadari, Madhu, et al.
Pubblicazione: (2024)
WSCLoc: Weakly-Supervised Sparse-View Camera Relocalization
di: Wang, Jialu, et al.
Pubblicazione: (2024)
di: Wang, Jialu, et al.
Pubblicazione: (2024)
MambaLoc: Efficient Camera Localisation via State Space Model
di: Wang, Jialu, et al.
Pubblicazione: (2024)
di: Wang, Jialu, et al.
Pubblicazione: (2024)
Manydepth2: Motion-Aware Self-Supervised Monocular Depth Estimation in Dynamic Scenes
di: Zhou, Kaichen, et al.
Pubblicazione: (2023)
di: Zhou, Kaichen, et al.
Pubblicazione: (2023)
Spherical Mask: Coarse-to-Fine 3D Point Cloud Instance Segmentation with Spherical Representation
di: Shin, Sangyun, et al.
Pubblicazione: (2023)
di: Shin, Sangyun, et al.
Pubblicazione: (2023)
SoundLoc3D: Invisible 3D Sound Source Localization and Classification Using a Multimodal RGB-D Acoustic Camera
di: He, Yuhang, et al.
Pubblicazione: (2024)
di: He, Yuhang, et al.
Pubblicazione: (2024)
SpatialPIN: Enhancing Spatial Reasoning Capabilities of Vision-Language Models through Prompting and Interacting 3D Priors
di: Ma, Chenyang, et al.
Pubblicazione: (2024)
di: Ma, Chenyang, et al.
Pubblicazione: (2024)
ZeST: Zero-Shot Material Transfer from a Single Image
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
Pre-training Feature Guided Diffusion Model for Speech Enhancement
di: Yang, Yiyuan, et al.
Pubblicazione: (2024)
di: Yang, Yiyuan, et al.
Pubblicazione: (2024)
Data Factory with Minimal Human Effort Using VLMs
di: Ye, Jiaojiao, et al.
Pubblicazione: (2025)
di: Ye, Jiaojiao, et al.
Pubblicazione: (2025)
PoseDiffusion: Solving Pose Estimation via Diffusion-aided Bundle Adjustment
di: Wang, Jianyuan, et al.
Pubblicazione: (2023)
di: Wang, Jianyuan, et al.
Pubblicazione: (2023)
Mitigating Cognitive Bias in RLHF by Altering Rationality
di: Horter, Tiffany, et al.
Pubblicazione: (2026)
di: Horter, Tiffany, et al.
Pubblicazione: (2026)
Target Speaker Extraction through Comparing Noisy Positive and Negative Audio Enrollments
di: Xu, Shitong, et al.
Pubblicazione: (2025)
di: Xu, Shitong, et al.
Pubblicazione: (2025)
Efficient and Microphone-Fault-Tolerant 3D Sound Source Localization
di: Yang, Yiyuan, et al.
Pubblicazione: (2025)
di: Yang, Yiyuan, et al.
Pubblicazione: (2025)
VMLoc: Variational Fusion For Learning-Based Multimodal Camera Localization
di: Zhou, Kaichen, et al.
Pubblicazione: (2020)
di: Zhou, Kaichen, et al.
Pubblicazione: (2020)
Learning Continuous 3D Words for Text-to-Image Generation
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
di: Cheng, Ta-Ying, et al.
Pubblicazione: (2024)
DynPoint: Dynamic Neural Point For View Synthesis
di: Zhou, Kaichen, et al.
Pubblicazione: (2023)
di: Zhou, Kaichen, et al.
Pubblicazione: (2023)
WildDepth: A Multimodal Dataset for 3D Wildlife Perception and Depth Estimation
di: Aamir, Muhammad, et al.
Pubblicazione: (2026)
di: Aamir, Muhammad, et al.
Pubblicazione: (2026)
Scene-Conditional 3D Object Stylization and Composition
di: Zhou, Jinghao, et al.
Pubblicazione: (2023)
di: Zhou, Jinghao, et al.
Pubblicazione: (2023)
Multi-Modal Monocular Endoscopic Depth and Pose Estimation with Edge-Guided Self-Supervision
di: Ju, Xinwei, et al.
Pubblicazione: (2026)
di: Ju, Xinwei, et al.
Pubblicazione: (2026)
Gen4Gen: Generative Data Pipeline for Generative Multi-Concept Composition
di: Yeh, Chun-Hsiao, et al.
Pubblicazione: (2024)
di: Yeh, Chun-Hsiao, et al.
Pubblicazione: (2024)
Demo-Pose: Depth-Monocular Modality Fusion For Object Pose Estimation
di: Agarwal, Rachit, et al.
Pubblicazione: (2026)
di: Agarwal, Rachit, et al.
Pubblicazione: (2026)
AnimalClue: Recognizing Animals by their Traces
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
New keypoint-based approach for recognising British Sign Language (BSL) from sequences
di: Deb, Oishi, et al.
Pubblicazione: (2024)
di: Deb, Oishi, et al.
Pubblicazione: (2024)
CountGD: Multi-Modal Open-World Counting
di: Amini-Naieni, Niki, et al.
Pubblicazione: (2024)
di: Amini-Naieni, Niki, et al.
Pubblicazione: (2024)
DiffPose-Animal: A Language-Conditioned Diffusion Framework for Animal Pose Estimation
di: Xiong, Tianyu, et al.
Pubblicazione: (2025)
di: Xiong, Tianyu, et al.
Pubblicazione: (2025)
Towards Balanced Multi-Modal Learning in 3D Human Pose Estimation
di: Qi, Mengshi, et al.
Pubblicazione: (2025)
di: Qi, Mengshi, et al.
Pubblicazione: (2025)
COOPERA: Continual Open-Ended Human-Robot Assistance
di: Ma, Chenyang, et al.
Pubblicazione: (2025)
di: Ma, Chenyang, et al.
Pubblicazione: (2025)
Mushroom Segmentation and 3D Pose Estimation from Point Clouds using Fully Convolutional Geometric Features and Implicit Pose Encoding
di: Retsinas, George, et al.
Pubblicazione: (2024)
di: Retsinas, George, et al.
Pubblicazione: (2024)
MMP: Towards Robust Multi-Modal Learning with Masked Modality Projection
di: Nezakati, Niki, et al.
Pubblicazione: (2024)
di: Nezakati, Niki, et al.
Pubblicazione: (2024)
DualPM: Dual Posed-Canonical Point Maps for 3D Shape and Pose Reconstruction
di: Kaye, Ben, et al.
Pubblicazione: (2024)
di: Kaye, Ben, et al.
Pubblicazione: (2024)
Probabilistic Prompt Distribution Learning for Animal Pose Estimation
di: Rao, Jiyong, et al.
Pubblicazione: (2025)
di: Rao, Jiyong, et al.
Pubblicazione: (2025)
STEP: Simultaneous Tracking and Estimation of Pose for Animals and Humans
di: Verma, Shashikant, et al.
Pubblicazione: (2025)
di: Verma, Shashikant, et al.
Pubblicazione: (2025)
SPEAR: Receiver-to-Receiver Acoustic Neural Warping Field
di: He, Yuhang, et al.
Pubblicazione: (2024)
di: He, Yuhang, et al.
Pubblicazione: (2024)
Invisible Stitch: Generating Smooth 3D Scenes with Depth Inpainting
di: Engstler, Paul, et al.
Pubblicazione: (2024)
di: Engstler, Paul, et al.
Pubblicazione: (2024)
DeepInteraction++: Multi-Modality Interaction for Autonomous Driving
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
di: Yang, Zeyu, et al.
Pubblicazione: (2024)
PTC-Depth: Pose-Refined Monocular Depth Estimation with Temporal Consistency
di: Han, Leezy, et al.
Pubblicazione: (2026)
di: Han, Leezy, et al.
Pubblicazione: (2026)
AnyCam: Learning to Recover Camera Poses and Intrinsics from Casual Videos
di: Wimbauer, Felix, et al.
Pubblicazione: (2025)
di: Wimbauer, Felix, et al.
Pubblicazione: (2025)
Farm3D: Learning Articulated 3D Animals by Distilling 2D Diffusion
di: Jakab, Tomas, et al.
Pubblicazione: (2023)
di: Jakab, Tomas, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Articulate3D: Zero-Shot Text-Driven 3D Object Posing
di: Deb, Oishi, et al.
Pubblicazione: (2025) -
Dusk Till Dawn: Self-supervised Nighttime Stereo Depth Estimation using Visual Foundation Models
di: Vankadari, Madhu, et al.
Pubblicazione: (2024) -
WSCLoc: Weakly-Supervised Sparse-View Camera Relocalization
di: Wang, Jialu, et al.
Pubblicazione: (2024) -
MambaLoc: Efficient Camera Localisation via State Space Model
di: Wang, Jialu, et al.
Pubblicazione: (2024) -
Manydepth2: Motion-Aware Self-Supervised Monocular Depth Estimation in Dynamic Scenes
di: Zhou, Kaichen, et al.
Pubblicazione: (2023)