METER: a mobile vision transformer architecture for monocular depth estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Papa, L., Russo, P., Amerini, I. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
D4D: An RGBD diffusion model to boost monocular depth estimation
par: Papa, L., et autres
Publié: (2024)
par: Papa, L., et autres
Publié: (2024)
A survey on efficient vision transformers: algorithms, techniques, and performance benchmarking
par: Papa, Lorenzo, et autres
Publié: (2023)
par: Papa, Lorenzo, et autres
Publié: (2023)
DepthFake: a depth-based strategy for detecting Deepfake videos
par: Maiano, Luca, et autres
Publié: (2022)
par: Maiano, Luca, et autres
Publié: (2022)
Shedding Light on Depth: Explainability Assessment in Monocular Depth Estimation
par: Cirillo, Lorenzo, et autres
Publié: (2025)
par: Cirillo, Lorenzo, et autres
Publié: (2025)
Markerless Stride Length estimation in Athletic using Pose Estimation with monocular vision
par: Skorupski, Patryk, et autres
Publié: (2025)
par: Skorupski, Patryk, et autres
Publié: (2025)
VidCLearn: A Continual Learning Approach for Text-to-Video Generation
par: Zanchetta, Luca, et autres
Publié: (2025)
par: Zanchetta, Luca, et autres
Publié: (2025)
EC-Depth: Exploring the consistency of self-supervised monocular depth estimation in challenging scenes
par: Song, Ziyang, et autres
Publié: (2023)
par: Song, Ziyang, et autres
Publié: (2023)
On the impact of key design aspects in simulated Hybrid Quantum Neural Networks for Earth Observation
par: Papa, Lorenzo, et autres
Publié: (2024)
par: Papa, Lorenzo, et autres
Publié: (2024)
Diffusion Models for Earth Observation Use-cases: from cloud removal to urban change detection
par: Sanguigni, Fulvio, et autres
Publié: (2023)
par: Sanguigni, Fulvio, et autres
Publié: (2023)
Generalizing monocular colonoscopy image depth estimation by uncertainty-based global and local fusion network
par: Du, Sijia, et autres
Publié: (2024)
par: Du, Sijia, et autres
Publié: (2024)
KBody: Towards general, robust, and aligned monocular whole-body estimation
par: Zioulis, Nikolaos, et autres
Publié: (2023)
par: Zioulis, Nikolaos, et autres
Publié: (2023)
FMPose3D: monocular 3D pose estimation via flow matching
par: Wang, Ti, et autres
Publié: (2026)
par: Wang, Ti, et autres
Publié: (2026)
Improved monocular depth prediction using distance transform over pre-semantic contours with self-supervised neural networks
par: Hariat, Marwane, et autres
Publié: (2026)
par: Hariat, Marwane, et autres
Publié: (2026)
Enhancing Ground-to-Aerial Image Matching for Visual Misinformation Detection Using Semantic Segmentation
par: Mule, Emanuele, et autres
Publié: (2025)
par: Mule, Emanuele, et autres
Publié: (2025)
FitDiff: Robust monocular 3D facial shape and reflectance estimation using Diffusion Models
par: Galanakis, Stathis, et autres
Publié: (2023)
par: Galanakis, Stathis, et autres
Publié: (2023)
Forest canopy height estimation from satellite RGB imagery using large-scale airborne LiDAR-derived training data and monocular depth estimation
par: Lai, Yongkang, et autres
Publié: (2026)
par: Lai, Yongkang, et autres
Publié: (2026)
Spiking monocular event based 6D pose estimation for space application
par: Courtois, Jonathan, et autres
Publié: (2025)
par: Courtois, Jonathan, et autres
Publié: (2025)
Extended monocular 3D imaging
par: Shen, Zicheng, et autres
Publié: (2025)
par: Shen, Zicheng, et autres
Publié: (2025)
Z-SASLM: Zero-Shot Style-Aligned SLI Blending Latent Manipulation
par: Borgi, Alessio, et autres
Publié: (2025)
par: Borgi, Alessio, et autres
Publié: (2025)
Enhancing Abnormality Identification: Robust Out-of-Distribution Strategies for Deepfake Detection
par: Maiano, Luca, et autres
Publié: (2025)
par: Maiano, Luca, et autres
Publié: (2025)
LADLE-MM: Limited Annotation based Detector with Learned Ensembles for Multimodal Misinformation
par: Cardullo, Daniele, et autres
Publié: (2025)
par: Cardullo, Daniele, et autres
Publié: (2025)
R3ST: A Synthetic 3D Dataset With Realistic Trajectories
par: Teglia, Simone, et autres
Publié: (2025)
par: Teglia, Simone, et autres
Publié: (2025)
Cross multiscale vision transformer for deep fake detection
par: P, Akhshan, et autres
Publié: (2025)
par: P, Akhshan, et autres
Publié: (2025)
COSMU: Complete 3D human shape from monocular unconstrained images
par: Pesavento, Marco, et autres
Publié: (2024)
par: Pesavento, Marco, et autres
Publié: (2024)
Continuous fake media detection: adapting deepfake detectors to new generative techniques
par: Tassone, Francesco, et autres
Publié: (2024)
par: Tassone, Francesco, et autres
Publié: (2024)
DRSM: efficient neural 4d decomposition for dynamic reconstruction in stationary monocular cameras
par: Xie, Weixing, et autres
Publié: (2024)
par: Xie, Weixing, et autres
Publié: (2024)
WildLIFT: Lifting monocular drone video to 3D for species-agnostic wildlife monitoring
par: Shukla, Vandita, et autres
Publié: (2026)
par: Shukla, Vandita, et autres
Publié: (2026)
STLight: a Fully Convolutional Approach for Efficient Predictive Learning by Spatio-Temporal joint Processing
par: Alfarano, Andrea, et autres
Publié: (2024)
par: Alfarano, Andrea, et autres
Publié: (2024)
X-ray illicit object detection using hybrid CNN-transformer neural network architectures
par: Cani, Jorgen, et autres
Publié: (2025)
par: Cani, Jorgen, et autres
Publié: (2025)
an interpretable vision transformer framework for automated brain tumor classification
par: Mbonu, Chinedu Emmanuel, et autres
Publié: (2026)
par: Mbonu, Chinedu Emmanuel, et autres
Publié: (2026)
Beyond the final layer: Attentive multilayer fusion for vision transformers
par: Ciernik, Laure, et autres
Publié: (2026)
par: Ciernik, Laure, et autres
Publié: (2026)
Self-localization on a 3D map by fusing global and local features from a monocular camera
par: Kikuchi, Satoshi, et autres
Publié: (2025)
par: Kikuchi, Satoshi, et autres
Publié: (2025)
Hybridnet for depth estimation and semantic segmentation
par: Sánchez-Escobedo, Dalila, et autres
Publié: (2024)
par: Sánchez-Escobedo, Dalila, et autres
Publié: (2024)
Synthetic data augmentation for robotic mobility aids to support blind and low vision people
par: Hwang, Hochul, et autres
Publié: (2024)
par: Hwang, Hochul, et autres
Publié: (2024)
A review on vision-based motion estimation
par: Liu, Hongyi, et autres
Publié: (2024)
par: Liu, Hongyi, et autres
Publié: (2024)
Computer vision-based estimation of invertebrate biomass
par: Impiö, Mikko, et autres
Publié: (2026)
par: Impiö, Mikko, et autres
Publié: (2026)
Self-supervised pretraining for an iterative image size agnostic vision transformer
par: Prisadnikov, Nedyalko, et autres
Publié: (2026)
par: Prisadnikov, Nedyalko, et autres
Publié: (2026)
MonoVisual3DFilter: 3D tomatoes' localisation with monocular cameras using histogram filters
par: Magalhães, Sandro Costa, et autres
Publié: (2023)
par: Magalhães, Sandro Costa, et autres
Publié: (2023)
Beyond sparse denoising in frames: minimax estimation with a scattering transform
par: Cuvelle--Magar, Nathanaël, et autres
Publié: (2025)
par: Cuvelle--Magar, Nathanaël, et autres
Publié: (2025)
SAFER: Sharpness Aware layer-selective Finetuning for Enhanced Robustness in vision transformers
par: Gopal, Bhavna, et autres
Publié: (2025)
par: Gopal, Bhavna, et autres
Publié: (2025)
Documents similaires
-
D4D: An RGBD diffusion model to boost monocular depth estimation
par: Papa, L., et autres
Publié: (2024) -
A survey on efficient vision transformers: algorithms, techniques, and performance benchmarking
par: Papa, Lorenzo, et autres
Publié: (2023) -
DepthFake: a depth-based strategy for detecting Deepfake videos
par: Maiano, Luca, et autres
Publié: (2022) -
Shedding Light on Depth: Explainability Assessment in Monocular Depth Estimation
par: Cirillo, Lorenzo, et autres
Publié: (2025) -
Markerless Stride Length estimation in Athletic using Pose Estimation with monocular vision
par: Skorupski, Patryk, et autres
Publié: (2025)