Depth Estimation Algorithm Based on Transformer-Encoder and Feature Fusion
Fuente:
arXiv
Guardado en:
| Autores principales: | Xia, Linhan, Liu, Junbang, Wu, Tong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Improving Depth Gradient Continuity in Transformers: A Comparative Study on Monocular Depth Estimation with CNN
por: Yao, Jiawei, et al.
Publicado: (2023)
por: Yao, Jiawei, et al.
Publicado: (2023)
UniCT Depth: Event-Image Fusion Based Monocular Depth Estimation with Convolution-Compensated ViT Dual SA Block
por: Jing, Luoxi, et al.
Publicado: (2025)
por: Jing, Luoxi, et al.
Publicado: (2025)
Unsupervised Monocular Depth Estimation Based on Hierarchical Feature-Guided Diffusion
por: Liu, Runze, et al.
Publicado: (2024)
por: Liu, Runze, et al.
Publicado: (2024)
RadarCam-Depth: Radar-Camera Fusion for Depth Estimation with Learned Metric Scale
por: Li, Han, et al.
Publicado: (2024)
por: Li, Han, et al.
Publicado: (2024)
3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud Pretraining
por: Yan, Siming, et al.
Publicado: (2023)
por: Yan, Siming, et al.
Publicado: (2023)
DepthFusion: Depth-Aware Hybrid Feature Fusion for LiDAR-Camera 3D Object Detection
por: Ji, Mingqian, et al.
Publicado: (2025)
por: Ji, Mingqian, et al.
Publicado: (2025)
Facial Affect Recognition based on Multi Architecture Encoder and Feature Fusion for the ABAW7 Challenge
por: Shen, Kang, et al.
Publicado: (2024)
por: Shen, Kang, et al.
Publicado: (2024)
FiffDepth: Feed-forward Transformation of Diffusion-Based Generators for Detailed Depth Estimation
por: Bai, Yunpeng, et al.
Publicado: (2024)
por: Bai, Yunpeng, et al.
Publicado: (2024)
OccFusion: Depth Estimation Free Multi-sensor Fusion for 3D Occupancy Prediction
por: Zhang, Ji, et al.
Publicado: (2024)
por: Zhang, Ji, et al.
Publicado: (2024)
360Recon: An Accurate Reconstruction Method Based on Depth Fusion from 360 Images
por: Yan, Zhongmiao, et al.
Publicado: (2024)
por: Yan, Zhongmiao, et al.
Publicado: (2024)
SphereFusion: Efficient Panorama Depth Estimation via Gated Fusion
por: Yan, Qingsong, et al.
Publicado: (2025)
por: Yan, Qingsong, et al.
Publicado: (2025)
A Cross-Hierarchical Difference Feature Fusion Network Based on Multiscale Encoder-Decoder for Hyperspectral Change Detection
por: Sheng, Mingshuai, et al.
Publicado: (2025)
por: Sheng, Mingshuai, et al.
Publicado: (2025)
Florence-VL: Enhancing Vision-Language Models with Generative Vision Encoder and Depth-Breadth Fusion
por: Chen, Jiuhai, et al.
Publicado: (2024)
por: Chen, Jiuhai, et al.
Publicado: (2024)
TacoDepth: Towards Efficient Radar-Camera Depth Estimation with One-stage Fusion
por: Wang, Yiran, et al.
Publicado: (2025)
por: Wang, Yiran, et al.
Publicado: (2025)
Monocular Depth Estimation and Segmentation for Transparent Object with Iterative Semantic and Geometric Fusion
por: Liu, Jiangyuan, et al.
Publicado: (2025)
por: Liu, Jiangyuan, et al.
Publicado: (2025)
Improving Video Diffusion Transformer Training by Multi-Feature Fusion and Alignment from Self-Supervised Vision Encoders
por: Lee, Dohun, et al.
Publicado: (2025)
por: Lee, Dohun, et al.
Publicado: (2025)
EndoDepthL: Lightweight Endoscopic Monocular Depth Estimation with CNN-Transformer
por: Li, Yangke
Publicado: (2023)
por: Li, Yangke
Publicado: (2023)
Hierarchical Awareness Adapters with Hybrid Pyramid Feature Fusion for Dense Depth Prediction
por: Su, Wuqi, et al.
Publicado: (2026)
por: Su, Wuqi, et al.
Publicado: (2026)
The Devil is in the Edges: Monocular Depth Estimation with Edge-aware Consistency Fusion
por: Li, Pengzhi, et al.
Publicado: (2024)
por: Li, Pengzhi, et al.
Publicado: (2024)
Fusion to Enhance: Fusion Visual Encoder to Enhance Multimodal Language Model
por: She, Yifei, et al.
Publicado: (2025)
por: She, Yifei, et al.
Publicado: (2025)
Enhanced Encoder-Decoder Architecture for Accurate Monocular Depth Estimation
por: Das, Dabbrata, et al.
Publicado: (2024)
por: Das, Dabbrata, et al.
Publicado: (2024)
Cross-Modal RGB-D Fusion Transformer for 6D Pose Estimation of Non-Cooperative Spacecraft with Stereo-Derived Depth
por: Zhen, Yongliang, et al.
Publicado: (2026)
por: Zhen, Yongliang, et al.
Publicado: (2026)
ScaleDepth: Decomposing Metric Depth Estimation into Scale Prediction and Relative Depth Estimation
por: Zhu, Ruijie, et al.
Publicado: (2024)
por: Zhu, Ruijie, et al.
Publicado: (2024)
Uni-Encoder Meets Multi-Encoders: Representation Before Fusion for Brain Tumor Segmentation with Missing Modalities
por: Song, Peibo, et al.
Publicado: (2026)
por: Song, Peibo, et al.
Publicado: (2026)
Multispectral Detection Transformer with Infrared-Centric Feature Fusion
por: Hwang, Seongmin, et al.
Publicado: (2025)
por: Hwang, Seongmin, et al.
Publicado: (2025)
ExFusion: Efficient Transformer Training via Multi-Experts Fusion
por: Ruan, Jiacheng, et al.
Publicado: (2026)
por: Ruan, Jiacheng, et al.
Publicado: (2026)
Revisiting 360 Depth Estimation with PanoGabor: A New Fusion Perspective
por: Shen, Zhijie, et al.
Publicado: (2024)
por: Shen, Zhijie, et al.
Publicado: (2024)
AnyDepth: Depth Estimation Made Easy
por: Ren, Zeyu, et al.
Publicado: (2026)
por: Ren, Zeyu, et al.
Publicado: (2026)
Federated Modality-specific Encoders and Partially Personalized Fusion Decoder for Multimodal Brain Tumor Segmentation
por: Liu, Hong, et al.
Publicado: (2026)
por: Liu, Hong, et al.
Publicado: (2026)
Depth as Points: Center Point-based Depth Estimation
por: Tu, Zhiheng, et al.
Publicado: (2025)
por: Tu, Zhiheng, et al.
Publicado: (2025)
Multi-Grained Feature Pruning for Video-Based Human Pose Estimation
por: Wang, Zhigang, et al.
Publicado: (2025)
por: Wang, Zhigang, et al.
Publicado: (2025)
HTMNet: A Hybrid Network with Transformer-Mamba Bottleneck Multimodal Fusion for Transparent and Reflective Objects Depth Completion
por: Xie, Guanghu, et al.
Publicado: (2025)
por: Xie, Guanghu, et al.
Publicado: (2025)
Adjacent-view Transformers for Supervised Surround-view Depth Estimation
por: Guo, Xianda, et al.
Publicado: (2023)
por: Guo, Xianda, et al.
Publicado: (2023)
Interpretable Vision Transformers in Monocular Depth Estimation via SVDA
por: Arampatzakis, Vasileios, et al.
Publicado: (2026)
por: Arampatzakis, Vasileios, et al.
Publicado: (2026)
Mask-adaptive Gated Convolution and Bi-directional Progressive Fusion Network for Depth Completion
por: Huang, Tingxuan, et al.
Publicado: (2024)
por: Huang, Tingxuan, et al.
Publicado: (2024)
Scalable Autoregressive Monocular Depth Estimation
por: Wang, Jinhong, et al.
Publicado: (2024)
por: Wang, Jinhong, et al.
Publicado: (2024)
Transformer-based RGB-T Tracking with Channel and Spatial Feature Fusion
por: Li, Yunfeng, et al.
Publicado: (2024)
por: Li, Yunfeng, et al.
Publicado: (2024)
PathFusion: Path-consistent Lidar-Camera Deep Feature Fusion
por: Wu, Lemeng, et al.
Publicado: (2022)
por: Wu, Lemeng, et al.
Publicado: (2022)
GlyphMastero: A Glyph Encoder for High-Fidelity Scene Text Editing
por: Wang, Tong, et al.
Publicado: (2025)
por: Wang, Tong, et al.
Publicado: (2025)
TUNI: Real-time RGB-T Semantic Segmentation with Unified Multi-Modal Feature Extraction and Cross-Modal Feature Fusion
por: Guo, Xiaodong, et al.
Publicado: (2025)
por: Guo, Xiaodong, et al.
Publicado: (2025)
Ejemplares similares
-
Improving Depth Gradient Continuity in Transformers: A Comparative Study on Monocular Depth Estimation with CNN
por: Yao, Jiawei, et al.
Publicado: (2023) -
UniCT Depth: Event-Image Fusion Based Monocular Depth Estimation with Convolution-Compensated ViT Dual SA Block
por: Jing, Luoxi, et al.
Publicado: (2025) -
Unsupervised Monocular Depth Estimation Based on Hierarchical Feature-Guided Diffusion
por: Liu, Runze, et al.
Publicado: (2024) -
RadarCam-Depth: Radar-Camera Fusion for Depth Estimation with Learned Metric Scale
por: Li, Han, et al.
Publicado: (2024) -
3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud Pretraining
por: Yan, Siming, et al.
Publicado: (2023)