Deep Extrinsic Manifold Representation for Vision Tasks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Tongtong, Wei, Xian, Li, Yuanxiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
psPRF:Pansharpening Planar Neural Radiance Field for Generalized 3D Reconstruction Satellite Imagery
von: Zhang, Tongtong, et al.
Veröffentlicht: (2024)
von: Zhang, Tongtong, et al.
Veröffentlicht: (2024)
A Nerf-Based Color Consistency Method for Remote Sensing Images
von: Zuo, Zongcheng, et al.
Veröffentlicht: (2024)
von: Zuo, Zongcheng, et al.
Veröffentlicht: (2024)
Online LiDAR-Camera Extrinsic Parameters Self-checking
von: Wei, Pengjin, et al.
Veröffentlicht: (2022)
von: Wei, Pengjin, et al.
Veröffentlicht: (2022)
Proximal Vision Transformer: Enhancing Feature Representation through Two-Stage Manifold Geometry
von: Yun, Haoyu, et al.
Veröffentlicht: (2025)
von: Yun, Haoyu, et al.
Veröffentlicht: (2025)
Surface Vision Mamba: Leveraging Bidirectional State Space Model for Efficient Spherical Manifold Representation
von: He, Rongzhao, et al.
Veröffentlicht: (2025)
von: He, Rongzhao, et al.
Veröffentlicht: (2025)
Superpixel Semantics Representation and Pre-training for Vision-Language Task
von: Zhang, Siyu, et al.
Veröffentlicht: (2023)
von: Zhang, Siyu, et al.
Veröffentlicht: (2023)
MedUnifier: Unifying Vision-and-Language Pre-training on Medical Data with Vision Generation Task using Discrete Visual Representations
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
Improved Belief-Attention in Vision Task
von: Zhang, Guoqiang
Veröffentlicht: (2026)
von: Zhang, Guoqiang
Veröffentlicht: (2026)
Environment-Driven Online LiDAR-Camera Extrinsic Calibration
von: Huang, Zhiwei, et al.
Veröffentlicht: (2025)
von: Huang, Zhiwei, et al.
Veröffentlicht: (2025)
Generalized Single-Image-Based Morphing Attack Detection Using Deep Representations from Vision Transformer
von: Zhang, Haoyu, et al.
Veröffentlicht: (2025)
von: Zhang, Haoyu, et al.
Veröffentlicht: (2025)
ZSPAPrune: Zero-Shot Prompt-Aware Token Pruning for Vision-Language Models
von: Zhang, Pu, et al.
Veröffentlicht: (2025)
von: Zhang, Pu, et al.
Veröffentlicht: (2025)
Deep Active Learning with Manifold-preserving Trajectory Sampling
von: Ji, Yingrui, et al.
Veröffentlicht: (2024)
von: Ji, Yingrui, et al.
Veröffentlicht: (2024)
NuWa: Deriving Lightweight Task-Specific Vision Transformers for Edge Devices
von: Wei, Ziteng, et al.
Veröffentlicht: (2025)
von: Wei, Ziteng, et al.
Veröffentlicht: (2025)
Dynamic Universal Approximation Theory: The Basic Theory for Deep Learning-Based Computer Vision Models
von: Wang, Wei, et al.
Veröffentlicht: (2024)
von: Wang, Wei, et al.
Veröffentlicht: (2024)
Compressing Vision Transformers in Geospatial Transfer Learning with Manifold-Constrained Optimization
von: Snyder, Thomas, et al.
Veröffentlicht: (2026)
von: Snyder, Thomas, et al.
Veröffentlicht: (2026)
LLaVA-OneVision: Easy Visual Task Transfer
von: Li, Bo, et al.
Veröffentlicht: (2024)
von: Li, Bo, et al.
Veröffentlicht: (2024)
PMMD: A pose-guided multi-view multi-modal diffusion for person generation
von: Shang, Ziyu, et al.
Veröffentlicht: (2025)
von: Shang, Ziyu, et al.
Veröffentlicht: (2025)
Two-Stream Interactive Joint Learning of Scene Parsing and Geometric Vision Tasks
von: Tang, Guanfeng, et al.
Veröffentlicht: (2026)
von: Tang, Guanfeng, et al.
Veröffentlicht: (2026)
UniGaussian: Driving Scene Reconstruction from Multiple Camera Models via Unified Gaussian Representations
von: Ren, Yuan, et al.
Veröffentlicht: (2024)
von: Ren, Yuan, et al.
Veröffentlicht: (2024)
Masked Modeling for Self-supervised Representation Learning on Vision and Beyond
von: Li, Siyuan, et al.
Veröffentlicht: (2023)
von: Li, Siyuan, et al.
Veröffentlicht: (2023)
Recurrent Reasoning with Vision-Language Models for Estimating Long-Horizon Embodied Task Progress
von: Zhang, Yuelin, et al.
Veröffentlicht: (2026)
von: Zhang, Yuelin, et al.
Veröffentlicht: (2026)
UNIC: Learning Unified Multimodal Extrinsic Contact Estimation
von: Xu, Zhengtong, et al.
Veröffentlicht: (2026)
von: Xu, Zhengtong, et al.
Veröffentlicht: (2026)
Human-Like Coarse Object Representations in Vision Models
von: Gizdov, Andrey, et al.
Veröffentlicht: (2026)
von: Gizdov, Andrey, et al.
Veröffentlicht: (2026)
TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task Types
von: Chen, Jiankang, et al.
Veröffentlicht: (2025)
von: Chen, Jiankang, et al.
Veröffentlicht: (2025)
GTMA: Dynamic Representation Optimization for OOD Vision-Language Models
von: Zhang, Jensen, et al.
Veröffentlicht: (2025)
von: Zhang, Jensen, et al.
Veröffentlicht: (2025)
Research on the Application of Computer Vision Based on Deep Learning in Autonomous Driving Technology
von: Zhang, Jingyu, et al.
Veröffentlicht: (2024)
von: Zhang, Jingyu, et al.
Veröffentlicht: (2024)
Global Geometry Is Not Enough for Vision Representations
von: Chung, Jiwan, et al.
Veröffentlicht: (2026)
von: Chung, Jiwan, et al.
Veröffentlicht: (2026)
Behavior-Grounded Lane Representation Learning for Multi-Task Traffic Digital Twins
von: Tamaru, Rei, et al.
Veröffentlicht: (2026)
von: Tamaru, Rei, et al.
Veröffentlicht: (2026)
Olympus: A Universal Task Router for Computer Vision Tasks
von: Lin, Yuanze, et al.
Veröffentlicht: (2024)
von: Lin, Yuanze, et al.
Veröffentlicht: (2024)
Representation Separation for Semantic Segmentation with Vision Transformers
von: Hong, Yuanduo, et al.
Veröffentlicht: (2022)
von: Hong, Yuanduo, et al.
Veröffentlicht: (2022)
The Geometry of Representational Failures in Vision Language Models
von: Savietto, Daniele, et al.
Veröffentlicht: (2026)
von: Savietto, Daniele, et al.
Veröffentlicht: (2026)
Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models
von: He, Yuting, et al.
Veröffentlicht: (2026)
von: He, Yuting, et al.
Veröffentlicht: (2026)
SpatialFly: Geometry-Guided Representation Alignment for UAV Vision-and-Language Navigation in Urban Environments
von: Jiang, Wen, et al.
Veröffentlicht: (2026)
von: Jiang, Wen, et al.
Veröffentlicht: (2026)
LVLM-Aided Alignment of Task-Specific Vision Models
von: Koebler, Alexander, et al.
Veröffentlicht: (2025)
von: Koebler, Alexander, et al.
Veröffentlicht: (2025)
Demystifying KAN for Vision Tasks: The RepKAN Approach
von: Cheon, Minjong
Veröffentlicht: (2026)
von: Cheon, Minjong
Veröffentlicht: (2026)
Vision Language Model-Empowered Contract Theory for AIGC Task Allocation in Teleoperation
von: Zhan, Zijun, et al.
Veröffentlicht: (2024)
von: Zhan, Zijun, et al.
Veröffentlicht: (2024)
Towards Accurate UAV Image Perception: Guiding Vision-Language Models with Stronger Task Prompts
von: Guo, Mingning, et al.
Veröffentlicht: (2025)
von: Guo, Mingning, et al.
Veröffentlicht: (2025)
PyVision-RL: Forging Open Agentic Vision Models via RL
von: Zhao, Shitian, et al.
Veröffentlicht: (2026)
von: Zhao, Shitian, et al.
Veröffentlicht: (2026)
Think Before You Act: A Two-Stage Framework for Mitigating Gender Bias Towards Vision-Language Tasks
von: Zhang, Yunqi, et al.
Veröffentlicht: (2024)
von: Zhang, Yunqi, et al.
Veröffentlicht: (2024)
SurgeryV2: Bridging the Gap Between Model Merging and Multi-Task Learning with Deep Representation Surgery
von: Yang, Enneng, et al.
Veröffentlicht: (2024)
von: Yang, Enneng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
psPRF:Pansharpening Planar Neural Radiance Field for Generalized 3D Reconstruction Satellite Imagery
von: Zhang, Tongtong, et al.
Veröffentlicht: (2024) -
A Nerf-Based Color Consistency Method for Remote Sensing Images
von: Zuo, Zongcheng, et al.
Veröffentlicht: (2024) -
Online LiDAR-Camera Extrinsic Parameters Self-checking
von: Wei, Pengjin, et al.
Veröffentlicht: (2022) -
Proximal Vision Transformer: Enhancing Feature Representation through Two-Stage Manifold Geometry
von: Yun, Haoyu, et al.
Veröffentlicht: (2025) -
Surface Vision Mamba: Leveraging Bidirectional State Space Model for Efficient Spherical Manifold Representation
von: He, Rongzhao, et al.
Veröffentlicht: (2025)