XoFTR: Cross-modal Feature Matching Transformer
Fuente:
arXiv
Salvato in:
| Autori principali: | Tuzcuoğlu, Önder, Köksal, Aybora, Sofu, Buğra, Kalkan, Sinan, Alatan, A. Aydın |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Few-Shot Vision-Language Reasoning for Satellite Imagery via Verifiable Rewards
di: Koksal, Aybora, et al.
Pubblicazione: (2025)
di: Koksal, Aybora, et al.
Pubblicazione: (2025)
SAMChat: Introducing Chain of Thought Reasoning and GRPO to a Multimodal Small Language Model for Small Scale Remote Sensing
di: Koksal, Aybora, et al.
Pubblicazione: (2025)
di: Koksal, Aybora, et al.
Pubblicazione: (2025)
TinyRS-R1: Compact Multimodal Language Model for Remote Sensing
di: Koksal, Aybora, et al.
Pubblicazione: (2025)
di: Koksal, Aybora, et al.
Pubblicazione: (2025)
MDE-VIO: Enhancing Visual-Inertial Odometry Using Learned Depth Priors
di: Alniak, Arda, et al.
Pubblicazione: (2026)
di: Alniak, Arda, et al.
Pubblicazione: (2026)
MatchED: Crisp Edge Detection Using End-to-End, Matching-based Supervision
di: Cetinkaya, Bedrettin, et al.
Pubblicazione: (2026)
di: Cetinkaya, Bedrettin, et al.
Pubblicazione: (2026)
Causal Transformer for Fusion and Pose Estimation in Deep Visual Inertial Odometry
di: Kurt, Yunus Bilge, et al.
Pubblicazione: (2024)
di: Kurt, Yunus Bilge, et al.
Pubblicazione: (2024)
IG-SLAM: Instant Gaussian SLAM
di: Sarikamis, F. Aykut, et al.
Pubblicazione: (2024)
di: Sarikamis, F. Aykut, et al.
Pubblicazione: (2024)
Efficient LoFTR: Semi-Dense Local Feature Matching with Sparse-Like Speed
di: Wang, Yifan, et al.
Pubblicazione: (2024)
di: Wang, Yifan, et al.
Pubblicazione: (2024)
RankED: Addressing Imbalance and Uncertainty in Edge Detection Using Ranking-based Losses
di: Cetinkaya, Bedrettin, et al.
Pubblicazione: (2024)
di: Cetinkaya, Bedrettin, et al.
Pubblicazione: (2024)
Investigating Bias and Fairness in Appearance-based Gaze Estimation
di: Akgül, Burak, et al.
Pubblicazione: (2026)
di: Akgül, Burak, et al.
Pubblicazione: (2026)
PDV: Prompt Directional Vectors for Zero-shot Composed Image Retrieval
di: Tursun, Osman, et al.
Pubblicazione: (2025)
di: Tursun, Osman, et al.
Pubblicazione: (2025)
RSPose: Ranking Based Losses for Human Pose Estimation
di: Keles, Muhammed Can, et al.
Pubblicazione: (2025)
di: Keles, Muhammed Can, et al.
Pubblicazione: (2025)
L-VAE: Variational Auto-Encoder with Learnable Beta for Disentangled Representation
di: Ozcan, Hazal Mogultay, et al.
Pubblicazione: (2025)
di: Ozcan, Hazal Mogultay, et al.
Pubblicazione: (2025)
Deep Learning-Based Real-Time Sequential Facial Expression Analysis Using Geometric Features
di: Koksal, Talha Enes, et al.
Pubblicazione: (2025)
di: Koksal, Talha Enes, et al.
Pubblicazione: (2025)
Intrinsic Dimensionality as a Model-Free Measure of Class Imbalance
di: Eser, Çağrı, et al.
Pubblicazione: (2025)
di: Eser, Çağrı, et al.
Pubblicazione: (2025)
Multi-modal Semantic Understanding with Contrastive Cross-modal Feature Alignment
di: Zhang, Ming, et al.
Pubblicazione: (2024)
di: Zhang, Ming, et al.
Pubblicazione: (2024)
CrossFlowDG: Bridging the Modality Gap with Cross-modal Flow Matching for Domain Generalization
di: Kritikos, Antonios, et al.
Pubblicazione: (2026)
di: Kritikos, Antonios, et al.
Pubblicazione: (2026)
Text-guided Feature Disentanglement for Cross-modal Gait Recognition
di: Lu, Zhiyang, et al.
Pubblicazione: (2026)
di: Lu, Zhiyang, et al.
Pubblicazione: (2026)
Bucketed Ranking-based Losses for Efficient Training of Object Detectors
di: Yavuz, Feyza, et al.
Pubblicazione: (2024)
di: Yavuz, Feyza, et al.
Pubblicazione: (2024)
Craft: Cross-modal Aligned Features Improve Robustness of Prompt Tuning
di: Sun, Jingchen, et al.
Pubblicazione: (2024)
di: Sun, Jingchen, et al.
Pubblicazione: (2024)
Detecting Driver Fatigue With Eye Blink Behavior
di: Akin, Ali, et al.
Pubblicazione: (2024)
di: Akin, Ali, et al.
Pubblicazione: (2024)
A 3D Cross-modal Keypoint Descriptor for MR-US Matching and Registration
di: Morozov, Daniil, et al.
Pubblicazione: (2025)
di: Morozov, Daniil, et al.
Pubblicazione: (2025)
MatChA: Cross-Algorithm Matching with Feature Augmentation
di: Cubero, Paula Carbó, et al.
Pubblicazione: (2025)
di: Cubero, Paula Carbó, et al.
Pubblicazione: (2025)
Gaze4HRI: Zero-shot Benchmarking Gaze Estimation Neural-Networks for Human-Robot Interaction
di: Sezer, Berk, et al.
Pubblicazione: (2026)
di: Sezer, Berk, et al.
Pubblicazione: (2026)
Hierarchical Multi-modal Transformer for Cross-modal Long Document Classification
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
Computed Tomography Visual Question Answering with Cross-modal Feature Graphing
di: Tian, Yuanhe, et al.
Pubblicazione: (2025)
di: Tian, Yuanhe, et al.
Pubblicazione: (2025)
Part-based Quantitative Analysis for Heatmaps
di: Tursun, Osman, et al.
Pubblicazione: (2024)
di: Tursun, Osman, et al.
Pubblicazione: (2024)
Machine Learning Fairness for Depression Detection using EEG Data
di: Kwok, Angus Man Ho, et al.
Pubblicazione: (2025)
di: Kwok, Angus Man Ho, et al.
Pubblicazione: (2025)
LoFLAT: Local Feature Matching using Focused Linear Attention Transformer
di: Cao, Naijian, et al.
Pubblicazione: (2024)
di: Cao, Naijian, et al.
Pubblicazione: (2024)
A 3D Multimodal Feature for Infrastructure Anomaly Detection
di: Jing, Yixiong, et al.
Pubblicazione: (2025)
di: Jing, Yixiong, et al.
Pubblicazione: (2025)
FG$^2$: Fine-Grained Cross-View Localization by Fine-Grained Feature Matching
di: Xia, Zimin, et al.
Pubblicazione: (2025)
di: Xia, Zimin, et al.
Pubblicazione: (2025)
Modality-Aware Feature Matching: A Comprehensive Review of Single- and Cross-Modality Techniques
di: Liu, Weide, et al.
Pubblicazione: (2025)
di: Liu, Weide, et al.
Pubblicazione: (2025)
Cross-Domain Few-Shot Semantic Segmentation via Doubly Matching Transformation
di: Chen, Jiayi, et al.
Pubblicazione: (2024)
di: Chen, Jiayi, et al.
Pubblicazione: (2024)
SURGIVID: Annotation-Efficient Surgical Video Object Discovery
di: Köksal, Çağhan, et al.
Pubblicazione: (2024)
di: Köksal, Çağhan, et al.
Pubblicazione: (2024)
Cross-modal Prompting for Balanced Incomplete Multi-modal Emotion Recognition
di: He, Wen-Jue, et al.
Pubblicazione: (2025)
di: He, Wen-Jue, et al.
Pubblicazione: (2025)
A Low-rank Matching Attention based Cross-modal Feature Fusion Method for Conversational Emotion Recognition
di: Shou, Yuntao, et al.
Pubblicazione: (2023)
di: Shou, Yuntao, et al.
Pubblicazione: (2023)
ETO:Efficient Transformer-based Local Feature Matching by Organizing Multiple Homography Hypotheses
di: Ni, Junjie, et al.
Pubblicazione: (2024)
di: Ni, Junjie, et al.
Pubblicazione: (2024)
SceneGlue: Scene-Aware Transformer for Feature Matching without Scene-Level Annotation
di: Du, Songlin, et al.
Pubblicazione: (2026)
di: Du, Songlin, et al.
Pubblicazione: (2026)
Cross-modal learning for plankton recognition
di: Kareinen, Joona, et al.
Pubblicazione: (2026)
di: Kareinen, Joona, et al.
Pubblicazione: (2026)
X-MIC: Cross-Modal Instance Conditioning for Egocentric Action Generalization
di: Kukleva, Anna, et al.
Pubblicazione: (2024)
di: Kukleva, Anna, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Few-Shot Vision-Language Reasoning for Satellite Imagery via Verifiable Rewards
di: Koksal, Aybora, et al.
Pubblicazione: (2025) -
SAMChat: Introducing Chain of Thought Reasoning and GRPO to a Multimodal Small Language Model for Small Scale Remote Sensing
di: Koksal, Aybora, et al.
Pubblicazione: (2025) -
TinyRS-R1: Compact Multimodal Language Model for Remote Sensing
di: Koksal, Aybora, et al.
Pubblicazione: (2025) -
MDE-VIO: Enhancing Visual-Inertial Odometry Using Learned Depth Priors
di: Alniak, Arda, et al.
Pubblicazione: (2026) -
MatchED: Crisp Edge Detection Using End-to-End, Matching-based Supervision
di: Cetinkaya, Bedrettin, et al.
Pubblicazione: (2026)