SkyLink: A Large Vision-Language Model Driven Re-ranking Framework for Cross-View UAV geolocalization
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Bowen, Jia, Pengyue, Wang, Wanyu, Xu, Derong, Cheng, Jiawei, Dong, Jiancheng, Han, Xiao, Zhao, Zimo, Zhang, Chao, Yu, Bowen, Hong, Fangyu, Zhao, Xiangyu |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
How to Utilize Complementary Vision-Text Information for 2D Structure Understanding
by: Dong, Jiancheng, et al.
Published: (2026)
by: Dong, Jiancheng, et al.
Published: (2026)
SkyLink: Unifying Street-Satellite Geo-Localization via UAV-Mediated 3D Scene Alignment
by: Zhang, Hongyang, et al.
Published: (2025)
by: Zhang, Hongyang, et al.
Published: (2025)
Curriculum Learning for Efficient Chain-of-Thought Distillation via Structure-Aware Masking and GRPO
by: Yu, Bowen, et al.
Published: (2026)
by: Yu, Bowen, et al.
Published: (2026)
GeoArena: Evaluating Open-World Geographic Reasoning in Large Vision-Language Models
by: Jia, Pengyue, et al.
Published: (2025)
by: Jia, Pengyue, et al.
Published: (2025)
LLM-EDT: Large Language Model Enhanced Cross-domain Sequential Recommendation with Dual-phase Training
by: Liu, Ziwei, et al.
Published: (2025)
by: Liu, Ziwei, et al.
Published: (2025)
Renormalization Group Guided Tensor Network Structure Search
by: Wang, Maolin, et al.
Published: (2025)
by: Wang, Maolin, et al.
Published: (2025)
Are VLMs Lost Between Sky and Space? LinkS$^2$Bench for UAV-Satellite Dynamic Cross-View Spatial Intelligence
by: Liu, Dian, et al.
Published: (2026)
by: Liu, Dian, et al.
Published: (2026)
GeoRouter: Dynamic Paradigm Routing for Worldwide Image Geolocalization
by: Jia, Pengyue, et al.
Published: (2026)
by: Jia, Pengyue, et al.
Published: (2026)
Data Efficient Adaptation in Large Language Models via Continuous Low-Rank Fine-Tuning
by: Han, Xiao, et al.
Published: (2025)
by: Han, Xiao, et al.
Published: (2025)
RoSA: Enhancing Parameter-Efficient Fine-Tuning via RoPE-aware Selective Adaptation in Large Language Models
by: Pan, Dayan, et al.
Published: (2025)
by: Pan, Dayan, et al.
Published: (2025)
Differentiable Room Acoustic Rendering with Multi-View Vision Priors
by: Jin, Derong, et al.
Published: (2025)
by: Jin, Derong, et al.
Published: (2025)
Human tissue oxygen and strontium isotope values in North America: A data compilation and assessment for forensic geolocation
by: Kirsten A. Verostick, et al.
Published: (2025)
by: Kirsten A. Verostick, et al.
Published: (2025)
Scenario-Wise Rec: A Multi-Scenario Recommendation Benchmark
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
Stepwise Reasoning Error Disruption Attack of LLMs
by: Peng, Jingyu, et al.
Published: (2024)
by: Peng, Jingyu, et al.
Published: (2024)
ERASE: Benchmarking Feature Selection Methods for Deep Recommender Systems
by: Jia, Pengyue, et al.
Published: (2024)
by: Jia, Pengyue, et al.
Published: (2024)
Pre-train, Align, and Disentangle: Empowering Sequential Recommendation with Large Language Models
by: Wang, Yuhao, et al.
Published: (2024)
by: Wang, Yuhao, et al.
Published: (2024)
SIGMA: Selective Gated Mamba for Sequential Recommendation
by: Liu, Ziwei, et al.
Published: (2024)
by: Liu, Ziwei, et al.
Published: (2024)
MTA: A Merge-then-Adapt Framework for Personalized Large Language Model
by: Li, Xiaopeng, et al.
Published: (2025)
by: Li, Xiaopeng, et al.
Published: (2025)
Graph models for covariant holographic entropy I
by: Zhao, Bowen
Published: (2026)
by: Zhao, Bowen
Published: (2026)
Beyond $2$-to-$2$: Geometrization of Entanglement Wedge Connectivity in Holographic Scattering
by: Zhao, Bowen
Published: (2025)
by: Zhao, Bowen
Published: (2025)
A proof of Generalized Connected Wedge Theorem
by: Zhao, Bowen
Published: (2025)
by: Zhao, Bowen
Published: (2025)
GeoRanker: Distance-Aware Ranking for Worldwide Image Geolocalization
by: Jia, Pengyue, et al.
Published: (2025)
by: Jia, Pengyue, et al.
Published: (2025)
A Survey of Personalization: From RAG to Agent
by: Li, Xiaopeng, et al.
Published: (2025)
by: Li, Xiaopeng, et al.
Published: (2025)
Behavior-Equivalent Token: Single-Token Replacement for Long Prompts in LLMs
by: Dong, Jiancheng, et al.
Published: (2025)
by: Dong, Jiancheng, et al.
Published: (2025)
Rationale-Augmented Retrieval with Constrained LLM Re-Ranking for Task Discovery
by: Wei, Bowen
Published: (2025)
by: Wei, Bowen
Published: (2025)
Logic Jailbreak: Efficiently Unlocking LLM Safety Restrictions Through Formal Logical Expression
by: Peng, Jingyu, et al.
Published: (2025)
by: Peng, Jingyu, et al.
Published: (2025)
UniRank: Unified List-wise Reranking via Confidence-Ordered Denoising
by: Jia, Pengyue, et al.
Published: (2026)
by: Jia, Pengyue, et al.
Published: (2026)
To Search or Not to Search: Aligning the Decision Boundary of Deep Search Agents via Causal Intervention
by: Zhang, Wenlin, et al.
Published: (2026)
by: Zhang, Wenlin, et al.
Published: (2026)
Process vs. Outcome Reward: Which is Better for Agentic RAG Reinforcement Learning
by: Zhang, Wenlin, et al.
Published: (2025)
by: Zhang, Wenlin, et al.
Published: (2025)
Radio Map Assisted Approach for Interference-Aware Predictive UAV Communications
by: Li, Bowen, et al.
Published: (2024)
by: Li, Bowen, et al.
Published: (2024)
MultiDx: A Multi-Source Knowledge Integration Framework towards Diagnostic Reasoning
by: Deng, Yimin, et al.
Published: (2026)
by: Deng, Yimin, et al.
Published: (2026)
Learning How and What to Memorize: Cognition-Inspired Two-Stage Optimization for Evolving Memory
by: Xu, Derong, et al.
Published: (2026)
by: Xu, Derong, et al.
Published: (2026)
LSRP: A Leader-Subordinate Retrieval Framework for Privacy-Preserving Cloud-Device Collaboration
by: Zhang, Yingyi, et al.
Published: (2025)
by: Zhang, Yingyi, et al.
Published: (2025)
From Single to Multi-Granularity: Toward Long-Term Memory Association and Selection of Conversational Agents
by: Xu, Derong, et al.
Published: (2025)
by: Xu, Derong, et al.
Published: (2025)
TAPO: Task-Referenced Adaptation for Prompt Optimization
by: Luo, Wenxin, et al.
Published: (2025)
by: Luo, Wenxin, et al.
Published: (2025)
SyNeg: LLM-Driven Synthetic Hard-Negatives for Dense Retrieval
by: Li, Xiaopeng, et al.
Published: (2024)
by: Li, Xiaopeng, et al.
Published: (2024)
RePO-VLA: Recovery-Driven Policy Optimization for Vision-Language-Action Models
by: Liufu, Weijia, et al.
Published: (2026)
by: Liufu, Weijia, et al.
Published: (2026)
Can Vision Language Models Learn from Visual Demonstrations of Ambiguous Spatial Reasoning?
by: Zhao, Bowen, et al.
Published: (2024)
by: Zhao, Bowen, et al.
Published: (2024)
DML - movies of geolocated airborne images
by: Eisen, Olaf, et al.
Published: (2022)
by: Eisen, Olaf, et al.
Published: (2022)
Plastic inorganic Sn2BiS2I3 semiconductor enabled deformable and flexible electronic tongue for heavy metal detection
by: Wang, Qiao, et al.
Published: (2025)
by: Wang, Qiao, et al.
Published: (2025)
Similar Items
-
How to Utilize Complementary Vision-Text Information for 2D Structure Understanding
by: Dong, Jiancheng, et al.
Published: (2026) -
SkyLink: Unifying Street-Satellite Geo-Localization via UAV-Mediated 3D Scene Alignment
by: Zhang, Hongyang, et al.
Published: (2025) -
Curriculum Learning for Efficient Chain-of-Thought Distillation via Structure-Aware Masking and GRPO
by: Yu, Bowen, et al.
Published: (2026) -
GeoArena: Evaluating Open-World Geographic Reasoning in Large Vision-Language Models
by: Jia, Pengyue, et al.
Published: (2025) -
LLM-EDT: Large Language Model Enhanced Cross-domain Sequential Recommendation with Dual-phase Training
by: Liu, Ziwei, et al.
Published: (2025)