Guardado en:
| Autores principales: | Li, Yujie, Xu, Wenjia, Li, Guangzuo, Yu, Zijian, Wei, Zhiwei, Wang, Jiuniu, Peng, Mugen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2412.20742 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RS-Agent: Automating Remote Sensing Tasks through Intelligent Agent
por: Xu, Wenjia, et al.
Publicado: (2024)
por: Xu, Wenjia, et al.
Publicado: (2024)
Graph-RHO: Critical-path-aware Heterogeneous Graph Network for Long-Horizon Flexible Job-Shop Scheduling
por: Li, Yujie, et al.
Publicado: (2026)
por: Li, Yujie, et al.
Publicado: (2026)
BTCChat: Advancing Remote Sensing Bi-temporal Change Captioning with Multimodal Large Language Model
por: Li, Yujie, et al.
Publicado: (2025)
por: Li, Yujie, et al.
Publicado: (2025)
Deep Semantic-Visual Alignment for Zero-Shot Remote Sensing Image Scene Classification
por: Xu, Wenjia, et al.
Publicado: (2024)
por: Xu, Wenjia, et al.
Publicado: (2024)
Online Specific Emitter Identification via Collision-Alleviated Signal Hash
por: Wang, Hongyu, et al.
Publicado: (2025)
por: Wang, Hongyu, et al.
Publicado: (2025)
UAV-VisLoc: A Large-scale Dataset for UAV Visual Localization
por: Xu, Wenjia, et al.
Publicado: (2024)
por: Xu, Wenjia, et al.
Publicado: (2024)
Uni-RS: A Spatially Faithful Unified Understanding and Generation Model for Remote Sensing
por: Zhang, Weiyu, et al.
Publicado: (2026)
por: Zhang, Weiyu, et al.
Publicado: (2026)
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
por: Li, Yu, et al.
Publicado: (2025)
por: Li, Yu, et al.
Publicado: (2025)
UniTS: Unified Spatio-Temporal Generative Model for Remote Sensing
por: Zhang, Yuxiang, et al.
Publicado: (2025)
por: Zhang, Yuxiang, et al.
Publicado: (2025)
RS-WorldModel: a Unified Model for Remote Sensing Understanding and Future Sense Forecasting
por: Xu, Linrui, et al.
Publicado: (2026)
por: Xu, Linrui, et al.
Publicado: (2026)
Group-based Distinctive Image Captioning with Memory Difference Encoding and Attention
por: Wang, Jiuniu, et al.
Publicado: (2025)
por: Wang, Jiuniu, et al.
Publicado: (2025)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
por: Zhang, Jiazhao, et al.
Publicado: (2024)
por: Zhang, Jiazhao, et al.
Publicado: (2024)
RS-DFM: A Remote Sensing Distributed Foundation Model for Diverse Downstream Tasks
por: Wang, Zhechao, et al.
Publicado: (2024)
por: Wang, Zhechao, et al.
Publicado: (2024)
Uni-Fi: Integrated Multi-Task Wi-Fi Sensing
por: Li, Mengning, et al.
Publicado: (2026)
por: Li, Mengning, et al.
Publicado: (2026)
UniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models
por: Yu, Qiaojun, et al.
Publicado: (2024)
por: Yu, Qiaojun, et al.
Publicado: (2024)
GeoGround: A Unified Large Vision-Language Model for Remote Sensing Visual Grounding
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
SkyEyeGPT: Unifying Remote Sensing Vision-Language Tasks via Instruction Tuning with Large Language Model
por: Zhan, Yang, et al.
Publicado: (2024)
por: Zhan, Yang, et al.
Publicado: (2024)
RS-OOD: A Vision-Language Augmented Framework for Out-of-Distribution Detection in Remote Sensing
por: Wang, Chenhao, et al.
Publicado: (2025)
por: Wang, Chenhao, et al.
Publicado: (2025)
UniFusion: Vision-Language Model as Unified Encoder in Image Generation
por: Li, Kevin, et al.
Publicado: (2025)
por: Li, Kevin, et al.
Publicado: (2025)
Co-Training Vision Language Models for Remote Sensing Multi-task Learning
por: Li, Qingyun, et al.
Publicado: (2025)
por: Li, Qingyun, et al.
Publicado: (2025)
UniRSCD: A Unified Novel Architectural Paradigm for Remote Sensing Change Detection
por: Qu, Yuan, et al.
Publicado: (2025)
por: Qu, Yuan, et al.
Publicado: (2025)
UniChange: Unifying Change Detection with Multimodal Large Language Model
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
UniRoute: Unified Routing Mixture-of-Experts for Modality-Adaptive Remote Sensing Change Detection
por: Shu, Qingling, et al.
Publicado: (2026)
por: Shu, Qingling, et al.
Publicado: (2026)
RS-GPT4V: A Unified Multimodal Instruction-Following Dataset for Remote Sensing Image Understanding
por: Xu, Linrui, et al.
Publicado: (2024)
por: Xu, Linrui, et al.
Publicado: (2024)
MMTL-UniAD: A Unified Framework for Multimodal and Multi-Task Learning in Assistive Driving Perception
por: Liu, Wenzhuo, et al.
Publicado: (2025)
por: Liu, Wenzhuo, et al.
Publicado: (2025)
SatelliteCalculator: A Multi-Task Vision Foundation Model for Quantitative Remote Sensing Inversion
por: Yu, Zhenyu, et al.
Publicado: (2025)
por: Yu, Zhenyu, et al.
Publicado: (2025)
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
por: Yao, Kelu, et al.
Publicado: (2025)
por: Yao, Kelu, et al.
Publicado: (2025)
SkySense V2: A Unified Foundation Model for Multi-modal Remote Sensing
por: Zhang, Yingying, et al.
Publicado: (2025)
por: Zhang, Yingying, et al.
Publicado: (2025)
TerraGen: A Unified Multi-Task Layout Generation Framework for Remote Sensing Data Augmentation
por: Tang, Datao, et al.
Publicado: (2025)
por: Tang, Datao, et al.
Publicado: (2025)
Unifying Heterogeneous Multi-Modal Remote Sensing Detection Via Language-Pivoted Pretraining
por: Li, Yuxuan, et al.
Publicado: (2026)
por: Li, Yuxuan, et al.
Publicado: (2026)
An Efficient and Effective Encoder Model for Vision and Language Tasks in the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2025)
por: Silva, João Daniel, et al.
Publicado: (2025)
UniVL: Unified Vision-Language Embedding for Spatially Grounded Contextual Image Generation
por: Wang, Jiayun, et al.
Publicado: (2026)
por: Wang, Jiayun, et al.
Publicado: (2026)
RoboSVG: A Unified Framework for Interactive SVG Generation with Multi-modal Guidance
por: Wang, Jiuniu, et al.
Publicado: (2025)
por: Wang, Jiuniu, et al.
Publicado: (2025)
UniCompress: Token Compression for Unified Vision-Language Understanding and Generation
por: Wang, Ziyao, et al.
Publicado: (2026)
por: Wang, Ziyao, et al.
Publicado: (2026)
GeoRSMLLM: A Multimodal Large Language Model for Vision-Language Tasks in Geoscience and Remote Sensing
por: Zhang, Zilun, et al.
Publicado: (2025)
por: Zhang, Zilun, et al.
Publicado: (2025)
RSUniVLM: A Unified Vision Language Model for Remote Sensing via Granularity-oriented Mixture of Experts
por: Liu, Xu, et al.
Publicado: (2024)
por: Liu, Xu, et al.
Publicado: (2024)
UniPlan: Vision-Language Task Planning for Mobile Manipulation with Unified PDDL Formulation
por: Ye, Haoming, et al.
Publicado: (2026)
por: Ye, Haoming, et al.
Publicado: (2026)
UniVid: Unifying Vision Tasks with Pre-trained Video Generation Models
por: Chen, Lan, et al.
Publicado: (2025)
por: Chen, Lan, et al.
Publicado: (2025)
Continual Vision-Language Learning for Remote Sensing: Benchmarking and Analysis
por: Weng, Xingxing, et al.
Publicado: (2026)
por: Weng, Xingxing, et al.
Publicado: (2026)
UniTS: A Unified Multi-Task Time Series Model
por: Gao, Shanghua, et al.
Publicado: (2024)
por: Gao, Shanghua, et al.
Publicado: (2024)
Ejemplares similares
-
RS-Agent: Automating Remote Sensing Tasks through Intelligent Agent
por: Xu, Wenjia, et al.
Publicado: (2024) -
Graph-RHO: Critical-path-aware Heterogeneous Graph Network for Long-Horizon Flexible Job-Shop Scheduling
por: Li, Yujie, et al.
Publicado: (2026) -
BTCChat: Advancing Remote Sensing Bi-temporal Change Captioning with Multimodal Large Language Model
por: Li, Yujie, et al.
Publicado: (2025) -
Deep Semantic-Visual Alignment for Zero-Shot Remote Sensing Image Scene Classification
por: Xu, Wenjia, et al.
Publicado: (2024) -
Online Specific Emitter Identification via Collision-Alleviated Signal Hash
por: Wang, Hongyu, et al.
Publicado: (2025)