A TextGCN-Based Decoding Approach for Improving Remote Sensing Image Captioning
Fuente:
arXiv
Guardado en:
| Autores principales: | Das, Swadhin, Sharma, Raksha |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MsEdF: A Multi-stream Encoder-decoder Framework for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025)
por: Das, Swadhin, et al.
Publicado: (2025)
Good Representation, Better Explanation: Role of Convolutional Neural Networks in Transformer-Based Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025)
por: Das, Swadhin, et al.
Publicado: (2025)
A Novel Lightweight Transformer with Edge-Aware Fusion for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025)
por: Das, Swadhin, et al.
Publicado: (2025)
Leveraging Language Semantics for Collaborative Filtering with TextGCN and TextGCN-MLP: Zero-Shot vs In-Domain Performance
por: Chernov, Andrei, et al.
Publicado: (2025)
por: Chernov, Andrei, et al.
Publicado: (2025)
JSSFF: A Joint Structural-Semantic Fusion Framework for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2026)
por: Das, Swadhin, et al.
Publicado: (2026)
Mask Approximation Net: A Novel Diffusion Model Approach for Remote Sensing Change Captioning
por: Sun, Dongwei, et al.
Publicado: (2024)
por: Sun, Dongwei, et al.
Publicado: (2024)
STAND: Semantic Anchoring Constraint with Dual-Granularity Disambiguation for Remote Sensing Image Change Captioning
por: Gong, Yanpei, et al.
Publicado: (2026)
por: Gong, Yanpei, et al.
Publicado: (2026)
Improving Remote Sensing Classification using Topological Data Analysis and Convolutional Neural Networks
por: Sharma, Aaryam
Publicado: (2025)
por: Sharma, Aaryam
Publicado: (2025)
Deep Learning for Remote Sensing to Improve Flood Inundation Mapping
por: Bhattarai, Yogesh, et al.
Publicado: (2026)
por: Bhattarai, Yogesh, et al.
Publicado: (2026)
MLC-GCN: Multi-Level Generated Connectome Based GCN for AD Analysis
por: Zhu, Wenqi, et al.
Publicado: (2024)
por: Zhu, Wenqi, et al.
Publicado: (2024)
Structured Captions Improve Prompt Adherence in Text-to-Image Models (Re-LAION-Caption 19M)
por: Merchant, Nicholas, et al.
Publicado: (2025)
por: Merchant, Nicholas, et al.
Publicado: (2025)
Improving Text-To-Audio Models with Synthetic Captions
por: Kong, Zhifeng, et al.
Publicado: (2024)
por: Kong, Zhifeng, et al.
Publicado: (2024)
Learning to Price Bundles: A GCN Approach for Mixed Bundling
por: Ding, Liangyu, et al.
Publicado: (2025)
por: Ding, Liangyu, et al.
Publicado: (2025)
Pixels to Prose: Understanding the art of Image Captioning
por: Singh, Hrishikesh, et al.
Publicado: (2024)
por: Singh, Hrishikesh, et al.
Publicado: (2024)
Remote Sensing-Based Assessment of Economic Development
por: Pan, Yijian, et al.
Publicado: (2024)
por: Pan, Yijian, et al.
Publicado: (2024)
PMPGuard: Catching Pseudo-Matched Pairs in Remote Sensing Image-Text Retrieval
por: Ouyang, Pengxiang, et al.
Publicado: (2025)
por: Ouyang, Pengxiang, et al.
Publicado: (2025)
Image Captions are Natural Prompts for Text-to-Image Models
por: Lei, Shiye, et al.
Publicado: (2023)
por: Lei, Shiye, et al.
Publicado: (2023)
Pretrained Image-Text Models are Secretly Video Captioners
por: Zhang, Chunhui, et al.
Publicado: (2025)
por: Zhang, Chunhui, et al.
Publicado: (2025)
MixGCN: Scalable GCN Training by Mixture of Parallelism and Mixture of Accelerators
por: Wan, Cheng, et al.
Publicado: (2025)
por: Wan, Cheng, et al.
Publicado: (2025)
Indoor Air Quality Dataset with Activities of Daily Living in Low to Middle-income Communities
por: Karmakar, Prasenjit, et al.
Publicado: (2024)
por: Karmakar, Prasenjit, et al.
Publicado: (2024)
Robust Change Captioning in Remote Sensing: SECOND-CC Dataset and MModalCC Framework
por: Karaca, Ali Can, et al.
Publicado: (2025)
por: Karaca, Ali Can, et al.
Publicado: (2025)
ViPCap: Retrieval Text-Based Visual Prompts for Lightweight Image Captioning
por: Kim, Taewhan, et al.
Publicado: (2024)
por: Kim, Taewhan, et al.
Publicado: (2024)
MOB-GCN: A Novel Multiscale Object-Based Graph Neural Network for Hyperspectral Image Classification
por: Yang, Tuan-Anh, et al.
Publicado: (2025)
por: Yang, Tuan-Anh, et al.
Publicado: (2025)
Image-Caption Encoding for Improving Zero-Shot Generalization
por: Yu, Eric Yang, et al.
Publicado: (2024)
por: Yu, Eric Yang, et al.
Publicado: (2024)
Hierarchical Motion Captioning Utilizing External Text Data Source
por: Leite, Clayton, et al.
Publicado: (2025)
por: Leite, Clayton, et al.
Publicado: (2025)
GCN-Based Throughput-Oriented Handover Management in Dense 5G Vehicular Networks
por: Mehregan, Nazanin, et al.
Publicado: (2025)
por: Mehregan, Nazanin, et al.
Publicado: (2025)
Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning
por: Luo, Jianjie, et al.
Publicado: (2024)
por: Luo, Jianjie, et al.
Publicado: (2024)
Decoding Human Preferences in Alignment: An Improved Approach to Inverse Constitutional AI
por: Henneking, Carl-Leander, et al.
Publicado: (2025)
por: Henneking, Carl-Leander, et al.
Publicado: (2025)
Value Bonuses using Ensemble Errors for Exploration in Reinforcement Learning
por: Wahab, Abdul, et al.
Publicado: (2026)
por: Wahab, Abdul, et al.
Publicado: (2026)
DarkVesselNet: Multi-Modal Remote Sensing and Trajectory Reasoning for Dark Vessel Detection
por: Sharma, Arun
Publicado: (2026)
por: Sharma, Arun
Publicado: (2026)
DeepTextMark: A Deep Learning-Driven Text Watermarking Approach for Identifying Large Language Model Generated Text
por: Munyer, Travis, et al.
Publicado: (2023)
por: Munyer, Travis, et al.
Publicado: (2023)
A Recipe for Improving Remote Sensing VLM Zero Shot Generalization
por: Barzilai, Aviad, et al.
Publicado: (2025)
por: Barzilai, Aviad, et al.
Publicado: (2025)
RegionGCN: Spatial-Heterogeneity-Aware Graph Convolutional Networks
por: Guo, Hao, et al.
Publicado: (2025)
por: Guo, Hao, et al.
Publicado: (2025)
SStaGCN: Simplified stacking based graph convolutional networks
por: Cai, Jia, et al.
Publicado: (2021)
por: Cai, Jia, et al.
Publicado: (2021)
A Billion-scale Foundation Model for Remote Sensing Images
por: Cha, Keumgang, et al.
Publicado: (2023)
por: Cha, Keumgang, et al.
Publicado: (2023)
Estimated Audio-Caption Correspondences Improve Language-Based Audio Retrieval
por: Primus, Paul, et al.
Publicado: (2024)
por: Primus, Paul, et al.
Publicado: (2024)
Multi-Agent Geospatial Copilots for Remote Sensing Workflows
por: Lee, Chaehong, et al.
Publicado: (2025)
por: Lee, Chaehong, et al.
Publicado: (2025)
A Data-Driven Review of Remote Sensing-Based Data Fusion in Precision Agriculture from Foundational to Transformer-Based Techniques
por: Saki, Mahdi, et al.
Publicado: (2024)
por: Saki, Mahdi, et al.
Publicado: (2024)
PromptGCN: Bridging Subgraph Gaps in Lightweight GCNs
por: Ji, Shengwei, et al.
Publicado: (2024)
por: Ji, Shengwei, et al.
Publicado: (2024)
Subimage Overlap Prediction: Task-Aligned Self-Supervised Pretraining For Semantic Segmentation In Remote Sensing Imagery
por: Sharma, Lakshay, et al.
Publicado: (2026)
por: Sharma, Lakshay, et al.
Publicado: (2026)
Ejemplares similares
-
MsEdF: A Multi-stream Encoder-decoder Framework for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025) -
Good Representation, Better Explanation: Role of Convolutional Neural Networks in Transformer-Based Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025) -
A Novel Lightweight Transformer with Edge-Aware Fusion for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2025) -
Leveraging Language Semantics for Collaborative Filtering with TextGCN and TextGCN-MLP: Zero-Shot vs In-Domain Performance
por: Chernov, Andrei, et al.
Publicado: (2025) -
JSSFF: A Joint Structural-Semantic Fusion Framework for Remote Sensing Image Captioning
por: Das, Swadhin, et al.
Publicado: (2026)