Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Kai, Liu, Bowen, Lin, Jianghang, Ji, Jiayi, Dai, Pingyang, Cao, Liujuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HippoMM: Hippocampal-inspired Multimodal Memory for Long Audiovisual Event Understanding
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
par: Zhang, Haoshuo, et autres
Publié: (2025)
par: Zhang, Haoshuo, et autres
Publié: (2025)
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
par: Zhang, Yufeng, et autres
Publié: (2025)
par: Zhang, Yufeng, et autres
Publié: (2025)
Adaptive Wireless Image Semantic Transmission and Over-The-Air Testing
par: Ding, Jiarun, et autres
Publié: (2024)
par: Ding, Jiarun, et autres
Publié: (2024)
Unified ROI-based Image Compression Paradigm with Generalized Gaussian Model
par: Hu, Kai, et autres
Publié: (2026)
par: Hu, Kai, et autres
Publié: (2026)
Avoiding Quality Saturation in UGC Compression Using Denoised References
par: Xiong, Xin, et autres
Publié: (2025)
par: Xiong, Xin, et autres
Publié: (2025)
Enhanced Quality Aware-Scalable Underwater Image Compression
par: Zhu, Linwei, et autres
Publié: (2025)
par: Zhu, Linwei, et autres
Publié: (2025)
UNQA: Unified No-Reference Quality Assessment for Audio, Image, Video, and Audio-Visual Content
par: Cao, Yuqin, et autres
Publié: (2024)
par: Cao, Yuqin, et autres
Publié: (2024)
SatFusion: A Unified Framework for Enhancing Remote Sensing Images via Multi-Frame and Multi-Source Images Fusion
par: Tong, Yufei, et autres
Publié: (2025)
par: Tong, Yufei, et autres
Publié: (2025)
A H.265/HEVC Fine-Grained ROI Video Encryption Algorithm Based on Coding Unit and Prompt Segmentation
par: Zhang, Xiang, et autres
Publié: (2026)
par: Zhang, Xiang, et autres
Publié: (2026)
An Overview of the JPEG AI Learning-Based Image Coding Standard
par: Esenlik, Semih, et autres
Publié: (2025)
par: Esenlik, Semih, et autres
Publié: (2025)
Combined Channel and Spatial Attention-based Stereo Endoscopic Image Super-Resolution
par: Hayat, Mansoor, et autres
Publié: (2023)
par: Hayat, Mansoor, et autres
Publié: (2023)
Visual and Text Prompt Segmentation: A Novel Multi-Model Framework for Remote Sensing
par: Zi, Xing, et autres
Publié: (2025)
par: Zi, Xing, et autres
Publié: (2025)
MarsSQE: Stereo Quality Enhancement for Martian Images Using Bi-level Cross-view Attention
par: Xu, Mai, et autres
Publié: (2024)
par: Xu, Mai, et autres
Publié: (2024)
Symmetric Entropy-Constrained Video Coding for Machines
par: Sun, Yuxiao, et autres
Publié: (2025)
par: Sun, Yuxiao, et autres
Publié: (2025)
Change Detection Between Optical Remote Sensing Imagery and Map Data via Segment Anything Model (SAM)
par: Chen, Hongruixuan, et autres
Publié: (2024)
par: Chen, Hongruixuan, et autres
Publié: (2024)
Transform and Entropy Coding in AV2
par: Nalci, Alican, et autres
Publié: (2026)
par: Nalci, Alican, et autres
Publié: (2026)
On the Possible Detectability of Image-in-Image Steganography
par: Mallet, Antoine, et autres
Publié: (2026)
par: Mallet, Antoine, et autres
Publié: (2026)
Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation
par: Fang, Hao, et autres
Publié: (2025)
par: Fang, Hao, et autres
Publié: (2025)
Enhanced Template-based Intra Mode Derivation with Adaptive Block Vector Replacement
par: Zhang, Jiaqi, et autres
Publié: (2025)
par: Zhang, Jiaqi, et autres
Publié: (2025)
Tube-Structured Incremental Semantic HARQ for Generative Video Receivers
par: Wang, Xuesong, et autres
Publié: (2026)
par: Wang, Xuesong, et autres
Publié: (2026)
Rate-Quality or Energy-Quality Pareto Fronts for Adaptive Video Streaming?
par: Katsenou, Angeliki, et autres
Publié: (2024)
par: Katsenou, Angeliki, et autres
Publié: (2024)
Smaller is Better: Generative Models Can Power Short Video Preloading
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
Camel: Frame-Level Bandwidth Estimation for Low-Latency Live Streaming under Video Bitrate Undershooting
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
NiMark: A Non-intrusive Watermarking Framework against Screen-shooting Attacks
par: Wu, Yufeng, et autres
Publié: (2026)
par: Wu, Yufeng, et autres
Publié: (2026)
Fast Multirate Encoding for 360° Video in OMAF Streaming Workflows
par: Premkumar, Amritha, et autres
Publié: (2026)
par: Premkumar, Amritha, et autres
Publié: (2026)
Decoding Complexity-Rate-Quality Pareto-Front for Adaptive VVC Streaming
par: Katsenou, Angeliki, et autres
Publié: (2024)
par: Katsenou, Angeliki, et autres
Publié: (2024)
Memory-Anchored Multimodal Reasoning for Explainable Video Forensics
par: Chen, Chen, et autres
Publié: (2025)
par: Chen, Chen, et autres
Publié: (2025)
GScomp-QA: A Subjective Dataset for Quality Assessment of Compressed Gaussian Splatting
par: Martin, Pedro, et autres
Publié: (2026)
par: Martin, Pedro, et autres
Publié: (2026)
Unravelling the Power of Single-Pass Look-Ahead in Modern Codecs for Optimized Transcoding Deployment
par: Vibhoothi, Vibhoothi, et autres
Publié: (2024)
par: Vibhoothi, Vibhoothi, et autres
Publié: (2024)
Perception-Aware Video Semantic Communication
par: Huang, Yinhuan, et autres
Publié: (2026)
par: Huang, Yinhuan, et autres
Publié: (2026)
Video Compression Beyond VVC: Quantitative Analysis of Intra Coding Tools in Enhanced Compression Model (ECM)
par: Abdoli, Mohsen, et autres
Publié: (2024)
par: Abdoli, Mohsen, et autres
Publié: (2024)
Dynamic resolution switching for live streaming
par: Xiong, Xin, et autres
Publié: (2026)
par: Xiong, Xin, et autres
Publié: (2026)
Generative Flow Networks for Personalized Multimedia Systems: A Case Study on Short Video Feeds
par: Jin, Yili, et autres
Publié: (2025)
par: Jin, Yili, et autres
Publié: (2025)
HybridPrompt: Bridging Generative Priors and Traditional Codecs for Mobile Streaming
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
Partition Tree Search Acceleration for VVC: Survey and Evaluation with VTM Evolution
par: Kherchouche, M. E. A., et autres
Publié: (2026)
par: Kherchouche, M. E. A., et autres
Publié: (2026)
H.265/HEVC Video Steganalysis Based on CU Block Structure Gradients and IPM Mapping
par: Zhang, Xiang, et autres
Publié: (2026)
par: Zhang, Xiang, et autres
Publié: (2026)
Sandwiched Compression: Repurposing Standard Codecs with Neural Network Wrappers
par: Guleryuz, Onur G., et autres
Publié: (2024)
par: Guleryuz, Onur G., et autres
Publié: (2024)
Encoding Time and Energy Model for SVT-AV1 based on Video Complexity
par: Eichermüller, Lena, et autres
Publié: (2024)
par: Eichermüller, Lena, et autres
Publié: (2024)
Interactive $360^{\circ}$ Video Streaming Using FoV-Adaptive Coding with Temporal Prediction
par: Mao, Yixiang, et autres
Publié: (2024)
par: Mao, Yixiang, et autres
Publié: (2024)
Documents similaires
-
HippoMM: Hippocampal-inspired Multimodal Memory for Long Audiovisual Event Understanding
par: Lin, Yueqian, et autres
Publié: (2025) -
Prompt-based Multimodal Semantic Communication for Multi-spectral Image Segmentation
par: Zhang, Haoshuo, et autres
Publié: (2025) -
ABC: Adaptive BayesNet Structure Learning for Computational Scalable Multi-task Image Compression
par: Zhang, Yufeng, et autres
Publié: (2025) -
Adaptive Wireless Image Semantic Transmission and Over-The-Air Testing
par: Ding, Jiarun, et autres
Publié: (2024) -
Unified ROI-based Image Compression Paradigm with Generalized Gaussian Model
par: Hu, Kai, et autres
Publié: (2026)