Disentangling Hardness from Noise: An Uncertainty-Driven Model-Agnostic Framework for Long-Tailed Remote Sensing Classification
Fuente:
arXiv
Guardado en:
| Autores principales: | Ding, Chi, Xue, Junxiao, Yin, Xinyi, Chen, Shi, Shi, Yunyun, Wang, Yiduo, Xue, Fengjian, Wu, Xuecheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FED-Bench: A Cross-Granular Benchmark for Disentangled Evaluation of Facial Expression Editing
por: Xue, Fengjian, et al.
Publicado: (2026)
por: Xue, Fengjian, et al.
Publicado: (2026)
MooD: Perception-Enhanced Efficient Affective Image Editing via Continuous Valence-Arousal Modeling
por: Yin, Xinyi, et al.
Publicado: (2026)
por: Yin, Xinyi, et al.
Publicado: (2026)
AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control
por: Chen, Shi, et al.
Publicado: (2026)
por: Chen, Shi, et al.
Publicado: (2026)
RePose: A Real-Time 3D Human Pose Estimation and Biomechanical Analysis Framework for Rehabilitation
por: Xue, Junxiao, et al.
Publicado: (2026)
por: Xue, Junxiao, et al.
Publicado: (2026)
AeroRAG: Structured Multimodal Retrieval-Augmented LLM for Fine-Grained Aerial Visual Reasoning
por: Xue, Junxiao, et al.
Publicado: (2026)
por: Xue, Junxiao, et al.
Publicado: (2026)
Scalable Audio-Visual Masked Autoencoders for Efficient Affective Video Facial Analysis
por: Wu, Xuecheng, et al.
Publicado: (2025)
por: Wu, Xuecheng, et al.
Publicado: (2025)
Towards Comprehensive Interactive Change Understanding in Remote Sensing: A Large-scale Dataset and Dual-granularity Enhanced VLM
por: Xue, Junxiao, et al.
Publicado: (2025)
por: Xue, Junxiao, et al.
Publicado: (2025)
3A-YOLO: New Real-Time Object Detectors with Triple Discriminative Awareness and Coordinated Representations
por: Wu, Xuecheng, et al.
Publicado: (2024)
por: Wu, Xuecheng, et al.
Publicado: (2024)
AD-AVSR: Asymmetric Dual-stream Enhancement for Robust Audio-Visual Speech Recognition
por: Xue, Junxiao, et al.
Publicado: (2025)
por: Xue, Junxiao, et al.
Publicado: (2025)
Affective Video Content Analysis: Decade Review and New Perspectives
por: Xue, Junxiao, et al.
Publicado: (2023)
por: Xue, Junxiao, et al.
Publicado: (2023)
A Trustworthy Method for Multimodal Emotion Recognition
por: Xue, Junxiao, et al.
Publicado: (2025)
por: Xue, Junxiao, et al.
Publicado: (2025)
Identifying Hard Noise in Long-Tailed Sample Distribution
por: Yi, Xuanyu, et al.
Publicado: (2022)
por: Yi, Xuanyu, et al.
Publicado: (2022)
InfoSyncNet: Information Synchronization Temporal Convolutional Network for Visual Speech Recognition
por: Xue, Junxiao, et al.
Publicado: (2025)
por: Xue, Junxiao, et al.
Publicado: (2025)
ViC-Bench: Benchmarking Visual-Interleaved Chain-of-Thought Capability in MLLMs with Free-Style Intermediate State Representations
por: Wu, Xuecheng, et al.
Publicado: (2025)
por: Wu, Xuecheng, et al.
Publicado: (2025)
Geospatial-Reasoning-Driven Vocabulary-Agnostic Remote Sensing Semantic Segmentation
por: Zhou, Chufeng, et al.
Publicado: (2026)
por: Zhou, Chufeng, et al.
Publicado: (2026)
CSFMamba: Cross State Fusion Mamba Operator for Multimodal Remote Sensing Image Classification
por: Wang, Qingyu, et al.
Publicado: (2025)
por: Wang, Qingyu, et al.
Publicado: (2025)
Conformal Prediction for Long-Tailed Classification
por: Ding, Tiffany, et al.
Publicado: (2025)
por: Ding, Tiffany, et al.
Publicado: (2025)
Towards Emotion Analysis in Short-form Videos: A Large-Scale Dataset and Baseline
por: Wu, Xuecheng, et al.
Publicado: (2023)
por: Wu, Xuecheng, et al.
Publicado: (2023)
TACR-YOLO: A Real-time Detection Framework for Abnormal Human Behaviors Enhanced with Coordinate and Task-Aware Representations
por: Yin, Xinyi, et al.
Publicado: (2025)
por: Yin, Xinyi, et al.
Publicado: (2025)
HiSem: Hierarchical Semantic Disentangling for Remote Sensing Image Change Captioning
por: Wang, Man, et al.
Publicado: (2026)
por: Wang, Man, et al.
Publicado: (2026)
FAMNet: Integrating 2D and 3D Features for Micro-expression Recognition via Multi-task Learning and Hierarchical Attention
por: Fu, Liangyu, et al.
Publicado: (2025)
por: Fu, Liangyu, et al.
Publicado: (2025)
RSMamba: Remote Sensing Image Classification with State Space Model
por: Chen, Keyan, et al.
Publicado: (2024)
por: Chen, Keyan, et al.
Publicado: (2024)
eMotions: A Large-Scale Dataset and Audio-Visual Fusion Network for Emotion Analysis in Short-form Videos
por: Wu, Xuecheng, et al.
Publicado: (2025)
por: Wu, Xuecheng, et al.
Publicado: (2025)
HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training
por: Wu, Xuecheng, et al.
Publicado: (2025)
por: Wu, Xuecheng, et al.
Publicado: (2025)
A Diff-Attention Aware State Space Fusion Model for Remote Sensing Classification
por: Ma, Wenping, et al.
Publicado: (2025)
por: Ma, Wenping, et al.
Publicado: (2025)
Efficient and Long-Tailed Generalization for Pre-trained Vision-Language Model
por: Shi, Jiang-Xin, et al.
Publicado: (2024)
por: Shi, Jiang-Xin, et al.
Publicado: (2024)
Noise-Adaptive Regularization for Robust Multi-Label Remote Sensing Image Classification
por: Burgert, Tom, et al.
Publicado: (2026)
por: Burgert, Tom, et al.
Publicado: (2026)
CloudMamba: An Uncertainty-Guided Dual-Scale Mamba Network for Cloud Detection in Remote Sensing Imagery
por: Yang, Jiajun, et al.
Publicado: (2026)
por: Yang, Jiajun, et al.
Publicado: (2026)
Edge-Cloud Collaborative Satellite Image Analysis for Efficient Man-Made Structure Recognition
por: Sheng, Kaicheng, et al.
Publicado: (2024)
por: Sheng, Kaicheng, et al.
Publicado: (2024)
HDGlyph: A Hierarchical Disentangled Glyph-Based Framework for Long-Tail Text Rendering in Diffusion Models
por: Zhuang, Shuhan, et al.
Publicado: (2025)
por: Zhuang, Shuhan, et al.
Publicado: (2025)
BiCoR-Seg: Bidirectional Co-Refinement Framework for High-Resolution Remote Sensing Image Segmentation
por: Shi, Jinghao, et al.
Publicado: (2025)
por: Shi, Jinghao, et al.
Publicado: (2025)
Toward Long-Tailed Online Anomaly Detection through Class-Agnostic Concepts
por: Yang, Chiao-An, et al.
Publicado: (2025)
por: Yang, Chiao-An, et al.
Publicado: (2025)
ERVD: An Efficient and Robust ViT-Based Distillation Framework for Remote Sensing Image Retrieval
por: Dong, Le, et al.
Publicado: (2024)
por: Dong, Le, et al.
Publicado: (2024)
CroBIM-U: Uncertainty-Driven Referring Remote Sensing Image Segmentation
por: Sun, Yuzhe, et al.
Publicado: (2026)
por: Sun, Yuzhe, et al.
Publicado: (2026)
Leveraging Fine-Grained Information and Noise Decoupling for Remote Sensing Change Detection
por: Du, Qiangang, et al.
Publicado: (2024)
por: Du, Qiangang, et al.
Publicado: (2024)
V2X-RECT: An Efficient V2X Trajectory Prediction Framework via Redundant Interaction Filtering and Tracking Error Correction
por: Kong, Xiangyan, et al.
Publicado: (2025)
por: Kong, Xiangyan, et al.
Publicado: (2025)
Hard Region Aware Network for Remote Sensing Change Detection
por: Li, Zhenglai, et al.
Publicado: (2023)
por: Li, Zhenglai, et al.
Publicado: (2023)
Noise Adaption Network for Morse Code Image Classification
por: Wang, Xiaxia, et al.
Publicado: (2024)
por: Wang, Xiaxia, et al.
Publicado: (2024)
Learning to Adapt Category Consistent Meta-Feature of CLIP for Few-Shot Classification
por: Shi, Jiaying, et al.
Publicado: (2024)
por: Shi, Jiaying, et al.
Publicado: (2024)
InstructSAM: A Training-Free Framework for Instruction-Oriented Remote Sensing Object Recognition
por: Zheng, Yijie, et al.
Publicado: (2025)
por: Zheng, Yijie, et al.
Publicado: (2025)
Ejemplares similares
-
FED-Bench: A Cross-Granular Benchmark for Disentangled Evaluation of Facial Expression Editing
por: Xue, Fengjian, et al.
Publicado: (2026) -
MooD: Perception-Enhanced Efficient Affective Image Editing via Continuous Valence-Arousal Modeling
por: Yin, Xinyi, et al.
Publicado: (2026) -
AIM-Bench: Benchmarking and Improving Affective Image Manipulation via Fine-Grained Hierarchical Control
por: Chen, Shi, et al.
Publicado: (2026) -
RePose: A Real-Time 3D Human Pose Estimation and Biomechanical Analysis Framework for Rehabilitation
por: Xue, Junxiao, et al.
Publicado: (2026) -
AeroRAG: Structured Multimodal Retrieval-Augmented LLM for Fine-Grained Aerial Visual Reasoning
por: Xue, Junxiao, et al.
Publicado: (2026)