DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Yuhang, Zhu, Jing, Qian, Shengyi, Zhao, Zhuokai, Wang, Xiyao, Liu, Xiaoyu, Li, Ming, Xu, Paiheng, Ai, Wei, Huang, Furong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-Stage Balanced Distillation: Addressing Long-Tail Challenges in Sequence-Level Knowledge Distillation
by: Zhou, Yuhang, et al.
Published: (2024)
by: Zhou, Yuhang, et al.
Published: (2024)
Explore Spurious Correlations at the Concept Level in Language Models for Text Classification
by: Zhou, Yuhang, et al.
Published: (2023)
by: Zhou, Yuhang, et al.
Published: (2023)
GFairHint: Improving Individual Fairness for Graph Neural Networks via Fairness Hint
by: Xu, Paiheng, et al.
Published: (2023)
by: Xu, Paiheng, et al.
Published: (2023)
Emojis Decoded: Leveraging ChatGPT for Enhanced Understanding in Social Media Communications
by: Zhou, Yuhang, et al.
Published: (2024)
by: Zhou, Yuhang, et al.
Published: (2024)
DISCO: Efficient Diffusion Solver for Large-Scale Combinatorial Optimization Problems
by: Zhao, Hang, et al.
Published: (2024)
by: Zhao, Hang, et al.
Published: (2024)
Balancing Label Imbalance in Federated Environments Using Only Mixup and Artificially-Labeled Noise
by: Sang, Kyle, et al.
Published: (2024)
by: Sang, Kyle, et al.
Published: (2024)
CSRec: Rethinking Sequential Recommendation from A Causal Perspective
by: Liu, Xiaoyu, et al.
Published: (2024)
by: Liu, Xiaoyu, et al.
Published: (2024)
Token-Level LLM Collaboration via FusionRoute
by: Xiong, Nuoya, et al.
Published: (2026)
by: Xiong, Nuoya, et al.
Published: (2026)
ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs
by: Wang, Xiyao, et al.
Published: (2025)
by: Wang, Xiyao, et al.
Published: (2025)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
by: Zhou, Yang, et al.
Published: (2026)
by: Zhou, Yang, et al.
Published: (2026)
Large Language Models and Causal Inference in Collaboration: A Survey
by: Liu, Xiaoyu, et al.
Published: (2024)
by: Liu, Xiaoyu, et al.
Published: (2024)
Mosaic of Modalities: A Comprehensive Benchmark for Multimodal Graph Learning
by: Zhu, Jing, et al.
Published: (2024)
by: Zhu, Jing, et al.
Published: (2024)
The Promises and Pitfalls of Using Language Models to Measure Instruction Quality in Education
by: Xu, Paiheng, et al.
Published: (2024)
by: Xu, Paiheng, et al.
Published: (2024)
Learning with Challenges: Adaptive Difficulty-Aware Data Generation for Mobile GUI Agent Training
by: Kang, Linjia, et al.
Published: (2026)
by: Kang, Linjia, et al.
Published: (2026)
TACO: Temporal Latent Action-Driven Contrastive Loss for Visual Reinforcement Learning
by: Zheng, Ruijie, et al.
Published: (2023)
by: Zheng, Ruijie, et al.
Published: (2023)
How Difficulty-Aware Staged Reinforcement Learning Enhances LLMs' Reasoning Capabilities: A Preliminary Experimental Study
by: Ji, Yunjie, et al.
Published: (2025)
by: Ji, Yunjie, et al.
Published: (2025)
Lemon: A Unified and Scalable 3D Multimodal Model for Universal Spatial Understanding
by: Liang, Yongyuan, et al.
Published: (2025)
by: Liang, Yongyuan, et al.
Published: (2025)
ADHint: Adaptive Hints with Difficulty Priors for Reinforcement Learning
by: Zhang, Feng, et al.
Published: (2025)
by: Zhang, Feng, et al.
Published: (2025)
Balanced Sharpness-Aware Minimization for Imbalanced Regression
by: Liu, Yahao, et al.
Published: (2025)
by: Liu, Yahao, et al.
Published: (2025)
RELAX: Reinforcement Learning Enabled 2D-LiDAR Autonomous System for Parsimonious UAVs
by: Wu, Guanlin, et al.
Published: (2023)
by: Wu, Guanlin, et al.
Published: (2023)
Safe Reinforcement Learning via Hierarchical Adaptive Chance-Constraint Safeguards
by: Chen, Zhaorun, et al.
Published: (2023)
by: Chen, Zhaorun, et al.
Published: (2023)
Denoising, Fast and Slow: Difficulty-Aware Adaptive Sampling for Image Generation
by: Schusterbauer, Johannes, et al.
Published: (2026)
by: Schusterbauer, Johannes, et al.
Published: (2026)
Metabolic Imbalance Triggers Adaptive Remodeling to Accelerate Diploidization in Murine Haploid Embryonic Stem Cells
by: Yi Fu, et al.
Published: (2026)
by: Yi Fu, et al.
Published: (2026)
Balancing the Scales: A Theoretical and Algorithmic Framework for Learning from Imbalanced Data
by: Cortes, Corinna, et al.
Published: (2025)
by: Cortes, Corinna, et al.
Published: (2025)
Addressing Imbalanced Domain-Incremental Learning through Dual-Balance Collaborative Experts
by: Li, Lan, et al.
Published: (2025)
by: Li, Lan, et al.
Published: (2025)
DeepDistill: Enhancing LLM Reasoning Capabilities via Large-Scale Difficulty-Graded Data Training
by: Tian, Xiaoyu, et al.
Published: (2025)
by: Tian, Xiaoyu, et al.
Published: (2025)
Balanced Data, Imbalanced Spectra: Unveiling Class Disparities with Spectral Imbalance
by: Kaushik, Chiraag, et al.
Published: (2024)
by: Kaushik, Chiraag, et al.
Published: (2024)
Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences
by: Wang, Xiyao, et al.
Published: (2024)
by: Wang, Xiyao, et al.
Published: (2024)
Scaling Data Difficulty: Improving Coding Models via Reinforcement Learning on Fresh and Challenging Problems
by: Li, Zongqian, et al.
Published: (2026)
by: Li, Zongqian, et al.
Published: (2026)
Adaptive Task Balancing for Visual Instruction Tuning via Inter-Task Contribution and Intra-Task Difficulty
by: Dai, Yanqi, et al.
Published: (2024)
by: Dai, Yanqi, et al.
Published: (2024)
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
by: Wang, Xiyao, et al.
Published: (2024)
by: Wang, Xiyao, et al.
Published: (2024)
DISCO-TAB: A Hierarchical Reinforcement Learning Framework for Privacy-Preserving Synthesis of Complex Clinical Data
by: Ilaty, Arshia, et al.
Published: (2026)
by: Ilaty, Arshia, et al.
Published: (2026)
CODA: Difficulty-Aware Compute Allocation for Adaptive Reasoning
by: Wu, Siye, et al.
Published: (2026)
by: Wu, Siye, et al.
Published: (2026)
Adapting Static Fairness to Sequential Decision-Making: Bias Mitigation Strategies towards Equal Long-term Benefit Rate
by: Xu, Yuancheng, et al.
Published: (2023)
by: Xu, Yuancheng, et al.
Published: (2023)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
by: Huang, Shijue, et al.
Published: (2025)
by: Huang, Shijue, et al.
Published: (2025)
Label What Matters: Modality-Balanced and Difficulty-Aware Multimodal Active Learning
by: Zeng, Yuqiao, et al.
Published: (2026)
by: Zeng, Yuqiao, et al.
Published: (2026)
Integrated Sensing and Communication Under DISCO Physical-Layer Jamming Attacks
by: Huang, Huan, et al.
Published: (2024)
by: Huang, Huan, et al.
Published: (2024)
D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning
by: Zhang, Ru, et al.
Published: (2026)
by: Zhang, Ru, et al.
Published: (2026)
HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding
by: Chen, Zhaorun, et al.
Published: (2024)
by: Chen, Zhaorun, et al.
Published: (2024)
LinkGPT: Teaching Large Language Models To Predict Missing Links
by: He, Zhongmou, et al.
Published: (2024)
by: He, Zhongmou, et al.
Published: (2024)
Similar Items
-
Multi-Stage Balanced Distillation: Addressing Long-Tail Challenges in Sequence-Level Knowledge Distillation
by: Zhou, Yuhang, et al.
Published: (2024) -
Explore Spurious Correlations at the Concept Level in Language Models for Text Classification
by: Zhou, Yuhang, et al.
Published: (2023) -
GFairHint: Improving Individual Fairness for Graph Neural Networks via Fairness Hint
by: Xu, Paiheng, et al.
Published: (2023) -
Emojis Decoded: Leveraging ChatGPT for Enhanced Understanding in Social Media Communications
by: Zhou, Yuhang, et al.
Published: (2024) -
DISCO: Efficient Diffusion Solver for Large-Scale Combinatorial Optimization Problems
by: Zhao, Hang, et al.
Published: (2024)