Enregistré dans:
| Auteurs principaux: | Chen, Shuang, Guo, Yue, Ye, Yimeng, Huang, Shijue, Hu, Wenbo, Li, Haoxi, Zhang, Manyuan, Chen, Jiayu, Guo, Song, Peng, Nanyun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.08457 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Think How to Think: Mitigating Overthinking with Autonomous Difficulty Cognition in Large Reasoning Models
par: Liu, Yongjiang, et autres
Publié: (2025)
par: Liu, Yongjiang, et autres
Publié: (2025)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
par: Huang, Shijue, et autres
Publié: (2025)
par: Huang, Shijue, et autres
Publié: (2025)
OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks
par: Hu, Wenbo, et autres
Publié: (2026)
par: Hu, Wenbo, et autres
Publié: (2026)
On the Difficulty of Token-Level Modeling of Dysfluency and Fluency Shaping Artifacts
par: Gulzar, Kashaf, et autres
Publié: (2025)
par: Gulzar, Kashaf, et autres
Publié: (2025)
DiffAdapt: Difficulty-Adaptive Reasoning for Token-Efficient LLM Inference
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
TemMed-Bench: Evaluating Temporal Medical Image Reasoning in Vision-Language Models
par: Zhang, Junyi, et autres
Publié: (2025)
par: Zhang, Junyi, et autres
Publié: (2025)
Advancing Multimodal Reasoning: From Optimized Cold Start to Staged Reinforcement Learning
par: Chen, Shuang, et autres
Publié: (2025)
par: Chen, Shuang, et autres
Publié: (2025)
DiEP: Adaptive Mixture-of-Experts Compression through Differentiable Expert Pruning
par: Bai, Sikai, et autres
Publié: (2025)
par: Bai, Sikai, et autres
Publié: (2025)
Resurgence number of matroid configuration
par: Hu, Haoxi
Publié: (2025)
par: Hu, Haoxi
Publié: (2025)
EGAD: Entropy-Guided Adaptive Distillation for Token-Level Knowledge Transfer
par: Zhang, Hao, et autres
Publié: (2026)
par: Zhang, Hao, et autres
Publié: (2026)
Exploring Reasoning Reward Model for Agents
par: Fan, Kaixuan, et autres
Publié: (2026)
par: Fan, Kaixuan, et autres
Publié: (2026)
Unify-Agent: A Unified Multimodal Agent for World-Grounded Image Synthesis
par: Chen, Shuang, et autres
Publié: (2026)
par: Chen, Shuang, et autres
Publié: (2026)
DIVA-GRPO: Enhancing Multimodal Reasoning through Difficulty-Adaptive Variant Advantage
par: Gao, Haowen, et autres
Publié: (2026)
par: Gao, Haowen, et autres
Publié: (2026)
Compress the Easy, Explore the Hard: Difficulty-Aware Entropy Regularization for Efficient LLM Reasoning
par: Luo, Qin-Wen, et autres
Publié: (2026)
par: Luo, Qin-Wen, et autres
Publié: (2026)
PACE: Prefix-Protected and Difficulty-Aware Compression for Efficient Reasoning
par: Feng, Ruixiang, et autres
Publié: (2026)
par: Feng, Ruixiang, et autres
Publié: (2026)
GTPO and GRPO-S: Token and Sequence-Level Reward Shaping with Policy Entropy
par: Tan, Hongze, et autres
Publié: (2025)
par: Tan, Hongze, et autres
Publié: (2025)
CODA: Difficulty-Aware Compute Allocation for Adaptive Reasoning
par: Wu, Siye, et autres
Publié: (2026)
par: Wu, Siye, et autres
Publié: (2026)
CoRE: Enhancing Metacognition with Label-free Self-evaluation in LRMs
par: Li, Haoxi, et autres
Publié: (2025)
par: Li, Haoxi, et autres
Publié: (2025)
MRAG-Bench: Vision-Centric Evaluation for Retrieval-Augmented Multimodal Models
par: Hu, Wenbo, et autres
Publié: (2024)
par: Hu, Wenbo, et autres
Publié: (2024)
AdaTok: Adaptive Token Compression with Object-Aware Representations for Efficient Multimodal LLMs
par: Zhang, Xinliang, et autres
Publié: (2025)
par: Zhang, Xinliang, et autres
Publié: (2025)
VALOR-EVAL: Holistic Coverage and Faithfulness Evaluation of Large Vision-Language Models
par: Qiu, Haoyi, et autres
Publié: (2024)
par: Qiu, Haoyi, et autres
Publié: (2024)
DeReason: A Difficulty-Aware Curriculum Improves Decoupled SFT-then-RL Training for General Reasoning
par: Hu, Hanxu, et autres
Publié: (2026)
par: Hu, Hanxu, et autres
Publié: (2026)
ERPO: Token-Level Entropy-Regulated Policy Optimization for Large Reasoning Models
par: Yu, Song, et autres
Publié: (2026)
par: Yu, Song, et autres
Publié: (2026)
Towards On-Policy Data Evolution for Visual-Native Multimodal Deep Search Agents
par: Huang, Shijue, et autres
Publié: (2026)
par: Huang, Shijue, et autres
Publié: (2026)
Symbolic powers via extension
par: Bisui, Sankhaneel, et autres
Publié: (2024)
par: Bisui, Sankhaneel, et autres
Publié: (2024)
ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
par: Wadhawan, Rohan, et autres
Publié: (2024)
par: Wadhawan, Rohan, et autres
Publié: (2024)
TTVS: Boosting Self-Exploring Reinforcement Learning via Test-time Variational Synthesis
par: Bai, Sikai, et autres
Publié: (2026)
par: Bai, Sikai, et autres
Publié: (2026)
Beyond High-Entropy Exploration: Correctness-Aware Low-Entropy Segment-Based Advantage Shaping for Reasoning LLMs
par: Chen, Xinzhu, et autres
Publié: (2025)
par: Chen, Xinzhu, et autres
Publié: (2025)
VADE: Variance-Aware Dynamic Sampling via Online Sample-Level Difficulty Estimation for Multimodal RL
par: Hu, Zengjie, et autres
Publié: (2025)
par: Hu, Zengjie, et autres
Publié: (2025)
Thinking-while-Generating: Interleaving Textual Reasoning throughout Visual Generation
par: Guo, Ziyu, et autres
Publié: (2025)
par: Guo, Ziyu, et autres
Publié: (2025)
Unlocking the Potential of Difficulty Prior in RL-based Multimodal Reasoning
par: Chen, Mingrui, et autres
Publié: (2025)
par: Chen, Mingrui, et autres
Publié: (2025)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
par: Li, Xue, et autres
Publié: (2025)
par: Li, Xue, et autres
Publié: (2025)
Less is More Tokens: Efficient Math Reasoning via Difficulty-Aware Chain-of-Thought Distillation
par: Waheed, Abdul, et autres
Publié: (2025)
par: Waheed, Abdul, et autres
Publié: (2025)
ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System
par: Liang, Jiacheng, et autres
Publié: (2026)
par: Liang, Jiacheng, et autres
Publié: (2026)
Enhancing Multi-Modal LLMs Reasoning via Difficulty-Aware Group Normalization
par: Li, Jinghan, et autres
Publié: (2026)
par: Li, Jinghan, et autres
Publié: (2026)
EditThinker: Unlocking Iterative Reasoning for Any Image Editor
par: Li, Hongyu, et autres
Publié: (2025)
par: Li, Hongyu, et autres
Publié: (2025)
Towards Realistic Scene Generation with LiDAR Diffusion Models
par: Ran, Haoxi, et autres
Publié: (2024)
par: Ran, Haoxi, et autres
Publié: (2024)
MorphoBench: A Benchmark with Difficulty Adaptive to Model Reasoning
par: Wang, Xukai, et autres
Publié: (2025)
par: Wang, Xukai, et autres
Publié: (2025)
Prompt-Aware Adapter: Towards Learning Adaptive Visual Tokens for Multimodal Large Language Models
par: Zhang, Yue, et autres
Publié: (2024)
par: Zhang, Yue, et autres
Publié: (2024)
When Inviting Voice Backfires: How Leader Dominance Shapes Employee Responses to Voice Solicitation
par: Qi Song, et autres
Publié: (2026)
par: Qi Song, et autres
Publié: (2026)
Documents similaires
-
Think How to Think: Mitigating Overthinking with Autonomous Difficulty Cognition in Large Reasoning Models
par: Liu, Yongjiang, et autres
Publié: (2025) -
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
par: Huang, Shijue, et autres
Publié: (2025) -
OpenVLThinkerV2: A Generalist Multimodal Reasoning Model for Multi-domain Visual Tasks
par: Hu, Wenbo, et autres
Publié: (2026) -
On the Difficulty of Token-Level Modeling of Dysfluency and Fluency Shaping Artifacts
par: Gulzar, Kashaf, et autres
Publié: (2025) -
DiffAdapt: Difficulty-Adaptive Reasoning for Token-Efficient LLM Inference
par: Liu, Xiang, et autres
Publié: (2025)