General-Reasoner: Advancing LLM Reasoning Across All Domains
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Xueguang, Liu, Qian, Jiang, Dongfu, Zhang, Ge, Ma, Zejun, Chen, Wenhu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LongRAG: Enhancing Retrieval-Augmented Generation with Long-context LLMs
por: Jiang, Ziyan, et al.
Publicado: (2024)
por: Jiang, Ziyan, et al.
Publicado: (2024)
TIGERScore: Towards Building Explainable Metric for All Text Generation Tasks
por: Jiang, Dongfu, et al.
Publicado: (2023)
por: Jiang, Dongfu, et al.
Publicado: (2023)
PixelWorld: How Far Are We from Perceiving Everything as Pixels?
por: Lyu, Zhiheng, et al.
Publicado: (2025)
por: Lyu, Zhiheng, et al.
Publicado: (2025)
Augmenting Black-box LLMs with Medical Textbooks for Biomedical Question Answering
por: Wang, Yubo, et al.
Publicado: (2023)
por: Wang, Yubo, et al.
Publicado: (2023)
Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning
por: Ruan, Chi, et al.
Publicado: (2025)
por: Ruan, Chi, et al.
Publicado: (2025)
OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis
por: Li, Zhuofeng, et al.
Publicado: (2026)
por: Li, Zhuofeng, et al.
Publicado: (2026)
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
por: Zhuang, Shengyao, et al.
Publicado: (2025)
por: Zhuang, Shengyao, et al.
Publicado: (2025)
EvolveCoder: Evolving Test Cases via Adversarial Verification for Code Reinforcement Learning
por: Ruan, Chi, et al.
Publicado: (2026)
por: Ruan, Chi, et al.
Publicado: (2026)
AgentIR: Reasoning-Aware Retrieval for Deep Research Agents
por: Chen, Zijian, et al.
Publicado: (2026)
por: Chen, Zijian, et al.
Publicado: (2026)
MANTIS: Interleaved Multi-Image Instruction Tuning
por: Jiang, Dongfu, et al.
Publicado: (2024)
por: Jiang, Dongfu, et al.
Publicado: (2024)
VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation
por: Ku, Max, et al.
Publicado: (2023)
por: Ku, Max, et al.
Publicado: (2023)
Learning to Reason Across Parallel Samples for LLM Reasoning
por: Qi, Jianing, et al.
Publicado: (2025)
por: Qi, Jianing, et al.
Publicado: (2025)
X-Reasoner: Towards Generalizable Reasoning Across Modalities and Domains
por: Liu, Qianchu, et al.
Publicado: (2025)
por: Liu, Qianchu, et al.
Publicado: (2025)
ACECODER: Acing Coder RL via Automated Test-Case Synthesis
por: Zeng, Huaye, et al.
Publicado: (2025)
por: Zeng, Huaye, et al.
Publicado: (2025)
NeedleBench: Evaluating LLM Retrieval and Reasoning Across Varying Information Densities
por: Li, Mo, et al.
Publicado: (2024)
por: Li, Mo, et al.
Publicado: (2024)
SciReasoner: Laying the Scientific Reasoning Ground Across Disciplines
por: Wang, Yizhou, et al.
Publicado: (2025)
por: Wang, Yizhou, et al.
Publicado: (2025)
Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning
por: Liu, Qihao, et al.
Publicado: (2025)
por: Liu, Qihao, et al.
Publicado: (2025)
Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning
por: Liu, Hanbing, et al.
Publicado: (2025)
por: Liu, Hanbing, et al.
Publicado: (2025)
Deciphering Trajectory-Aided LLM Reasoning: An Optimization Perspective
por: Liu, Junnan, et al.
Publicado: (2025)
por: Liu, Junnan, et al.
Publicado: (2025)
Pixel Reasoner: Incentivizing Pixel-Space Reasoning with Curiosity-Driven Reinforcement Learning
por: Wang, Haozhe, et al.
Publicado: (2025)
por: Wang, Haozhe, et al.
Publicado: (2025)
ORBIT: Scalable and Verifiable Data Generation for Search Agents on a Tight Budget
por: Thakur, Nandan, et al.
Publicado: (2026)
por: Thakur, Nandan, et al.
Publicado: (2026)
WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences
por: Lu, Yujie, et al.
Publicado: (2024)
por: Lu, Yujie, et al.
Publicado: (2024)
Grounding Long-Context Reasoning with Contextual Normalization for Retrieval-Augmented Generation
por: Chen, Jiamin, et al.
Publicado: (2025)
por: Chen, Jiamin, et al.
Publicado: (2025)
Knowledge or Reasoning? A Close Look at How LLMs Think Across Domains
por: Wu, Juncheng, et al.
Publicado: (2025)
por: Wu, Juncheng, et al.
Publicado: (2025)
Crowd Comparative Reasoning: Unlocking Comprehensive Evaluations for LLM-as-a-Judge
por: Zhang, Qiyuan, et al.
Publicado: (2025)
por: Zhang, Qiyuan, et al.
Publicado: (2025)
ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations
por: Wang, Yubo, et al.
Publicado: (2025)
por: Wang, Yubo, et al.
Publicado: (2025)
Textualized Agent-Style Reasoning for Complex Tasks by Multiple Round LLM Generation
por: Liang, Chen, et al.
Publicado: (2024)
por: Liang, Chen, et al.
Publicado: (2024)
Understanding Reasoning Ability of Language Models From the Perspective of Reasoning Paths Aggregation
por: Wang, Xinyi, et al.
Publicado: (2024)
por: Wang, Xinyi, et al.
Publicado: (2024)
Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning
por: Qian, Chen, et al.
Publicado: (2025)
por: Qian, Chen, et al.
Publicado: (2025)
Emergent Hierarchical Reasoning in LLMs through Reinforcement Learning
por: Wang, Haozhe, et al.
Publicado: (2025)
por: Wang, Haozhe, et al.
Publicado: (2025)
Unified Data Selection for LLM Reasoning
por: Li, Xiaoyuan, et al.
Publicado: (2026)
por: Li, Xiaoyuan, et al.
Publicado: (2026)
General365: Benchmarking General Reasoning in Large Language Models Across Diverse and Challenging Tasks
por: Liu, Junlin, et al.
Publicado: (2026)
por: Liu, Junlin, et al.
Publicado: (2026)
MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI
por: Yue, Xiang, et al.
Publicado: (2023)
por: Yue, Xiang, et al.
Publicado: (2023)
Advances in LLM Reasoning Enable Flexibility in Clinical Problem-Solving
por: Shidara, Kie, et al.
Publicado: (2026)
por: Shidara, Kie, et al.
Publicado: (2026)
Learning from Mistakes: Negative Reasoning Samples Enhance Out-of-Domain Generalization
por: Tian, Xueyun, et al.
Publicado: (2026)
por: Tian, Xueyun, et al.
Publicado: (2026)
Advancing LLM Reasoning Generalists with Preference Trees
por: Yuan, Lifan, et al.
Publicado: (2024)
por: Yuan, Lifan, et al.
Publicado: (2024)
Alleviating Choice Supportive Bias in LLM with Reasoning Dependency Generation
por: Zhuang, Nan, et al.
Publicado: (2025)
por: Zhuang, Nan, et al.
Publicado: (2025)
Not All Thoughts are Generated Equal: Efficient LLM Reasoning via Multi-Turn Reinforcement Learning
por: Ning, Yansong, et al.
Publicado: (2025)
por: Ning, Yansong, et al.
Publicado: (2025)
Evaluating LLM Reasoning in the Operations Research Domain with ORQA
por: Mostajabdaveh, Mahdi, et al.
Publicado: (2024)
por: Mostajabdaveh, Mahdi, et al.
Publicado: (2024)
Efficiently Scaling LLM Reasoning with Certaindex
por: Fu, Yichao, et al.
Publicado: (2024)
por: Fu, Yichao, et al.
Publicado: (2024)
Ejemplares similares
-
LongRAG: Enhancing Retrieval-Augmented Generation with Long-context LLMs
por: Jiang, Ziyan, et al.
Publicado: (2024) -
TIGERScore: Towards Building Explainable Metric for All Text Generation Tasks
por: Jiang, Dongfu, et al.
Publicado: (2023) -
PixelWorld: How Far Are We from Perceiving Everything as Pixels?
por: Lyu, Zhiheng, et al.
Publicado: (2025) -
Augmenting Black-box LLMs with Medical Textbooks for Biomedical Question Answering
por: Wang, Yubo, et al.
Publicado: (2023) -
Critique-Coder: Enhancing Coder Models by Critique Reinforcement Learning
por: Ruan, Chi, et al.
Publicado: (2025)