Improving Language Model Reasoning with Self-motivated Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Feng, Yunlong, Xu, Yang, Qin, Libo, Wang, Yasheng, Che, Wanxiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Two-Stage Framework with Self-Supervised Distillation For Cross-Domain Text Classification
por: Feng, Yunlong, et al.
Publicado: (2023)
por: Feng, Yunlong, et al.
Publicado: (2023)
Aware First, Think Less: Dynamic Boundary Self-Awareness Drives Extreme Reasoning Efficiency in Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
ESAinsTOD: A Unified End-to-End Schema-Aware Instruction-Tuning Framework for Task-Oriented Dialog Modeling
por: Teng, Dechuan, et al.
Publicado: (2026)
por: Teng, Dechuan, et al.
Publicado: (2026)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
Stealthy Jailbreak Attacks on Large Language Models via Benign Data Mirroring
por: Mu, Honglin, et al.
Publicado: (2024)
por: Mu, Honglin, et al.
Publicado: (2024)
Large Language Models Meet NLP: A Survey
por: Qin, Libo, et al.
Publicado: (2024)
por: Qin, Libo, et al.
Publicado: (2024)
OMIBench: Benchmarking Olympiad-Level Multi-Image Reasoning in Large Vision-Language Model
por: Chen, Qiguang, et al.
Publicado: (2026)
por: Chen, Qiguang, et al.
Publicado: (2026)
RBF++: Quantifying and Optimizing Reasoning Boundaries across Measurable and Unmeasurable Capabilities for Chain-of-Thought Reasoning
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
Electronic Circuit Principles of Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
ViTCoT: Video-Text Interleaved Chain-of-Thought for Boosting Video Understanding in Large Language Models
por: Zhang, Yongheng, et al.
Publicado: (2025)
por: Zhang, Yongheng, et al.
Publicado: (2025)
What Factors Affect Multi-Modal In-Context Learning? An In-Depth Exploration
por: Qin, Libo, et al.
Publicado: (2024)
por: Qin, Libo, et al.
Publicado: (2024)
M$^3$CoT: A Novel Benchmark for Multi-Domain Multi-step Multi-modal Chain-of-Thought
por: Chen, Qiguang, et al.
Publicado: (2024)
por: Chen, Qiguang, et al.
Publicado: (2024)
Learning the Boundary of Solvability: Aligning LLMs to Detect Unsolvable Problems
por: Peng, Dengyun, et al.
Publicado: (2025)
por: Peng, Dengyun, et al.
Publicado: (2025)
HUOZIIME: An On-Device LLM-enhanced Input Method for Deep Personalization
por: Shan, Baocai, et al.
Publicado: (2026)
por: Shan, Baocai, et al.
Publicado: (2026)
MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models
por: Ji, Yiyan, et al.
Publicado: (2025)
por: Ji, Yiyan, et al.
Publicado: (2025)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
por: Chen, Qiguang, et al.
Publicado: (2026)
por: Chen, Qiguang, et al.
Publicado: (2026)
Improving Grammatical Error Correction via Contextual Data Augmentation
por: Wang, Yixuan, et al.
Publicado: (2024)
por: Wang, Yixuan, et al.
Publicado: (2024)
Advancing Large Language Model Attribution through Self-Improving
por: Huang, Lei, et al.
Publicado: (2024)
por: Huang, Lei, et al.
Publicado: (2024)
PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models
por: Tan, Haochen, et al.
Publicado: (2024)
por: Tan, Haochen, et al.
Publicado: (2024)
Learning Evolving Tools for Large Language Models
por: Chen, Guoxin, et al.
Publicado: (2024)
por: Chen, Guoxin, et al.
Publicado: (2024)
Large Language Models Can Self-Improve in Long-context Reasoning
por: Li, Siheng, et al.
Publicado: (2024)
por: Li, Siheng, et al.
Publicado: (2024)
Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational Capabilities
por: Zhao, Weixiang, et al.
Publicado: (2025)
por: Zhao, Weixiang, et al.
Publicado: (2025)
Graph-of-Causal Evolution: Challenging Chain-of-Model for Reasoning
por: Wang, Libo
Publicado: (2025)
por: Wang, Libo
Publicado: (2025)
ToolACE-DEV: Self-Improving Tool Learning via Decomposition and EVolution
por: Huang, Xu, et al.
Publicado: (2025)
por: Huang, Xu, et al.
Publicado: (2025)
Improving Retrieval Augmented Language Model with Self-Reasoning
por: Xia, Yuan, et al.
Publicado: (2024)
por: Xia, Yuan, et al.
Publicado: (2024)
The Universal Landscape of Human Reasoning
por: Chen, Qiguang, et al.
Publicado: (2025)
por: Chen, Qiguang, et al.
Publicado: (2025)
Fitting Is Not Enough: Smoothness in Extremely Quantized LLMs
por: Xu, Yuzhuang, et al.
Publicado: (2026)
por: Xu, Yuzhuang, et al.
Publicado: (2026)
What are the Essential Factors in Crafting Effective Long Context Multi-Hop Instruction Datasets? Insights and Best Practices
por: Chen, Zhi, et al.
Publicado: (2024)
por: Chen, Zhi, et al.
Publicado: (2024)
Self-Constructed Context Decompilation with Fined-grained Alignment Enhancement
por: Feng, Yunlong, et al.
Publicado: (2024)
por: Feng, Yunlong, et al.
Publicado: (2024)
Lookahead Q-Cache: Achieving More Consistent KV Cache Eviction via Pseudo Query
por: Wang, Yixuan, et al.
Publicado: (2025)
por: Wang, Yixuan, et al.
Publicado: (2025)
Judge Q: Trainable Queries for Optimized Information Retention in KV Cache Eviction
por: Liu, Yijun, et al.
Publicado: (2025)
por: Liu, Yijun, et al.
Publicado: (2025)
Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future
por: Wang, Yidong, et al.
Publicado: (2025)
por: Wang, Yidong, et al.
Publicado: (2025)
Learning to Self-Verify Makes Language Models Better Reasoners
por: Chen, Yuxin, et al.
Publicado: (2026)
por: Chen, Yuxin, et al.
Publicado: (2026)
Multilingual Multi-Aspect Explainability Analyses on Machine Reading Comprehension Models
por: Cui, Yiming, et al.
Publicado: (2021)
por: Cui, Yiming, et al.
Publicado: (2021)
Learning to Reason Over Time: Timeline Self-Reflection for Improved Temporal Reasoning in Language Models
por: Bazaga, Adrián, et al.
Publicado: (2025)
por: Bazaga, Adrián, et al.
Publicado: (2025)
Learning to Check: Unleashing Potentials for Self-Correction in Large Language Models
por: Zhang, Che, et al.
Publicado: (2024)
por: Zhang, Che, et al.
Publicado: (2024)
Towards Autonomous Agents: Adaptive-planning, Reasoning, and Acting in Language Models
por: Dutta, Abhishek, et al.
Publicado: (2024)
por: Dutta, Abhishek, et al.
Publicado: (2024)
"Moralized" Multi-Step Jailbreak Prompts: Black-Box Testing of Guardrails in Large Language Models for Verbal Attacks
por: Wang, Libo
Publicado: (2024)
por: Wang, Libo
Publicado: (2024)
Know More, Know Clearer: A Meta-Cognitive Framework for Knowledge Augmentation in Large Language Models
por: Chen, Hao, et al.
Publicado: (2026)
por: Chen, Hao, et al.
Publicado: (2026)
Brainstorming Brings Power to Large Language Models of Knowledge Reasoning
por: Qin, Zining, et al.
Publicado: (2024)
por: Qin, Zining, et al.
Publicado: (2024)
Ejemplares similares
-
A Two-Stage Framework with Self-Supervised Distillation For Cross-Domain Text Classification
por: Feng, Yunlong, et al.
Publicado: (2023) -
Aware First, Think Less: Dynamic Boundary Self-Awareness Drives Extreme Reasoning Efficiency in Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025) -
ESAinsTOD: A Unified End-to-End Schema-Aware Instruction-Tuning Framework for Task-Oriented Dialog Modeling
por: Teng, Dechuan, et al.
Publicado: (2026) -
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
por: Chen, Qiguang, et al.
Publicado: (2025) -
Stealthy Jailbreak Attacks on Large Language Models via Benign Data Mirroring
por: Mu, Honglin, et al.
Publicado: (2024)