MUR: Momentum Uncertainty guided Reasoning for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Yan, Hang, Xu, Fangzhi, Xu, Rongman, Li, Yifei, Zhang, Jian, Luo, Haoran, Wu, Xiaobao, Tuan, Luu Anh, Zhao, Haiteng, Lin, Qika, Liu, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
$ϕ$-Decoding: Adaptive Foresight Sampling for Balanced Inference-Time Exploration and Exploitation
por: Xu, Fangzhi, et al.
Publicado: (2025)
por: Xu, Fangzhi, et al.
Publicado: (2025)
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
por: Xu, Fangzhi, et al.
Publicado: (2023)
por: Xu, Fangzhi, et al.
Publicado: (2023)
Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning
por: Luo, Haoran, et al.
Publicado: (2025)
por: Luo, Haoran, et al.
Publicado: (2025)
Towards Reliable Truth-Aligned Uncertainty Estimation in Large Language Models
por: Srey, Ponhvoan, et al.
Publicado: (2026)
por: Srey, Ponhvoan, et al.
Publicado: (2026)
Learning Uncertainty from Sequential Internal Dispersion in Large Language Models
por: Srey, Ponhvoan, et al.
Publicado: (2026)
por: Srey, Ponhvoan, et al.
Publicado: (2026)
PathReasoner: Modeling Reasoning Path with Equivalent Extension for Logical Question Answering
por: Xu, Fangzhi, et al.
Publicado: (2024)
por: Xu, Fangzhi, et al.
Publicado: (2024)
Unsupervised Hallucination Detection by Inspecting Reasoning Processes
por: Srey, Ponhvoan, et al.
Publicado: (2025)
por: Srey, Ponhvoan, et al.
Publicado: (2025)
BioMaze: Benchmarking and Enhancing Large Language Models for Biological Pathway Reasoning
por: Zhao, Haiteng, et al.
Publicado: (2025)
por: Zhao, Haiteng, et al.
Publicado: (2025)
Understanding and Preventing Entropy Collapse in RLVR with On-Policy Entropy Flow Optimization
por: Xu, Huimin, et al.
Publicado: (2026)
por: Xu, Huimin, et al.
Publicado: (2026)
A Survey on Neural Topic Models: Methods, Applications, and Challenges
por: Wu, Xiaobao, et al.
Publicado: (2024)
por: Wu, Xiaobao, et al.
Publicado: (2024)
Towards the TopMost: A Topic Modeling System Toolkit
por: Wu, Xiaobao, et al.
Publicado: (2023)
por: Wu, Xiaobao, et al.
Publicado: (2023)
KBQA-o1: Agentic Knowledge Base Question Answering with Monte Carlo Tree Search
por: Luo, Haoran, et al.
Publicado: (2025)
por: Luo, Haoran, et al.
Publicado: (2025)
Genius: A Generalizable and Purely Unsupervised Self-Training Framework For Advanced Reasoning
por: Xu, Fangzhi, et al.
Publicado: (2025)
por: Xu, Fangzhi, et al.
Publicado: (2025)
A Semantic Mention Graph Augmented Model for Document-Level Event Argument Extraction
por: Zhang, Jian, et al.
Publicado: (2024)
por: Zhang, Jian, et al.
Publicado: (2024)
From Stimuli to Minds: Enhancing Psychological Reasoning in LLMs via Bilateral Reinforcement Learning
por: Feng, Yichao, et al.
Publicado: (2025)
por: Feng, Yichao, et al.
Publicado: (2025)
$A^3$-Bench: Benchmarking Memory-Driven Scientific Reasoning via Anchor and Attractor Activation
por: Zhang, Jian, et al.
Publicado: (2026)
por: Zhang, Jian, et al.
Publicado: (2026)
Dual-Dimensional Consistency: Balancing Budget and Quality in Adaptive Inference-Time Scaling
por: Xu, Rongman, et al.
Publicado: (2026)
por: Xu, Rongman, et al.
Publicado: (2026)
SCOPE: Compress Mathematical Reasoning Steps for Efficient Automated Process Annotation
por: Xu, Huimin, et al.
Publicado: (2025)
por: Xu, Huimin, et al.
Publicado: (2025)
Full-Step-DPO: Self-Supervised Preference Optimization with Step-wise Rewards for Mathematical Reasoning
por: Xu, Huimin, et al.
Publicado: (2025)
por: Xu, Huimin, et al.
Publicado: (2025)
MAPS: Multi-Agent Personality Shaping for Collaborative Reasoning
por: Zhang, Jian, et al.
Publicado: (2025)
por: Zhang, Jian, et al.
Publicado: (2025)
Read as You See: Guiding Unimodal LLMs for Low-Resource Explainable Harmful Meme Detection
por: Pan, Fengjun, et al.
Publicado: (2025)
por: Pan, Fengjun, et al.
Publicado: (2025)
Are LLMs Good Zero-Shot Fallacy Classifiers?
por: Pan, Fengjun, et al.
Publicado: (2024)
por: Pan, Fengjun, et al.
Publicado: (2024)
Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models
por: Lin, Qika, et al.
Publicado: (2025)
por: Lin, Qika, et al.
Publicado: (2025)
Towards Unified Neurosymbolic Reasoning on Knowledge Graphs
por: Lin, Qika, et al.
Publicado: (2025)
por: Lin, Qika, et al.
Publicado: (2025)
HyperGraphRAG: Retrieval-Augmented Generation via Hypergraph-Structured Knowledge Representation
por: Luo, Haoran, et al.
Publicado: (2025)
por: Luo, Haoran, et al.
Publicado: (2025)
Symbol-LLM: Towards Foundational Symbol-centric Interface For Large Language Models
por: Xu, Fangzhi, et al.
Publicado: (2023)
por: Xu, Fangzhi, et al.
Publicado: (2023)
Vision-and-Language Pretraining
por: Nguyen, Thong, et al.
Publicado: (2022)
por: Nguyen, Thong, et al.
Publicado: (2022)
KDMCSE: Knowledge Distillation Multimodal Sentence Embeddings with Adaptive Angular margin Contrastive Learning
por: Nguyen, Cong-Duy, et al.
Publicado: (2024)
por: Nguyen, Cong-Duy, et al.
Publicado: (2024)
AKEW: Assessing Knowledge Editing in the Wild
por: Wu, Xiaobao, et al.
Publicado: (2024)
por: Wu, Xiaobao, et al.
Publicado: (2024)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
TIDE: Trajectory-based Diagnostic Evaluation of Test-Time Improvement in LLM Agents
por: Yan, Hang, et al.
Publicado: (2026)
por: Yan, Hang, et al.
Publicado: (2026)
Zero-to-Strong Generalization: Eliciting Strong Capabilities of Large Language Models Iteratively without Gold Labels
por: Liu, Chaoqun, et al.
Publicado: (2024)
por: Liu, Chaoqun, et al.
Publicado: (2024)
BenchBench: Benchmarking Automated Benchmark Generation
por: Zheng, Yandan, et al.
Publicado: (2026)
por: Zheng, Yandan, et al.
Publicado: (2026)
Modeling Dynamic Topics in Chain-Free Fashion by Evolution-Tracking Contrastive Learning and Unassociated Word Exclusion
por: Wu, Xiaobao, et al.
Publicado: (2024)
por: Wu, Xiaobao, et al.
Publicado: (2024)
Three Minds, One Legend: Jailbreak Large Reasoning Model with Adaptive Stacked Ciphers
por: Nguyen, Viet-Anh, et al.
Publicado: (2025)
por: Nguyen, Viet-Anh, et al.
Publicado: (2025)
OdysseyArena: Benchmarking Large Language Models For Long-Horizon, Active and Inductive Interactions
por: Xu, Fangzhi, et al.
Publicado: (2026)
por: Xu, Fangzhi, et al.
Publicado: (2026)
CutPaste&Find: Efficient Multimodal Hallucination Detector with Visual-aid Knowledge Base
por: Nguyen, Cong-Duy, et al.
Publicado: (2025)
por: Nguyen, Cong-Duy, et al.
Publicado: (2025)
OrchMAS: Orchestrated Reasoning with Multi Collaborative Heterogeneous Scientific Expert Structured Agents
por: Feng, Yichao, et al.
Publicado: (2026)
por: Feng, Yichao, et al.
Publicado: (2026)
MRAG: A Modular Retrieval Framework for Time-Sensitive Question Answering
por: Siyue, Zhang, et al.
Publicado: (2024)
por: Siyue, Zhang, et al.
Publicado: (2024)
Aspect-Based Summarization with Self-Aspect Retrieval Enhanced Generation
por: Feng, Yichao, et al.
Publicado: (2025)
por: Feng, Yichao, et al.
Publicado: (2025)
Ejemplares similares
-
$ϕ$-Decoding: Adaptive Foresight Sampling for Balanced Inference-Time Exploration and Exploitation
por: Xu, Fangzhi, et al.
Publicado: (2025) -
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
por: Xu, Fangzhi, et al.
Publicado: (2023) -
Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning
por: Luo, Haoran, et al.
Publicado: (2025) -
Towards Reliable Truth-Aligned Uncertainty Estimation in Large Language Models
por: Srey, Ponhvoan, et al.
Publicado: (2026) -
Learning Uncertainty from Sequential Internal Dispersion in Large Language Models
por: Srey, Ponhvoan, et al.
Publicado: (2026)