MITS: Enhanced Tree Search Reasoning for LLMs via Pointwise Mutual Information
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Jiaxi, Shi, Yucheng, Huang, Xiao, Lu, Jin, Liu, Ninghao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
von: Shen, Guobin, et al.
Veröffentlicht: (2026)
von: Shen, Guobin, et al.
Veröffentlicht: (2026)
TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL
von: Yang, Tianze, et al.
Veröffentlicht: (2026)
von: Yang, Tianze, et al.
Veröffentlicht: (2026)
Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
von: Yang, Hanlin, et al.
Veröffentlicht: (2024)
von: Yang, Hanlin, et al.
Veröffentlicht: (2024)
SearchRAG: Can Search Engines Be Helpful for LLM-based Medical Question Answering?
von: Shi, Yucheng, et al.
Veröffentlicht: (2025)
von: Shi, Yucheng, et al.
Veröffentlicht: (2025)
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
von: Liu, Tianyu, et al.
Veröffentlicht: (2024)
von: Liu, Tianyu, et al.
Veröffentlicht: (2024)
Beyond Scalars: Evaluating and Understanding LLM Reasoning via Geometric Progress and Stability
von: Jiang, Xinyan, et al.
Veröffentlicht: (2026)
von: Jiang, Xinyan, et al.
Veröffentlicht: (2026)
Leveraging Large Language Models with Chain-of-Thought and Prompt Engineering for Traffic Crash Severity Analysis and Inference
von: Zhen, Hao, et al.
Veröffentlicht: (2024)
von: Zhen, Hao, et al.
Veröffentlicht: (2024)
Could Small Language Models Serve as Recommenders? Towards Data-centric Cold-start Recommendations
von: Wu, Xuansheng, et al.
Veröffentlicht: (2023)
von: Wu, Xuansheng, et al.
Veröffentlicht: (2023)
MITS: A Large-Scale Multimodal Benchmark Dataset for Intelligent Traffic Surveillance
von: Zhao, Kaikai, et al.
Veröffentlicht: (2025)
von: Zhao, Kaikai, et al.
Veröffentlicht: (2025)
MGH Radiology Llama: A Llama 3 70B Model for Radiology
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
MKRAG: Medical Knowledge Retrieval Augmented Generation for Medical Question Answering
von: Shi, Yucheng, et al.
Veröffentlicht: (2023)
von: Shi, Yucheng, et al.
Veröffentlicht: (2023)
ChatTS: Aligning Time Series with LLMs via Synthetic Data for Enhanced Understanding and Reasoning
von: Xie, Zhe, et al.
Veröffentlicht: (2024)
von: Xie, Zhe, et al.
Veröffentlicht: (2024)
Demystifying Reasoning Dynamics with Mutual Information: Thinking Tokens are Information Peaks in LLM Reasoning
von: Qian, Chen, et al.
Veröffentlicht: (2025)
von: Qian, Chen, et al.
Veröffentlicht: (2025)
Retrieval-enhanced Knowledge Editing in Language Models for Multi-Hop Question Answering
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
Language Ranker: A Metric for Quantifying LLM Performance Across High and Low-Resource Languages
von: Li, Zihao, et al.
Veröffentlicht: (2024)
von: Li, Zihao, et al.
Veröffentlicht: (2024)
Precise Zero-Shot Pointwise Ranking with LLMs through Post-Aggregated Global Context Information
von: Long, Kehan, et al.
Veröffentlicht: (2025)
von: Long, Kehan, et al.
Veröffentlicht: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
Policy Guided Tree Search for Enhanced LLM Reasoning
von: Li, Yang
Veröffentlicht: (2025)
von: Li, Yang
Veröffentlicht: (2025)
Xiangqi-R1: Enhancing Spatial Strategic Reasoning in LLMs for Chinese Chess via Reinforcement Learning
von: Chen, Yuhao, et al.
Veröffentlicht: (2025)
von: Chen, Yuhao, et al.
Veröffentlicht: (2025)
DyTopo: Dynamic Topology Routing for Multi-Agent Reasoning via Semantic Matching
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
von: Lu, Yuxing, et al.
Veröffentlicht: (2026)
Applying Neural Monte Carlo Tree Search to Unsignalized Multi-intersection Scheduling for Autonomous Vehicles
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
von: Shi, Yucheng, et al.
Veröffentlicht: (2024)
THE-Tree: Can Tracing Historical Evolution Enhance Scientific Verification and Reasoning?
von: Wang, Xin, et al.
Veröffentlicht: (2025)
von: Wang, Xin, et al.
Veröffentlicht: (2025)
VISOR: Agentic Visual Retrieval-Augmented Generation via Iterative Search and Over-horizon Reasoning
von: Shen, Yucheng, et al.
Veröffentlicht: (2026)
von: Shen, Yucheng, et al.
Veröffentlicht: (2026)
MMG: Mutual Information Estimation via the MMSE Gap in Diffusion
von: Yu, Longxuan, et al.
Veröffentlicht: (2025)
von: Yu, Longxuan, et al.
Veröffentlicht: (2025)
Limits of PRM-Guided Tree Search for Mathematical Reasoning with LLMs
von: Cinquin, Tristan, et al.
Veröffentlicht: (2025)
von: Cinquin, Tristan, et al.
Veröffentlicht: (2025)
Enhancing LLM Reasoning with Reward-guided Tree Search
von: Jiang, Jinhao, et al.
Veröffentlicht: (2024)
von: Jiang, Jinhao, et al.
Veröffentlicht: (2024)
BPP-Search: Enhancing Tree of Thought Reasoning for Mathematical Modeling Problem Solving
von: Wang, Teng, et al.
Veröffentlicht: (2024)
von: Wang, Teng, et al.
Veröffentlicht: (2024)
Training LLMs Beyond Next Token Prediction -- Filling the Mutual Information Gap
von: Yang, Chun-Hao, et al.
Veröffentlicht: (2025)
von: Yang, Chun-Hao, et al.
Veröffentlicht: (2025)
MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
von: Yuan, Qianhao, et al.
Veröffentlicht: (2025)
von: Yuan, Qianhao, et al.
Veröffentlicht: (2025)
Rethinking the Understanding Ability across LLMs through Mutual Information
von: Wang, Shaojie, et al.
Veröffentlicht: (2025)
von: Wang, Shaojie, et al.
Veröffentlicht: (2025)
StructRAG: Boosting Knowledge Intensive Reasoning of LLMs via Inference-time Hybrid Information Structurization
von: Li, Zhuoqun, et al.
Veröffentlicht: (2024)
von: Li, Zhuoqun, et al.
Veröffentlicht: (2024)
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
von: He, Bowei, et al.
Veröffentlicht: (2026)
von: He, Bowei, et al.
Veröffentlicht: (2026)
AutoSCORE: Enhancing Automated Scoring with Multi-Agent Large Language Models via Structured Component Recognition
von: Wang, Yun, et al.
Veröffentlicht: (2025)
von: Wang, Yun, et al.
Veröffentlicht: (2025)
From Logs to Language: Learning Optimal Verbalization for LLM-Based Recommendation at Industry Scale
von: Shi, Yucheng, et al.
Veröffentlicht: (2026)
von: Shi, Yucheng, et al.
Veröffentlicht: (2026)
CreDes: Causal Reasoning Enhancement and Dual-End Searching for Solving Long-Range Reasoning Problems using LLMs
von: Wang, Kangsheng, et al.
Veröffentlicht: (2024)
von: Wang, Kangsheng, et al.
Veröffentlicht: (2024)
Chain-in-Tree: Back to Sequential Reasoning in LLM Tree Search
von: Li, Xinzhe
Veröffentlicht: (2025)
von: Li, Xinzhe
Veröffentlicht: (2025)
Towards Faithful Reasoning in Comics for Small MLLMs
von: Feng, Chengcheng, et al.
Veröffentlicht: (2026)
von: Feng, Chengcheng, et al.
Veröffentlicht: (2026)
Learning to Build the Environment: Self-Evolving Reasoning RL via Verifiable Environment Synthesis
von: Shi, Yucheng, et al.
Veröffentlicht: (2026)
von: Shi, Yucheng, et al.
Veröffentlicht: (2026)
IRPM: Intergroup Relative Preference Modeling for Pointwise Generative Reward Models
von: Song, Haonan, et al.
Veröffentlicht: (2026)
von: Song, Haonan, et al.
Veröffentlicht: (2026)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
von: Li, Xiaoxi, et al.
Veröffentlicht: (2025)
von: Li, Xiaoxi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
von: Shen, Guobin, et al.
Veröffentlicht: (2026) -
TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL
von: Yang, Tianze, et al.
Veröffentlicht: (2026) -
Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
von: Yang, Hanlin, et al.
Veröffentlicht: (2024) -
SearchRAG: Can Search Engines Be Helpful for LLM-based Medical Question Answering?
von: Shi, Yucheng, et al.
Veröffentlicht: (2025) -
Pointwise Mutual Information as a Performance Gauge for Retrieval-Augmented Generation
von: Liu, Tianyu, et al.
Veröffentlicht: (2024)