Guardado en:
| Autores principales: | Chi, Yizhou, Yang, Kevin, Klein, Dan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2404.05966 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CLARINET: Augmenting Language Models to Ask Clarification Questions for Retrieval
por: Chi, Yizhou, et al.
Publicado: (2024)
por: Chi, Yizhou, et al.
Publicado: (2024)
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
por: Yang, Kevin, et al.
Publicado: (2023)
por: Yang, Kevin, et al.
Publicado: (2023)
SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval
por: Petcu, Roxana, et al.
Publicado: (2026)
por: Petcu, Roxana, et al.
Publicado: (2026)
Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2024)
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2024)
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
por: Ma, Long, et al.
Publicado: (2025)
por: Ma, Long, et al.
Publicado: (2025)
Intermediate Languages Matter: Formal Choice Drives Neurosymbolic LLM Reasoning
por: Beiser, Alexander, et al.
Publicado: (2025)
por: Beiser, Alexander, et al.
Publicado: (2025)
American Sign Language Handshapes Reflect Pressures for Communicative Efficiency
por: Yin, Kayo, et al.
Publicado: (2024)
por: Yin, Kayo, et al.
Publicado: (2024)
When the Majority is Wrong: Modeling Annotator Disagreement for Subjective Tasks
por: Fleisig, Eve, et al.
Publicado: (2023)
por: Fleisig, Eve, et al.
Publicado: (2023)
Instructing the Architecture Search for Spatial-temporal Sequence Forecasting with LLM
por: Xue, Xin, et al.
Publicado: (2025)
por: Xue, Xin, et al.
Publicado: (2025)
Trustworthy Reasoning: Evaluating and Enhancing Factual Accuracy in LLM Intermediate Thought Processes
por: Jiao, Rui, et al.
Publicado: (2025)
por: Jiao, Rui, et al.
Publicado: (2025)
LRAS: Advanced Legal Reasoning with Agentic Search
por: Zhou, Yujin, et al.
Publicado: (2026)
por: Zhou, Yujin, et al.
Publicado: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
por: Chen, Mingyang, et al.
Publicado: (2025)
por: Chen, Mingyang, et al.
Publicado: (2025)
Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning
por: Guo, Chenyou, et al.
Publicado: (2026)
por: Guo, Chenyou, et al.
Publicado: (2026)
Ghostbuster: Detecting Text Ghostwritten by Large Language Models
por: Verma, Vivek, et al.
Publicado: (2023)
por: Verma, Vivek, et al.
Publicado: (2023)
Balancing Quality and Variation: Spam Filtering Distorts Data Label Distributions
por: Fleisig, Eve, et al.
Publicado: (2025)
por: Fleisig, Eve, et al.
Publicado: (2025)
Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers
por: Yang, Wang, et al.
Publicado: (2026)
por: Yang, Wang, et al.
Publicado: (2026)
Emergent Search and Backtracking in Latent Reasoning Models
por: Cui, Jasmine, et al.
Publicado: (2026)
por: Cui, Jasmine, et al.
Publicado: (2026)
PromptTailor: Multi-turn Intent-Aligned Prompt Synthesis for Lightweight LLMs
por: Xu, Yizhou, et al.
Publicado: (2025)
por: Xu, Yizhou, et al.
Publicado: (2025)
WildSci: Advancing Scientific Reasoning from In-the-Wild Literature
por: Liu, Tengxiao, et al.
Publicado: (2026)
por: Liu, Tengxiao, et al.
Publicado: (2026)
What Makes Good Multilingual Reasoning? Disentangling Reasoning Traces with Measurable Features
por: Ki, Dayeon, et al.
Publicado: (2026)
por: Ki, Dayeon, et al.
Publicado: (2026)
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
por: He, Bowei, et al.
Publicado: (2026)
por: He, Bowei, et al.
Publicado: (2026)
R2-Write: Reflection and Revision for Open-Ended Writing with Deep Reasoning
por: Liu, Wanlong, et al.
Publicado: (2026)
por: Liu, Wanlong, et al.
Publicado: (2026)
SRA-MCTS: Self-driven Reasoning Augmentation with Monte Carlo Tree Search for Code Generation
por: Xu, Bin, et al.
Publicado: (2024)
por: Xu, Bin, et al.
Publicado: (2024)
Learning to Reason via Program Generation, Emulation, and Search
por: Weir, Nathaniel, et al.
Publicado: (2024)
por: Weir, Nathaniel, et al.
Publicado: (2024)
Enhancing LLM Reasoning with Reward-guided Tree Search
por: Jiang, Jinhao, et al.
Publicado: (2024)
por: Jiang, Jinhao, et al.
Publicado: (2024)
Interpretable Contrastive Monte Carlo Tree Search Reasoning
por: Gao, Zitian, et al.
Publicado: (2024)
por: Gao, Zitian, et al.
Publicado: (2024)
Efficient Reasoning with Hidden Thinking
por: Shen, Xuan, et al.
Publicado: (2025)
por: Shen, Xuan, et al.
Publicado: (2025)
Generating Chain-of-Thoughts with a Pairwise-Comparison Approach to Searching for the Most Promising Intermediate Thought
por: Zhang, Zhen-Yu, et al.
Publicado: (2024)
por: Zhang, Zhen-Yu, et al.
Publicado: (2024)
BFS-PO: Best-First Search for Large Reasoning Models
por: Parascandolo, Fiorenzo, et al.
Publicado: (2026)
por: Parascandolo, Fiorenzo, et al.
Publicado: (2026)
Accelerating Large Language Model Reasoning via Speculative Search
por: Wang, Zhihai, et al.
Publicado: (2025)
por: Wang, Zhihai, et al.
Publicado: (2025)
A Study on Leveraging Search and Self-Feedback for Agent Reasoning
por: K, Karthikeyan, et al.
Publicado: (2025)
por: K, Karthikeyan, et al.
Publicado: (2025)
Novelty-based Tree-of-Thought Search for LLM Reasoning and Planning
por: Hamm, Leon, et al.
Publicado: (2026)
por: Hamm, Leon, et al.
Publicado: (2026)
ReasonBENCH: Benchmarking the (In)Stability of LLM Reasoning
por: Potamitis, Nearchos, et al.
Publicado: (2025)
por: Potamitis, Nearchos, et al.
Publicado: (2025)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
por: Xiong, Xuan, et al.
Publicado: (2026)
por: Xiong, Xuan, et al.
Publicado: (2026)
MultiZebraLogic: A Multilingual Logical Reasoning Benchmark
por: Bruun, Sofie Helene, et al.
Publicado: (2025)
por: Bruun, Sofie Helene, et al.
Publicado: (2025)
No Universal Prompt: Unifying Reasoning through Adaptive Prompting for Temporal Table Reasoning
por: Rajgaria, Abhishek, et al.
Publicado: (2025)
por: Rajgaria, Abhishek, et al.
Publicado: (2025)
Language Models Represent Beliefs of Self and Others
por: Zhu, Wentao, et al.
Publicado: (2024)
por: Zhu, Wentao, et al.
Publicado: (2024)
SIGMA: Search-Augmented On-Demand Knowledge Integration for Agentic Mathematical Reasoning
por: Asgarov, Ali, et al.
Publicado: (2025)
por: Asgarov, Ali, et al.
Publicado: (2025)
Robust Search with Uncertainty-Aware Value Models for Language Model Reasoning
por: Yu, Fei, et al.
Publicado: (2025)
por: Yu, Fei, et al.
Publicado: (2025)
ARise: Towards Knowledge-Augmented Reasoning via Risk-Adaptive Search
por: Zhang, Yize, et al.
Publicado: (2025)
por: Zhang, Yize, et al.
Publicado: (2025)
Ejemplares similares
-
CLARINET: Augmenting Language Models to Ask Clarification Questions for Retrieval
por: Chi, Yizhou, et al.
Publicado: (2024) -
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
por: Yang, Kevin, et al.
Publicado: (2023) -
SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval
por: Petcu, Roxana, et al.
Publicado: (2026) -
Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2024) -
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
por: Ma, Long, et al.
Publicado: (2025)