Think&Cite: Improving Attributed Text Generation with Self-Guided Tree Search and Progress Reward Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Junyi, Ng, Hwee Tou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models
por: Li, Junyi, et al.
Publicado: (2025)
por: Li, Junyi, et al.
Publicado: (2025)
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
por: Qorib, Muhammad Reza, et al.
Publicado: (2025)
por: Qorib, Muhammad Reza, et al.
Publicado: (2025)
Preference-Guided Reflective Sampling for Aligning Language Models
por: Ye, Hai, et al.
Publicado: (2024)
por: Ye, Hai, et al.
Publicado: (2024)
Self-Judge: Selective Instruction Following with Alignment Self-Evaluation
por: Ye, Hai, et al.
Publicado: (2024)
por: Ye, Hai, et al.
Publicado: (2024)
Multi-Agent Sampling: Scaling Inference Compute for Data Synthesis with Tree Search-Based Agentic Collaboration
por: Ye, Hai, et al.
Publicado: (2024)
por: Ye, Hai, et al.
Publicado: (2024)
Just What You Desire: Constrained Timeline Summarization with Self-Reflection for Enhanced Relevance
por: Qorib, Muhammad Reza, et al.
Publicado: (2024)
por: Qorib, Muhammad Reza, et al.
Publicado: (2024)
Towards Robust Temporal Reasoning of Large Language Models via a Multi-Hop QA Dataset and Pseudo-Instruction Tuning
por: Tan, Qingyu, et al.
Publicado: (2023)
por: Tan, Qingyu, et al.
Publicado: (2023)
Parametric Knowledge is Not All You Need: Toward Honest Large Language Models via Retrieval of Pretraining Data
por: Kusuma, Christopher Adrian, et al.
Publicado: (2026)
por: Kusuma, Christopher Adrian, et al.
Publicado: (2026)
SlideTailor: Personalized Presentation Slide Generation for Scientific Papers
por: Zeng, Wenzheng, et al.
Publicado: (2025)
por: Zeng, Wenzheng, et al.
Publicado: (2025)
ContextCite: Attributing Model Generation to Context
por: Cohen-Wang, Benjamin, et al.
Publicado: (2024)
por: Cohen-Wang, Benjamin, et al.
Publicado: (2024)
Efficient and Interpretable Grammatical Error Correction with Mixture of Experts
por: Qorib, Muhammad Reza, et al.
Publicado: (2024)
por: Qorib, Muhammad Reza, et al.
Publicado: (2024)
Cited Text Spans for Citation Text Generation
por: Li, Xiangci, et al.
Publicado: (2023)
por: Li, Xiangci, et al.
Publicado: (2023)
Game of Thought: Robust Information Seeking with Large Language Models Using Game Theory
por: Cui, Langyuan, et al.
Publicado: (2026)
por: Cui, Langyuan, et al.
Publicado: (2026)
OpenSeal: Good, Fast, and Cheap Construction of an Open-Source Southeast Asian LLM via Parallel Data
por: Nguyen, Tan Sang, et al.
Publicado: (2026)
por: Nguyen, Tan Sang, et al.
Publicado: (2026)
Unlocking Temporal Question Answering for Large Language Models with Tailor-Made Reasoning Logic
por: Li, Xingxuan, et al.
Publicado: (2023)
por: Li, Xingxuan, et al.
Publicado: (2023)
Factorized Learning for Temporally Grounded Video-Language Models
por: Zeng, Wenzheng, et al.
Publicado: (2025)
por: Zeng, Wenzheng, et al.
Publicado: (2025)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
por: Chuang, Yung-Sung, et al.
Publicado: (2025)
por: Chuang, Yung-Sung, et al.
Publicado: (2025)
WebCiteS: Attributed Query-Focused Summarization on Chinese Web Search Results with Citations
por: Deng, Haolin, et al.
Publicado: (2024)
por: Deng, Haolin, et al.
Publicado: (2024)
Libra: Assessing and Improving Reward Model by Learning to Think
por: Zhou, Meng, et al.
Publicado: (2025)
por: Zhou, Meng, et al.
Publicado: (2025)
The CoNLL-2013 Shared Task on Grammatical Error Correction
por: Ng, Hwee Tou, et al.
Publicado: (2025)
por: Ng, Hwee Tou, et al.
Publicado: (2025)
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
por: Hu, Minda, et al.
Publicado: (2024)
por: Hu, Minda, et al.
Publicado: (2024)
SPA-RL: Reinforcing LLM Agents via Stepwise Progress Attribution
por: Wang, Hanlin, et al.
Publicado: (2025)
por: Wang, Hanlin, et al.
Publicado: (2025)
FocusUI: Efficient UI Grounding via Position-Preserving Visual Token Selection
por: Ouyang, Mingyu, et al.
Publicado: (2026)
por: Ouyang, Mingyu, et al.
Publicado: (2026)
Inference Time Alignment with Reward-Guided Tree Search
por: Hung, Chia-Yu, et al.
Publicado: (2024)
por: Hung, Chia-Yu, et al.
Publicado: (2024)
MedCite: Can Language Models Generate Verifiable Text for Medicine?
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
ReST-MCTS*: LLM Self-Training via Process Reward Guided Tree Search
por: Zhang, Dan, et al.
Publicado: (2024)
por: Zhang, Dan, et al.
Publicado: (2024)
Think Twice, Generate Once: Safeguarding by Progressive Self-Reflection
por: Phan, Hoang, et al.
Publicado: (2025)
por: Phan, Hoang, et al.
Publicado: (2025)
Towards Cost-Effective Reward Guided Text Generation
por: Rashid, Ahmad, et al.
Publicado: (2025)
por: Rashid, Ahmad, et al.
Publicado: (2025)
C$^2$-Cite: Contextual-Aware Citation Generation for Attributed Large Language Models
por: Yu, Yue, et al.
Publicado: (2025)
por: Yu, Yue, et al.
Publicado: (2025)
CiteVQA: Benchmarking Evidence Attribution for Trustworthy Document Intelligence
por: Ma, Dongsheng, et al.
Publicado: (2026)
por: Ma, Dongsheng, et al.
Publicado: (2026)
Improving Attributed Text Generation of Large Language Models via Preference Learning
por: Li, Dongfang, et al.
Publicado: (2024)
por: Li, Dongfang, et al.
Publicado: (2024)
Finding the Sweet Spot: Preference Data Construction for Scaling Preference Optimization
por: Xiao, Yao, et al.
Publicado: (2025)
por: Xiao, Yao, et al.
Publicado: (2025)
Multi-Intent Attribute-Aware Text Matching in Searching
por: Li, Mingzhe, et al.
Publicado: (2024)
por: Li, Mingzhe, et al.
Publicado: (2024)
Search-Based Interaction For Conversation Recommendation via Generative Reward Model Based Simulated User
por: Wang, Xiaolei, et al.
Publicado: (2025)
por: Wang, Xiaolei, et al.
Publicado: (2025)
Reward Models Can Improve Themselves: Reward-Guided Adversarial Failure Mode Discovery for Robust Reward Modeling
por: Pathmanathan, Pankayaraj, et al.
Publicado: (2025)
por: Pathmanathan, Pankayaraj, et al.
Publicado: (2025)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
por: Huang, Yukun, et al.
Publicado: (2025)
por: Huang, Yukun, et al.
Publicado: (2025)
Cited but Not Verified: Parsing and Evaluating Source Attribution in LLM Deep Research Agents
por: Onweller, Hailey, et al.
Publicado: (2026)
por: Onweller, Hailey, et al.
Publicado: (2026)
Rewarding How Models Think Pedagogically: Integrating Pedagogical Reasoning and Thinking Rewards for LLMs in Education
por: Lee, Unggi, et al.
Publicado: (2026)
por: Lee, Unggi, et al.
Publicado: (2026)
Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning
por: Park, Sungjin, et al.
Publicado: (2024)
por: Park, Sungjin, et al.
Publicado: (2024)
ARGS: Alignment as Reward-Guided Search
por: Khanov, Maxim, et al.
Publicado: (2024)
por: Khanov, Maxim, et al.
Publicado: (2024)
Ejemplares similares
-
Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models
por: Li, Junyi, et al.
Publicado: (2025) -
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
por: Qorib, Muhammad Reza, et al.
Publicado: (2025) -
Preference-Guided Reflective Sampling for Aligning Language Models
por: Ye, Hai, et al.
Publicado: (2024) -
Self-Judge: Selective Instruction Following with Alignment Self-Evaluation
por: Ye, Hai, et al.
Publicado: (2024) -
Multi-Agent Sampling: Scaling Inference Compute for Data Synthesis with Tree Search-Based Agentic Collaboration
por: Ye, Hai, et al.
Publicado: (2024)