STaR-GATE: Teaching Language Models to Ask Clarifying Questions
Fuente:
arXiv
Salvato in:
| Autori principali: | Andukuri, Chinmaya, Fränken, Jan-Philipp, Gerstenberg, Tobias, Goodman, Noah D. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
di: Zelikman, Eric, et al.
Pubblicazione: (2024)
di: Zelikman, Eric, et al.
Pubblicazione: (2024)
Kwai-STaR: Transform LLMs into State-Transition Reasoners
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
V-STaR: Training Verifiers for Self-Taught Reasoners
di: Hosseini, Arian, et al.
Pubblicazione: (2024)
di: Hosseini, Arian, et al.
Pubblicazione: (2024)
B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners
di: Zeng, Weihao, et al.
Pubblicazione: (2024)
di: Zeng, Weihao, et al.
Pubblicazione: (2024)
Procedural Dilemma Generation for Evaluating Moral Reasoning in Humans and Language Models
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)
HS-STaR: Hierarchical Sampling for Self-Taught Reasoners via Difficulty Estimation and Budget Reallocation
di: Xiong, Feng, et al.
Pubblicazione: (2025)
di: Xiong, Feng, et al.
Pubblicazione: (2025)
Self-Supervised Alignment with Mutual Information: Learning to Follow Principles without Preference Labels
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)
Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs
di: Gandhi, Kanishk, et al.
Pubblicazione: (2025)
di: Gandhi, Kanishk, et al.
Pubblicazione: (2025)
Ask Good Questions for Large Language Models
di: Wu, Qi, et al.
Pubblicazione: (2025)
di: Wu, Qi, et al.
Pubblicazione: (2025)
Lean-STaR: Learning to Interleave Thinking and Proving
di: Lin, Haohan, et al.
Pubblicazione: (2024)
di: Lin, Haohan, et al.
Pubblicazione: (2024)
STaR: Sensitive Trajectory Regulation for Unlearning in Large Reasoning Models
di: Zhou, Jingjing, et al.
Pubblicazione: (2026)
di: Zhou, Jingjing, et al.
Pubblicazione: (2026)
From Next-Token to Mathematics: The Learning Dynamics of Mathematical Reasoning in Language Models
di: Mishra, Shubhra, et al.
Pubblicazione: (2024)
di: Mishra, Shubhra, et al.
Pubblicazione: (2024)
Evaluating and Optimizing Educational Content with Large Language Model Judgments
di: He-Yueya, Joy, et al.
Pubblicazione: (2024)
di: He-Yueya, Joy, et al.
Pubblicazione: (2024)
STaR-SQL: Self-Taught Reasoner for Text-to-SQL
di: He, Mingqian, et al.
Pubblicazione: (2025)
di: He, Mingqian, et al.
Pubblicazione: (2025)
Human-like Affective Cognition in Foundation Models
di: Gandhi, Kanishk, et al.
Pubblicazione: (2024)
di: Gandhi, Kanishk, et al.
Pubblicazione: (2024)
Video-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision
di: Zohar, Orr, et al.
Pubblicazione: (2024)
di: Zohar, Orr, et al.
Pubblicazione: (2024)
Modeling Future Conversation Turns to Teach LLMs to Ask Clarifying Questions
di: Zhang, Michael J. Q., et al.
Pubblicazione: (2024)
di: Zhang, Michael J. Q., et al.
Pubblicazione: (2024)
CLARINET: Augmenting Language Models to Ask Clarification Questions for Retrieval
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
Can LLMs Ask Good Questions?
di: Zhang, Yueheng, et al.
Pubblicazione: (2025)
di: Zhang, Yueheng, et al.
Pubblicazione: (2025)
IntelliAsk: Learning to Ask High-Quality Research Questions via RLVR
di: Sharma, Karun, et al.
Pubblicazione: (2026)
di: Sharma, Karun, et al.
Pubblicazione: (2026)
STaR-KV: Spatio-Temporal Adaptive Re-weighting for KV Cache Compression in GUI Vision-Language Models
di: Han, Yuhang, et al.
Pubblicazione: (2026)
di: Han, Yuhang, et al.
Pubblicazione: (2026)
Large Language Model Reasoning Failures
di: Song, Peiyang, et al.
Pubblicazione: (2026)
di: Song, Peiyang, et al.
Pubblicazione: (2026)
Resolving Intent Ambiguities by Retrieving Discriminative Clarifying Questions
di: Dhole, Kaustubh D.
Pubblicazione: (2020)
di: Dhole, Kaustubh D.
Pubblicazione: (2020)
STaR: Towards Effective and Stable Table Reasoning via Slow-Thinking Large Language Models
di: Zhang, Huajian, et al.
Pubblicazione: (2025)
di: Zhang, Huajian, et al.
Pubblicazione: (2025)
Asking the Right Question at the Right Time: Human and Model Uncertainty Guidance to Ask Clarification Questions
di: Testoni, Alberto, et al.
Pubblicazione: (2024)
di: Testoni, Alberto, et al.
Pubblicazione: (2024)
Effective Explanations Support Planning Under Uncertainty
di: Zhou, Hanqi, et al.
Pubblicazione: (2026)
di: Zhou, Hanqi, et al.
Pubblicazione: (2026)
Rephrase and Respond: Let Large Language Models Ask Better Questions for Themselves
di: Deng, Yihe, et al.
Pubblicazione: (2023)
di: Deng, Yihe, et al.
Pubblicazione: (2023)
Is Child-Directed Speech Effective Training Data for Language Models?
di: Feng, Steven Y., et al.
Pubblicazione: (2024)
di: Feng, Steven Y., et al.
Pubblicazione: (2024)
Fast Quiet-STaR: Thinking Without Thought Tokens
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
STaRR: Spatial-Temporal Token-Dynamics-Aware Responsive Remasking for Diffusion Language Models
di: Sun, Xinhao, et al.
Pubblicazione: (2025)
di: Sun, Xinhao, et al.
Pubblicazione: (2025)
STaR-DRO: Stateful Tsallis Reweighting for Group-Robust Structured Prediction
di: Fodeh, Samah, et al.
Pubblicazione: (2026)
di: Fodeh, Samah, et al.
Pubblicazione: (2026)
CriticAL: Critic Automation with Language Models
di: Li, Michael Y., et al.
Pubblicazione: (2024)
di: Li, Michael Y., et al.
Pubblicazione: (2024)
TO-GATE: Clarifying Questions and Summarizing Responses with Trajectory Optimization for Eliciting Human Preference
di: Dou, Yulin, et al.
Pubblicazione: (2025)
di: Dou, Yulin, et al.
Pubblicazione: (2025)
STaR: Scalable Task-Conditioned Retrieval for Long-Horizon Multimodal Robot Memory
di: Yuan, Mingfeng, et al.
Pubblicazione: (2026)
di: Yuan, Mingfeng, et al.
Pubblicazione: (2026)
GATE X-E : A Challenge Set for Gender-Fair Translations from Weakly-Gendered Languages
di: Rarrick, Spencer, et al.
Pubblicazione: (2024)
di: Rarrick, Spencer, et al.
Pubblicazione: (2024)
Ask more, know better: Reinforce-Learned Prompt Questions for Decision Making with Large Language Models
di: Yan, Xue, et al.
Pubblicazione: (2023)
di: Yan, Xue, et al.
Pubblicazione: (2023)
RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
Psychometric Alignment: Capturing Human Knowledge Distributions via Language Models
di: He-Yueya, Joy, et al.
Pubblicazione: (2024)
di: He-Yueya, Joy, et al.
Pubblicazione: (2024)
AdaSTaR: Adaptive Data Sampling for Training Self-Taught Reasoners
di: Koh, Woosung, et al.
Pubblicazione: (2025)
di: Koh, Woosung, et al.
Pubblicazione: (2025)
Hypothesis Search: Inductive Reasoning with Language Models
di: Wang, Ruocheng, et al.
Pubblicazione: (2023)
di: Wang, Ruocheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
di: Zelikman, Eric, et al.
Pubblicazione: (2024) -
Kwai-STaR: Transform LLMs into State-Transition Reasoners
di: Lu, Xingyu, et al.
Pubblicazione: (2024) -
V-STaR: Training Verifiers for Self-Taught Reasoners
di: Hosseini, Arian, et al.
Pubblicazione: (2024) -
B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners
di: Zeng, Weihao, et al.
Pubblicazione: (2024) -
Procedural Dilemma Generation for Evaluating Moral Reasoning in Humans and Language Models
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)