MASH: Modeling Abstention via Selective Help-Seeking
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gul, Mustafa Omer, Cardie, Claire, Goyal, Tanya |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Updating Parametric Knowledge with Context Distillation Retains Post-Training Capabilities
von: Padmanabhan, Shankar, et al.
Veröffentlicht: (2026)
von: Padmanabhan, Shankar, et al.
Veröffentlicht: (2026)
Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards
von: Su, Jinyan, et al.
Veröffentlicht: (2025)
von: Su, Jinyan, et al.
Veröffentlicht: (2025)
Knowing but Not Showing: LLMs Recognize Ambiguity but Rarely Ask Clarifying Questions
von: Su, Jinyan, et al.
Veröffentlicht: (2026)
von: Su, Jinyan, et al.
Veröffentlicht: (2026)
Reasoning Court: Combining Reasoning, Action, and Judgment for Multi-Hop Reasoning
von: Wu, Jingtian, et al.
Veröffentlicht: (2025)
von: Wu, Jingtian, et al.
Veröffentlicht: (2025)
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)
Adapting Fake News Detection to the Era of Large Language Models
von: Su, Jinyan, et al.
Veröffentlicht: (2023)
von: Su, Jinyan, et al.
Veröffentlicht: (2023)
CLIPer: Tailoring Diverse User Preference via Classifier-Guided Inference-Time Personalization
von: Su, Jinyan, et al.
Veröffentlicht: (2026)
von: Su, Jinyan, et al.
Veröffentlicht: (2026)
CoGen: Learning from Feedback with Coupled Comprehension and Generation
von: Gul, Mustafa Omer, et al.
Veröffentlicht: (2024)
von: Gul, Mustafa Omer, et al.
Veröffentlicht: (2024)
Bootstrapping Post-training Signals for Open-ended Tasks via Rubric-based Self-play on Pre-training Text
von: Huang, Chengyu, et al.
Veröffentlicht: (2026)
von: Huang, Chengyu, et al.
Veröffentlicht: (2026)
Selective "Selective Prediction": Reducing Unnecessary Abstention in Vision-Language Reasoning
von: Srinivasan, Tejas, et al.
Veröffentlicht: (2024)
von: Srinivasan, Tejas, et al.
Veröffentlicht: (2024)
Better LLM Reasoning via Dual-Play
von: Zhang, Zhengxin, et al.
Veröffentlicht: (2025)
von: Zhang, Zhengxin, et al.
Veröffentlicht: (2025)
Token-weighted Direct Preference Optimization with Attention
von: Huang, Chengyu, et al.
Veröffentlicht: (2026)
von: Huang, Chengyu, et al.
Veröffentlicht: (2026)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
von: Su, Jinyan, et al.
Veröffentlicht: (2025)
von: Su, Jinyan, et al.
Veröffentlicht: (2025)
WildHallucinations: Evaluating Long-form Factuality in LLMs with Real-World Entity Queries
von: Zhao, Wenting, et al.
Veröffentlicht: (2024)
von: Zhao, Wenting, et al.
Veröffentlicht: (2024)
I Could've Asked That: Reformulating Unanswerable Questions
von: Zhao, Wenting, et al.
Veröffentlicht: (2024)
von: Zhao, Wenting, et al.
Veröffentlicht: (2024)
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
von: Zeng, Hang, et al.
Veröffentlicht: (2026)
von: Zeng, Hang, et al.
Veröffentlicht: (2026)
Multi-Hop Question Answering: When Can Humans Help, and Where do They Struggle?
von: Su, Jinyan, et al.
Veröffentlicht: (2025)
von: Su, Jinyan, et al.
Veröffentlicht: (2025)
RefreshKV: Updating Small KV Cache During Long-form Generation
von: Xu, Fangyuan, et al.
Veröffentlicht: (2024)
von: Xu, Fangyuan, et al.
Veröffentlicht: (2024)
DCRM: A Heuristic to Measure Response Pair Quality in Preference Optimization
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)
WildChat: 1M ChatGPT Interaction Logs in the Wild
von: Zhao, Wenting, et al.
Veröffentlicht: (2024)
von: Zhao, Wenting, et al.
Veröffentlicht: (2024)
Are Triggers Needed for Document-Level Event Extraction?
von: Shaar, Shaden, et al.
Veröffentlicht: (2024)
von: Shaar, Shaden, et al.
Veröffentlicht: (2024)
Geometry-Calibrated Conformal Abstention for Language Models
von: Xu, Rui, et al.
Veröffentlicht: (2026)
von: Xu, Rui, et al.
Veröffentlicht: (2026)
Debate Helps Weak Judges Reward Stronger Models
von: Elasky, Ethan, et al.
Veröffentlicht: (2026)
von: Elasky, Ethan, et al.
Veröffentlicht: (2026)
Mitigating LLM Hallucinations via Conformal Abstention
von: Yadkori, Yasin Abbasi, et al.
Veröffentlicht: (2024)
von: Yadkori, Yasin Abbasi, et al.
Veröffentlicht: (2024)
Policy-Gradient Training of Language Models for Ranking
von: Gao, Ge, et al.
Veröffentlicht: (2023)
von: Gao, Ge, et al.
Veröffentlicht: (2023)
Memorization vs. Reasoning: Updating LLMs with New Knowledge
von: Li, Aochong Oliver, et al.
Veröffentlicht: (2025)
von: Li, Aochong Oliver, et al.
Veröffentlicht: (2025)
D2PO: Discriminator-Guided DPO with Response Evaluation Models
von: Singhal, Prasann, et al.
Veröffentlicht: (2024)
von: Singhal, Prasann, et al.
Veröffentlicht: (2024)
Know Your Limits: A Survey of Abstention in Large Language Models
von: Wen, Bingbing, et al.
Veröffentlicht: (2024)
von: Wen, Bingbing, et al.
Veröffentlicht: (2024)
MKA: Leveraging Cross-Lingual Consensus for Model Abstention
von: Duwal, Sharad
Veröffentlicht: (2025)
von: Duwal, Sharad
Veröffentlicht: (2025)
The Effect of Surprisal on Reading Times in Information Seeking and Repeated Reading
von: Klein, Keren Gruteke, et al.
Veröffentlicht: (2024)
von: Klein, Keren Gruteke, et al.
Veröffentlicht: (2024)
When to Speak, When to Abstain: Contrastive Decoding with Abstention
von: Kim, Hyuhng Joon, et al.
Veröffentlicht: (2024)
von: Kim, Hyuhng Joon, et al.
Veröffentlicht: (2024)
Do LLMs Know When to NOT Answer? Investigating Abstention Abilities of Large Language Models
von: Madhusudhan, Nishanth, et al.
Veröffentlicht: (2024)
von: Madhusudhan, Nishanth, et al.
Veröffentlicht: (2024)
M-HELP: Using Social Media Data to Detect Mental Health Help-Seeking Signals
von: Sathvik, MSVPJ, et al.
Veröffentlicht: (2025)
von: Sathvik, MSVPJ, et al.
Veröffentlicht: (2025)
Characterizing LLM Abstention Behavior in Science QA with Context Perturbations
von: Wen, Bingbing, et al.
Veröffentlicht: (2024)
von: Wen, Bingbing, et al.
Veröffentlicht: (2024)
Effective Skill Unlearning through Intervention and Abstention
von: Li, Yongce, et al.
Veröffentlicht: (2025)
von: Li, Yongce, et al.
Veröffentlicht: (2025)
Knowledge Graph Guided Evaluation of Abstention Techniques
von: Vasisht, Kinshuk, et al.
Veröffentlicht: (2024)
von: Vasisht, Kinshuk, et al.
Veröffentlicht: (2024)
A Long Way to Go: Investigating Length Correlations in RLHF
von: Singhal, Prasann, et al.
Veröffentlicht: (2023)
von: Singhal, Prasann, et al.
Veröffentlicht: (2023)
KnowGuard: Knowledge-Driven Abstention for Multi-Round Clinical Reasoning
von: Dang, Xilin, et al.
Veröffentlicht: (2025)
von: Dang, Xilin, et al.
Veröffentlicht: (2025)
GRACE: Reinforcement Learning for Grounded Response and Abstention under Contextual Evidence
von: Zhao, Yibo, et al.
Veröffentlicht: (2026)
von: Zhao, Yibo, et al.
Veröffentlicht: (2026)
Abstain-R1: Calibrated Abstention and Post-Refusal Clarification via Verifiable RL
von: Zhai, Skylar, et al.
Veröffentlicht: (2026)
von: Zhai, Skylar, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Updating Parametric Knowledge with Context Distillation Retains Post-Training Capabilities
von: Padmanabhan, Shankar, et al.
Veröffentlicht: (2026) -
Thinking Fast and Right: Balancing Accuracy and Reasoning Length with Adaptive Rewards
von: Su, Jinyan, et al.
Veröffentlicht: (2025) -
Knowing but Not Showing: LLMs Recognize Ambiguity but Rarely Ask Clarifying Questions
von: Su, Jinyan, et al.
Veröffentlicht: (2026) -
Reasoning Court: Combining Reasoning, Action, and Judgment for Multi-Hop Reasoning
von: Wu, Jingtian, et al.
Veröffentlicht: (2025) -
HAPO: Training Language Models to Reason Concisely via History-Aware Policy Optimization
von: Huang, Chengyu, et al.
Veröffentlicht: (2025)