R-Tuning: Instructing Large Language Models to Say `I Don't Know'
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Hanning, Diao, Shizhe, Lin, Yong, Fung, Yi R., Lian, Qing, Wang, Xingyao, Chen, Yangyi, Ji, Heng, Zhang, Tong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SaySelf: Teaching LLMs to Express Confidence with Self-Reflective Rationales
por: Xu, Tianyang, et al.
Publicado: (2024)
por: Xu, Tianyang, et al.
Publicado: (2024)
Honest AI: Fine-Tuning "Small" Language Models to Say "I Don't Know", and Reducing Hallucination in RAG
por: Chen, Xinxi, et al.
Publicado: (2024)
por: Chen, Xinxi, et al.
Publicado: (2024)
What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When to Say "I Don't Know"
por: Lee, Joosung, et al.
Publicado: (2026)
por: Lee, Joosung, et al.
Publicado: (2026)
When You Don't Know the Answer, Say So
Publicado: (2024)
Publicado: (2024)
Decomposed Prompting Does Not Fix Knowledge Gaps, But Helps Models Say "I Don't Know"
por: Madhwal, Dhruv, et al.
Publicado: (2026)
por: Madhwal, Dhruv, et al.
Publicado: (2026)
What Language Models Know But Don't Say: Non-Generative Prior Extraction for Generalization
por: Rezaeimanesh, Sara, et al.
Publicado: (2026)
por: Rezaeimanesh, Sara, et al.
Publicado: (2026)
SOLO: A Single Transformer for Scalable Vision-Language Modeling
por: Chen, Yangyi, et al.
Publicado: (2024)
por: Chen, Yangyi, et al.
Publicado: (2024)
When Robots Should Say "I Don't Know": Benchmarking Abstention in Embodied Question Answering
por: Wu, Tao, et al.
Publicado: (2025)
por: Wu, Tao, et al.
Publicado: (2025)
DRESS: Instructing Large Vision-Language Models to Align and Interact with Humans via Natural Language Feedback
por: Chen, Yangyi, et al.
Publicado: (2023)
por: Chen, Yangyi, et al.
Publicado: (2023)
Large Language Models Must Be Taught to Know What They Don't Know
por: Kapoor, Sanyam, et al.
Publicado: (2024)
por: Kapoor, Sanyam, et al.
Publicado: (2024)
CRAFT: Customizing LLMs by Creating and Retrieving from Specialized Toolsets
por: Yuan, Lifan, et al.
Publicado: (2023)
por: Yuan, Lifan, et al.
Publicado: (2023)
Physicists Don't Know What They're Talking About When They Say 'Order'
por: Arafat Gaspar Jiménez Gaistardo
Publicado: (2025)
por: Arafat Gaspar Jiménez Gaistardo
Publicado: (2025)
Active Prompting with Chain-of-Thought for Large Language Models
por: Diao, Shizhe, et al.
Publicado: (2023)
por: Diao, Shizhe, et al.
Publicado: (2023)
Do Retrieval Augmented Language Models Know When They Don't Know?
por: Zhou, Youchao, et al.
Publicado: (2025)
por: Zhou, Youchao, et al.
Publicado: (2025)
Don't Just Say "I don't know"! Self-aligning Large Language Models for Responding to Unknown Questions with Explanations
por: Deng, Yang, et al.
Publicado: (2024)
por: Deng, Yang, et al.
Publicado: (2024)
Can AI Assistants Know What They Don't Know?
por: Cheng, Qinyuan, et al.
Publicado: (2024)
por: Cheng, Qinyuan, et al.
Publicado: (2024)
LISA: Layerwise Importance Sampling for Memory-Efficient Large Language Model Fine-Tuning
por: Pan, Rui, et al.
Publicado: (2024)
por: Pan, Rui, et al.
Publicado: (2024)
Knowing What You Know Is Not Enough: Large Language Model Confidences Don't Align With Their Actions
por: Pal, Arka, et al.
Publicado: (2025)
por: Pal, Arka, et al.
Publicado: (2025)
Don't Say No: Jailbreaking LLM by Suppressing Refusal
por: Zhou, Yukai, et al.
Publicado: (2024)
por: Zhou, Yukai, et al.
Publicado: (2024)
Who Says We Don't Need Catalogers?
por: Bishoff, Lizbeth J.
Publicado: (1987)
por: Bishoff, Lizbeth J.
Publicado: (1987)
Prioritizing Image-Related Tokens Enhances Vision-Language Pre-Training
por: Chen, Yangyi, et al.
Publicado: (2025)
por: Chen, Yangyi, et al.
Publicado: (2025)
The Instinctive Bias: Spurious Images lead to Illusion in MLLMs
por: Han, Tianyang, et al.
Publicado: (2024)
por: Han, Tianyang, et al.
Publicado: (2024)
Fine-Tuned LLMs Know They Don't Know: A Parameter-Efficient Approach to Recovering Honesty
por: Shi, Zeyu, et al.
Publicado: (2025)
por: Shi, Zeyu, et al.
Publicado: (2025)
I Don't Know: Explicit Modeling of Uncertainty with an [IDK] Token
por: Cohen, Roi, et al.
Publicado: (2024)
por: Cohen, Roi, et al.
Publicado: (2024)
Experts Don't Cheat: Learning What You Don't Know By Predicting Pairs
por: Johnson, Daniel D., et al.
Publicado: (2024)
por: Johnson, Daniel D., et al.
Publicado: (2024)
Imagining What We Don't Know
por: Samuels, Lisa
Publicado: (2026)
por: Samuels, Lisa
Publicado: (2026)
Imagining What We Don't Know
por: Samuels, Lisa
Publicado: (2026)
por: Samuels, Lisa
Publicado: (2026)
Entropy-Regularized Process Reward Model
por: Zhang, Hanning, et al.
Publicado: (2024)
por: Zhang, Hanning, et al.
Publicado: (2024)
Knowing You Don't Know: Learning When to Continue Search in Multi-round RAG through Self-Practicing
por: Yang, Diji, et al.
Publicado: (2025)
por: Yang, Diji, et al.
Publicado: (2025)
Reasoning Models Don't Always Say What They Think
por: Chen, Yanda, et al.
Publicado: (2025)
por: Chen, Yanda, et al.
Publicado: (2025)
Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?
por: Mei, Zhiting, et al.
Publicado: (2025)
por: Mei, Zhiting, et al.
Publicado: (2025)
EpiCaR: Knowing What You Don't Know Matters for Better Reasoning in LLMs
por: Yeom, Jewon, et al.
Publicado: (2026)
por: Yeom, Jewon, et al.
Publicado: (2026)
'Show It, Don't Just Say It': The Complementary Effects of Instruction Multimodality for Software Guidance
por: Poh, Emran, et al.
Publicado: (2026)
por: Poh, Emran, et al.
Publicado: (2026)
"Don't Look, But I Know You Do": Norms and Observer Effects in Shared LLM Accounts
por: Song, Ji Eun, et al.
Publicado: (2026)
por: Song, Ji Eun, et al.
Publicado: (2026)
Coding Agents Don't Know When to Act
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
por: Gloaguen, Thibaud, et al.
Publicado: (2026)
I Know What I Don't Know: Latent Posterior Factor Models for Multi-Evidence Probabilistic Reasoning
por: Alege, Aliyu Agboola
Publicado: (2026)
por: Alege, Aliyu Agboola
Publicado: (2026)
Implicit Intelligence -- Evaluating Agents on What Users Don't Say
por: Sirdeshmukh, Ved, et al.
Publicado: (2026)
por: Sirdeshmukh, Ved, et al.
Publicado: (2026)
Visually Dehallucinative Instruction Generation: Know What You Don't Know
por: Cha, Sungguk, et al.
Publicado: (2024)
por: Cha, Sungguk, et al.
Publicado: (2024)
Don't Just Fine-tune the Agent, Tune the Environment
por: Lu, Siyuan, et al.
Publicado: (2025)
por: Lu, Siyuan, et al.
Publicado: (2025)
MINT: Evaluating LLMs in Multi-turn Interaction with Tools and Language Feedback
por: Wang, Xingyao, et al.
Publicado: (2023)
por: Wang, Xingyao, et al.
Publicado: (2023)
Ejemplares similares
-
SaySelf: Teaching LLMs to Express Confidence with Self-Reflective Rationales
por: Xu, Tianyang, et al.
Publicado: (2024) -
Honest AI: Fine-Tuning "Small" Language Models to Say "I Don't Know", and Reducing Hallucination in RAG
por: Chen, Xinxi, et al.
Publicado: (2024) -
What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When to Say "I Don't Know"
por: Lee, Joosung, et al.
Publicado: (2026) -
When You Don't Know the Answer, Say So
Publicado: (2024) -
Decomposed Prompting Does Not Fix Knowledge Gaps, But Helps Models Say "I Don't Know"
por: Madhwal, Dhruv, et al.
Publicado: (2026)