Teaching Large Language Models When Not to Know: Learning Temporal Critique for Ex-Ante Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ding, Chenlu, Wu, Jiancan, Luo, Yanchen, Liu, Zheyuan, Yuan, Yancheng, Wang, Xiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MLLMEraser: Achieving Test-Time Unlearning in Multimodal Large Language Models through Activation Steering
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
Delayed Feedback Modeling with Influence Functions
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
Unified Parameter-Efficient Unlearning for LLMs
di: Ding, Chenlu, et al.
Pubblicazione: (2024)
di: Ding, Chenlu, et al.
Pubblicazione: (2024)
Enhancing Temporal Sensitivity of Large Language Model for Recommendation with Counterfactual Tuning
di: Liu, Yutian, et al.
Pubblicazione: (2025)
di: Liu, Yutian, et al.
Pubblicazione: (2025)
Adaptive Self-supervised Robust Clustering for Unstructured Data with Unknown Cluster Number
di: Ding, Chen-Lu, et al.
Pubblicazione: (2024)
di: Ding, Chen-Lu, et al.
Pubblicazione: (2024)
Process Supervision via Verbal Critique Improves Reasoning in Large Language Models
di: Chen, Hao-Yuan
Pubblicazione: (2026)
di: Chen, Hao-Yuan
Pubblicazione: (2026)
Text-guided Diffusion Model for 3D Molecule Generation
di: Luo, Yanchen, et al.
Pubblicazione: (2024)
di: Luo, Yanchen, et al.
Pubblicazione: (2024)
Reasoning about Uncertainty: Do Reasoning Models Know When They Don't Know?
di: Mei, Zhiting, et al.
Pubblicazione: (2025)
di: Mei, Zhiting, et al.
Pubblicazione: (2025)
On Negative-aware Preference Optimization for Recommendation
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
KnowRL: Teaching Language Models to Know What They Know
di: Kale, Sahil, et al.
Pubblicazione: (2025)
di: Kale, Sahil, et al.
Pubblicazione: (2025)
Teaching Language Models to Critique via Reinforcement Learning
di: Xie, Zhihui, et al.
Pubblicazione: (2025)
di: Xie, Zhihui, et al.
Pubblicazione: (2025)
Base Models Know How to Reason, Thinking Models Learn When
di: Venhoff, Constantin, et al.
Pubblicazione: (2025)
di: Venhoff, Constantin, et al.
Pubblicazione: (2025)
Large Language Models Often Know When They Are Being Evaluated
di: Needham, Joe, et al.
Pubblicazione: (2025)
di: Needham, Joe, et al.
Pubblicazione: (2025)
CaRT: Teaching LLM Agents to Know When They Know Enough
di: Liu, Grace, et al.
Pubblicazione: (2025)
di: Liu, Grace, et al.
Pubblicazione: (2025)
Teaching Language Models to Reason with Tools
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
di: Li, Chengpeng, et al.
Pubblicazione: (2025)
Do Retrieval Augmented Language Models Know When They Don't Know?
di: Zhou, Youchao, et al.
Pubblicazione: (2025)
di: Zhou, Youchao, et al.
Pubblicazione: (2025)
Do Large Language Models Mentalize When They Teach?
di: Harootonian, Sevan K., et al.
Pubblicazione: (2026)
di: Harootonian, Sevan K., et al.
Pubblicazione: (2026)
Quantile Advantage Estimation: Stabilizing RLVR for LLM Reasoning
di: Wu, Junkang, et al.
Pubblicazione: (2025)
di: Wu, Junkang, et al.
Pubblicazione: (2025)
Self-Evolving Critique Abilities in Large Language Models
di: Tang, Zhengyang, et al.
Pubblicazione: (2025)
di: Tang, Zhengyang, et al.
Pubblicazione: (2025)
Does Your Reasoning Model Implicitly Know When to Stop Thinking?
di: Huang, Zixuan, et al.
Pubblicazione: (2026)
di: Huang, Zixuan, et al.
Pubblicazione: (2026)
Scaling Retrieval-Augmented Reasoning with Parallel Search and Explicit Merging
di: Liu, Jiabei, et al.
Pubblicazione: (2026)
di: Liu, Jiabei, et al.
Pubblicazione: (2026)
The Critique of Critique
di: Sun, Shichao, et al.
Pubblicazione: (2024)
di: Sun, Shichao, et al.
Pubblicazione: (2024)
CritiqueLLM: Towards an Informative Critique Generation Model for Evaluation of Large Language Model Generation
di: Ke, Pei, et al.
Pubblicazione: (2023)
di: Ke, Pei, et al.
Pubblicazione: (2023)
LookWise: Knowing When and Where to Look for Fine-Grained Visual Reasoning in Multimodal Large Language Models
di: Shen, Yuxiang, et al.
Pubblicazione: (2026)
di: Shen, Yuxiang, et al.
Pubblicazione: (2026)
Invariant Graph Learning Meets Information Bottleneck for Out-of-Distribution Generalization
di: Mao, Wenyu, et al.
Pubblicazione: (2024)
di: Mao, Wenyu, et al.
Pubblicazione: (2024)
Towards Agents That Know When They Don't Know: Uncertainty as a Control Signal for Structured Reasoning
di: Stoisser, Josefa Lia, et al.
Pubblicazione: (2025)
di: Stoisser, Josefa Lia, et al.
Pubblicazione: (2025)
When Models Know When They Do Not Know: Calibration, Cascading, and Cleaning
di: Hao, Chenjie, et al.
Pubblicazione: (2026)
di: Hao, Chenjie, et al.
Pubblicazione: (2026)
Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning
di: Li, Ang, et al.
Pubblicazione: (2025)
di: Li, Ang, et al.
Pubblicazione: (2025)
Epistemic Artificial Intelligence is Essential for Machine Learning Models to Truly 'Know When They Do Not Know'
di: Manchingal, Shireen Kudukkil, et al.
Pubblicazione: (2025)
di: Manchingal, Shireen Kudukkil, et al.
Pubblicazione: (2025)
Epistemic Deep Learning: Enabling Machine Learning Models to Know When They Do Not Know
di: Manchingal, Shireen Kudukkil
Pubblicazione: (2025)
di: Manchingal, Shireen Kudukkil
Pubblicazione: (2025)
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
Critique of Impure Reason: Unveiling the reasoning behaviour of medical Large Language Models
di: Sim, Shamus, et al.
Pubblicazione: (2024)
di: Sim, Shamus, et al.
Pubblicazione: (2024)
Knowing When Not to Answer: Abstention-Aware Scientific Reasoning
di: Abdaljalil, Samir, et al.
Pubblicazione: (2026)
di: Abdaljalil, Samir, et al.
Pubblicazione: (2026)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
di: Luo, Linhao, et al.
Pubblicazione: (2023)
di: Luo, Linhao, et al.
Pubblicazione: (2023)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
Customizing Language Models with Instance-wise LoRA for Sequential Recommendation
di: Kong, Xiaoyu, et al.
Pubblicazione: (2024)
di: Kong, Xiaoyu, et al.
Pubblicazione: (2024)
Computing Ex Ante Equilibrium in Heterogeneous Zero-Sum Team Games
di: Liu, Naming, et al.
Pubblicazione: (2024)
di: Liu, Naming, et al.
Pubblicazione: (2024)
Mixture of Reasonings: Teach Large Language Models to Reason with Adaptive Strategies
di: Xiong, Tao, et al.
Pubblicazione: (2025)
di: Xiong, Tao, et al.
Pubblicazione: (2025)
When Do Symbolic Solvers Enhance Reasoning in Large Language Models?
di: He, Zhiyuan, et al.
Pubblicazione: (2025)
di: He, Zhiyuan, et al.
Pubblicazione: (2025)
When Models Learn to Ask Why: Adaptive Causal Reasoning for Trustworthy Medical Vision-Language Models
di: Lin, Jianxin, et al.
Pubblicazione: (2026)
di: Lin, Jianxin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MLLMEraser: Achieving Test-Time Unlearning in Multimodal Large Language Models through Activation Steering
di: Ding, Chenlu, et al.
Pubblicazione: (2025) -
Delayed Feedback Modeling with Influence Functions
di: Ding, Chenlu, et al.
Pubblicazione: (2025) -
Unified Parameter-Efficient Unlearning for LLMs
di: Ding, Chenlu, et al.
Pubblicazione: (2024) -
Enhancing Temporal Sensitivity of Large Language Model for Recommendation with Counterfactual Tuning
di: Liu, Yutian, et al.
Pubblicazione: (2025) -
Adaptive Self-supervised Robust Clustering for Unstructured Data with Unknown Cluster Number
di: Ding, Chen-Lu, et al.
Pubblicazione: (2024)