Answer, Refuse, or Guess? Investigating Risk-Aware Decision Making in Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wu, Cheng-Kuang, Tam, Zhi Rui, Lin, Chieh-Yen, Chen, Yun-Nung, Lee, Hung-yi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
StreamBench: Towards Benchmarking Continuous Improvement of Language Agents
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2024)
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2024)
Language Matters: How Do Multilingual Input and Reasoning Paths Affect Large Reasoning Models?
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
I Need Help! Evaluating LLM's Ability to Ask for Users' Support: A Case Study on Text-to-SQL Generation
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024)
None of the Above, Less of the Right: Parallel Patterns between Humans and LLMs on Multi-Choice Questions Answering
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
MedVoiceBias: A Controlled Study of Audio LLM Behavior in Clinical Decision-Making
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
Mitigating Forgetting in LLM Fine-Tuning via Low-Perplexity Token Learning
von: Wu, Chao-Chung, et al.
Veröffentlicht: (2025)
von: Wu, Chao-Chung, et al.
Veröffentlicht: (2025)
On Calibration of Large Language Models: From Response To Capability
von: Yang, Sin-Han, et al.
Veröffentlicht: (2026)
von: Yang, Sin-Han, et al.
Veröffentlicht: (2026)
Expected Harm: Rethinking Safety Evaluation of (Mis)Aligned LLMs
von: Chen, Yen-Shan, et al.
Veröffentlicht: (2026)
von: Chen, Yen-Shan, et al.
Veröffentlicht: (2026)
VisTW: Benchmarking Vision-Language Models for Traditional Chinese in Taiwan
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)
DogeRM: Equipping Reward Models with Domain Knowledge through Model Merging
von: Lin, Tzu-Han, et al.
Veröffentlicht: (2024)
von: Lin, Tzu-Han, et al.
Veröffentlicht: (2024)
Transferring Textual Preferences to Vision-Language Understanding through Model Merging
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
InstructionCP: A fast approach to transfer Large Language Models into target language
von: Chen, Kuang-Ming, et al.
Veröffentlicht: (2024)
von: Chen, Kuang-Ming, et al.
Veröffentlicht: (2024)
AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning
von: Lin, Tzu-Han, et al.
Veröffentlicht: (2025)
von: Lin, Tzu-Han, et al.
Veröffentlicht: (2025)
Style Amnesia: Investigating Speaking Style Degradation and Mitigation in Multi-Turn Spoken Language Models
von: Lin, Yu-Xiang, et al.
Veröffentlicht: (2025)
von: Lin, Yu-Xiang, et al.
Veröffentlicht: (2025)
Investigating the Effects of Large-Scale Pseudo-Stereo Data and Different Speech Foundation Model on Dialogue Generative Spoken Language Model
von: Fu, Yu-Kuan, et al.
Veröffentlicht: (2024)
von: Fu, Yu-Kuan, et al.
Veröffentlicht: (2024)
Over-Reasoning and Redundant Calculation of Large Language Models
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
Teaching Audio-Aware Large Language Models What Does Not Hear: Mitigating Hallucinations through Synthesized Negative Samples
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2025)
Measuring Taiwanese Mandarin Language Understanding
von: Chen, Po-Heng, et al.
Veröffentlicht: (2024)
von: Chen, Po-Heng, et al.
Veröffentlicht: (2024)
Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts
von: Chen, Yi-Chang, et al.
Veröffentlicht: (2026)
von: Chen, Yi-Chang, et al.
Veröffentlicht: (2026)
AQUA-Bench: Beyond Finding Answers to Knowing When There Are None in Audio Question Answering
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2026)
von: Kuan, Chun-Yi, et al.
Veröffentlicht: (2026)
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2024)
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2024)
Creativity in LLM-based Multi-Agent Systems: A Survey
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2025)
von: Lin, Yi-Cheng, et al.
Veröffentlicht: (2025)
Advancing Large Language Models to Capture Varied Speaking Styles and Respond Properly in Spoken Conversations
von: Lin, Guan-Ting, et al.
Veröffentlicht: (2024)
von: Lin, Guan-Ting, et al.
Veröffentlicht: (2024)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
von: Hsu, Chan-Jan, et al.
Veröffentlicht: (2026)
von: Hsu, Chan-Jan, et al.
Veröffentlicht: (2026)
TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2025)
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2025)
MI-Fuse: Label Fusion for Unsupervised Domain Adaptation with Closed-Source Large-Audio Language Model
von: Huang, Hsiao-Ying, et al.
Veröffentlicht: (2025)
von: Huang, Hsiao-Ying, et al.
Veröffentlicht: (2025)
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
von: Hsueh, Cheng-Hsun, et al.
Veröffentlicht: (2024)
von: Hsueh, Cheng-Hsun, et al.
Veröffentlicht: (2024)
Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding
von: Hsu, Tzu-wen, et al.
Veröffentlicht: (2025)
von: Hsu, Tzu-wen, et al.
Veröffentlicht: (2025)
Second Guess: Detecting Uncertainty Through Abstention and Answer Stability in Small Language Models
von: Aravindan, Ashwath Vaithinathan, et al.
Veröffentlicht: (2026)
von: Aravindan, Ashwath Vaithinathan, et al.
Veröffentlicht: (2026)
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
von: Li, Chen-An, et al.
Veröffentlicht: (2025)
The Role of Exploration Modules in Small Language Models for Knowledge Graph Question Answering
von: Cheng, Yi-Jie, et al.
Veröffentlicht: (2025)
von: Cheng, Yi-Jie, et al.
Veröffentlicht: (2025)
Speech-IFEval: Evaluating Instruction-Following and Quantifying Catastrophic Forgetting in Speech-Aware Language Models
von: Lu, Ke-Han, et al.
Veröffentlicht: (2025)
von: Lu, Ke-Han, et al.
Veröffentlicht: (2025)
TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)
How Contrastive Decoding Enhances Large Audio Language Models?
von: Lin, Tzu-Quan, et al.
Veröffentlicht: (2026)
von: Lin, Tzu-Quan, et al.
Veröffentlicht: (2026)
SAKURA: On the Multi-hop Reasoning of Large Audio-Language Models Based on Speech and Audio Information
von: Yang, Chih-Kai, et al.
Veröffentlicht: (2025)
von: Yang, Chih-Kai, et al.
Veröffentlicht: (2025)
Merging Facts, Crafting Fallacies: Evaluating the Contradictory Nature of Aggregated Factual Claims in Long-Form Generations
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
von: Chiang, Cheng-Han, et al.
Veröffentlicht: (2024)
Rehearsing Answers to Probable Questions with Perspective-Taking
von: Shih, Yung-Yu, et al.
Veröffentlicht: (2024)
von: Shih, Yung-Yu, et al.
Veröffentlicht: (2024)
Exploring Personality-Aware Interactions in Salesperson Dialogue Agents
von: Cheng, Sijia, et al.
Veröffentlicht: (2025)
von: Cheng, Sijia, et al.
Veröffentlicht: (2025)
Hearing the Order: Investigating Position Bias in Large Audio-Language Models
von: Lin, Yu-Xiang, et al.
Veröffentlicht: (2025)
von: Lin, Yu-Xiang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
StreamBench: Towards Benchmarking Continuous Improvement of Language Agents
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024) -
Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2024) -
Language Matters: How Do Multilingual Input and Reasoning Paths Affect Large Reasoning Models?
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025) -
I Need Help! Evaluating LLM's Ability to Ask for Users' Support: A Case Study on Text-to-SQL Generation
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2024) -
None of the Above, Less of the Right: Parallel Patterns between Humans and LLMs on Multi-Choice Questions Answering
von: Tam, Zhi Rui, et al.
Veröffentlicht: (2025)