SEAL: Steerable Reasoning Calibration of Large Language Models for Free
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Runjin, Zhang, Zhenyu, Hong, Junyuan, Kundu, Souvik, Wang, Zhangyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLMs Can Get "Brain Rot": A Pilot Study on Twitter/X
di: Xing, Shuo, et al.
Pubblicazione: (2025)
di: Xing, Shuo, et al.
Pubblicazione: (2025)
LoX: Low-Rank Extrapolation Robustifies LLM Safety Against Fine-tuning
di: Perin, Gabriel J., et al.
Pubblicazione: (2025)
di: Perin, Gabriel J., et al.
Pubblicazione: (2025)
DP-OPT: Make Large Language Model Your Privacy-Preserving Prompt Engineer
di: Hong, Junyuan, et al.
Pubblicazione: (2023)
di: Hong, Junyuan, et al.
Pubblicazione: (2023)
MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
Evaluating the Prompt Steerability of Large Language Models
di: Miehling, Erik, et al.
Pubblicazione: (2024)
di: Miehling, Erik, et al.
Pubblicazione: (2024)
Extracting and Understanding the Superficial Knowledge in Alignment
di: Chen, Runjin, et al.
Pubblicazione: (2025)
di: Chen, Runjin, et al.
Pubblicazione: (2025)
AI Steerability 360: A Toolkit for Steering Large Language Models
di: Miehling, Erik, et al.
Pubblicazione: (2026)
di: Miehling, Erik, et al.
Pubblicazione: (2026)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language Models
di: Kim, Woojin, et al.
Pubblicazione: (2026)
di: Kim, Woojin, et al.
Pubblicazione: (2026)
LaMDA: Large Model Fine-Tuning via Spectrally Decomposed Low-Dimensional Adaptation
di: Azizi, Seyedarmin, et al.
Pubblicazione: (2024)
di: Azizi, Seyedarmin, et al.
Pubblicazione: (2024)
Framing Effects in Independent-Agent Large Language Models: A Cross-Family Behavioral Analysis
di: Wang, Zice, et al.
Pubblicazione: (2026)
di: Wang, Zice, et al.
Pubblicazione: (2026)
Large Language Models Are Neurosymbolic Reasoners
di: Fang, Meng, et al.
Pubblicazione: (2024)
di: Fang, Meng, et al.
Pubblicazione: (2024)
Scaling Textual Gradients via Sampling-Based Momentum
di: Ding, Zixin, et al.
Pubblicazione: (2025)
di: Ding, Zixin, et al.
Pubblicazione: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2024)
di: Liu, Han, et al.
Pubblicazione: (2024)
Fantastic Reasoning Behaviors and Where to Find Them: Unsupervised Discovery of the Reasoning Process
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
Calibrating Reasoning in Language Models with Internal Consistency
di: Xie, Zhihui, et al.
Pubblicazione: (2024)
di: Xie, Zhihui, et al.
Pubblicazione: (2024)
ChemATP: A Training-Free Chemical Reasoning Framework for Large Language Models
di: Zhang, Mingxu, et al.
Pubblicazione: (2025)
di: Zhang, Mingxu, et al.
Pubblicazione: (2025)
Calibrating Verbalized Probabilities for Large Language Models
di: Wang, Cheng, et al.
Pubblicazione: (2024)
di: Wang, Cheng, et al.
Pubblicazione: (2024)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
Are Large Language Models Good Essay Graders?
di: Kundu, Anindita, et al.
Pubblicazione: (2024)
di: Kundu, Anindita, et al.
Pubblicazione: (2024)
Correct Answers from Sound Reasoning: Verifiable Process Supervision for Language Models
di: Kim, Kyuyoung, et al.
Pubblicazione: (2026)
di: Kim, Kyuyoung, et al.
Pubblicazione: (2026)
SocREval: Large Language Models with the Socratic Method for Reference-Free Reasoning Evaluation
di: He, Hangfeng, et al.
Pubblicazione: (2023)
di: He, Hangfeng, et al.
Pubblicazione: (2023)
VL-Calibration: Decoupled Confidence Calibration for Large Vision-Language Models Reasoning
di: Xiao, Wenyi, et al.
Pubblicazione: (2026)
di: Xiao, Wenyi, et al.
Pubblicazione: (2026)
CITER: Collaborative Inference for Efficient Large Language Model Decoding with Token-Level Routing
di: Zheng, Wenhao, et al.
Pubblicazione: (2025)
di: Zheng, Wenhao, et al.
Pubblicazione: (2025)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
di: Xu, Fengli, et al.
Pubblicazione: (2025)
di: Xu, Fengli, et al.
Pubblicazione: (2025)
MONICA: Real-Time Monitoring and Calibration of Chain-of-Thought Sycophancy in Large Reasoning Models
di: Hu, Jingyu, et al.
Pubblicazione: (2025)
di: Hu, Jingyu, et al.
Pubblicazione: (2025)
A Survey of Inductive Reasoning for Large Language Models
di: Chen, Kedi, et al.
Pubblicazione: (2025)
di: Chen, Kedi, et al.
Pubblicazione: (2025)
Large Language Models as an Indirect Reasoner: Contrapositive and Contradiction for Automated Reasoning
di: Zhang, Yanfang, et al.
Pubblicazione: (2024)
di: Zhang, Yanfang, et al.
Pubblicazione: (2024)
Emotion Concepts and their Function in a Large Language Model
di: Sofroniew, Nicholas, et al.
Pubblicazione: (2026)
di: Sofroniew, Nicholas, et al.
Pubblicazione: (2026)
A Closer Look at the Self-Verification Abilities of Large Language Models in Logical Reasoning
di: Hong, Ruixin, et al.
Pubblicazione: (2023)
di: Hong, Ruixin, et al.
Pubblicazione: (2023)
Premise Order Matters in Reasoning with Large Language Models
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
Attention-Aligned Reasoning for Large Language Models
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025)
di: Zhang, Hongxiang, et al.
Pubblicazione: (2025)
A Survey of Confidence Estimation and Calibration in Large Language Models
di: Geng, Jiahui, et al.
Pubblicazione: (2023)
di: Geng, Jiahui, et al.
Pubblicazione: (2023)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
Credence Calibration Game? Calibrating Large Language Models through Structured Play
di: Fang, Ke, et al.
Pubblicazione: (2025)
di: Fang, Ke, et al.
Pubblicazione: (2025)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
di: Wang, Yajing, et al.
Pubblicazione: (2024)
di: Wang, Yajing, et al.
Pubblicazione: (2024)
Agentic Reasoning for Large Language Models
di: Wei, Tianxin, et al.
Pubblicazione: (2026)
di: Wei, Tianxin, et al.
Pubblicazione: (2026)
Tool Calling is Linearly Readable and Steerable in Language Models
di: Wu, Zekun, et al.
Pubblicazione: (2026)
di: Wu, Zekun, et al.
Pubblicazione: (2026)
SEAL: Speaker Error Correction using Acoustic-conditioned Large Language Models
di: Kumar, Anurag, et al.
Pubblicazione: (2025)
di: Kumar, Anurag, et al.
Pubblicazione: (2025)
PortLLM: Personalizing Evolving Large Language Models with Training-Free and Portable Model Patches
di: Khan, Rana Muhammad Shahroz, et al.
Pubblicazione: (2024)
di: Khan, Rana Muhammad Shahroz, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LLMs Can Get "Brain Rot": A Pilot Study on Twitter/X
di: Xing, Shuo, et al.
Pubblicazione: (2025) -
LoX: Low-Rank Extrapolation Robustifies LLM Safety Against Fine-tuning
di: Perin, Gabriel J., et al.
Pubblicazione: (2025) -
DP-OPT: Make Large Language Model Your Privacy-Preserving Prompt Engineer
di: Hong, Junyuan, et al.
Pubblicazione: (2023) -
MedHallu: A Comprehensive Benchmark for Detecting Medical Hallucinations in Large Language Models
di: Pandit, Shrey, et al.
Pubblicazione: (2025) -
Evaluating the Prompt Steerability of Large Language Models
di: Miehling, Erik, et al.
Pubblicazione: (2024)