Reliable Control-Point Selection for Steering Reasoning in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhuang, Haomin, Yoo, Hojun, Luo, Xiaonan, Guo, Kehan, Zhang, Xiangliang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Social Science Meets LLMs: How Reliable Are Large Language Models in Social Simulations?
von: Huang, Yue, et al.
Veröffentlicht: (2024)
von: Huang, Yue, et al.
Veröffentlicht: (2024)
Dual Optimal: Make Your LLM Peer-like with Dignity
von: Wang, Xiangqi, et al.
Veröffentlicht: (2026)
von: Wang, Xiangqi, et al.
Veröffentlicht: (2026)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
von: Zhuang, Haomin, et al.
Veröffentlicht: (2024)
von: Zhuang, Haomin, et al.
Veröffentlicht: (2024)
Causally-Enhanced Reinforcement Policy Optimization
von: Wang, Xiangqi, et al.
Veröffentlicht: (2025)
von: Wang, Xiangqi, et al.
Veröffentlicht: (2025)
Dissecting Logical Reasoning in LLMs: A Fine-Grained Evaluation and Supervision Study
von: Zhou, Yujun, et al.
Veröffentlicht: (2025)
von: Zhou, Yujun, et al.
Veröffentlicht: (2025)
Exploring Multi-Temperature Strategies for Token- and Rollout-Level Control in RLVR
von: Zhuang, Haomin, et al.
Veröffentlicht: (2025)
von: Zhuang, Haomin, et al.
Veröffentlicht: (2025)
Better Datasets Start From RefineLab: Automatic Optimization for High-Quality Dataset Refinement
von: Luo, Xiaonan, et al.
Veröffentlicht: (2025)
von: Luo, Xiaonan, et al.
Veröffentlicht: (2025)
ChemOrch: Empowering LLMs with Chemical Intelligence via Synthetic Instructions
von: Huang, Yue, et al.
Veröffentlicht: (2025)
von: Huang, Yue, et al.
Veröffentlicht: (2025)
SocialMaze: A Benchmark for Evaluating Social Reasoning in Large Language Models
von: Xu, Zixiang, et al.
Veröffentlicht: (2025)
von: Xu, Zixiang, et al.
Veröffentlicht: (2025)
Steering off Course: Reliability Challenges in Steering Language Models
von: Da Silva, Patrick Queiroz, et al.
Veröffentlicht: (2025)
von: Da Silva, Patrick Queiroz, et al.
Veröffentlicht: (2025)
AdaReasoner: Adaptive Reasoning Enables More Flexible Thinking in Large Language Models
von: Wang, Xiangqi, et al.
Veröffentlicht: (2025)
von: Wang, Xiangqi, et al.
Veröffentlicht: (2025)
SAE-SSV: Supervised Steering in Sparse Representation Spaces for Reliable Control of Language Models
von: He, Zirui, et al.
Veröffentlicht: (2025)
von: He, Zirui, et al.
Veröffentlicht: (2025)
Aggregation of Reasoning: A Hierarchical Framework for Enhancing Answer Selection in Large Language Models
von: Yin, Zhangyue, et al.
Veröffentlicht: (2024)
von: Yin, Zhangyue, et al.
Veröffentlicht: (2024)
PolicyLLM: Towards Excellent Comprehension of Public Policy for Large Language Models
von: Bao, Han, et al.
Veröffentlicht: (2026)
von: Bao, Han, et al.
Veröffentlicht: (2026)
ScholarChemQA: Unveiling the Power of Language Models in Chemical Research Question Answering
von: Chen, Xiuying, et al.
Veröffentlicht: (2024)
von: Chen, Xiuying, et al.
Veröffentlicht: (2024)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
von: Xue, Boyang, et al.
Veröffentlicht: (2025)
von: Xue, Boyang, et al.
Veröffentlicht: (2025)
STU-PID: Steering Token Usage via PID Controller for Efficient Large Language Model Reasoning
von: Bharadwaj, Aryasomayajula Ram
Veröffentlicht: (2025)
von: Bharadwaj, Aryasomayajula Ram
Veröffentlicht: (2025)
Steering Large Language Models between Code Execution and Textual Reasoning
von: Chen, Yongchao, et al.
Veröffentlicht: (2024)
von: Chen, Yongchao, et al.
Veröffentlicht: (2024)
On the Reliability of Large Language Models for Causal Discovery
von: Feng, Tao, et al.
Veröffentlicht: (2024)
von: Feng, Tao, et al.
Veröffentlicht: (2024)
Controlling Large Language Model Agents with Entropic Activation Steering
von: Rahn, Nate, et al.
Veröffentlicht: (2024)
von: Rahn, Nate, et al.
Veröffentlicht: (2024)
Hybrid and Unitary PEFT for Resource-Efficient Large Language Models
von: Qi, Haomin, et al.
Veröffentlicht: (2025)
von: Qi, Haomin, et al.
Veröffentlicht: (2025)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
von: Cheng, Zifeng, et al.
Veröffentlicht: (2025)
von: Cheng, Zifeng, et al.
Veröffentlicht: (2025)
CogSteer: Cognition-Inspired Selective Layer Intervention for Efficiently Steering Large Language Models
von: Wang, Xintong, et al.
Veröffentlicht: (2024)
von: Wang, Xintong, et al.
Veröffentlicht: (2024)
DRQA: Dynamic Reasoning Quota Allocation for Controlling Overthinking in Reasoning Large Language Models
von: Yan, Kaiwen, et al.
Veröffentlicht: (2025)
von: Yan, Kaiwen, et al.
Veröffentlicht: (2025)
SeLaR: Selective Latent Reasoning in Large Language Models
von: Fu, Renyu, et al.
Veröffentlicht: (2026)
von: Fu, Renyu, et al.
Veröffentlicht: (2026)
AgentClick: A Skill-Based Human-in-the-Loop Review Layer for Terminal AI Agents
von: Zhuang, Haomin, et al.
Veröffentlicht: (2026)
von: Zhuang, Haomin, et al.
Veröffentlicht: (2026)
Prototype-Based Dynamic Steering for Large Language Models
von: Kayan, Ceyhun Efe, et al.
Veröffentlicht: (2025)
von: Kayan, Ceyhun Efe, et al.
Veröffentlicht: (2025)
Psychological Steering of Large Language Models
von: Blas, Leonardo, et al.
Veröffentlicht: (2026)
von: Blas, Leonardo, et al.
Veröffentlicht: (2026)
Decomposed On-Policy Distillation for Vision-Language Reasoning: Steering Gradients for Visual Grounding
von: Yoon, Hee Suk, et al.
Veröffentlicht: (2026)
von: Yoon, Hee Suk, et al.
Veröffentlicht: (2026)
Shaping the Safety Boundaries: Understanding and Defending Against Jailbreaks in Large Language Models
von: Gao, Lang, et al.
Veröffentlicht: (2024)
von: Gao, Lang, et al.
Veröffentlicht: (2024)
Evaluating Large Language Models with Psychometrics
von: Li, Yuan, et al.
Veröffentlicht: (2024)
von: Li, Yuan, et al.
Veröffentlicht: (2024)
Decomposing and Steering Functional Metacognition in Large Language Models
von: Li, Yanshi, et al.
Veröffentlicht: (2026)
von: Li, Yanshi, et al.
Veröffentlicht: (2026)
Integrating Chemistry Knowledge in Large Language Models via Prompt Engineering
von: Liu, Hongxuan, et al.
Veröffentlicht: (2024)
von: Liu, Hongxuan, et al.
Veröffentlicht: (2024)
Governance-Aware Hybrid Fine-Tuning for Multilingual Large Language Models
von: Qi, Haomin, et al.
Veröffentlicht: (2025)
von: Qi, Haomin, et al.
Veröffentlicht: (2025)
Guardian-as-an-Advisor: Advancing Next-Generation Guardian Models for Trustworthy LLMs
von: Huang, Yue, et al.
Veröffentlicht: (2026)
von: Huang, Yue, et al.
Veröffentlicht: (2026)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
Steering Vector Fields for Context-Aware Inference-Time Control in Large Language Models
von: Li, Jiaqian, et al.
Veröffentlicht: (2026)
von: Li, Jiaqian, et al.
Veröffentlicht: (2026)
Multi-chain Graph Refinement and Selection for Reliable Reasoning in Large Language Models
von: Yang, Yujiao, et al.
Veröffentlicht: (2025)
von: Yang, Yujiao, et al.
Veröffentlicht: (2025)
AALC: Large Language Model Efficient Reasoning via Adaptive Accuracy-Length Control
von: Li, Ruosen, et al.
Veröffentlicht: (2025)
von: Li, Ruosen, et al.
Veröffentlicht: (2025)
BenchmarkCards: Standardized Documentation for Large Language Model Benchmarks
von: Sokol, Anna, et al.
Veröffentlicht: (2024)
von: Sokol, Anna, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Social Science Meets LLMs: How Reliable Are Large Language Models in Social Simulations?
von: Huang, Yue, et al.
Veröffentlicht: (2024) -
Dual Optimal: Make Your LLM Peer-like with Dignity
von: Wang, Xiangqi, et al.
Veröffentlicht: (2026) -
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
von: Zhuang, Haomin, et al.
Veröffentlicht: (2024) -
Causally-Enhanced Reinforcement Policy Optimization
von: Wang, Xiangqi, et al.
Veröffentlicht: (2025) -
Dissecting Logical Reasoning in LLMs: A Fine-Grained Evaluation and Supervision Study
von: Zhou, Yujun, et al.
Veröffentlicht: (2025)