Prototype-Based Dynamic Steering for Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kayan, Ceyhun Efe, Zhang, Li |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A Reality Check of Language Models as Formalizers on Constraint Satisfaction Problems
von: Amonkar, Rikhil, et al.
Veröffentlicht: (2025)
von: Amonkar, Rikhil, et al.
Veröffentlicht: (2025)
Decomposing and Steering Functional Metacognition in Large Language Models
von: Li, Yanshi, et al.
Veröffentlicht: (2026)
von: Li, Yanshi, et al.
Veröffentlicht: (2026)
Psychological Steering of Large Language Models
von: Blas, Leonardo, et al.
Veröffentlicht: (2026)
von: Blas, Leonardo, et al.
Veröffentlicht: (2026)
Prompt-Based Value Steering of Large Language Models
von: Abbo, Giulio Antonio, et al.
Veröffentlicht: (2025)
von: Abbo, Giulio Antonio, et al.
Veröffentlicht: (2025)
LF-Steering: Latent Feature Activation Steering for Enhancing Semantic Consistency in Large Language Models
von: Yang, Jingyuan, et al.
Veröffentlicht: (2025)
von: Yang, Jingyuan, et al.
Veröffentlicht: (2025)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
Compositional Steering of Large Language Models with Steering Tokens
von: Radevski, Gorjan, et al.
Veröffentlicht: (2026)
von: Radevski, Gorjan, et al.
Veröffentlicht: (2026)
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
von: Sharma, Kartik, et al.
Veröffentlicht: (2026)
von: Sharma, Kartik, et al.
Veröffentlicht: (2026)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
von: Cheng, Zifeng, et al.
Veröffentlicht: (2025)
von: Cheng, Zifeng, et al.
Veröffentlicht: (2025)
Style Vectors for Steering Generative Large Language Model
von: Konen, Kai, et al.
Veröffentlicht: (2024)
von: Konen, Kai, et al.
Veröffentlicht: (2024)
Mechanistic Indicators of Steering Effectiveness in Large Language Models
von: Jafari, Mehdi, et al.
Veröffentlicht: (2026)
von: Jafari, Mehdi, et al.
Veröffentlicht: (2026)
Beyond Static Personas: Situational Personality Steering for Large Language Models
von: Wei, Zesheng, et al.
Veröffentlicht: (2026)
von: Wei, Zesheng, et al.
Veröffentlicht: (2026)
Reliable Control-Point Selection for Steering Reasoning in Large Language Models
von: Zhuang, Haomin, et al.
Veröffentlicht: (2026)
von: Zhuang, Haomin, et al.
Veröffentlicht: (2026)
Enhancing Cross-task Transfer of Large Language Models via Activation Steering
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
Model Whisper: Steering Vectors Unlock Large Language Models' Potential in Test-time
von: Kang, Xinyue, et al.
Veröffentlicht: (2025)
von: Kang, Xinyue, et al.
Veröffentlicht: (2025)
Steering Vector Fields for Context-Aware Inference-Time Control in Large Language Models
von: Li, Jiaqian, et al.
Veröffentlicht: (2026)
von: Li, Jiaqian, et al.
Veröffentlicht: (2026)
CogSteer: Cognition-Inspired Selective Layer Intervention for Efficiently Steering Large Language Models
von: Wang, Xintong, et al.
Veröffentlicht: (2024)
von: Wang, Xintong, et al.
Veröffentlicht: (2024)
Multi-property Steering of Large Language Models with Dynamic Activation Composition
von: Scalena, Daniel, et al.
Veröffentlicht: (2024)
von: Scalena, Daniel, et al.
Veröffentlicht: (2024)
Multilingual Political Views of Large Language Models: Identification and Steering
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2025)
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2025)
Controlling Large Language Model Agents with Entropic Activation Steering
von: Rahn, Nate, et al.
Veröffentlicht: (2024)
von: Rahn, Nate, et al.
Veröffentlicht: (2024)
Evaluating Large Language Model Biases in Persona-Steered Generation
von: Liu, Andy, et al.
Veröffentlicht: (2024)
von: Liu, Andy, et al.
Veröffentlicht: (2024)
FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models
von: Weng, Zixuan, et al.
Veröffentlicht: (2026)
von: Weng, Zixuan, et al.
Veröffentlicht: (2026)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
von: Cao, Yuanpu, et al.
Veröffentlicht: (2024)
von: Cao, Yuanpu, et al.
Veröffentlicht: (2024)
FairSteer: Inference Time Debiasing for LLMs with Dynamic Activation Steering
von: Li, Yichen, et al.
Veröffentlicht: (2025)
von: Li, Yichen, et al.
Veröffentlicht: (2025)
Steering off Course: Reliability Challenges in Steering Language Models
von: Da Silva, Patrick Queiroz, et al.
Veröffentlicht: (2025)
von: Da Silva, Patrick Queiroz, et al.
Veröffentlicht: (2025)
Differentially Private Steering for Large Language Model Alignment
von: Goel, Anmol, et al.
Veröffentlicht: (2025)
von: Goel, Anmol, et al.
Veröffentlicht: (2025)
Steering Large Language Models to Evaluate and Amplify Creativity
von: Olson, Matthew Lyle, et al.
Veröffentlicht: (2024)
von: Olson, Matthew Lyle, et al.
Veröffentlicht: (2024)
Corpus-Steered Query Expansion with Large Language Models
von: Lei, Yibin, et al.
Veröffentlicht: (2024)
von: Lei, Yibin, et al.
Veröffentlicht: (2024)
Steering Large Language Models with Register Analysis for Arbitrary Style Transfer
von: Yang, Xinchen, et al.
Veröffentlicht: (2025)
von: Yang, Xinchen, et al.
Veröffentlicht: (2025)
Steering Large Language Models between Code Execution and Textual Reasoning
von: Chen, Yongchao, et al.
Veröffentlicht: (2024)
von: Chen, Yongchao, et al.
Veröffentlicht: (2024)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
von: Xiang, Hao, et al.
Veröffentlicht: (2024)
von: Xiang, Hao, et al.
Veröffentlicht: (2024)
Steering Conversational Large Language Models for Long Emotional Support Conversations
von: Madani, Navid, et al.
Veröffentlicht: (2024)
von: Madani, Navid, et al.
Veröffentlicht: (2024)
Automata-Based Steering of Large Language Models for Diverse Structured Generation
von: Luan, Xiaokun, et al.
Veröffentlicht: (2025)
von: Luan, Xiaokun, et al.
Veröffentlicht: (2025)
Prism-$Δ$: Differential Subspace Steering for Prompt Highlighting in Large Language Models
von: Ge, Yuyao, et al.
Veröffentlicht: (2026)
von: Ge, Yuyao, et al.
Veröffentlicht: (2026)
Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models
von: Zhang, Hengyuan, et al.
Veröffentlicht: (2026)
von: Zhang, Hengyuan, et al.
Veröffentlicht: (2026)
The Cylindrical Representation Hypothesis for Language Model Steering
von: Gao, Lang, et al.
Veröffentlicht: (2026)
von: Gao, Lang, et al.
Veröffentlicht: (2026)
On Effects of Steering Latent Representation for Large Language Model Unlearning
von: Huu-Tien, Dang, et al.
Veröffentlicht: (2024)
von: Huu-Tien, Dang, et al.
Veröffentlicht: (2024)
Improved Representation Steering for Language Models
von: Wu, Zhengxuan, et al.
Veröffentlicht: (2025)
von: Wu, Zhengxuan, et al.
Veröffentlicht: (2025)
ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models
von: Guang, Jiahui, et al.
Veröffentlicht: (2026)
von: Guang, Jiahui, et al.
Veröffentlicht: (2026)
Generalization or Memorization: Dynamic Decoding for Mode Steering
von: Zhang, Xuanming
Veröffentlicht: (2025)
von: Zhang, Xuanming
Veröffentlicht: (2025)
Ähnliche Einträge
-
A Reality Check of Language Models as Formalizers on Constraint Satisfaction Problems
von: Amonkar, Rikhil, et al.
Veröffentlicht: (2025) -
Decomposing and Steering Functional Metacognition in Large Language Models
von: Li, Yanshi, et al.
Veröffentlicht: (2026) -
Psychological Steering of Large Language Models
von: Blas, Leonardo, et al.
Veröffentlicht: (2026) -
Prompt-Based Value Steering of Large Language Models
von: Abbo, Giulio Antonio, et al.
Veröffentlicht: (2025) -
LF-Steering: Latent Feature Activation Steering for Enhancing Semantic Consistency in Large Language Models
von: Yang, Jingyuan, et al.
Veröffentlicht: (2025)