Context Steering: Controllable Personalization at Inference Time
Fuente:
arXiv
Guardado en:
| Autores principales: | He, Jerry Zhi-Yang, Pandey, Sashrika, Schrum, Mariah L., Dragan, Anca |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Coprocessor Actor Critic: A Model-Based Reinforcement Learning Approach For Adaptive Brain Stimulation
por: Pan, Michelle, et al.
Publicado: (2024)
por: Pan, Michelle, et al.
Publicado: (2024)
Planning without Search: Refining Frontier LLMs with Offline Goal-Conditioned RL
por: Hong, Joey, et al.
Publicado: (2025)
por: Hong, Joey, et al.
Publicado: (2025)
Towards Balancing Preference and Performance through Adaptive Personalized Explainability
por: Silva, Andrew, et al.
Publicado: (2025)
por: Silva, Andrew, et al.
Publicado: (2025)
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
por: Lv, Hang, et al.
Publicado: (2025)
por: Lv, Hang, et al.
Publicado: (2025)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024)
por: Hong, Joey, et al.
Publicado: (2024)
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
por: Hong, Joey, et al.
Publicado: (2024)
por: Hong, Joey, et al.
Publicado: (2024)
Exploring the Personality Traits of LLMs through Latent Features Steering
por: Yang, Shu, et al.
Publicado: (2024)
por: Yang, Shu, et al.
Publicado: (2024)
FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models
por: Weng, Zixuan, et al.
Publicado: (2026)
por: Weng, Zixuan, et al.
Publicado: (2026)
Context Engineering for Trustworthiness: Rescorla Wagner Steering Under Mixed and Inappropriate Contexts
por: Wang, Rushi, et al.
Publicado: (2025)
por: Wang, Rushi, et al.
Publicado: (2025)
Inference-time Alignment via Sparse Junction Steering
por: Hu, Runyi, et al.
Publicado: (2026)
por: Hu, Runyi, et al.
Publicado: (2026)
ILRR: Inference-Time Steering Method for Masked Diffusion Language Models
por: Avrahami, Eden, et al.
Publicado: (2026)
por: Avrahami, Eden, et al.
Publicado: (2026)
Identifying Cooperative Personalities in Multi-agent Contexts through Personality Steering with Representation Engineering
por: Ong, Kenneth J. K., et al.
Publicado: (2025)
por: Ong, Kenneth J. K., et al.
Publicado: (2025)
Steering Multimodal Large Language Models Decoding for Context-Aware Safety
por: Liu, Zheyuan, et al.
Publicado: (2025)
por: Liu, Zheyuan, et al.
Publicado: (2025)
Steering Safely or Off a Cliff? Rethinking Specificity and Robustness in Inference-Time Interventions
por: Goyal, Navita, et al.
Publicado: (2026)
por: Goyal, Navita, et al.
Publicado: (2026)
Fusion Steering: Prompt-Specific Activation Control
por: Chang, Waldemar, et al.
Publicado: (2025)
por: Chang, Waldemar, et al.
Publicado: (2025)
KV Cache Steering for Controlling Frozen LLMs
por: Belitsky, Max, et al.
Publicado: (2025)
por: Belitsky, Max, et al.
Publicado: (2025)
SDA: Steering-Driven Distribution Alignment for Open LLMs without Fine-Tuning
por: Xia, Wei, et al.
Publicado: (2025)
por: Xia, Wei, et al.
Publicado: (2025)
GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs
por: Nguyen, Duy, et al.
Publicado: (2025)
por: Nguyen, Duy, et al.
Publicado: (2025)
Towards Inference-time Category-wise Safety Steering for Large Language Models
por: Bhattacharjee, Amrita, et al.
Publicado: (2024)
por: Bhattacharjee, Amrita, et al.
Publicado: (2024)
In-context Vectors: Making In Context Learning More Effective and Controllable Through Latent Space Steering
por: Liu, Sheng, et al.
Publicado: (2023)
por: Liu, Sheng, et al.
Publicado: (2023)
Steering Large Language Models for Machine Translation Personalization
por: Scalena, Daniel, et al.
Publicado: (2025)
por: Scalena, Daniel, et al.
Publicado: (2025)
COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics
por: Sharma, Kartik, et al.
Publicado: (2026)
por: Sharma, Kartik, et al.
Publicado: (2026)
Learning to Model the World with Language
por: Lin, Jessy, et al.
Publicado: (2023)
por: Lin, Jessy, et al.
Publicado: (2023)
Controllable LLM Reasoning via Sparse Autoencoder-Based Steering
por: Fang, Yi, et al.
Publicado: (2026)
por: Fang, Yi, et al.
Publicado: (2026)
How Well Can a Long Sequence Model Model Long Sequences? Comparing Architechtural Inductive Biases on Long-Context Abilities
por: Huang, Jerry
Publicado: (2024)
por: Huang, Jerry
Publicado: (2024)
Communicate to Play: Pragmatic Reasoning for Efficient Cross-Cultural Communication in Codenames
por: White, Isadora, et al.
Publicado: (2024)
por: White, Isadora, et al.
Publicado: (2024)
AdaSkip: Adaptive Sublayer Skipping for Accelerating Long-Context LLM Inference
por: He, Zhuomin, et al.
Publicado: (2025)
por: He, Zhuomin, et al.
Publicado: (2025)
Controllable Safety Alignment: Inference-Time Adaptation to Diverse Safety Requirements
por: Zhang, Jingyu, et al.
Publicado: (2024)
por: Zhang, Jingyu, et al.
Publicado: (2024)
SAEMark: Steering Personalized Multilingual LLM Watermarks with Sparse Autoencoders
por: Yu, Zhuohao, et al.
Publicado: (2025)
por: Yu, Zhuohao, et al.
Publicado: (2025)
Steering Awareness: Detecting Activation Steering from Within
por: Rivera, Joshua Fonseca, et al.
Publicado: (2025)
por: Rivera, Joshua Fonseca, et al.
Publicado: (2025)
Steering LLM Thinking with Budget Guidance
por: Li, Junyan, et al.
Publicado: (2025)
por: Li, Junyan, et al.
Publicado: (2025)
Fractional Reasoning via Latent Steering Vectors Improves Inference Time Compute
por: Liu, Sheng, et al.
Publicado: (2025)
por: Liu, Sheng, et al.
Publicado: (2025)
Causal Language Control in Multilingual Transformers via Sparse Feature Steering
por: Chou, Cheng-Ting, et al.
Publicado: (2025)
por: Chou, Cheng-Ting, et al.
Publicado: (2025)
MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning
por: Shen, Jingyan, et al.
Publicado: (2025)
por: Shen, Jingyan, et al.
Publicado: (2025)
Aligning Machiavellian Agents: Behavior Steering via Test-Time Policy Shaping
por: Mujtaba, Dena, et al.
Publicado: (2025)
por: Mujtaba, Dena, et al.
Publicado: (2025)
Spectral Attention Steering for Prompt Highlighting
por: Li, Weixian Waylon, et al.
Publicado: (2026)
por: Li, Weixian Waylon, et al.
Publicado: (2026)
Latent Phase-Shift Rollback: Inference-Time Error Correction via Residual Stream Monitoring and KV-Cache Steering
por: Gupta, Manan, et al.
Publicado: (2026)
por: Gupta, Manan, et al.
Publicado: (2026)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
por: Cheng, Zifeng, et al.
Publicado: (2025)
por: Cheng, Zifeng, et al.
Publicado: (2025)
Annotation Guidelines-Based Knowledge Augmentation: Towards Enhancing Large Language Models for Educational Text Classification
por: Liu, Shiqi, et al.
Publicado: (2024)
por: Liu, Shiqi, et al.
Publicado: (2024)
Steering at the Source: Style Modulation Heads for Robust Persona Control
por: Izawa, Yoshihiro, et al.
Publicado: (2026)
por: Izawa, Yoshihiro, et al.
Publicado: (2026)
Ejemplares similares
-
Coprocessor Actor Critic: A Model-Based Reinforcement Learning Approach For Adaptive Brain Stimulation
por: Pan, Michelle, et al.
Publicado: (2024) -
Planning without Search: Refining Frontier LLMs with Offline Goal-Conditioned RL
por: Hong, Joey, et al.
Publicado: (2025) -
Towards Balancing Preference and Performance through Adaptive Personalized Explainability
por: Silva, Andrew, et al.
Publicado: (2025) -
CoSteer: Collaborative Decoding-Time Personalization via Local Delta Steering
por: Lv, Hang, et al.
Publicado: (2025) -
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
por: Hong, Joey, et al.
Publicado: (2024)