Fine-Grained Activation Steering: Steering Less, Achieving More
Fuente:
arXiv
Salvato in:
| Autori principali: | Feng, Zijian, Li, Tianjiao, Zhu, Zixiao, Zhou, Hanzhang, Qian, Junlang, Zhang, Li, Chua, Jia Jim Deryl, Mak, Lee Onn, Ng, Gee Wah, Mao, Kezhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Restoring Pruned Large Language Models via Lost Component Compensation
di: Feng, Zijian, et al.
Pubblicazione: (2025)
di: Feng, Zijian, et al.
Pubblicazione: (2025)
Rethinking Prompt Optimizers: From Prompt Merits to Optimization
di: Zhu, Zixiao, et al.
Pubblicazione: (2025)
di: Zhu, Zixiao, et al.
Pubblicazione: (2025)
Unveiling and Manipulating Prompt Influence in Large Language Models
di: Feng, Zijian, et al.
Pubblicazione: (2024)
di: Feng, Zijian, et al.
Pubblicazione: (2024)
UniBias: Unveiling and Mitigating LLM Bias through Internal Attention and FFN Manipulation
di: Zhou, Hanzhang, et al.
Pubblicazione: (2024)
di: Zhou, Hanzhang, et al.
Pubblicazione: (2024)
Logit Separability-Driven Samples and Multiple Class-Related Words Selection for Advancing In-Context Learning
di: Zixiao, Zhu, et al.
Pubblicazione: (2024)
di: Zixiao, Zhu, et al.
Pubblicazione: (2024)
LLMs Learn Task Heuristics from Demonstrations: A Heuristic-Driven Prompting Strategy for Document-Level Event Argument Extraction
di: Zhou, Hanzhang, et al.
Pubblicazione: (2023)
di: Zhou, Hanzhang, et al.
Pubblicazione: (2023)
Beyond the Next Token: Towards Prompt-Robust Zero-Shot Classification via Efficient Multi-Token Prediction
di: Qian, Junlang, et al.
Pubblicazione: (2025)
di: Qian, Junlang, et al.
Pubblicazione: (2025)
FreeCtrl: Constructing Control Centers with Feedforward Layers for Learning-Free Controllable Text Generation
di: Feng, Zijian, et al.
Pubblicazione: (2024)
di: Feng, Zijian, et al.
Pubblicazione: (2024)
EmoSteer-TTS: Fine-Grained and Training-Free Emotion-Controllable Text-to-Speech via Activation Steering
di: Xie, Tianxin, et al.
Pubblicazione: (2025)
di: Xie, Tianxin, et al.
Pubblicazione: (2025)
QCaption: Video Captioning and Q&A through Fusion of Large Multimodal Models
di: Wang, Jiale, et al.
Pubblicazione: (2026)
di: Wang, Jiale, et al.
Pubblicazione: (2026)
Domain Lexical Knowledge-based Word Embedding Learning for Text Classification under Small Data
di: Zhu, Zixiao, et al.
Pubblicazione: (2025)
di: Zhu, Zixiao, et al.
Pubblicazione: (2025)
FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models
di: Weng, Zixuan, et al.
Pubblicazione: (2026)
di: Weng, Zixuan, et al.
Pubblicazione: (2026)
QMAVIS: Long Video-Audio Understanding using Fusion of Large Multimodal Models
di: Lin, Zixing, et al.
Pubblicazione: (2026)
di: Lin, Zixing, et al.
Pubblicazione: (2026)
Personalized Text Generation with Contrastive Activation Steering
di: Zhang, Jinghao, et al.
Pubblicazione: (2025)
di: Zhang, Jinghao, et al.
Pubblicazione: (2025)
Mitigating Content Effects on Reasoning in Language Models through Fine-Grained Activation Steering
di: Valentino, Marco, et al.
Pubblicazione: (2025)
di: Valentino, Marco, et al.
Pubblicazione: (2025)
HyperSteer: Activation Steering at Scale with Hypernetworks
di: Sun, Jiuding, et al.
Pubblicazione: (2025)
di: Sun, Jiuding, et al.
Pubblicazione: (2025)
FairSteer: Inference Time Debiasing for LLMs with Dynamic Activation Steering
di: Li, Yichen, et al.
Pubblicazione: (2025)
di: Li, Yichen, et al.
Pubblicazione: (2025)
Steer Like the LLM: Activation Steering that Mimics Prompting
di: Heyman, Geert, et al.
Pubblicazione: (2026)
di: Heyman, Geert, et al.
Pubblicazione: (2026)
RankSteer: Activation Steering for Pointwise LLM Ranking
di: Wang, Yumeng, et al.
Pubblicazione: (2026)
di: Wang, Yumeng, et al.
Pubblicazione: (2026)
Steering Awareness: Detecting Activation Steering from Within
di: Rivera, Joshua Fonseca, et al.
Pubblicazione: (2025)
di: Rivera, Joshua Fonseca, et al.
Pubblicazione: (2025)
SteerX: Disentangled Steering for LLM Personalization
di: Zhao, Xiaoyan, et al.
Pubblicazione: (2025)
di: Zhao, Xiaoyan, et al.
Pubblicazione: (2025)
On Optimal Steering to Achieve Exact Fairness
di: Sharma, Mohit, et al.
Pubblicazione: (2025)
di: Sharma, Mohit, et al.
Pubblicazione: (2025)
LF-Steering: Latent Feature Activation Steering for Enhancing Semantic Consistency in Large Language Models
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
FoleyDirector: Fine-Grained Temporal Steering for Video-to-Audio Generation via Structured Scripts
di: Li, You, et al.
Pubblicazione: (2026)
di: Li, You, et al.
Pubblicazione: (2026)
Steer2Edit: From Activation Steering to Component-Level Editing
di: Sun, Chung-En, et al.
Pubblicazione: (2026)
di: Sun, Chung-En, et al.
Pubblicazione: (2026)
Steering Video Diffusion Transformers with Massive Activations
di: Cheng, Xianhang, et al.
Pubblicazione: (2026)
di: Cheng, Xianhang, et al.
Pubblicazione: (2026)
Dynamically Scaled Activation Steering
di: Ferrando, Alex, et al.
Pubblicazione: (2025)
di: Ferrando, Alex, et al.
Pubblicazione: (2025)
AlphaSteer: Learning Refusal Steering with Principled Null-Space Constraint
di: Sheng, Leheng, et al.
Pubblicazione: (2025)
di: Sheng, Leheng, et al.
Pubblicazione: (2025)
Steering to Say No: Configurable Refusal via Activation Steering in Vision Language Models
di: Yang, Jiaxi, et al.
Pubblicazione: (2026)
di: Yang, Jiaxi, et al.
Pubblicazione: (2026)
MedSteer: Counterfactual Endoscopic Synthesis via Training-Free Activation Steering
di: Pham, Trong-Thang, et al.
Pubblicazione: (2026)
di: Pham, Trong-Thang, et al.
Pubblicazione: (2026)
Beyond Steering Vector: Flow-based Activation Steering for Inference-Time Intervention
di: Jin, Zehao, et al.
Pubblicazione: (2026)
di: Jin, Zehao, et al.
Pubblicazione: (2026)
SteerConf: Steering LLMs for Confidence Elicitation
di: Zhou, Ziang, et al.
Pubblicazione: (2025)
di: Zhou, Ziang, et al.
Pubblicazione: (2025)
MLLMEraser: Achieving Test-Time Unlearning in Multimodal Large Language Models through Activation Steering
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
di: Ding, Chenlu, et al.
Pubblicazione: (2025)
Minimizing Collateral Damage in Activation Steering
di: Nguyen, Tam, et al.
Pubblicazione: (2026)
di: Nguyen, Tam, et al.
Pubblicazione: (2026)
Activation Steering with a Feedback Controller
di: Nguyen, Dung V., et al.
Pubblicazione: (2025)
di: Nguyen, Dung V., et al.
Pubblicazione: (2025)
Programming Refusal with Conditional Activation Steering
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
SAKE: Steering Activations for Knowledge Editing
di: Scialanga, Marco, et al.
Pubblicazione: (2025)
di: Scialanga, Marco, et al.
Pubblicazione: (2025)
Activation Steering for Chain-of-Thought Compression
di: Azizi, Seyedarmin, et al.
Pubblicazione: (2025)
di: Azizi, Seyedarmin, et al.
Pubblicazione: (2025)
Steering Language Models With Activation Engineering
di: Turner, Alexander Matt, et al.
Pubblicazione: (2023)
di: Turner, Alexander Matt, et al.
Pubblicazione: (2023)
Steered LLM Activations are Non-Surjective
di: Mishra, Aayush, et al.
Pubblicazione: (2026)
di: Mishra, Aayush, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Restoring Pruned Large Language Models via Lost Component Compensation
di: Feng, Zijian, et al.
Pubblicazione: (2025) -
Rethinking Prompt Optimizers: From Prompt Merits to Optimization
di: Zhu, Zixiao, et al.
Pubblicazione: (2025) -
Unveiling and Manipulating Prompt Influence in Large Language Models
di: Feng, Zijian, et al.
Pubblicazione: (2024) -
UniBias: Unveiling and Mitigating LLM Bias through Internal Attention and FFN Manipulation
di: Zhou, Hanzhang, et al.
Pubblicazione: (2024) -
Logit Separability-Driven Samples and Multiple Class-Related Words Selection for Advancing In-Context Learning
di: Zixiao, Zhu, et al.
Pubblicazione: (2024)