Style Vectors for Steering Generative Large Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Konen, Kai, Jentzsch, Sophie, Diallo, Diaoulé, Schütt, Peer, Bensch, Oliver, Baff, Roxanne El, Opitz, Dominik, Hecking, Tobias |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Effectiveness of Style Vectors for Steering Large Language Models: A Human Evaluation
di: Diallo, Diaoulé, et al.
Pubblicazione: (2026)
di: Diallo, Diaoulé, et al.
Pubblicazione: (2026)
AI Assistants for Spaceflight Procedures: Combining Generative Pre-Trained Transformer and Retrieval-Augmented Generation on Knowledge Graphs With Augmented Reality Cues
di: Bensch, Oliver, et al.
Pubblicazione: (2024)
di: Bensch, Oliver, et al.
Pubblicazione: (2024)
Evaluating Prompt Engineering Strategies for Sentiment Control in AI-Generated Texts
di: Sahler, Kerstin, et al.
Pubblicazione: (2026)
di: Sahler, Kerstin, et al.
Pubblicazione: (2026)
BILLY: Steering Large Language Models via Merging Persona Vectors for Creative Generation
di: Pai, Tsung-Min, et al.
Pubblicazione: (2025)
di: Pai, Tsung-Min, et al.
Pubblicazione: (2025)
Steering Large Language Models with Register Analysis for Arbitrary Style Transfer
di: Yang, Xinchen, et al.
Pubblicazione: (2025)
di: Yang, Xinchen, et al.
Pubblicazione: (2025)
The Impact of Steering Large Language Models with Persona Vectors in Educational Applications
di: Wu, Yongchao, et al.
Pubblicazione: (2026)
di: Wu, Yongchao, et al.
Pubblicazione: (2026)
Model Whisper: Steering Vectors Unlock Large Language Models' Potential in Test-time
di: Kang, Xinyue, et al.
Pubblicazione: (2025)
di: Kang, Xinyue, et al.
Pubblicazione: (2025)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
di: Cao, Yuanpu, et al.
Pubblicazione: (2024)
di: Cao, Yuanpu, et al.
Pubblicazione: (2024)
Steering Vector Fields for Context-Aware Inference-Time Control in Large Language Models
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
Towards a Reliable Offline Personal AI Assistant for Long Duration Spaceflight
di: Bensch, Oliver, et al.
Pubblicazione: (2024)
di: Bensch, Oliver, et al.
Pubblicazione: (2024)
Evaluating Large Language Model Biases in Persona-Steered Generation
di: Liu, Andy, et al.
Pubblicazione: (2024)
di: Liu, Andy, et al.
Pubblicazione: (2024)
RepIt: Steering Language Models with Concept-Specific Refusal Vectors
di: Siu, Vincent, et al.
Pubblicazione: (2025)
di: Siu, Vincent, et al.
Pubblicazione: (2025)
Psychological Steering of Large Language Models
di: Blas, Leonardo, et al.
Pubblicazione: (2026)
di: Blas, Leonardo, et al.
Pubblicazione: (2026)
Style-Specific Neurons for Steering LLMs in Text Style Transfer
di: Lai, Wen, et al.
Pubblicazione: (2024)
di: Lai, Wen, et al.
Pubblicazione: (2024)
Textual Steering Vectors Can Improve Visual Understanding in Multimodal Large Language Models
di: Gan, Woody Haosheng, et al.
Pubblicazione: (2025)
di: Gan, Woody Haosheng, et al.
Pubblicazione: (2025)
Compositional Steering of Large Language Models with Steering Tokens
di: Radevski, Gorjan, et al.
Pubblicazione: (2026)
di: Radevski, Gorjan, et al.
Pubblicazione: (2026)
Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering
di: Zhao, Haiyan, et al.
Pubblicazione: (2025)
di: Zhao, Haiyan, et al.
Pubblicazione: (2025)
Generative Linguistics, Large Language Models, and the Social Nature of Scientific Success
di: Hao, Sophie
Pubblicazione: (2025)
di: Hao, Sophie
Pubblicazione: (2025)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
di: Cheng, Zifeng, et al.
Pubblicazione: (2025)
di: Cheng, Zifeng, et al.
Pubblicazione: (2025)
VSPO: Vector-Steered Policy Optimization for Behavioral Control
di: Zhang, Xuechen, et al.
Pubblicazione: (2026)
di: Zhang, Xuechen, et al.
Pubblicazione: (2026)
Prototype-Based Dynamic Steering for Large Language Models
di: Kayan, Ceyhun Efe, et al.
Pubblicazione: (2025)
di: Kayan, Ceyhun Efe, et al.
Pubblicazione: (2025)
Decomposing and Steering Functional Metacognition in Large Language Models
di: Li, Yanshi, et al.
Pubblicazione: (2026)
di: Li, Yanshi, et al.
Pubblicazione: (2026)
Mechanistic Indicators of Steering Effectiveness in Large Language Models
di: Jafari, Mehdi, et al.
Pubblicazione: (2026)
di: Jafari, Mehdi, et al.
Pubblicazione: (2026)
Large Language Models on Wikipedia-Style Survey Generation: an Evaluation in NLP Concepts
di: Gao, Fan, et al.
Pubblicazione: (2023)
di: Gao, Fan, et al.
Pubblicazione: (2023)
Customizing Large Language Model Generation Style using Parameter-Efficient Finetuning
di: Liu, Xinyue, et al.
Pubblicazione: (2024)
di: Liu, Xinyue, et al.
Pubblicazione: (2024)
ANLS* -- A Universal Document Processing Metric for Generative Large Language Models
di: Peer, David, et al.
Pubblicazione: (2024)
di: Peer, David, et al.
Pubblicazione: (2024)
LF-Steering: Latent Feature Activation Steering for Enhancing Semantic Consistency in Large Language Models
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
Do LLMs Know What Is Private Internally? Probing and Steering Contextual Privacy Norms in Large Language Model Representations
di: Wang, Haoran, et al.
Pubblicazione: (2026)
di: Wang, Haoran, et al.
Pubblicazione: (2026)
Schroedinger's Threshold: When the AUC doesn't predict Accuracy
di: Opitz, Juri
Pubblicazione: (2024)
di: Opitz, Juri
Pubblicazione: (2024)
Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment
di: Wang, Haoran, et al.
Pubblicazione: (2023)
di: Wang, Haoran, et al.
Pubblicazione: (2023)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Controlling Large Language Model Agents with Entropic Activation Steering
di: Rahn, Nate, et al.
Pubblicazione: (2024)
di: Rahn, Nate, et al.
Pubblicazione: (2024)
Multilingual Political Views of Large Language Models: Identification and Steering
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
Differentially Private Steering for Large Language Model Alignment
di: Goel, Anmol, et al.
Pubblicazione: (2025)
di: Goel, Anmol, et al.
Pubblicazione: (2025)
Steering Large Language Models to Evaluate and Amplify Creativity
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2024)
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2024)
Prompt-Based Value Steering of Large Language Models
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
Corpus-Steered Query Expansion with Large Language Models
di: Lei, Yibin, et al.
Pubblicazione: (2024)
di: Lei, Yibin, et al.
Pubblicazione: (2024)
Rule-Guided Feedback: Enhancing Reasoning by Enforcing Rule Adherence in Large Language Models
di: Diallo, Aissatou, et al.
Pubblicazione: (2025)
di: Diallo, Aissatou, et al.
Pubblicazione: (2025)
Analysing the Safety Pitfalls of Steering Vectors
di: Li, Yuxiao, et al.
Pubblicazione: (2026)
di: Li, Yuxiao, et al.
Pubblicazione: (2026)
Predicting Where Steering Vectors Succeed
di: Billa, Jayadev
Pubblicazione: (2026)
di: Billa, Jayadev
Pubblicazione: (2026)
Documenti analoghi
-
The Effectiveness of Style Vectors for Steering Large Language Models: A Human Evaluation
di: Diallo, Diaoulé, et al.
Pubblicazione: (2026) -
AI Assistants for Spaceflight Procedures: Combining Generative Pre-Trained Transformer and Retrieval-Augmented Generation on Knowledge Graphs With Augmented Reality Cues
di: Bensch, Oliver, et al.
Pubblicazione: (2024) -
Evaluating Prompt Engineering Strategies for Sentiment Control in AI-Generated Texts
di: Sahler, Kerstin, et al.
Pubblicazione: (2026) -
BILLY: Steering Large Language Models via Merging Persona Vectors for Creative Generation
di: Pai, Tsung-Min, et al.
Pubblicazione: (2025) -
Steering Large Language Models with Register Analysis for Arbitrary Style Transfer
di: Yang, Xinchen, et al.
Pubblicazione: (2025)