Activation Transport Operators
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Szablewski, Andrzej, Masiak, Marek |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
StateAct: Enhancing LLM Base Agents via Self-prompting and State-tracking
par: Rozanov, Nikolai, et autres
Publié: (2024)
par: Rozanov, Nikolai, et autres
Publié: (2024)
Reprompting: Automated Chain-of-Thought Prompt Inference Through Gibbs Sampling
par: Xu, Weijia, et autres
Publié: (2023)
par: Xu, Weijia, et autres
Publié: (2023)
Activation Oracles: Training and Evaluating LLMs as General-Purpose Activation Explainers
par: Karvonen, Adam, et autres
Publié: (2025)
par: Karvonen, Adam, et autres
Publié: (2025)
SAKE: Steering Activations for Knowledge Editing
par: Scialanga, Marco, et autres
Publié: (2025)
par: Scialanga, Marco, et autres
Publié: (2025)
Turning LLM Activations Quantization-Friendly
par: Czakó, Patrik, et autres
Publié: (2025)
par: Czakó, Patrik, et autres
Publié: (2025)
Programming Refusal with Conditional Activation Steering
par: Lee, Bruce W., et autres
Publié: (2024)
par: Lee, Bruce W., et autres
Publié: (2024)
Communicating Activations Between Language Model Agents
par: Ramesh, Vignav, et autres
Publié: (2025)
par: Ramesh, Vignav, et autres
Publié: (2025)
HyperSteer: Activation Steering at Scale with Hypernetworks
par: Sun, Jiuding, et autres
Publié: (2025)
par: Sun, Jiuding, et autres
Publié: (2025)
Circuit Insights: Towards Interpretability Beyond Activations
par: Golimblevskaia, Elena, et autres
Publié: (2025)
par: Golimblevskaia, Elena, et autres
Publié: (2025)
Endogenous Resistance to Activation Steering in Language Models
par: McKenzie, Alex, et autres
Publié: (2026)
par: McKenzie, Alex, et autres
Publié: (2026)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
par: Azimi, Rambod, et autres
Publié: (2024)
par: Azimi, Rambod, et autres
Publié: (2024)
Jacobian Sparse Autoencoders: Sparsify Computations, Not Just Activations
par: Farnik, Lucy, et autres
Publié: (2025)
par: Farnik, Lucy, et autres
Publié: (2025)
Understanding In-context Learning of Addition via Activation Subspaces
par: Hu, Xinyan, et autres
Publié: (2025)
par: Hu, Xinyan, et autres
Publié: (2025)
Steer Like the LLM: Activation Steering that Mimics Prompting
par: Heyman, Geert, et autres
Publié: (2026)
par: Heyman, Geert, et autres
Publié: (2026)
Learning a Generative Meta-Model of LLM Activations
par: Luo, Grace, et autres
Publié: (2026)
par: Luo, Grace, et autres
Publié: (2026)
Measuring the Depth of LLM Unlearning via Activation Patching
par: Lee, Jaeung, et autres
Publié: (2026)
par: Lee, Jaeung, et autres
Publié: (2026)
Spectral Editing of Activations for Large Language Model Alignment
par: Qiu, Yifu, et autres
Publié: (2024)
par: Qiu, Yifu, et autres
Publié: (2024)
Extracting Unlearned Information from LLMs with Activation Steering
par: Seyitoğlu, Atakan, et autres
Publié: (2024)
par: Seyitoğlu, Atakan, et autres
Publié: (2024)
Steering Llama 2 via Contrastive Activation Addition
par: Panickssery, Nina, et autres
Publié: (2023)
par: Panickssery, Nina, et autres
Publié: (2023)
On the Mathematical Relationship Between Layer Normalization and Dynamic Activation Functions
par: Stollenwerk, Felix
Publié: (2025)
par: Stollenwerk, Felix
Publié: (2025)
Joint Localization and Activation Editing for Low-Resource Fine-Tuning
par: Lai, Wen, et autres
Publié: (2025)
par: Lai, Wen, et autres
Publié: (2025)
Improving Instruction-Following in Language Models through Activation Steering
par: Stolfo, Alessandro, et autres
Publié: (2024)
par: Stolfo, Alessandro, et autres
Publié: (2024)
Hallucination Detection via Activations of Open-Weight Proxy Analyzers
par: Singh, Akshita, et autres
Publié: (2026)
par: Singh, Akshita, et autres
Publié: (2026)
VISPA: Pluralistic Alignment via Automatic Value Selection and Activation
par: Zheng, Shenyan, et autres
Publié: (2026)
par: Zheng, Shenyan, et autres
Publié: (2026)
Polynomial Composition Activations: Unleashing the Dynamics of Large Language Models
par: Zhuo, Zhijian, et autres
Publié: (2024)
par: Zhuo, Zhijian, et autres
Publié: (2024)
Belief Dynamics Reveal the Dual Nature of In-Context Learning and Activation Steering
par: Bigelow, Eric, et autres
Publié: (2025)
par: Bigelow, Eric, et autres
Publié: (2025)
Interpretable Steering of Large Language Models with Feature Guided Activation Additions
par: Soo, Samuel, et autres
Publié: (2025)
par: Soo, Samuel, et autres
Publié: (2025)
Beyond Input Activations: Identifying Influential Latents by Gradient Sparse Autoencoders
par: Shu, Dong, et autres
Publié: (2025)
par: Shu, Dong, et autres
Publié: (2025)
Dissecting Persona-Driven Reasoning in Language Models via Activation Patching
par: Poonia, Ansh, et autres
Publié: (2025)
par: Poonia, Ansh, et autres
Publié: (2025)
Breaking the Mirror: Activation-Based Mitigation of Self-Preference in LLM Evaluators
par: Roytburg, Dani, et autres
Publié: (2025)
par: Roytburg, Dani, et autres
Publié: (2025)
IA2: Alignment with ICL Activations Improves Supervised Fine-Tuning
par: Mishra, Aayush, et autres
Publié: (2025)
par: Mishra, Aayush, et autres
Publié: (2025)
Multi-property Steering of Large Language Models with Dynamic Activation Composition
par: Scalena, Daniel, et autres
Publié: (2024)
par: Scalena, Daniel, et autres
Publié: (2024)
ContextFocus: Activation Steering for Contextual Faithfulness in Large Language Models
par: Anand, Nikhil, et autres
Publié: (2026)
par: Anand, Nikhil, et autres
Publié: (2026)
Agile-Quant: Activation-Guided Quantization for Faster Inference of LLMs on the Edge
par: Shen, Xuan, et autres
Publié: (2023)
par: Shen, Xuan, et autres
Publié: (2023)
Towards Best Practices of Activation Patching in Language Models: Metrics and Methods
par: Zhang, Fred, et autres
Publié: (2023)
par: Zhang, Fred, et autres
Publié: (2023)
LLMs Encode Their Failures: Predicting Success from Pre-Generation Activations
par: Lugoloobi, William, et autres
Publié: (2026)
par: Lugoloobi, William, et autres
Publié: (2026)
Generalist Foundation Models Are Not Clinical Enough for Hospital Operations
par: Jiang, Lavender Y., et autres
Publié: (2025)
par: Jiang, Lavender Y., et autres
Publié: (2025)
Optimal Transport-Based Token Weighting scheme for Enhanced Preference Optimization
par: Li, Meng, et autres
Publié: (2025)
par: Li, Meng, et autres
Publié: (2025)
COTET: Cross-view Optimal Transport for Knowledge Graph Entity Typing
par: Hu, Zhiwei, et autres
Publié: (2024)
par: Hu, Zhiwei, et autres
Publié: (2024)
NeuroAda: Activating Each Neuron's Potential for Parameter-Efficient Fine-Tuning
par: Zhang, Zhi, et autres
Publié: (2025)
par: Zhang, Zhi, et autres
Publié: (2025)
Documents similaires
-
StateAct: Enhancing LLM Base Agents via Self-prompting and State-tracking
par: Rozanov, Nikolai, et autres
Publié: (2024) -
Reprompting: Automated Chain-of-Thought Prompt Inference Through Gibbs Sampling
par: Xu, Weijia, et autres
Publié: (2023) -
Activation Oracles: Training and Evaluating LLMs as General-Purpose Activation Explainers
par: Karvonen, Adam, et autres
Publié: (2025) -
SAKE: Steering Activations for Knowledge Editing
par: Scialanga, Marco, et autres
Publié: (2025) -
Turning LLM Activations Quantization-Friendly
par: Czakó, Patrik, et autres
Publié: (2025)