Salvato in:
| Autori principali: | Jafari, Mehdi, Xue, Hao, Salim, Flora |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.01716 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing Conversational Agents with Theory of Mind: Aligning Beliefs, Desires, and Intentions for Human-Like Interaction
di: Jafari, Mehdi, et al.
Pubblicazione: (2025)
di: Jafari, Mehdi, et al.
Pubblicazione: (2025)
Is my model "mind blurting"? Interpreting the dynamics of reasoning tokens with Recurrence Quantification Analysis (RQA)
di: Pham, Quoc Tuan, et al.
Pubblicazione: (2026)
di: Pham, Quoc Tuan, et al.
Pubblicazione: (2026)
MAPLE: Mobile App Prediction Leveraging Large Language Model Embeddings
di: Khaokaew, Yonchanok, et al.
Pubblicazione: (2023)
di: Khaokaew, Yonchanok, et al.
Pubblicazione: (2023)
SensorLLM: Aligning Large Language Models with Motion Sensors for Human Activity Recognition
di: Li, Zechen, et al.
Pubblicazione: (2024)
di: Li, Zechen, et al.
Pubblicazione: (2024)
What am I missing here?: Evaluating Large Language Models for Masked Sentence Prediction
di: Wyatt, Charlie, et al.
Pubblicazione: (2025)
di: Wyatt, Charlie, et al.
Pubblicazione: (2025)
Mechanistic Indicators of Understanding in Large Language Models
di: Beckmann, Pierre, et al.
Pubblicazione: (2025)
di: Beckmann, Pierre, et al.
Pubblicazione: (2025)
Prompt Mining for Language-based Human Mobility Forecasting
di: Xue, Hao, et al.
Pubblicazione: (2024)
di: Xue, Hao, et al.
Pubblicazione: (2024)
RIDE: Enhancing Large Language Model Alignment through Restyled In-Context Learning Demonstration Exemplars
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
Locate, Steer, and Improve: A Practical Survey of Actionable Mechanistic Interpretability in Large Language Models
di: Zhang, Hengyuan, et al.
Pubblicazione: (2026)
di: Zhang, Hengyuan, et al.
Pubblicazione: (2026)
ZARA: Training-Free Motion Time-Series Reasoning via Evidence-Grounded LLM Agents
di: Li, Zechen, et al.
Pubblicazione: (2025)
di: Li, Zechen, et al.
Pubblicazione: (2025)
RELOOP: Recursive Retrieval with Multi-Hop Reasoner and Planners for Heterogeneous QA
di: Yang, Ruiyi, et al.
Pubblicazione: (2025)
di: Yang, Ruiyi, et al.
Pubblicazione: (2025)
Psychological Steering of Large Language Models
di: Blas, Leonardo, et al.
Pubblicazione: (2026)
di: Blas, Leonardo, et al.
Pubblicazione: (2026)
The Effectiveness of Style Vectors for Steering Large Language Models: A Human Evaluation
di: Diallo, Diaoulé, et al.
Pubblicazione: (2026)
di: Diallo, Diaoulé, et al.
Pubblicazione: (2026)
Compositional Steering of Large Language Models with Steering Tokens
di: Radevski, Gorjan, et al.
Pubblicazione: (2026)
di: Radevski, Gorjan, et al.
Pubblicazione: (2026)
Steering Vector Fields for Context-Aware Inference-Time Control in Large Language Models
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
di: Li, Jiaqian, et al.
Pubblicazione: (2026)
Steering Without Breaking: Mechanistically Informed Interventions for Discrete Diffusion Language Models
di: Zhou, Hanhan, et al.
Pubblicazione: (2026)
di: Zhou, Hanhan, et al.
Pubblicazione: (2026)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
di: Xiang, Hao, et al.
Pubblicazione: (2024)
di: Xiang, Hao, et al.
Pubblicazione: (2024)
Harnessing Test-time Adaptation for NLU tasks Involving Dialects of English
di: Nguyen, Duke, et al.
Pubblicazione: (2025)
di: Nguyen, Duke, et al.
Pubblicazione: (2025)
Alternatives To Next Token Prediction In Text Generation -- A Survey
di: Wyatt, Charlie, et al.
Pubblicazione: (2025)
di: Wyatt, Charlie, et al.
Pubblicazione: (2025)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
di: Cheng, Zifeng, et al.
Pubblicazione: (2025)
di: Cheng, Zifeng, et al.
Pubblicazione: (2025)
Preference Heads in Large Language Models: A Mechanistic Framework for Interpretable Personalization
di: Zhang, Weixu, et al.
Pubblicazione: (2026)
di: Zhang, Weixu, et al.
Pubblicazione: (2026)
Decomposing and Steering Functional Metacognition in Large Language Models
di: Li, Yanshi, et al.
Pubblicazione: (2026)
di: Li, Yanshi, et al.
Pubblicazione: (2026)
Prototype-Based Dynamic Steering for Large Language Models
di: Kayan, Ceyhun Efe, et al.
Pubblicazione: (2025)
di: Kayan, Ceyhun Efe, et al.
Pubblicazione: (2025)
Style Vectors for Steering Generative Large Language Model
di: Konen, Kai, et al.
Pubblicazione: (2024)
di: Konen, Kai, et al.
Pubblicazione: (2024)
EchoAtt: Attend, Copy, then Adjust for More Efficient Large Language Models
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild
di: Chen, Baiyu, et al.
Pubblicazione: (2026)
di: Chen, Baiyu, et al.
Pubblicazione: (2026)
LF-Steering: Latent Feature Activation Steering for Enhancing Semantic Consistency in Large Language Models
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
Why Supervised Fine-Tuning Fails to Learn: A Systematic Study of Incomplete Learning in Large Language Models
di: Xue, Chao, et al.
Pubblicazione: (2026)
di: Xue, Chao, et al.
Pubblicazione: (2026)
Language Steering for Multilingual In-Context Learning
di: Kirtane, Neeraja, et al.
Pubblicazione: (2026)
di: Kirtane, Neeraja, et al.
Pubblicazione: (2026)
Evaluating and Steering Modality Preferences in Multimodal Large Language Model
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Controlling Large Language Model Agents with Entropic Activation Steering
di: Rahn, Nate, et al.
Pubblicazione: (2024)
di: Rahn, Nate, et al.
Pubblicazione: (2024)
Multilingual Political Views of Large Language Models: Identification and Steering
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
Evaluating Large Language Model Biases in Persona-Steered Generation
di: Liu, Andy, et al.
Pubblicazione: (2024)
di: Liu, Andy, et al.
Pubblicazione: (2024)
Mechanistic Circuit-Based Knowledge Editing in Large Language Models
di: Zhao, Tianyi, et al.
Pubblicazione: (2026)
di: Zhao, Tianyi, et al.
Pubblicazione: (2026)
What Drives Representation Steering? A Mechanistic Case Study on Steering Refusal
di: Cheng, Stephen, et al.
Pubblicazione: (2026)
di: Cheng, Stephen, et al.
Pubblicazione: (2026)
Differentially Private Steering for Large Language Model Alignment
di: Goel, Anmol, et al.
Pubblicazione: (2025)
di: Goel, Anmol, et al.
Pubblicazione: (2025)
Steering Large Language Models to Evaluate and Amplify Creativity
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2024)
di: Olson, Matthew Lyle, et al.
Pubblicazione: (2024)
Prompt-Based Value Steering of Large Language Models
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
Corpus-Steered Query Expansion with Large Language Models
di: Lei, Yibin, et al.
Pubblicazione: (2024)
di: Lei, Yibin, et al.
Pubblicazione: (2024)
SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization
di: Hua, Yuncheng, et al.
Pubblicazione: (2026)
di: Hua, Yuncheng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Enhancing Conversational Agents with Theory of Mind: Aligning Beliefs, Desires, and Intentions for Human-Like Interaction
di: Jafari, Mehdi, et al.
Pubblicazione: (2025) -
Is my model "mind blurting"? Interpreting the dynamics of reasoning tokens with Recurrence Quantification Analysis (RQA)
di: Pham, Quoc Tuan, et al.
Pubblicazione: (2026) -
MAPLE: Mobile App Prediction Leveraging Large Language Model Embeddings
di: Khaokaew, Yonchanok, et al.
Pubblicazione: (2023) -
SensorLLM: Aligning Large Language Models with Motion Sensors for Human Activity Recognition
di: Li, Zechen, et al.
Pubblicazione: (2024) -
What am I missing here?: Evaluating Large Language Models for Masked Sentence Prediction
di: Wyatt, Charlie, et al.
Pubblicazione: (2025)