Follow the Flow: On Information Flow Across Textual Tokens in Text-to-Image Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kaplan, Guy, Toker, Michael, Reif, Yuval, Belinkov, Yonatan, Schwartz, Roy |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Tokens to Words: On the Inner Lexicon of LLMs
par: Kaplan, Guy, et autres
Publié: (2024)
par: Kaplan, Guy, et autres
Publié: (2024)
Vocab Diet: Reshaping the Vocabulary of LLMs via Vector Arithmetic
par: Reif, Yuval, et autres
Publié: (2025)
par: Reif, Yuval, et autres
Publié: (2025)
DeLeaker: Dynamic Inference-Time Reweighting For Semantic Leakage Mitigation in Text-to-Image Models
par: Ventura, Mor, et autres
Publié: (2025)
par: Ventura, Mor, et autres
Publié: (2025)
Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines
par: Toker, Michael, et autres
Publié: (2024)
par: Toker, Michael, et autres
Publié: (2024)
Beyond Performance: Quantifying and Mitigating Label Bias in LLMs
par: Reif, Yuval, et autres
Publié: (2024)
par: Reif, Yuval, et autres
Publié: (2024)
Padding Tone: A Mechanistic Analysis of Padding Tokens in T2I Models
par: Toker, Michael, et autres
Publié: (2025)
par: Toker, Michael, et autres
Publié: (2025)
ReFACT: Updating Text-to-Image Models by Editing the Text Encoder
par: Arad, Dana, et autres
Publié: (2023)
par: Arad, Dana, et autres
Publié: (2023)
A Dataset for Metaphor Detection in Early Medieval Hebrew Poetry
par: Toker, Michael, et autres
Publié: (2024)
par: Toker, Michael, et autres
Publié: (2024)
Why Fine-Tuning Encourages Hallucinations and How to Fix It
par: Kaplan, Guy, et autres
Publié: (2026)
par: Kaplan, Guy, et autres
Publié: (2026)
ContraSim -- Analyzing Neural Representations Based on Contrastive Learning
par: Rahamim, Adir, et autres
Publié: (2023)
par: Rahamim, Adir, et autres
Publié: (2023)
REVS: Unlearning Sensitive Information in Language Models via Rank Editing in the Vocabulary Space
par: Ashuach, Tomer, et autres
Publié: (2024)
par: Ashuach, Tomer, et autres
Publié: (2024)
Silent Tokens, Loud Effects: Padding in LLMs
par: Himelstein, Rom, et autres
Publié: (2025)
par: Himelstein, Rom, et autres
Publié: (2025)
Mismatch Quest: Visual and Textual Feedback for Image-Text Misalignment
par: Gordon, Brian, et autres
Publié: (2023)
par: Gordon, Brian, et autres
Publié: (2023)
Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models
par: Yu, Zeping, et autres
Publié: (2025)
par: Yu, Zeping, et autres
Publié: (2025)
Leveraging Prototypical Representations for Mitigating Social Bias without Demographic Information
par: Iskander, Shadi, et autres
Publié: (2024)
par: Iskander, Shadi, et autres
Publié: (2024)
Mamba Knockout for Unraveling Factual Information Flow
par: Endy, Nir, et autres
Publié: (2025)
par: Endy, Nir, et autres
Publié: (2025)
Have Faith in Faithfulness: Going Beyond Circuit Overlap When Finding Model Mechanisms
par: Hanna, Michael, et autres
Publié: (2024)
par: Hanna, Michael, et autres
Publié: (2024)
Are formal and functional linguistic mechanisms dissociated in language models?
par: Hanna, Michael, et autres
Publié: (2025)
par: Hanna, Michael, et autres
Publié: (2025)
LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations
par: Orgad, Hadas, et autres
Publié: (2024)
par: Orgad, Hadas, et autres
Publié: (2024)
Concept-Best-Matching: Evaluating Compositionality in Emergent Communication
par: Carmeli, Boaz, et autres
Publié: (2024)
par: Carmeli, Boaz, et autres
Publié: (2024)
NL-Eye: Abductive NLI for Images
par: Ventura, Mor, et autres
Publié: (2024)
par: Ventura, Mor, et autres
Publié: (2024)
SAEs Are Good for Steering -- If You Select the Right Features
par: Arad, Dana, et autres
Publié: (2025)
par: Arad, Dana, et autres
Publié: (2025)
Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
par: Itzhak, Itay, et autres
Publié: (2025)
par: Itzhak, Itay, et autres
Publié: (2025)
DEPTH: Discourse Education through Pre-Training Hierarchically
par: Bamberger, Zachary, et autres
Publié: (2024)
par: Bamberger, Zachary, et autres
Publié: (2024)
Backward Lens: Projecting Language Model Gradients into the Vocabulary Space
par: Katz, Shahar, et autres
Publié: (2024)
par: Katz, Shahar, et autres
Publié: (2024)
FlowTok: Flowing Seamlessly Across Text and Image Tokens
par: He, Ju, et autres
Publié: (2025)
par: He, Ju, et autres
Publié: (2025)
Differentiable Faithfulness Alignment for Cross-Model Circuit Transfer
par: Shao, Shun, et autres
Publié: (2026)
par: Shao, Shun, et autres
Publié: (2026)
Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps
par: Tutek, Martin, et autres
Publié: (2025)
par: Tutek, Martin, et autres
Publié: (2025)
Arithmetic Without Algorithms: Language Models Solve Math With a Bag of Heuristics
par: Nikankin, Yaniv, et autres
Publié: (2024)
par: Nikankin, Yaniv, et autres
Publié: (2024)
Fast Forwarding Low-Rank Training
par: Rahamim, Adir, et autres
Publié: (2024)
par: Rahamim, Adir, et autres
Publié: (2024)
Will it Merge? On The Causes of Model Mergeability
par: Rahamim, Adir, et autres
Publié: (2026)
par: Rahamim, Adir, et autres
Publié: (2026)
The Roots of Performance Disparity in Multilingual Language Models: Intrinsic Modeling Difficulty or Design Choices?
par: Shani, Chen, et autres
Publié: (2026)
par: Shani, Chen, et autres
Publié: (2026)
Distinguishing Ignorance from Error in LLM Hallucinations
par: Simhi, Adi, et autres
Publié: (2024)
par: Simhi, Adi, et autres
Publié: (2024)
Constructing Benchmarks and Interventions for Combating Hallucinations in LLMs
par: Simhi, Adi, et autres
Publié: (2024)
par: Simhi, Adi, et autres
Publié: (2024)
Context-aware Prompt Tuning: Advancing In-Context Learning with Adversarial Methods
par: Blau, Tsachi, et autres
Publié: (2024)
par: Blau, Tsachi, et autres
Publié: (2024)
From Feelings to Metrics: Understanding and Formalizing How Users Vibe-Test LLMs
par: Itzhak, Itay, et autres
Publié: (2026)
par: Itzhak, Itay, et autres
Publié: (2026)
Beyond Text Compression: Evaluating Tokenizers Across Scales
par: Lotz, Jonas F., et autres
Publié: (2025)
par: Lotz, Jonas F., et autres
Publié: (2025)
Same Task, Different Circuits: Disentangling Modality-Specific Mechanisms in VLMs
par: Nikankin, Yaniv, et autres
Publié: (2025)
par: Nikankin, Yaniv, et autres
Publié: (2025)
Reasoning Models Know What's Important, and Encode It in Their Activations
par: Nikankin, Yaniv, et autres
Publié: (2026)
par: Nikankin, Yaniv, et autres
Publié: (2026)
Answer, Assemble, Ace: Understanding How LMs Answer Multiple Choice Questions
par: Wiegreffe, Sarah, et autres
Publié: (2024)
par: Wiegreffe, Sarah, et autres
Publié: (2024)
Documents similaires
-
From Tokens to Words: On the Inner Lexicon of LLMs
par: Kaplan, Guy, et autres
Publié: (2024) -
Vocab Diet: Reshaping the Vocabulary of LLMs via Vector Arithmetic
par: Reif, Yuval, et autres
Publié: (2025) -
DeLeaker: Dynamic Inference-Time Reweighting For Semantic Leakage Mitigation in Text-to-Image Models
par: Ventura, Mor, et autres
Publié: (2025) -
Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines
par: Toker, Michael, et autres
Publié: (2024) -
Beyond Performance: Quantifying and Mitigating Label Bias in LLMs
par: Reif, Yuval, et autres
Publié: (2024)