The UNDO Flip-Flop: A Controlled Probe for Reversible Semantic State Management in State Space Model
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhou, Hongxu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Flip-Flop Consistency: Unsupervised Training for Robustness to Prompt Perturbations in LLMs
par: Hejabi, Parsa, et autres
Publié: (2025)
par: Hejabi, Parsa, et autres
Publié: (2025)
Lost in State Space: Probing Frozen Mamba Representations
par: Wagh, Bhagyashree, et autres
Publié: (2026)
par: Wagh, Bhagyashree, et autres
Publié: (2026)
The Illusion of State in State-Space Models
par: Merrill, William, et autres
Publié: (2024)
par: Merrill, William, et autres
Publié: (2024)
Task Structure Reverses Layerwise State Encoding in Sequence Models
par: Jiang, Yuhang
Publié: (2026)
par: Jiang, Yuhang
Publié: (2026)
State Space Models as Foundation Models: A Control Theoretic Overview
par: Alonso, Carmen Amo, et autres
Publié: (2024)
par: Alonso, Carmen Amo, et autres
Publié: (2024)
Monitoring Latent World States in Language Models with Propositional Probes
par: Feng, Jiahai, et autres
Publié: (2024)
par: Feng, Jiahai, et autres
Publié: (2024)
Rethinking Token Reduction for State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
Parameter-Efficient Fine-Tuning of State Space Models
par: Galim, Kevin, et autres
Publié: (2024)
par: Galim, Kevin, et autres
Publié: (2024)
On Pruning State-Space LLMs
par: Ghattas, Tamer, et autres
Publié: (2025)
par: Ghattas, Tamer, et autres
Publié: (2025)
UNDO: Understanding Distillation as Optimization
par: Jain, Kushal, et autres
Publié: (2025)
par: Jain, Kushal, et autres
Publié: (2025)
MambaByte: Token-free Selective State Space Model
par: Wang, Junxiong, et autres
Publié: (2024)
par: Wang, Junxiong, et autres
Publié: (2024)
LOCOST: State-Space Models for Long Document Abstractive Summarization
par: Bronnec, Florian Le, et autres
Publié: (2024)
par: Bronnec, Florian Le, et autres
Publié: (2024)
Mimetic Initialization Helps State Space Models Learn to Recall
par: Trockman, Asher, et autres
Publié: (2024)
par: Trockman, Asher, et autres
Publié: (2024)
Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
par: Lv, Xingtai, et autres
Publié: (2025)
par: Lv, Xingtai, et autres
Publié: (2025)
Samba: Simple Hybrid State Space Models for Efficient Unlimited Context Language Modeling
par: Ren, Liliang, et autres
Publié: (2024)
par: Ren, Liliang, et autres
Publié: (2024)
Expansion Span: Combining Fading Memory and Retrieval in Hybrid State Space Models
par: Nunez, Elvis, et autres
Publié: (2024)
par: Nunez, Elvis, et autres
Publié: (2024)
DenseMamba: State Space Models with Dense Hidden Connection for Efficient Large Language Models
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
MatMamba: A Matryoshka State Space Model
par: Shukla, Abhinav, et autres
Publié: (2024)
par: Shukla, Abhinav, et autres
Publié: (2024)
The Expressive Capacity of State Space Models: A Formal Language Perspective
par: Sarrof, Yash, et autres
Publié: (2024)
par: Sarrof, Yash, et autres
Publié: (2024)
Geometric Organization of Cognitive States in Transformer Embedding Spaces
par: Zhao, Sophie
Publié: (2025)
par: Zhao, Sophie
Publié: (2025)
Studying the Soupability of Documents in State Space Models
par: Jafari, Yasaman, et autres
Publié: (2025)
par: Jafari, Yasaman, et autres
Publié: (2025)
Rethinking State Tracking in Recurrent Models Through Error Control Dynamics
par: Chung, Jiwan, et autres
Publié: (2026)
par: Chung, Jiwan, et autres
Publié: (2026)
Stateful KV Cache Management for LLMs: Balancing Space, Time, Accuracy, and Positional Fidelity
par: Poudel, Pratik
Publié: (2025)
par: Poudel, Pratik
Publié: (2025)
Semantic Structure of Feature Space in Large Language Models
par: Kozlowski, Austin C., et autres
Publié: (2026)
par: Kozlowski, Austin C., et autres
Publié: (2026)
Enhanced Structured State Space Models via Grouped FIR Filtering and Attention Sink Mechanisms
par: Meng, Tian, et autres
Publié: (2024)
par: Meng, Tian, et autres
Publié: (2024)
Flipping Against All Odds: Reducing LLM Coin Flip Bias via Verbalized Rejection Sampling
par: Xiao, Tim Z., et autres
Publié: (2025)
par: Xiao, Tim Z., et autres
Publié: (2025)
Semantic Anchors in In-Context Learning: Why Small LLMs Cannot Flip Their Labels
par: Kumar, Anantha Padmanaban Krishna
Publié: (2025)
par: Kumar, Anantha Padmanaban Krishna
Publié: (2025)
A Comparative Analysis of Contextual Representation Flow in State-Space and Transformer Architectures
par: Hoang, Nhat M., et autres
Publié: (2025)
par: Hoang, Nhat M., et autres
Publié: (2025)
MemMamba: Rethinking Memory Patterns in State Space Model
par: Wang, Youjin, et autres
Publié: (2025)
par: Wang, Youjin, et autres
Publié: (2025)
PICASO: Permutation-Invariant Context Composition with State Space Models
par: Liu, Tian Yu, et autres
Publié: (2025)
par: Liu, Tian Yu, et autres
Publié: (2025)
On Structured State-Space Duality
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2025)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2025)
Sessa: Selective State Space Attention
par: Horbatko, Liubomyr
Publié: (2026)
par: Horbatko, Liubomyr
Publié: (2026)
Sectoral Coupling in Linguistic State Space
par: Dumbrava, Sebastian
Publié: (2025)
par: Dumbrava, Sebastian
Publié: (2025)
Probing Semantic Routing in Large Mixture-of-Expert Models
par: Olson, Matthew Lyle, et autres
Publié: (2025)
par: Olson, Matthew Lyle, et autres
Publié: (2025)
Taipan: Efficient and Expressive State Space Language Models with Selective Attention
par: Van Nguyen, Chien, et autres
Publié: (2024)
par: Van Nguyen, Chien, et autres
Publié: (2024)
On the Expressiveness and Length Generalization of Selective State-Space Models on Regular Languages
par: Terzić, Aleksandar, et autres
Publié: (2024)
par: Terzić, Aleksandar, et autres
Publié: (2024)
Characterizing the Behavior of Training Mamba-based State Space Models on GPUs
par: Baruah, Trinayan, et autres
Publié: (2025)
par: Baruah, Trinayan, et autres
Publié: (2025)
Birdie: Advancing State Space Models with Reward-Driven Objectives and Curricula
par: Blouir, Sam, et autres
Publié: (2024)
par: Blouir, Sam, et autres
Publié: (2024)
Repeat After Me: Transformers are Better than State Space Models at Copying
par: Jelassi, Samy, et autres
Publié: (2024)
par: Jelassi, Samy, et autres
Publié: (2024)
MoE-Mamba: Efficient Selective State Space Models with Mixture of Experts
par: Pióro, Maciej, et autres
Publié: (2024)
par: Pióro, Maciej, et autres
Publié: (2024)
Documents similaires
-
Flip-Flop Consistency: Unsupervised Training for Robustness to Prompt Perturbations in LLMs
par: Hejabi, Parsa, et autres
Publié: (2025) -
Lost in State Space: Probing Frozen Mamba Representations
par: Wagh, Bhagyashree, et autres
Publié: (2026) -
The Illusion of State in State-Space Models
par: Merrill, William, et autres
Publié: (2024) -
Task Structure Reverses Layerwise State Encoding in Sequence Models
par: Jiang, Yuhang
Publié: (2026) -
State Space Models as Foundation Models: A Control Theoretic Overview
par: Alonso, Carmen Amo, et autres
Publié: (2024)