Modular Linear Tokenization (MLT)
Fuente:
arXiv
Guardado en:
| Autor principal: | Schmitz, Tcharlies |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Harmonic Token Projection (HTP): A Vocabulary-Free, Training-Free, Deterministic, and Reversible Embedding Methodology
por: Schmitz, Tcharlies
Publicado: (2025)
por: Schmitz, Tcharlies
Publicado: (2025)
MST-Direct: Matching via Sinkhorn Transport for Multivariate Geostatistical Simulation with Complex Non-Linear Dependencies
por: Schmitz, Tchalies Bachmann
Publicado: (2026)
por: Schmitz, Tchalies Bachmann
Publicado: (2026)
STILL: Selecting Tokens for Intra-Layer Hybrid Attention to Linearize LLMs
por: Meng, Weikang, et al.
Publicado: (2026)
por: Meng, Weikang, et al.
Publicado: (2026)
Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction
por: Wu, Ziyang, et al.
Publicado: (2024)
por: Wu, Ziyang, et al.
Publicado: (2024)
Implicit Optimization Bias of Next-Token Prediction in Linear Models
por: Thrampoulidis, Christos
Publicado: (2024)
por: Thrampoulidis, Christos
Publicado: (2024)
Patched-DeltaNet: Token-Level Event-Driven Memory for Linear-Time Anomaly Detection
por: Lee, Tae-Gyun, et al.
Publicado: (2026)
por: Lee, Tae-Gyun, et al.
Publicado: (2026)
Alleviating Forgetfulness of Linear Attention by Hybrid Sparse Attention and Contextualized Learnable Token Eviction
por: He, Mutian, et al.
Publicado: (2025)
por: He, Mutian, et al.
Publicado: (2025)
Neural Attention Search Linear: Towards Adaptive Token-Level Hybrid Attention Models
por: Deng, Difan, et al.
Publicado: (2026)
por: Deng, Difan, et al.
Publicado: (2026)
Modular Deep Learning
por: Pfeiffer, Jonas, et al.
Publicado: (2023)
por: Pfeiffer, Jonas, et al.
Publicado: (2023)
Wireless TokenCom: RL-Based Tokenizer Agreement for Multi-User Wireless Token Communications
por: Zeinali, Farshad, et al.
Publicado: (2026)
por: Zeinali, Farshad, et al.
Publicado: (2026)
Scalable Optimization in the Modular Norm
por: Large, Tim, et al.
Publicado: (2024)
por: Large, Tim, et al.
Publicado: (2024)
Riemannian Optimization in Modular Systems
por: Pehle, Christian, et al.
Publicado: (2026)
por: Pehle, Christian, et al.
Publicado: (2026)
TokenFormer: Rethinking Transformer Scaling with Tokenized Model Parameters
por: Wang, Haiyang, et al.
Publicado: (2024)
por: Wang, Haiyang, et al.
Publicado: (2024)
Lost in Tokenization: Fundamental Trade-offs in Graph Tokenization for Transformers
por: Bechler-Speicher, Maya, et al.
Publicado: (2026)
por: Bechler-Speicher, Maya, et al.
Publicado: (2026)
Adaptive Tokenization: On the Hop-Overpriority Problem in Tokenized Graph Learning Models
por: Wang, Zhibiao, et al.
Publicado: (2025)
por: Wang, Zhibiao, et al.
Publicado: (2025)
Trading Complexity for Expressivity Through Structured Generalized Linear Token Mixing
por: Fagnou, Erwan, et al.
Publicado: (2026)
por: Fagnou, Erwan, et al.
Publicado: (2026)
CAD-Tokenizer: Towards Text-based CAD Prototyping via Modality-Specific Tokenization
por: Wang, Ruiyu, et al.
Publicado: (2025)
por: Wang, Ruiyu, et al.
Publicado: (2025)
Modular Jump Gaussian Processes
por: Flowers, Anna R., et al.
Publicado: (2025)
por: Flowers, Anna R., et al.
Publicado: (2025)
Is One Token All It Takes? Graph Pooling Tokens for LLM-based GraphQA
por: Grover, Ankit, et al.
Publicado: (2026)
por: Grover, Ankit, et al.
Publicado: (2026)
Efficient Hyperdimensional Computing with Modular Composite Representations
por: Angioli, Marco, et al.
Publicado: (2025)
por: Angioli, Marco, et al.
Publicado: (2025)
PMODE: Theoretically Grounded and Modular Mixture Modeling
por: Vandermeulen, Robert A.
Publicado: (2025)
por: Vandermeulen, Robert A.
Publicado: (2025)
Deep Modularity Networks with Diversity-Preserving Regularization
por: Salehi, Yasmin, et al.
Publicado: (2025)
por: Salehi, Yasmin, et al.
Publicado: (2025)
Provable Benefits of Sinusoidal Activation for Modular Addition
por: Huang, Tianlong, et al.
Publicado: (2025)
por: Huang, Tianlong, et al.
Publicado: (2025)
Detecting Defective Wafers Via Modular Networks
por: Zhang, Yifeng, et al.
Publicado: (2025)
por: Zhang, Yifeng, et al.
Publicado: (2025)
DNN Modularization via Activation-Driven Training
por: Ngo, Tuan, et al.
Publicado: (2024)
por: Ngo, Tuan, et al.
Publicado: (2024)
A Probabilistic Framework for Modular Continual Learning
por: Valkov, Lazar, et al.
Publicado: (2023)
por: Valkov, Lazar, et al.
Publicado: (2023)
Breaking Neural Network Scaling Laws with Modularity
por: Boopathy, Akhilan, et al.
Publicado: (2024)
por: Boopathy, Akhilan, et al.
Publicado: (2024)
GT-SNT: A Linear-Time Transformer for Large-Scale Graphs via Spiking Node Tokenization
por: Zhang, Huizhe, et al.
Publicado: (2025)
por: Zhang, Huizhe, et al.
Publicado: (2025)
Not All Tokens Are Meant to Be Forgotten
por: Zhou, Xiangyu, et al.
Publicado: (2025)
por: Zhou, Xiangyu, et al.
Publicado: (2025)
Token Sample Complexity of Attention
por: Bohbot, Léa, et al.
Publicado: (2025)
por: Bohbot, Léa, et al.
Publicado: (2025)
Multi-Token Residual Prediction
por: Xu, Yufeng, et al.
Publicado: (2026)
por: Xu, Yufeng, et al.
Publicado: (2026)
Token-by-Token Regeneration and Domain Biases: A Benchmark of LLMs on Advanced Mathematical Problem-Solving
por: Evstafev, Evgenii
Publicado: (2025)
por: Evstafev, Evgenii
Publicado: (2025)
DeepTokenEEG Enhancing Mild Cognitive Impairment and Alzheimers Classification via Tokenized EEG Features
por: Nguyen-Quang, Thinh, et al.
Publicado: (2026)
por: Nguyen-Quang, Thinh, et al.
Publicado: (2026)
Tokenizing Loops of Antibodies
por: Fang, Ada, et al.
Publicado: (2025)
por: Fang, Ada, et al.
Publicado: (2025)
Adaptive Protein Tokenization
por: Dilip, Rohit, et al.
Publicado: (2026)
por: Dilip, Rohit, et al.
Publicado: (2026)
Modular Federated Learning: A Meta-Framework Perspective
por: Vicente, Frederico, et al.
Publicado: (2025)
por: Vicente, Frederico, et al.
Publicado: (2025)
A Modular Framework for Rapidly Building Intrusion Predictors
por: Wang, Xiaoxuan, et al.
Publicado: (2025)
por: Wang, Xiaoxuan, et al.
Publicado: (2025)
AXLearn: Modular, Hardware-Agnostic Large Model Training
por: Lee, Mark, et al.
Publicado: (2025)
por: Lee, Mark, et al.
Publicado: (2025)
Grokking of Diffusion Models: Case Study on Modular Addition
por: Kim, Joon Hyeok, et al.
Publicado: (2026)
por: Kim, Joon Hyeok, et al.
Publicado: (2026)
Clustering and Alignment: Understanding the Training Dynamics in Modular Addition
por: Musat, Tiberiu
Publicado: (2024)
por: Musat, Tiberiu
Publicado: (2024)
Ejemplares similares
-
Harmonic Token Projection (HTP): A Vocabulary-Free, Training-Free, Deterministic, and Reversible Embedding Methodology
por: Schmitz, Tcharlies
Publicado: (2025) -
MST-Direct: Matching via Sinkhorn Transport for Multivariate Geostatistical Simulation with Complex Non-Linear Dependencies
por: Schmitz, Tchalies Bachmann
Publicado: (2026) -
STILL: Selecting Tokens for Intra-Layer Hybrid Attention to Linearize LLMs
por: Meng, Weikang, et al.
Publicado: (2026) -
Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction
por: Wu, Ziyang, et al.
Publicado: (2024) -
Implicit Optimization Bias of Next-Token Prediction in Linear Models
por: Thrampoulidis, Christos
Publicado: (2024)