JTok: On Token Embedding as another Axis of Scaling Law via Joint Token Self-modulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Yebin, Wu, Huaijin, Guo, Fu, Yao, Lin, Qin, Xiaohan, Wang, Jingzhi, Zhang, Debing, Yan, Junchi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ssToken: Self-modulated and Semantic-aware Token Selection for LLM Fine-tuning
par: Qin, Xiaohan, et autres
Publié: (2025)
par: Qin, Xiaohan, et autres
Publié: (2025)
NITP: Next Implicit Token Prediction for LLM Pre-training
par: Zhang, Xiangdong, et autres
Publié: (2026)
par: Zhang, Xiangdong, et autres
Publié: (2026)
Token Encoding for Semantic Recovery
par: Hu, Jingzhi, et autres
Publié: (2026)
par: Hu, Jingzhi, et autres
Publié: (2026)
Boosting Order-Preserving and Transferability for Neural Architecture Search: a Joint Architecture Refined Search and Fine-tuning Approach
par: Zhang, Beichen, et autres
Publié: (2024)
par: Zhang, Beichen, et autres
Publié: (2024)
Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration
par: Wang, Zili, et autres
Publié: (2026)
par: Wang, Zili, et autres
Publié: (2026)
On Self-improving Token Embeddings
par: Kubek, Mario M., et autres
Publié: (2025)
par: Kubek, Mario M., et autres
Publié: (2025)
Molecule Generation for Drug Design: a Graph Learning Perspective
par: Yang, Nianzu, et autres
Publié: (2022)
par: Yang, Nianzu, et autres
Publié: (2022)
Rethinking Point Clouds as Sequences: A Causal Next-Token Predictive Learning Framework
par: Yao, Yumeng, et autres
Publié: (2026)
par: Yao, Yumeng, et autres
Publié: (2026)
Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging
par: Nguyen, Phat, et autres
Publié: (2026)
par: Nguyen, Phat, et autres
Publié: (2026)
EvoTok: A Unified Image Tokenizer via Residual Latent Evolution for Visual Understanding and Generation
par: Li, Yan, et autres
Publié: (2026)
par: Li, Yan, et autres
Publié: (2026)
Context-Aware Wireless Token Communication via Joint Token Masking and Detection
par: Shin, Junyong, et autres
Publié: (2026)
par: Shin, Junyong, et autres
Publié: (2026)
OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation
par: Wang, Junke, et autres
Publié: (2024)
par: Wang, Junke, et autres
Publié: (2024)
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
par: Yao, Lin
Publié: (2026)
par: Yao, Lin
Publié: (2026)
LaSeR: Reinforcement Learning with Last-Token Self-Rewarding
par: Yang, Wenkai, et autres
Publié: (2025)
par: Yang, Wenkai, et autres
Publié: (2025)
Scaling Mesh Generation via Compressive Tokenization
par: Weng, Haohan, et autres
Publié: (2024)
par: Weng, Haohan, et autres
Publié: (2024)
Exploring Unbiased Deepfake Detection via Token-Level Shuffling and Mixing
par: Fu, Xinghe, et autres
Publié: (2025)
par: Fu, Xinghe, et autres
Publié: (2025)
FineRMoE: Dimension Expansion for Finer-Grained Expert with Its Upcycling Approach
par: Liao, Ning, et autres
Publié: (2026)
par: Liao, Ning, et autres
Publié: (2026)
NTKMTL: Mitigating Task Imbalance in Multi-Task Learning from Neural Tangent Kernel Perspective
par: Qin, Xiaohan, et autres
Publié: (2025)
par: Qin, Xiaohan, et autres
Publié: (2025)
$μ^2$Tokenizer: Differentiable Multi-Scale Multi-Modal Tokenizer for Radiology Report Generation
par: Li, Siyou, et autres
Publié: (2025)
par: Li, Siyou, et autres
Publié: (2025)
Joint Semantic-Channel Coding and Modulation for Token Communications
par: Ying, Jingkai, et autres
Publié: (2025)
par: Ying, Jingkai, et autres
Publié: (2025)
Token Distillation: Attention-aware Input Embeddings For New Tokens
par: Dobler, Konstantin, et autres
Publié: (2025)
par: Dobler, Konstantin, et autres
Publié: (2025)
FoNE: Precise Single-Token Number Embeddings via Fourier Features
par: Zhou, Tianyi, et autres
Publié: (2025)
par: Zhou, Tianyi, et autres
Publié: (2025)
Learning Adaptive and Temporally Causal Video Tokenization in a 1D Latent Space
par: Li, Yan, et autres
Publié: (2025)
par: Li, Yan, et autres
Publié: (2025)
Strips as Tokens: Artist Mesh Generation with Native UV Segmentation
par: Xu, Rui, et autres
Publié: (2026)
par: Xu, Rui, et autres
Publié: (2026)
Scaling Laws in Patchification: An Image Is Worth 50,176 Tokens And More
par: Wang, Feng, et autres
Publié: (2025)
par: Wang, Feng, et autres
Publié: (2025)
TTE-Flash: Accelerating Reasoning-based Multimodal Representations via Think-Then-Embed Tokens
par: Cheng, Jianpeng, et autres
Publié: (2026)
par: Cheng, Jianpeng, et autres
Publié: (2026)
TokenSim: Enabling Hardware and Software Exploration for Large Language Model Inference Systems
par: Wu, Feiyang, et autres
Publié: (2025)
par: Wu, Feiyang, et autres
Publié: (2025)
Problematic Tokens: Tokenizer Bias in Large Language Models
par: Yang, Jin, et autres
Publié: (2024)
par: Yang, Jin, et autres
Publié: (2024)
Token-Guard: Towards Token-Level Hallucination Control via Self-Checking Decoding
par: Zhu, Yifan, et autres
Publié: (2026)
par: Zhu, Yifan, et autres
Publié: (2026)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
A Text is Worth Several Tokens: Text Embedding from LLMs Secretly Aligns Well with The Key Tokens
par: Nie, Zhijie, et autres
Publié: (2024)
par: Nie, Zhijie, et autres
Publié: (2024)
Almost Optimal Algorithms for Token Collision in Anonymous Networks
par: Bai, Sirui, et autres
Publié: (2024)
par: Bai, Sirui, et autres
Publié: (2024)
AMR-SD: Asymmetric Meta-Reflective Self-Distillation for Token-Level Credit Assignment
par: Wei, Zhenlin, et autres
Publié: (2026)
par: Wei, Zhenlin, et autres
Publié: (2026)
Tokens-per-Parameter Coverage Is Critical for Robust LLM Scaling Law Extrapolation
par: Kricheli, Joshua Shay, et autres
Publié: (2026)
par: Kricheli, Joshua Shay, et autres
Publié: (2026)
Attention with Trained Embeddings Provably Selects Important Tokens
par: Wu, Diyuan, et autres
Publié: (2025)
par: Wu, Diyuan, et autres
Publié: (2025)
WinTok: A Win-Win Hybrid Tokenizer via Decomposing Visual Understanding and Generation with Transferable Tokens
par: Guo, Yiwei, et autres
Publié: (2026)
par: Guo, Yiwei, et autres
Publié: (2026)
TokenDance: Token-to-Token Music-to-Dance Generation with Bidirectional Mamba
par: Yang, Ziyue, et autres
Publié: (2026)
par: Yang, Ziyue, et autres
Publié: (2026)
Scaling Image Tokenizers with Grouped Spherical Quantization
par: Wang, Jiangtao, et autres
Publié: (2024)
par: Wang, Jiangtao, et autres
Publié: (2024)
Rethinking Video Tokenization: A Conditioned Diffusion-based Approach
par: Yang, Nianzu, et autres
Publié: (2025)
par: Yang, Nianzu, et autres
Publié: (2025)
Learnings from Scaling Visual Tokenizers for Reconstruction and Generation
par: Hansen-Estruch, Philippe, et autres
Publié: (2025)
par: Hansen-Estruch, Philippe, et autres
Publié: (2025)
Documents similaires
-
ssToken: Self-modulated and Semantic-aware Token Selection for LLM Fine-tuning
par: Qin, Xiaohan, et autres
Publié: (2025) -
NITP: Next Implicit Token Prediction for LLM Pre-training
par: Zhang, Xiangdong, et autres
Publié: (2026) -
Token Encoding for Semantic Recovery
par: Hu, Jingzhi, et autres
Publié: (2026) -
Boosting Order-Preserving and Transferability for Neural Architecture Search: a Joint Architecture Refined Search and Fine-tuning Approach
par: Zhang, Beichen, et autres
Publié: (2024) -
Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration
par: Wang, Zili, et autres
Publié: (2026)