JTok: On Token Embedding as another Axis of Scaling Law via Joint Token Self-modulation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Yebin, Wu, Huaijin, Guo, Fu, Yao, Lin, Qin, Xiaohan, Wang, Jingzhi, Zhang, Debing, Yan, Junchi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ssToken: Self-modulated and Semantic-aware Token Selection for LLM Fine-tuning
por: Qin, Xiaohan, et al.
Publicado: (2025)
por: Qin, Xiaohan, et al.
Publicado: (2025)
NITP: Next Implicit Token Prediction for LLM Pre-training
por: Zhang, Xiangdong, et al.
Publicado: (2026)
por: Zhang, Xiangdong, et al.
Publicado: (2026)
Token Encoding for Semantic Recovery
por: Hu, Jingzhi, et al.
Publicado: (2026)
por: Hu, Jingzhi, et al.
Publicado: (2026)
Boosting Order-Preserving and Transferability for Neural Architecture Search: a Joint Architecture Refined Search and Fine-tuning Approach
por: Zhang, Beichen, et al.
Publicado: (2024)
por: Zhang, Beichen, et al.
Publicado: (2024)
Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration
por: Wang, Zili, et al.
Publicado: (2026)
por: Wang, Zili, et al.
Publicado: (2026)
On Self-improving Token Embeddings
por: Kubek, Mario M., et al.
Publicado: (2025)
por: Kubek, Mario M., et al.
Publicado: (2025)
Molecule Generation for Drug Design: a Graph Learning Perspective
por: Yang, Nianzu, et al.
Publicado: (2022)
por: Yang, Nianzu, et al.
Publicado: (2022)
Rethinking Point Clouds as Sequences: A Causal Next-Token Predictive Learning Framework
por: Yao, Yumeng, et al.
Publicado: (2026)
por: Yao, Yumeng, et al.
Publicado: (2026)
Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging
por: Nguyen, Phat, et al.
Publicado: (2026)
por: Nguyen, Phat, et al.
Publicado: (2026)
EvoTok: A Unified Image Tokenizer via Residual Latent Evolution for Visual Understanding and Generation
por: Li, Yan, et al.
Publicado: (2026)
por: Li, Yan, et al.
Publicado: (2026)
Context-Aware Wireless Token Communication via Joint Token Masking and Detection
por: Shin, Junyong, et al.
Publicado: (2026)
por: Shin, Junyong, et al.
Publicado: (2026)
OmniTokenizer: A Joint Image-Video Tokenizer for Visual Generation
por: Wang, Junke, et al.
Publicado: (2024)
por: Wang, Junke, et al.
Publicado: (2024)
Targeted Remasking: Replacing Token Editing with Token-to-Mask Refinement in Discrete Diffusion Language Models
por: Yao, Lin
Publicado: (2026)
por: Yao, Lin
Publicado: (2026)
LaSeR: Reinforcement Learning with Last-Token Self-Rewarding
por: Yang, Wenkai, et al.
Publicado: (2025)
por: Yang, Wenkai, et al.
Publicado: (2025)
Scaling Mesh Generation via Compressive Tokenization
por: Weng, Haohan, et al.
Publicado: (2024)
por: Weng, Haohan, et al.
Publicado: (2024)
Exploring Unbiased Deepfake Detection via Token-Level Shuffling and Mixing
por: Fu, Xinghe, et al.
Publicado: (2025)
por: Fu, Xinghe, et al.
Publicado: (2025)
FineRMoE: Dimension Expansion for Finer-Grained Expert with Its Upcycling Approach
por: Liao, Ning, et al.
Publicado: (2026)
por: Liao, Ning, et al.
Publicado: (2026)
NTKMTL: Mitigating Task Imbalance in Multi-Task Learning from Neural Tangent Kernel Perspective
por: Qin, Xiaohan, et al.
Publicado: (2025)
por: Qin, Xiaohan, et al.
Publicado: (2025)
$μ^2$Tokenizer: Differentiable Multi-Scale Multi-Modal Tokenizer for Radiology Report Generation
por: Li, Siyou, et al.
Publicado: (2025)
por: Li, Siyou, et al.
Publicado: (2025)
Joint Semantic-Channel Coding and Modulation for Token Communications
por: Ying, Jingkai, et al.
Publicado: (2025)
por: Ying, Jingkai, et al.
Publicado: (2025)
Token Distillation: Attention-aware Input Embeddings For New Tokens
por: Dobler, Konstantin, et al.
Publicado: (2025)
por: Dobler, Konstantin, et al.
Publicado: (2025)
FoNE: Precise Single-Token Number Embeddings via Fourier Features
por: Zhou, Tianyi, et al.
Publicado: (2025)
por: Zhou, Tianyi, et al.
Publicado: (2025)
Learning Adaptive and Temporally Causal Video Tokenization in a 1D Latent Space
por: Li, Yan, et al.
Publicado: (2025)
por: Li, Yan, et al.
Publicado: (2025)
Strips as Tokens: Artist Mesh Generation with Native UV Segmentation
por: Xu, Rui, et al.
Publicado: (2026)
por: Xu, Rui, et al.
Publicado: (2026)
Scaling Laws in Patchification: An Image Is Worth 50,176 Tokens And More
por: Wang, Feng, et al.
Publicado: (2025)
por: Wang, Feng, et al.
Publicado: (2025)
TTE-Flash: Accelerating Reasoning-based Multimodal Representations via Think-Then-Embed Tokens
por: Cheng, Jianpeng, et al.
Publicado: (2026)
por: Cheng, Jianpeng, et al.
Publicado: (2026)
TokenSim: Enabling Hardware and Software Exploration for Large Language Model Inference Systems
por: Wu, Feiyang, et al.
Publicado: (2025)
por: Wu, Feiyang, et al.
Publicado: (2025)
Problematic Tokens: Tokenizer Bias in Large Language Models
por: Yang, Jin, et al.
Publicado: (2024)
por: Yang, Jin, et al.
Publicado: (2024)
Token-Guard: Towards Token-Level Hallucination Control via Self-Checking Decoding
por: Zhu, Yifan, et al.
Publicado: (2026)
por: Zhu, Yifan, et al.
Publicado: (2026)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
por: Gong, Yitian, et al.
Publicado: (2026)
por: Gong, Yitian, et al.
Publicado: (2026)
A Text is Worth Several Tokens: Text Embedding from LLMs Secretly Aligns Well with The Key Tokens
por: Nie, Zhijie, et al.
Publicado: (2024)
por: Nie, Zhijie, et al.
Publicado: (2024)
Almost Optimal Algorithms for Token Collision in Anonymous Networks
por: Bai, Sirui, et al.
Publicado: (2024)
por: Bai, Sirui, et al.
Publicado: (2024)
AMR-SD: Asymmetric Meta-Reflective Self-Distillation for Token-Level Credit Assignment
por: Wei, Zhenlin, et al.
Publicado: (2026)
por: Wei, Zhenlin, et al.
Publicado: (2026)
Tokens-per-Parameter Coverage Is Critical for Robust LLM Scaling Law Extrapolation
por: Kricheli, Joshua Shay, et al.
Publicado: (2026)
por: Kricheli, Joshua Shay, et al.
Publicado: (2026)
Attention with Trained Embeddings Provably Selects Important Tokens
por: Wu, Diyuan, et al.
Publicado: (2025)
por: Wu, Diyuan, et al.
Publicado: (2025)
WinTok: A Win-Win Hybrid Tokenizer via Decomposing Visual Understanding and Generation with Transferable Tokens
por: Guo, Yiwei, et al.
Publicado: (2026)
por: Guo, Yiwei, et al.
Publicado: (2026)
TokenDance: Token-to-Token Music-to-Dance Generation with Bidirectional Mamba
por: Yang, Ziyue, et al.
Publicado: (2026)
por: Yang, Ziyue, et al.
Publicado: (2026)
Scaling Image Tokenizers with Grouped Spherical Quantization
por: Wang, Jiangtao, et al.
Publicado: (2024)
por: Wang, Jiangtao, et al.
Publicado: (2024)
Rethinking Video Tokenization: A Conditioned Diffusion-based Approach
por: Yang, Nianzu, et al.
Publicado: (2025)
por: Yang, Nianzu, et al.
Publicado: (2025)
Learnings from Scaling Visual Tokenizers for Reconstruction and Generation
por: Hansen-Estruch, Philippe, et al.
Publicado: (2025)
por: Hansen-Estruch, Philippe, et al.
Publicado: (2025)
Ejemplares similares
-
ssToken: Self-modulated and Semantic-aware Token Selection for LLM Fine-tuning
por: Qin, Xiaohan, et al.
Publicado: (2025) -
NITP: Next Implicit Token Prediction for LLM Pre-training
por: Zhang, Xiangdong, et al.
Publicado: (2026) -
Token Encoding for Semantic Recovery
por: Hu, Jingzhi, et al.
Publicado: (2026) -
Boosting Order-Preserving and Transferability for Neural Architecture Search: a Joint Architecture Refined Search and Fine-tuning Approach
por: Zhang, Beichen, et al.
Publicado: (2024) -
Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration
por: Wang, Zili, et al.
Publicado: (2026)