Rethinking Personalization in Large Language Models at the Token Level
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Chenheng, Lu, Yijun, Fang, Lizhe, Zheng, Chunyuan, Chai, Jiajun, Wang, Xiaohan, Yin, Guojun, Lin, Wei, Wang, Yisen, Lin, Zhouchen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
ResT: Reshaping Token-Level Policy Gradients for Tool-Use Large Language Models
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
Autoregressive Models Rival Diffusion Models at ANY-ORDER Generation
von: Du, Tianqi, et al.
Veröffentlicht: (2026)
von: Du, Tianqi, et al.
Veröffentlicht: (2026)
AWPO: Enhancing Tool-Use of Large Language Models through Adaptive Integration of Reasoning Rewards
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
von: Lin, Zihan, et al.
Veröffentlicht: (2025)
Language Ranker: A Lightweight Ranking framework for LLM Decoding
von: Zhang, Chenheng, et al.
Veröffentlicht: (2025)
von: Zhang, Chenheng, et al.
Veröffentlicht: (2025)
What is Wrong with Perplexity for Long-context Language Modeling?
von: Fang, Lizhe, et al.
Veröffentlicht: (2024)
von: Fang, Lizhe, et al.
Veröffentlicht: (2024)
Rethinking Invariance in In-context Learning
von: Fang, Lizhe, et al.
Veröffentlicht: (2025)
von: Fang, Lizhe, et al.
Veröffentlicht: (2025)
Implicit Hierarchical GRPO: Decoupling Tool Invocation from Execution for Tool-Integrated Mathematical Reasoning
von: Wang, Li, et al.
Veröffentlicht: (2026)
von: Wang, Li, et al.
Veröffentlicht: (2026)
When Self-Belief Misleads: Active Label Acquisition for Reinforcement Learning with Verifiable Rewards
von: Wang, Li, et al.
Veröffentlicht: (2026)
von: Wang, Li, et al.
Veröffentlicht: (2026)
SSL4RL: Revisiting Self-supervised Learning as Intrinsic Reward for Visual-Language Reasoning
von: Guo, Xiaojun, et al.
Veröffentlicht: (2025)
von: Guo, Xiaojun, et al.
Veröffentlicht: (2025)
ResRL: Boosting LLM Reasoning via Negative Sample Projection Residual Reinforcement Learning
von: Lin, Zihan, et al.
Veröffentlicht: (2026)
von: Lin, Zihan, et al.
Veröffentlicht: (2026)
SAE as a Crystal Ball: Interpretable Features Predict Cross-domain Transferability of LLMs without Training
von: Zhang, Qi, et al.
Veröffentlicht: (2026)
von: Zhang, Qi, et al.
Veröffentlicht: (2026)
Joint Training of Multi-Token Prediction in Reinforcement Learning via Optimal Coefficient Calibration
von: Wang, Zili, et al.
Veröffentlicht: (2026)
von: Wang, Zili, et al.
Veröffentlicht: (2026)
Advancing LLM Safe Alignment with Safety Representation Ranking
von: Du, Tianqi, et al.
Veröffentlicht: (2025)
von: Du, Tianqi, et al.
Veröffentlicht: (2025)
GL-Fusion: Rethinking the Combination of Graph Neural Network and Large Language model
von: Yang, Haotong, et al.
Veröffentlicht: (2024)
von: Yang, Haotong, et al.
Veröffentlicht: (2024)
From Experience to Strategy: Empowering LLM Agents with Trainable Graph Memory
von: Xia, Siyu, et al.
Veröffentlicht: (2025)
von: Xia, Siyu, et al.
Veröffentlicht: (2025)
AMR-SD: Asymmetric Meta-Reflective Self-Distillation for Token-Level Credit Assignment
von: Wei, Zhenlin, et al.
Veröffentlicht: (2026)
von: Wei, Zhenlin, et al.
Veröffentlicht: (2026)
Are Full Rollouts Necessary for On-Policy Distillation?
von: Zhang, Yaocheng, et al.
Veröffentlicht: (2026)
von: Zhang, Yaocheng, et al.
Veröffentlicht: (2026)
LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers
von: Sun, Yike, et al.
Veröffentlicht: (2026)
von: Sun, Yike, et al.
Veröffentlicht: (2026)
Diver: Large Language Model Decoding with Span-Level Mutual Information Verification
von: Lu, Jinliang, et al.
Veröffentlicht: (2024)
von: Lu, Jinliang, et al.
Veröffentlicht: (2024)
$π$-Play: Multi-Agent Self-Play via Privileged Self-Distillation without External Data
von: Zhang, Yaocheng, et al.
Veröffentlicht: (2026)
von: Zhang, Yaocheng, et al.
Veröffentlicht: (2026)
Problematic Tokens: Tokenizer Bias in Large Language Models
von: Yang, Jin, et al.
Veröffentlicht: (2024)
von: Yang, Jin, et al.
Veröffentlicht: (2024)
Tokenization Falling Short: On Subword Robustness in Large Language Models
von: Chai, Yekun, et al.
Veröffentlicht: (2024)
von: Chai, Yekun, et al.
Veröffentlicht: (2024)
Rethinking Tokenization: Crafting Better Tokenizers for Large Language Models
von: Yang, Jinbiao
Veröffentlicht: (2024)
von: Yang, Jinbiao
Veröffentlicht: (2024)
Large Language Model as Token Compressor and Decompressor
von: Li, Wenbing, et al.
Veröffentlicht: (2026)
von: Li, Wenbing, et al.
Veröffentlicht: (2026)
Rethinking Generative Large Language Model Evaluation for Semantic Comprehension
von: Wei, Fangyun, et al.
Veröffentlicht: (2024)
von: Wei, Fangyun, et al.
Veröffentlicht: (2024)
A Unified Representation Underlying the Judgment of Large Language Models
von: Lu, Yi-Long, et al.
Veröffentlicht: (2025)
von: Lu, Yi-Long, et al.
Veröffentlicht: (2025)
Parrot Mind: Towards Explaining the Complex Task Reasoning of Pretrained Large Language Models with Template-Content Structure
von: Yang, Haotong, et al.
Veröffentlicht: (2023)
von: Yang, Haotong, et al.
Veröffentlicht: (2023)
Incorporating Arbitrary Matrix Group Equivariance into KANs
von: Hu, Lexiang, et al.
Veröffentlicht: (2024)
von: Hu, Lexiang, et al.
Veröffentlicht: (2024)
Rethinking Token Reduction for State Space Models
von: Zhan, Zheng, et al.
Veröffentlicht: (2024)
von: Zhan, Zheng, et al.
Veröffentlicht: (2024)
CausalRM: Causal-Theoretic Reward Modeling for RLHF from Observational User Feedbacks
von: Wang, Hao, et al.
Veröffentlicht: (2026)
von: Wang, Hao, et al.
Veröffentlicht: (2026)
Large Language Models Struggle in Token-Level Clinical Named Entity Recognition
von: Lu, Qiuhao, et al.
Veröffentlicht: (2024)
von: Lu, Qiuhao, et al.
Veröffentlicht: (2024)
Democratizing Large Language Models via Personalized Parameter-Efficient Fine-tuning
von: Tan, Zhaoxuan, et al.
Veröffentlicht: (2024)
von: Tan, Zhaoxuan, et al.
Veröffentlicht: (2024)
Semantic Convergence: Harmonizing Recommender Systems via Two-Stage Alignment and Behavioral Semantic Tokenization
von: Li, Guanghan, et al.
Veröffentlicht: (2024)
von: Li, Guanghan, et al.
Veröffentlicht: (2024)
Editing Personality for Large Language Models
von: Mao, Shengyu, et al.
Veröffentlicht: (2023)
von: Mao, Shengyu, et al.
Veröffentlicht: (2023)
ZipRL: Adaptive Multi-Turn Context Compression with Hindsight Response Replay
von: Hu, Zhexin, et al.
Veröffentlicht: (2026)
von: Hu, Zhexin, et al.
Veröffentlicht: (2026)
Remask, Don't Replace: Token-to-Mask Refinement in Diffusion Large Language Models
von: Yao, Lin
Veröffentlicht: (2026)
von: Yao, Lin
Veröffentlicht: (2026)
VScan: Rethinking Visual Token Reduction for Efficient Large Vision-Language Models
von: Zhang, Ce, et al.
Veröffentlicht: (2025)
von: Zhang, Ce, et al.
Veröffentlicht: (2025)
Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness
von: Yang, Zhipeng, et al.
Veröffentlicht: (2026)
von: Yang, Zhipeng, et al.
Veröffentlicht: (2026)
Token-Level Privacy in Large Language Models
von: Harel, Re'em, et al.
Veröffentlicht: (2025)
von: Harel, Re'em, et al.
Veröffentlicht: (2025)
High-Fidelity Pruning for Large Language Models
von: Zhu, Yijun, et al.
Veröffentlicht: (2026)
von: Zhu, Yijun, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
ResT: Reshaping Token-Level Policy Gradients for Tool-Use Large Language Models
von: Lin, Zihan, et al.
Veröffentlicht: (2025) -
Autoregressive Models Rival Diffusion Models at ANY-ORDER Generation
von: Du, Tianqi, et al.
Veröffentlicht: (2026) -
AWPO: Enhancing Tool-Use of Large Language Models through Adaptive Integration of Reasoning Rewards
von: Lin, Zihan, et al.
Veröffentlicht: (2025) -
Language Ranker: A Lightweight Ranking framework for LLM Decoding
von: Zhang, Chenheng, et al.
Veröffentlicht: (2025) -
What is Wrong with Perplexity for Long-context Language Modeling?
von: Fang, Lizhe, et al.
Veröffentlicht: (2024)