Distributed Specialization: Rare-Token Neurons in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Jing, Wang, Haozheng, Li, Yueheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Emergent Specialization: Rare Token Neurons in Language Models
di: Liu, Jing, et al.
Pubblicazione: (2025)
di: Liu, Jing, et al.
Pubblicazione: (2025)
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
No Clustering, No Routing: How Transformers Actually Process Rare Tokens
di: Liu, Jing
Pubblicazione: (2025)
di: Liu, Jing
Pubblicazione: (2025)
Piculet: Specialized Models-Guided Hallucination Decrease for MultiModal Large Language Models
di: Wang, Kohou, et al.
Pubblicazione: (2024)
di: Wang, Kohou, et al.
Pubblicazione: (2024)
Reinforcement Learning with Promising Tokens for Large Language Models
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)
RHYTHM: Reasoning with Hierarchical Temporal Tokenization for Human Mobility
di: He, Haoyu, et al.
Pubblicazione: (2025)
di: He, Haoyu, et al.
Pubblicazione: (2025)
Survey of Specialized Large Language Model
di: Yang, Chenghan, et al.
Pubblicazione: (2025)
di: Yang, Chenghan, et al.
Pubblicazione: (2025)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
di: Liu, Peijie, et al.
Pubblicazione: (2025)
di: Liu, Peijie, et al.
Pubblicazione: (2025)
Neuron-based Multifractal Analysis of Neuron Interaction Dynamics in Large Models
di: Xiao, Xiongye, et al.
Pubblicazione: (2024)
di: Xiao, Xiongye, et al.
Pubblicazione: (2024)
Re-Initialization Token Learning for Tool-Augmented Large Language Models
di: Li, Chenghao, et al.
Pubblicazione: (2025)
di: Li, Chenghao, et al.
Pubblicazione: (2025)
Meta-Learning Based Few-Shot Graph-Level Anomaly Detection
di: Li, Liting, et al.
Pubblicazione: (2025)
di: Li, Liting, et al.
Pubblicazione: (2025)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
di: Le, Yifan, et al.
Pubblicazione: (2026)
di: Le, Yifan, et al.
Pubblicazione: (2026)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
Beyond Reproducibility: Token Probabilities Expose Large Language Model Nondeterminism
di: Fu, Tairan, et al.
Pubblicazione: (2026)
di: Fu, Tairan, et al.
Pubblicazione: (2026)
Visual Large Language Models for Generalized and Specialized Applications
di: Li, Yifan, et al.
Pubblicazione: (2025)
di: Li, Yifan, et al.
Pubblicazione: (2025)
Cracking Factual Knowledge: A Comprehensive Analysis of Degenerate Knowledge Neurons in Large Language Models
di: Chen, Yuheng, et al.
Pubblicazione: (2024)
di: Chen, Yuheng, et al.
Pubblicazione: (2024)
Membership Inference Attacks on Tokenizers of Large Language Models
di: Tong, Meng, et al.
Pubblicazione: (2025)
di: Tong, Meng, et al.
Pubblicazione: (2025)
Large Language Models Struggle in Token-Level Clinical Named Entity Recognition
di: Lu, Qiuhao, et al.
Pubblicazione: (2024)
di: Lu, Qiuhao, et al.
Pubblicazione: (2024)
GlitchProber: Advancing Effective Detection and Mitigation of Glitch Tokens in Large Language Models
di: Zhang, Zhibo, et al.
Pubblicazione: (2024)
di: Zhang, Zhibo, et al.
Pubblicazione: (2024)
Saliency-driven Dynamic Token Pruning for Large Language Models
di: Tao, Yao, et al.
Pubblicazione: (2025)
di: Tao, Yao, et al.
Pubblicazione: (2025)
Large Language Models Vote: Prompting for Rare Disease Identification
di: Oniani, David, et al.
Pubblicazione: (2023)
di: Oniani, David, et al.
Pubblicazione: (2023)
Probabilistic Token Alignment for Large Language Model Fusion
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2024)
di: Liu, Han, et al.
Pubblicazione: (2024)
ZipVL: Efficient Large Vision-Language Models with Dynamic Token Sparsification
di: He, Yefei, et al.
Pubblicazione: (2024)
di: He, Yefei, et al.
Pubblicazione: (2024)
GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization
di: Wu, Zihui, et al.
Pubblicazione: (2024)
di: Wu, Zihui, et al.
Pubblicazione: (2024)
Leveraging Large Language Models for Rare Disease Named Entity Recognition
di: Xi, Nan Miles, et al.
Pubblicazione: (2025)
di: Xi, Nan Miles, et al.
Pubblicazione: (2025)
Token-Efficient Leverage Learning in Large Language Models
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
Question Classification with Deep Contextualized Transformer
di: Luo, Haozheng, et al.
Pubblicazione: (2019)
di: Luo, Haozheng, et al.
Pubblicazione: (2019)
Multi-Agent Guided Policy Optimization
di: Li, Yueheng, et al.
Pubblicazione: (2025)
di: Li, Yueheng, et al.
Pubblicazione: (2025)
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
di: Wang, Hongbo, et al.
Pubblicazione: (2025)
di: Wang, Hongbo, et al.
Pubblicazione: (2025)
Rethinking Token Reduction for Large Vision-Language Models
di: Wang, Yi, et al.
Pubblicazione: (2026)
di: Wang, Yi, et al.
Pubblicazione: (2026)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
di: Zhang, Shaohua, et al.
Pubblicazione: (2025)
From Anchors to Answers: A Novel Node Tokenizer for Integrating Graph Structure into Large Language Models
di: Ji, Yanbiao, et al.
Pubblicazione: (2024)
di: Ji, Yanbiao, et al.
Pubblicazione: (2024)
Revisiting Large Language Model Pruning using Neuron Semantic Attribution
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
Large Language Models as Discounted Bayesian Filters
di: Zhang, Jensen, et al.
Pubblicazione: (2025)
di: Zhang, Jensen, et al.
Pubblicazione: (2025)
Scaling Capability in Token Space: An Analysis of Large Vision Language Model
di: Li, Tenghui, et al.
Pubblicazione: (2024)
di: Li, Tenghui, et al.
Pubblicazione: (2024)
Assessing and Enhancing Large Language Models in Rare Disease Question-answering
di: Wang, Guanchu, et al.
Pubblicazione: (2024)
di: Wang, Guanchu, et al.
Pubblicazione: (2024)
STAPO: Stabilizing Reinforcement Learning for LLMs by Silencing Rare Spurious Tokens
di: Liu, Shiqi, et al.
Pubblicazione: (2026)
di: Liu, Shiqi, et al.
Pubblicazione: (2026)
Cross-Modal Unlearning via Influential Neuron Path Editing in Multimodal Large Language Models
di: Li, Kunhao, et al.
Pubblicazione: (2025)
di: Li, Kunhao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Emergent Specialization: Rare Token Neurons in Language Models
di: Liu, Jing, et al.
Pubblicazione: (2025) -
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
di: Pan, Zhenyu, et al.
Pubblicazione: (2024) -
No Clustering, No Routing: How Transformers Actually Process Rare Tokens
di: Liu, Jing
Pubblicazione: (2025) -
Piculet: Specialized Models-Guided Hallucination Decrease for MultiModal Large Language Models
di: Wang, Kohou, et al.
Pubblicazione: (2024) -
Reinforcement Learning with Promising Tokens for Large Language Models
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)