A Markov Categorical Framework for Language Modeling
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhang, Yifan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Individual Facts: Investigating Categorical Knowledge Locality of Taxonomy and Meronomy Concepts in GPT Models
par: Burger, Christopher, et autres
Publié: (2024)
par: Burger, Christopher, et autres
Publié: (2024)
The Geometry of Categorical and Hierarchical Concepts in Large Language Models
par: Park, Kiho, et autres
Publié: (2024)
par: Park, Kiho, et autres
Publié: (2024)
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
par: Yang, Zihua, et autres
Publié: (2026)
par: Yang, Zihua, et autres
Publié: (2026)
Training and Evaluating Language Models with Template-based Data Generation
par: Zhang, Yifan
Publié: (2024)
par: Zhang, Yifan
Publié: (2024)
Large Language Models as Markov Chains
par: Zekri, Oussama, et autres
Publié: (2024)
par: Zekri, Oussama, et autres
Publié: (2024)
Markov Constraint as Large Language Model Surrogate
par: Bonlarron, Alexandre, et autres
Publié: (2024)
par: Bonlarron, Alexandre, et autres
Publié: (2024)
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
par: Zhang, Yifan, et autres
Publié: (2024)
par: Zhang, Yifan, et autres
Publié: (2024)
Masked Diffusion Models are Secretly Time-Agnostic Masked Models and Exploit Inaccurate Categorical Sampling
par: Zheng, Kaiwen, et autres
Publié: (2024)
par: Zheng, Kaiwen, et autres
Publié: (2024)
Cancer Diagnosis Categorization in Electronic Health Records Using Large Language Models and BioBERT: Model Performance Evaluation Study
par: Hashtarkhani, Soheil, et autres
Publié: (2025)
par: Hashtarkhani, Soheil, et autres
Publié: (2025)
An Empirical Categorization of Prompting Techniques for Large Language Models: A Practitioner's Guide
par: Fagbohun, Oluwole, et autres
Publié: (2024)
par: Fagbohun, Oluwole, et autres
Publié: (2024)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
par: Zhang, Songming, et autres
Publié: (2026)
par: Zhang, Songming, et autres
Publié: (2026)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
par: Zhang, Xue, et autres
Publié: (2025)
par: Zhang, Xue, et autres
Publié: (2025)
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
KIEval: A Knowledge-grounded Interactive Evaluation Framework for Large Language Models
par: Yu, Zhuohao, et autres
Publié: (2024)
par: Yu, Zhuohao, et autres
Publié: (2024)
Large Language Models Meet Text-Attributed Graphs: A Survey of Integration Frameworks and Applications
par: Su, Guangxin, et autres
Publié: (2025)
par: Su, Guangxin, et autres
Publié: (2025)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
par: Tang, Haoyu, et autres
Publié: (2024)
par: Tang, Haoyu, et autres
Publié: (2024)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
A Common Pitfall of Margin-based Language Model Alignment: Gradient Entanglement
par: Yuan, Hui, et autres
Publié: (2024)
par: Yuan, Hui, et autres
Publié: (2024)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
par: Liu, Jing, et autres
Publié: (2024)
par: Liu, Jing, et autres
Publié: (2024)
Residual Stream Duality in Modern Transformer Architectures
par: Zhang, Yifan
Publié: (2026)
par: Zhang, Yifan
Publié: (2026)
KScope: A Framework for Characterizing the Knowledge Status of Language Models
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
Understanding Understanding: A Pragmatic Framework Motivated by Large Language Models
par: Leyton-Brown, Kevin, et autres
Publié: (2024)
par: Leyton-Brown, Kevin, et autres
Publié: (2024)
Aioli: A Unified Optimization Framework for Language Model Data Mixing
par: Chen, Mayee F., et autres
Publié: (2024)
par: Chen, Mayee F., et autres
Publié: (2024)
Patchscopes: A Unifying Framework for Inspecting Hidden Representations of Language Models
par: Ghandeharioun, Asma, et autres
Publié: (2024)
par: Ghandeharioun, Asma, et autres
Publié: (2024)
Discrete Markov Bridge
par: Li, Hengli, et autres
Publié: (2025)
par: Li, Hengli, et autres
Publié: (2025)
FineSteer: A Unified Framework for Fine-Grained Inference-Time Steering in Large Language Models
par: Weng, Zixuan, et autres
Publié: (2026)
par: Weng, Zixuan, et autres
Publié: (2026)
Clinical QA 2.0: Multi-Task Learning for Answer Extraction and Categorization
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
par: Pattnayak, Priyaranjan, et autres
Publié: (2025)
MOSLD-Bench: Multilingual Open-Set Learning and Discovery Benchmark for Text Categorization
par: Costache, Adriana-Valentina, et autres
Publié: (2026)
par: Costache, Adriana-Valentina, et autres
Publié: (2026)
From Self-Attention to Markov Models: Unveiling the Dynamics of Generative Transformers
par: Ildiz, M. Emrullah, et autres
Publié: (2024)
par: Ildiz, M. Emrullah, et autres
Publié: (2024)
Constrained Entropic Unlearning: A Primal-Dual Framework for Large Language Models
par: Entesari, Taha, et autres
Publié: (2025)
par: Entesari, Taha, et autres
Publié: (2025)
MAPLE: A Framework for Active Preference Learning Guided by Large Language Models
par: Mahmud, Saaduddin, et autres
Publié: (2024)
par: Mahmud, Saaduddin, et autres
Publié: (2024)
Being Strong Progressively! Enhancing Knowledge Distillation of Large Language Models through a Curriculum Learning Framework
par: Liu, Lingyuan, et autres
Publié: (2025)
par: Liu, Lingyuan, et autres
Publié: (2025)
MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining
par: Chen, Zhixun, et autres
Publié: (2025)
par: Chen, Zhixun, et autres
Publié: (2025)
Polysemy of Synthetic Neurons Towards a New Type of Explanatory Categorical Vector Spaces
par: Pichat, Michael, et autres
Publié: (2025)
par: Pichat, Michael, et autres
Publié: (2025)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
par: Bhatt, Gantavya, et autres
Publié: (2024)
par: Bhatt, Gantavya, et autres
Publié: (2024)
Atom of Thoughts for Markov LLM Test-Time Scaling
par: Teng, Fengwei, et autres
Publié: (2025)
par: Teng, Fengwei, et autres
Publié: (2025)
An Efficient Inference Framework for Early-exit Large Language Models
par: Miao, Ruijie, et autres
Publié: (2024)
par: Miao, Ruijie, et autres
Publié: (2024)
SAIF: A Sparse Autoencoder Framework for Interpreting and Steering Instruction Following of Language Models
par: He, Zirui, et autres
Publié: (2025)
par: He, Zirui, et autres
Publié: (2025)
BiTA: Bi-Directional Tuning for Lossless Acceleration in Large Language Models
par: Lin, Feng, et autres
Publié: (2024)
par: Lin, Feng, et autres
Publié: (2024)
Prompt Risk Control: A Rigorous Framework for Responsible Deployment of Large Language Models
par: Zollo, Thomas P., et autres
Publié: (2023)
par: Zollo, Thomas P., et autres
Publié: (2023)
Documents similaires
-
Beyond Individual Facts: Investigating Categorical Knowledge Locality of Taxonomy and Meronomy Concepts in GPT Models
par: Burger, Christopher, et autres
Publié: (2024) -
The Geometry of Categorical and Hierarchical Concepts in Large Language Models
par: Park, Kiho, et autres
Publié: (2024) -
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
par: Yang, Zihua, et autres
Publié: (2026) -
Training and Evaluating Language Models with Template-based Data Generation
par: Zhang, Yifan
Publié: (2024) -
Large Language Models as Markov Chains
par: Zekri, Oussama, et autres
Publié: (2024)