Training Optimal Large Diffusion Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ni, Jinjie, Liu, Qian, Du, Chao, Dou, Longxu, Yan, Hang, Wang, Zili, Pang, Tianyu, Shieh, Michael Qizhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diffusion Language Models are Super Data Learners
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
Unnatural Languages Are Not Bugs but Features for LLMs
di: Duan, Keyu, et al.
Pubblicazione: (2025)
di: Duan, Keyu, et al.
Pubblicazione: (2025)
Efficient Process Reward Model Training via Active Learning
di: Duan, Keyu, et al.
Pubblicazione: (2025)
di: Duan, Keyu, et al.
Pubblicazione: (2025)
RegMix: Data Mixture as Regression for Language Model Pre-training
di: Liu, Qian, et al.
Pubblicazione: (2024)
di: Liu, Qian, et al.
Pubblicazione: (2024)
NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation
di: Liu, Xiangyan, et al.
Pubblicazione: (2025)
di: Liu, Xiangyan, et al.
Pubblicazione: (2025)
Sailor: Open Language Models for South-East Asia
di: Dou, Longxu, et al.
Pubblicazione: (2024)
di: Dou, Longxu, et al.
Pubblicazione: (2024)
Purifying Large Language Models by Ensembling a Small Language Model
di: Li, Tianlin, et al.
Pubblicazione: (2024)
di: Li, Tianlin, et al.
Pubblicazione: (2024)
The Emergence of Abstract Thought in Large Language Models Beyond Any Language
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
di: Chen, Yuxin, et al.
Pubblicazione: (2025)
Reasoning Does Not Necessarily Improve Role-Playing Ability
di: Feng, Xiachong, et al.
Pubblicazione: (2025)
di: Feng, Xiachong, et al.
Pubblicazione: (2025)
Scalable Token-Level Hallucination Detection in Large Language Models
di: Min, Rui, et al.
Pubblicazione: (2026)
di: Min, Rui, et al.
Pubblicazione: (2026)
Your Large Language Model is Secretly a Fairness Proponent and You Should Prompt it Like One
di: Li, Tianlin, et al.
Pubblicazione: (2024)
di: Li, Tianlin, et al.
Pubblicazione: (2024)
A Closer Look at Machine Unlearning for Large Language Models
di: Yuan, Xiaojian, et al.
Pubblicazione: (2024)
di: Yuan, Xiaojian, et al.
Pubblicazione: (2024)
A Survey on Large Language Model-Based Social Agents in Game-Theoretic Scenarios
di: Feng, Xiachong, et al.
Pubblicazione: (2024)
di: Feng, Xiachong, et al.
Pubblicazione: (2024)
Scaling up Masked Diffusion Models on Text
di: Nie, Shen, et al.
Pubblicazione: (2024)
di: Nie, Shen, et al.
Pubblicazione: (2024)
SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis
di: Wu, Zijian, et al.
Pubblicazione: (2025)
di: Wu, Zijian, et al.
Pubblicazione: (2025)
When Attention Sink Emerges in Language Models: An Empirical View
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
di: Gu, Xiangming, et al.
Pubblicazione: (2024)
MCPMark: A Benchmark for Stress-Testing Realistic and Comprehensive MCP Use
di: Wu, Zijian, et al.
Pubblicazione: (2025)
di: Wu, Zijian, et al.
Pubblicazione: (2025)
Imperceptible Jailbreaking against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2025)
di: Gao, Kuofeng, et al.
Pubblicazione: (2025)
Improved Few-Shot Jailbreaking Can Circumvent Aligned Language Models and Their Defenses
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
di: Tao, Chaofan, et al.
Pubblicazione: (2024)
di: Tao, Chaofan, et al.
Pubblicazione: (2024)
Logical Reasoning over Natural Language as Knowledge Representation: A Survey
di: Yang, Zonglin, et al.
Pubblicazione: (2023)
di: Yang, Zonglin, et al.
Pubblicazione: (2023)
Large Language Models to Diffusion Finetuning
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition
di: Huang, Chengsong, et al.
Pubblicazione: (2023)
di: Huang, Chengsong, et al.
Pubblicazione: (2023)
RAPID: Long-Context Inference with Retrieval-Augmented Speculative Decoding
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
di: Chen, Guanzheng, et al.
Pubblicazione: (2025)
Variational Reasoning for Language Models
di: Zhou, Xiangxin, et al.
Pubblicazione: (2025)
di: Zhou, Xiangxin, et al.
Pubblicazione: (2025)
Improving Your Model Ranking on Chatbot Arena by Vote Rigging
di: Min, Rui, et al.
Pubblicazione: (2025)
di: Min, Rui, et al.
Pubblicazione: (2025)
Optimizing Psychological Counseling with Instruction-Tuned Large Language Models
di: Li, Wenjie, et al.
Pubblicazione: (2024)
di: Li, Wenjie, et al.
Pubblicazione: (2024)
Cheating Automatic LLM Benchmarks: Null Models Achieve High Win Rates
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2024)
In-Context Reinforcement Learning for Tool Use in Large Language Models
di: Ye, Yaoqi, et al.
Pubblicazione: (2026)
di: Ye, Yaoqi, et al.
Pubblicazione: (2026)
Defeating the Training-Inference Mismatch via FP16
di: Qi, Penghui, et al.
Pubblicazione: (2025)
di: Qi, Penghui, et al.
Pubblicazione: (2025)
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
di: Luo, Renjie, et al.
Pubblicazione: (2025)
di: Luo, Renjie, et al.
Pubblicazione: (2025)
KARPA: A Training-free Method of Adapting Knowledge Graph as References for Large Language Model's Reasoning Path Aggregation
di: Fang, Siyuan, et al.
Pubblicazione: (2024)
di: Fang, Siyuan, et al.
Pubblicazione: (2024)
Your Agent, Their Asset: A Real-World Safety Analysis of OpenClaw
di: Wang, Zijun, et al.
Pubblicazione: (2026)
di: Wang, Zijun, et al.
Pubblicazione: (2026)
FlowReasoner: Reinforcing Query-Level Meta-Agents
di: Gao, Hongcheng, et al.
Pubblicazione: (2025)
di: Gao, Hongcheng, et al.
Pubblicazione: (2025)
Post-Training Language Models for Crosslingual Consistency
di: Liu, Tianyu, et al.
Pubblicazione: (2026)
di: Liu, Tianyu, et al.
Pubblicazione: (2026)
CodexGraph: Bridging Large Language Models and Code Repositories via Code Graph Databases
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
di: Liu, Xiangyan, et al.
Pubblicazione: (2024)
Personalized Large Language Model Assistant with Evolving Conditional Memory
di: Yuan, Ruifeng, et al.
Pubblicazione: (2023)
di: Yuan, Ruifeng, et al.
Pubblicazione: (2023)
Lifelong Safety Alignment for Language Models
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
di: Wang, Haoyu, et al.
Pubblicazione: (2025)
Balanced Data Sampling for Language Model Training with Clustering
di: Shao, Yunfan, et al.
Pubblicazione: (2024)
di: Shao, Yunfan, et al.
Pubblicazione: (2024)
One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models
di: Shao, Hang, et al.
Pubblicazione: (2023)
di: Shao, Hang, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Diffusion Language Models are Super Data Learners
di: Ni, Jinjie, et al.
Pubblicazione: (2025) -
Unnatural Languages Are Not Bugs but Features for LLMs
di: Duan, Keyu, et al.
Pubblicazione: (2025) -
Efficient Process Reward Model Training via Active Learning
di: Duan, Keyu, et al.
Pubblicazione: (2025) -
RegMix: Data Mixture as Regression for Language Model Pre-training
di: Liu, Qian, et al.
Pubblicazione: (2024) -
NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation
di: Liu, Xiangyan, et al.
Pubblicazione: (2025)