NDP: Next Distribution Prediction as a More Broad Target
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ruan, Junhao, Abudula, Abudukeyumu, Liu, Xinyu, Li, Bei, Li, Yinqiao, Wang, Chenglong, Fan, Yuchun, Ge, Yuan, Xiao, Tong, Zhu, Jingbo |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MTR-Suite: A Framework for Evaluating and Synthesizing Conversational Retrieval Benchmarks
von: Ruan, Junhao, et al.
Veröffentlicht: (2026)
von: Ruan, Junhao, et al.
Veröffentlicht: (2026)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
von: Liu, Xinyu, et al.
Veröffentlicht: (2025)
von: Liu, Xinyu, et al.
Veröffentlicht: (2025)
SUBQRAG: Sub-Question Driven Dynamic Graph RAG
von: Li, Jiaoyang, et al.
Veröffentlicht: (2025)
von: Li, Jiaoyang, et al.
Veröffentlicht: (2025)
EIT: Enhanced Interactive Transformer
von: Zheng, Tong, et al.
Veröffentlicht: (2022)
von: Zheng, Tong, et al.
Veröffentlicht: (2022)
Hybrid Alignment Training for Large Language Models
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
von: Wang, Chenglong, et al.
Veröffentlicht: (2024)
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
von: Luo, Yingfeng, et al.
Veröffentlicht: (2025)
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
von: Wang, Yilin, et al.
Veröffentlicht: (2026)
von: Wang, Yilin, et al.
Veröffentlicht: (2026)
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
von: Liu, Xinyu, et al.
Veröffentlicht: (2024)
von: Liu, Xinyu, et al.
Veröffentlicht: (2024)
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
von: Luo, Yingfeng, et al.
Veröffentlicht: (2026)
von: Luo, Yingfeng, et al.
Veröffentlicht: (2026)
LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
von: Fan, Yuchun, et al.
Veröffentlicht: (2026)
von: Fan, Yuchun, et al.
Veröffentlicht: (2026)
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
von: Liu, Xinyu, et al.
Veröffentlicht: (2026)
von: Liu, Xinyu, et al.
Veröffentlicht: (2026)
Cross-layer Attention Sharing for Pre-trained Large Language Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
On the Emotion Understanding of Synthesized Speech
von: Ge, Yuan, et al.
Veröffentlicht: (2026)
von: Ge, Yuan, et al.
Veröffentlicht: (2026)
PartialFormer: Modeling Part Instead of Whole for Machine Translation
von: Zheng, Tong, et al.
Veröffentlicht: (2023)
von: Zheng, Tong, et al.
Veröffentlicht: (2023)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
von: Zhou, Hang, et al.
Veröffentlicht: (2024)
von: Zhou, Hang, et al.
Veröffentlicht: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
von: Huang, Pengcheng, et al.
Veröffentlicht: (2024)
von: Huang, Pengcheng, et al.
Veröffentlicht: (2024)
Foundations of Large Language Models
von: Xiao, Tong, et al.
Veröffentlicht: (2025)
von: Xiao, Tong, et al.
Veröffentlicht: (2025)
Early Exit Is a Natural Capability in Transformer-based Models: An Empirical Study on Early Exit without Joint Optimization
von: Shan, Weiqiao, et al.
Veröffentlicht: (2024)
von: Shan, Weiqiao, et al.
Veröffentlicht: (2024)
StyleBench: Evaluating Speech Language Models on Conversational Speaking Style Control
von: Zhao, Haishu, et al.
Veröffentlicht: (2026)
von: Zhao, Haishu, et al.
Veröffentlicht: (2026)
Revealing the Parallel Multilingual Learning within Large Language Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
Causal Autoregressive Diffusion Language Model
von: Ruan, Junhao, et al.
Veröffentlicht: (2026)
von: Ruan, Junhao, et al.
Veröffentlicht: (2026)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
von: Chang, Kaiyan, et al.
Veröffentlicht: (2025)
von: Chang, Kaiyan, et al.
Veröffentlicht: (2025)
Text-Preserving Lossy Text Compression: A Study of Strategic Deletion and LLM Reconstruction
von: Zou, Yuchun, et al.
Veröffentlicht: (2026)
von: Zou, Yuchun, et al.
Veröffentlicht: (2026)
Efficient Prompting Methods for Large Language Models: A Survey
von: Chang, Kaiyan, et al.
Veröffentlicht: (2024)
von: Chang, Kaiyan, et al.
Veröffentlicht: (2024)
GRAM: A Generative Foundation Reward Model for Reward Generalization
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
RankPrompt: Step-by-Step Comparisons Make Language Models Better Reasoners
von: Hu, Chi, et al.
Veröffentlicht: (2024)
von: Hu, Chi, et al.
Veröffentlicht: (2024)
SpanNorm: Reconciling Training Stability and Performance in Deep Transformers
von: Wang, Chao, et al.
Veröffentlicht: (2026)
von: Wang, Chao, et al.
Veröffentlicht: (2026)
FLEXI: Benchmarking Full-duplex Human-LLM Speech Interaction
von: Ge, Yuan, et al.
Veröffentlicht: (2025)
von: Ge, Yuan, et al.
Veröffentlicht: (2025)
Clustering and Ranking: Diversity-preserved Instruction Selection through Expert-aligned Quality Estimation
von: Ge, Yuan, et al.
Veröffentlicht: (2024)
von: Ge, Yuan, et al.
Veröffentlicht: (2024)
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
von: Zhao, Runsong, et al.
Veröffentlicht: (2024)
von: Zhao, Runsong, et al.
Veröffentlicht: (2024)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
von: Wang, Chenglong, et al.
Veröffentlicht: (2025)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
von: Wang, Jianjin, et al.
Veröffentlicht: (2025)
von: Wang, Jianjin, et al.
Veröffentlicht: (2025)
KALL-E:Autoregressive Speech Synthesis with Next-Distribution Prediction
von: Xia, Kangxiang, et al.
Veröffentlicht: (2024)
von: Xia, Kangxiang, et al.
Veröffentlicht: (2024)
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
von: Mu, Yongyu, et al.
Veröffentlicht: (2025)
SageLM: A Multi-aspect and Explainable Large Language Model for Speech Judgement
von: Ge, Yuan, et al.
Veröffentlicht: (2025)
von: Ge, Yuan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
MTR-Suite: A Framework for Evaluating and Synthesizing Conversational Retrieval Benchmarks
von: Ruan, Junhao, et al.
Veröffentlicht: (2026) -
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
von: Fan, Yuchun, et al.
Veröffentlicht: (2025) -
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
von: Fan, Yuchun, et al.
Veröffentlicht: (2025) -
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
von: Liu, Xinyu, et al.
Veröffentlicht: (2025) -
SUBQRAG: Sub-Question Driven Dynamic Graph RAG
von: Li, Jiaoyang, et al.
Veröffentlicht: (2025)