Focus on the Core: Empowering Diffusion Large Language Models by Self-Contrast
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Feng, Jinyuan, Yu, Xin, Chen, Yiqun, Wei, Xiaochi, Gao, Yan, Wu, Yi, Hu, Yao, Pu, Zhiqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning
par: Chen, Yiqun, et autres
Publié: (2026)
par: Chen, Yiqun, et autres
Publié: (2026)
CoMoE: Contrastive Representation for Mixture-of-Experts in Parameter-Efficient Fine-tuning
par: Feng, Jinyuan, et autres
Publié: (2025)
par: Feng, Jinyuan, et autres
Publié: (2025)
OASES: Outcome-Aligned Search-Evaluation Co-Training for Agentic Search
par: Zhang, Erhan, et autres
Publié: (2026)
par: Zhang, Erhan, et autres
Publié: (2026)
Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended Long-Form Generation
par: Yang, Zixuan, et autres
Publié: (2026)
par: Yang, Zixuan, et autres
Publié: (2026)
JADE: Bridging the Strategic-Operational Gap in Dynamic Agentic RAG
par: Chen, Yiqun, et autres
Publié: (2026)
par: Chen, Yiqun, et autres
Publié: (2026)
UnityMAS-O: A General RL Optimization Framework for LLM-Based Multi-Agent Systems
par: Chen, Yiqun, et autres
Publié: (2026)
par: Chen, Yiqun, et autres
Publié: (2026)
OMoE: Diversifying Mixture of Low-Rank Adaptation by Orthogonal Finetuning
par: Feng, Jinyuan, et autres
Publié: (2025)
par: Feng, Jinyuan, et autres
Publié: (2025)
Aligning Large Language Models with Searcher Preferences
par: Wu, Wei, et autres
Publié: (2026)
par: Wu, Wei, et autres
Publié: (2026)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
Enhancing Large Language Models'Machine Translation via Dynamic Focus Anchoring
par: Ding, Qiuyu, et autres
Publié: (2025)
par: Ding, Qiuyu, et autres
Publié: (2025)
Large Language Models are Contrastive Reasoners
par: Yao, Liang
Publié: (2024)
par: Yao, Liang
Publié: (2024)
Relative-Based Scaling Law for Neural Language Models
par: Yue, Baoqing, et autres
Publié: (2025)
par: Yue, Baoqing, et autres
Publié: (2025)
Focused Large Language Models are Stable Many-Shot Learners
par: Yuan, Peiwen, et autres
Publié: (2024)
par: Yuan, Peiwen, et autres
Publié: (2024)
Self-Prompting Large Language Models for Zero-Shot Open-Domain QA
par: Li, Junlong, et autres
Publié: (2022)
par: Li, Junlong, et autres
Publié: (2022)
Self Speculative Decoding for Diffusion Large Language Models
par: Gao, Yifeng, et autres
Publié: (2025)
par: Gao, Yifeng, et autres
Publié: (2025)
WizardCoder: Empowering Code Large Language Models with Evol-Instruct
par: Luo, Ziyang, et autres
Publié: (2023)
par: Luo, Ziyang, et autres
Publié: (2023)
Focus-LIME: Surgical Interpretation of Long-Context Large Language Models via Proxy-Based Neighborhood Selection
par: Liu, Junhao, et autres
Publié: (2026)
par: Liu, Junhao, et autres
Publié: (2026)
Knowledge-Graph Paths as Intermediate Supervision for Self-Evolving Search Agents
par: Wu, Huyu, et autres
Publié: (2026)
par: Wu, Huyu, et autres
Publié: (2026)
Adaptive Testing for Segmenting Watermarked Texts From Language Models
par: Li, Xingchi, et autres
Publié: (2025)
par: Li, Xingchi, et autres
Publié: (2025)
AtomR: Atomic Operator-Empowered Large Language Models for Heterogeneous Knowledge Reasoning
par: Xin, Amy, et autres
Publié: (2024)
par: Xin, Amy, et autres
Publié: (2024)
Evaluating Large Language Models for Evidence-Based Clinical Question Answering
par: Wang, Can, et autres
Publié: (2025)
par: Wang, Can, et autres
Publié: (2025)
Dream 7B: Diffusion Large Language Models
par: Ye, Jiacheng, et autres
Publié: (2025)
par: Ye, Jiacheng, et autres
Publié: (2025)
SuperWriter: Reflection-Driven Long-Form Generation with Large Language Models
par: Wu, Yuhao, et autres
Publié: (2025)
par: Wu, Yuhao, et autres
Publié: (2025)
HSCR: Hierarchical Self-Contrastive Rewarding for Aligning Medical Vision Language Models
par: Jiang, Songtao, et autres
Publié: (2025)
par: Jiang, Songtao, et autres
Publié: (2025)
OverleafCopilot: Empowering Academic Writing in Overleaf with Large Language Models
par: Wen, Haomin, et autres
Publié: (2024)
par: Wen, Haomin, et autres
Publié: (2024)
CataLM: Empowering Catalyst Design Through Large Language Models
par: Wang, Ludi, et autres
Publié: (2024)
par: Wang, Ludi, et autres
Publié: (2024)
Tool Learning with Large Language Models: A Survey
par: Qu, Changle, et autres
Publié: (2024)
par: Qu, Changle, et autres
Publié: (2024)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
par: Wu, Shiwei, et autres
Publié: (2024)
par: Wu, Shiwei, et autres
Publié: (2024)
MMEvol: Empowering Multimodal Large Language Models with Evol-Instruct
par: Luo, Run, et autres
Publié: (2024)
par: Luo, Run, et autres
Publié: (2024)
Towards Completeness-Oriented Tool Retrieval for Large Language Models
par: Qu, Changle, et autres
Publié: (2024)
par: Qu, Changle, et autres
Publié: (2024)
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
par: Sun, Hao, et autres
Publié: (2024)
par: Sun, Hao, et autres
Publié: (2024)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
par: Hu, Yujia, et autres
Publié: (2024)
par: Hu, Yujia, et autres
Publié: (2024)
Empowering Working Memory for Large Language Model Agents
par: Guo, Jing, et autres
Publié: (2023)
par: Guo, Jing, et autres
Publié: (2023)
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
par: Shi, Zhengliang, et autres
Publié: (2024)
par: Shi, Zhengliang, et autres
Publié: (2024)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
par: Cheng, Xiaoxue, et autres
Publié: (2024)
par: Cheng, Xiaoxue, et autres
Publié: (2024)
Self-Explained Keywords Empower Large Language Models for Code Generation
par: Fan, Lishui, et autres
Publié: (2024)
par: Fan, Lishui, et autres
Publié: (2024)
AR-MAP: Are Autoregressive Large Language Models Implicit Teachers for Diffusion Large Language Models?
par: Lin, Liang, et autres
Publié: (2026)
par: Lin, Liang, et autres
Publié: (2026)
Nature-Inspired Population-Based Evolution of Large Language Models
par: Zhang, Yiqun, et autres
Publié: (2025)
par: Zhang, Yiqun, et autres
Publié: (2025)
EdgeMoE: Empowering Sparse Large Language Models on Mobile Devices
par: Yi, Rongjie, et autres
Publié: (2023)
par: Yi, Rongjie, et autres
Publié: (2023)
Paths-over-Graph: Knowledge Graph Empowered Large Language Model Reasoning
par: Tan, Xingyu, et autres
Publié: (2024)
par: Tan, Xingyu, et autres
Publié: (2024)
Documents similaires
-
Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning
par: Chen, Yiqun, et autres
Publié: (2026) -
CoMoE: Contrastive Representation for Mixture-of-Experts in Parameter-Efficient Fine-tuning
par: Feng, Jinyuan, et autres
Publié: (2025) -
OASES: Outcome-Aligned Search-Evaluation Co-Training for Agentic Search
par: Zhang, Erhan, et autres
Publié: (2026) -
Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended Long-Form Generation
par: Yang, Zixuan, et autres
Publié: (2026) -
JADE: Bridging the Strategic-Operational Gap in Dynamic Agentic RAG
par: Chen, Yiqun, et autres
Publié: (2026)