What Makes Diffusion Language Models Super Data Learners?
Fuente:
arXiv
Salvato in:
| Autori principali: | Gao, Zitian, Luo, Haoming, Chen, Lynx, Liu, Jason Klein, Tao, Ran, Zhou, Joey, Dai, Bryan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
One-shot Entropy Minimization
di: Gao, Zitian, et al.
Pubblicazione: (2025)
di: Gao, Zitian, et al.
Pubblicazione: (2025)
Universal Reasoning Model
di: Gao, Zitian, et al.
Pubblicazione: (2025)
di: Gao, Zitian, et al.
Pubblicazione: (2025)
Beyond N-gram: Data-Aware X-GRAM Extraction for Efficient Embedding Parameter Scaling
di: Chen, Yilong, et al.
Pubblicazione: (2026)
di: Chen, Yilong, et al.
Pubblicazione: (2026)
Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning
di: Xie, Tian, et al.
Pubblicazione: (2025)
di: Xie, Tian, et al.
Pubblicazione: (2025)
Temporal Predictors of Outcome in Reasoning Language Models
di: David, Joey
Pubblicazione: (2025)
di: David, Joey
Pubblicazione: (2025)
Making Text Embedders Few-Shot Learners
di: Li, Chaofan, et al.
Pubblicazione: (2024)
di: Li, Chaofan, et al.
Pubblicazione: (2024)
Supervised Knowledge Makes Large Language Models Better In-context Learners
di: Yang, Linyi, et al.
Pubblicazione: (2023)
di: Yang, Linyi, et al.
Pubblicazione: (2023)
Large Language Models Know What Makes Exemplary Contexts
di: Long, Quanyu, et al.
Pubblicazione: (2024)
di: Long, Quanyu, et al.
Pubblicazione: (2024)
Relational Database Augmented Large Language Model
di: Qin, Zongyue, et al.
Pubblicazione: (2024)
di: Qin, Zongyue, et al.
Pubblicazione: (2024)
What Makes Language Models Good-enough?
di: Asami, Daiki, et al.
Pubblicazione: (2024)
di: Asami, Daiki, et al.
Pubblicazione: (2024)
DiffPO: Diffusion-styled Preference Optimization for Efficient Inference-Time Alignment of Large Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
Enhancing Startup Success Predictions in Venture Capital: A GraphRAG Augmented Multivariate Time Series Method
di: Gao, Zitian, et al.
Pubblicazione: (2024)
di: Gao, Zitian, et al.
Pubblicazione: (2024)
Rethinking Token Prediction: Tree-Structured Diffusion Language Model
di: Wu, Zihao, et al.
Pubblicazione: (2026)
di: Wu, Zihao, et al.
Pubblicazione: (2026)
Making Language Models Better Tool Learners with Execution Feedback
di: Qiao, Shuofei, et al.
Pubblicazione: (2023)
di: Qiao, Shuofei, et al.
Pubblicazione: (2023)
XAL: EXplainable Active Learning Makes Classifiers Better Low-resource Learners
di: Luo, Yun, et al.
Pubblicazione: (2023)
di: Luo, Yun, et al.
Pubblicazione: (2023)
What Makes Two Language Models Think Alike?
di: Salle, Jeanne, et al.
Pubblicazione: (2024)
di: Salle, Jeanne, et al.
Pubblicazione: (2024)
TAIA: Large Language Models are Out-of-Distribution Data Learners
di: Jiang, Shuyang, et al.
Pubblicazione: (2024)
di: Jiang, Shuyang, et al.
Pubblicazione: (2024)
How to Make Large Language Models Generate 100% Valid Molecules?
di: Tao, Wen, et al.
Pubblicazione: (2025)
di: Tao, Wen, et al.
Pubblicazione: (2025)
Contextual Text Denoising with Masked Language Models
di: Sun, Yifu, et al.
Pubblicazione: (2019)
di: Sun, Yifu, et al.
Pubblicazione: (2019)
What Evidence Do Language Models Find Convincing?
di: Wan, Alexander, et al.
Pubblicazione: (2024)
di: Wan, Alexander, et al.
Pubblicazione: (2024)
What Makes a Good Natural Language Prompt?
di: Long, Do Xuan, et al.
Pubblicazione: (2025)
di: Long, Do Xuan, et al.
Pubblicazione: (2025)
Computational Reasoning of Large Language Models
di: Wu, Haitao, et al.
Pubblicazione: (2025)
di: Wu, Haitao, et al.
Pubblicazione: (2025)
Language Models are Symbolic Learners in Arithmetic
di: Deng, Chunyuan, et al.
Pubblicazione: (2024)
di: Deng, Chunyuan, et al.
Pubblicazione: (2024)
Identifying and Mitigating Social Bias Knowledge in Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
di: Chen, Ruizhe, et al.
Pubblicazione: (2024)
A Super-Learner with Large Language Models for Medical Emergency Advising
di: Aityan, Sergey K., et al.
Pubblicazione: (2025)
di: Aityan, Sergey K., et al.
Pubblicazione: (2025)
LMCD: Language Models are Zeroshot Cognitive Diagnosis Learners
di: He, Yu, et al.
Pubblicazione: (2025)
di: He, Yu, et al.
Pubblicazione: (2025)
Making Language Model a Hierarchical Classifier
di: Wang, Yihong, et al.
Pubblicazione: (2025)
di: Wang, Yihong, et al.
Pubblicazione: (2025)
RALLRec: Improving Retrieval Augmented Large Language Model Recommendation with Representation Learning
di: Xu, Jian, et al.
Pubblicazione: (2025)
di: Xu, Jian, et al.
Pubblicazione: (2025)
What Makes Large Language Models Reason in (Multi-Turn) Code Generation?
di: Zheng, Kunhao, et al.
Pubblicazione: (2024)
di: Zheng, Kunhao, et al.
Pubblicazione: (2024)
Discriminative Finetuning of Generative Large Language Models without Reward Models and Human Preference Data
di: Guo, Siqi, et al.
Pubblicazione: (2025)
di: Guo, Siqi, et al.
Pubblicazione: (2025)
Getting More from Less: Large Language Models are Good Spontaneous Multilingual Learners
di: Zhang, Shimao, et al.
Pubblicazione: (2024)
di: Zhang, Shimao, et al.
Pubblicazione: (2024)
IDEAL: Influence-Driven Selective Annotations Empower In-Context Learners in Large Language Models
di: Zhang, Shaokun, et al.
Pubblicazione: (2023)
di: Zhang, Shaokun, et al.
Pubblicazione: (2023)
LASP: Surveying the State-of-the-Art in Large Language Model-Assisted AI Planning
di: Li, Haoming, et al.
Pubblicazione: (2024)
di: Li, Haoming, et al.
Pubblicazione: (2024)
BLiSS 1.0: Evaluating Bilingual Learner Competence in Second Language Small Language Models
di: Gao, Yuan, et al.
Pubblicazione: (2025)
di: Gao, Yuan, et al.
Pubblicazione: (2025)
Embedding Enhancement via Fine-Tuned Language Models for Learner-Item Cognitive Modeling
di: Liu, Yuanhao, et al.
Pubblicazione: (2026)
di: Liu, Yuanhao, et al.
Pubblicazione: (2026)
Data or Language Supervision: What Makes CLIP Better than DINO?
di: Liu, Yiming, et al.
Pubblicazione: (2025)
di: Liu, Yiming, et al.
Pubblicazione: (2025)
DARWIN 1.5: Large Language Models as Materials Science Adapted Learners
di: Xie, Tong, et al.
Pubblicazione: (2024)
di: Xie, Tong, et al.
Pubblicazione: (2024)
Seal: Advancing Speech Language Models to be Few-Shot Learners
di: Lei, Shuyu, et al.
Pubblicazione: (2024)
di: Lei, Shuyu, et al.
Pubblicazione: (2024)
BlendFilter: Advancing Retrieval-Augmented Large Language Models via Query Generation Blending and Knowledge Filtering
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Large Language Models are In-Context Molecule Learners
di: Li, Jiatong, et al.
Pubblicazione: (2024)
di: Li, Jiatong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
One-shot Entropy Minimization
di: Gao, Zitian, et al.
Pubblicazione: (2025) -
Universal Reasoning Model
di: Gao, Zitian, et al.
Pubblicazione: (2025) -
Beyond N-gram: Data-Aware X-GRAM Extraction for Efficient Embedding Parameter Scaling
di: Chen, Yilong, et al.
Pubblicazione: (2026) -
Logic-RL: Unleashing LLM Reasoning with Rule-Based Reinforcement Learning
di: Xie, Tian, et al.
Pubblicazione: (2025) -
Temporal Predictors of Outcome in Reasoning Language Models
di: David, Joey
Pubblicazione: (2025)