DINOISER: Diffused Conditional Sequence Learning by Manipulating Noises
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ye, Jiasheng, Zheng, Zaixiang, Bao, Yu, Qian, Lihua, Wang, Mingxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Diffusion Language Models Can Perform Many Tasks with Scaling and Instruction-Finetuning
par: Ye, Jiasheng, et autres
Publié: (2023)
par: Ye, Jiasheng, et autres
Publié: (2023)
Text Diffusion with Reinforced Conditioning
par: Liu, Yuxuan, et autres
Publié: (2024)
par: Liu, Yuxuan, et autres
Publié: (2024)
Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance
par: Ye, Jiasheng, et autres
Publié: (2024)
par: Ye, Jiasheng, et autres
Publié: (2024)
Meta-DiffuB: A Contextualized Sequence-to-Sequence Text Diffusion Model with Meta-Exploration
par: Chuang, Yun-Yen, et autres
Publié: (2024)
par: Chuang, Yun-Yen, et autres
Publié: (2024)
Distantly-Supervised Joint Extraction with Noise-Robust Learning
par: Li, Yufei, et autres
Publié: (2023)
par: Li, Yufei, et autres
Publié: (2023)
Multiple Noises in Diffusion Model for Semi-Supervised Multi-Domain Translation
par: Mayet, Tsiry, et autres
Publié: (2023)
par: Mayet, Tsiry, et autres
Publié: (2023)
Group Sequence Policy Optimization
par: Zheng, Chujie, et autres
Publié: (2025)
par: Zheng, Chujie, et autres
Publié: (2025)
FastDiSS: Few-step Match Many-step Diffusion Language Model on Sequence-to-Sequence Generation--Full Version
par: Nguyen-Cong, Dat, et autres
Publié: (2026)
par: Nguyen-Cong, Dat, et autres
Publié: (2026)
Principled RL for Diffusion LLMs Emerges from a Sequence-Level Perspective
par: Ou, Jingyang, et autres
Publié: (2025)
par: Ou, Jingyang, et autres
Publié: (2025)
HypoEval: Hypothesis-Guided Evaluation for Natural Language Generation
par: Li, Mingxuan, et autres
Publié: (2025)
par: Li, Mingxuan, et autres
Publié: (2025)
Enhancing Time Series Forecasting via Multi-Level Text Alignment with LLMs
par: Zhao, Taibiao, et autres
Publié: (2025)
par: Zhao, Taibiao, et autres
Publié: (2025)
The Detection-Extraction Gap: Models Know the Answer Before They Can Say It
par: Wang, Hanyang, et autres
Publié: (2026)
par: Wang, Hanyang, et autres
Publié: (2026)
In-Context Learning Dynamics with Random Binary Sequences
par: Bigelow, Eric J., et autres
Publié: (2023)
par: Bigelow, Eric J., et autres
Publié: (2023)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion
par: Pei, Zehua, et autres
Publié: (2024)
par: Pei, Zehua, et autres
Publié: (2024)
Unleashing Low-Bit Inference on Ascend NPUs: A Comprehensive Evaluation of HiFloat Formats
par: Zhao, Pengxiang, et autres
Publié: (2026)
par: Zhao, Pengxiang, et autres
Publié: (2026)
Learn from the Past: Fast Sparse Indexing for Large Language Model Decoding
par: Yao, Feiyu, et autres
Publié: (2025)
par: Yao, Feiyu, et autres
Publié: (2025)
Native Hybrid Attention for Efficient Sequence Modeling
par: Du, Jusen, et autres
Publié: (2025)
par: Du, Jusen, et autres
Publié: (2025)
Adaptive Guidance for Retrieval-Augmented Masked Diffusion Models
par: Kim, Jaemin, et autres
Publié: (2026)
par: Kim, Jaemin, et autres
Publié: (2026)
AnyGPT: Unified Multimodal LLM with Discrete Sequence Modeling
par: Zhan, Jun, et autres
Publié: (2024)
par: Zhan, Jun, et autres
Publié: (2024)
Reinforcement Learning with Conditional Expectation Reward
par: Xiao, Changyi, et autres
Publié: (2026)
par: Xiao, Changyi, et autres
Publié: (2026)
Multimodal Generative Engine Optimization: Rank Manipulation for Vision-Language Model Rankers
par: Du, Yixuan, et autres
Publié: (2026)
par: Du, Yixuan, et autres
Publié: (2026)
Sequence-to-Sequence Spanish Pre-trained Language Models
par: Araujo, Vladimir, et autres
Publié: (2023)
par: Araujo, Vladimir, et autres
Publié: (2023)
PREMISE: Scalable and Strategic Prompt Optimization for Efficient Mathematical Reasoning in Large Models
par: Yu, Ye, et autres
Publié: (2025)
par: Yu, Ye, et autres
Publié: (2025)
Revealing Behavioral Plasticity in Large Language Models: A Token-Conditional Perspective
par: Mao, Liyuan, et autres
Publié: (2026)
par: Mao, Liyuan, et autres
Publié: (2026)
Hypothesis-Conditioned Query Rewriting for Decision-Useful Retrieval
par: Chang, Hangeol, et autres
Publié: (2026)
par: Chang, Hangeol, et autres
Publié: (2026)
MoM: Linear Sequence Modeling with Mixture-of-Memories
par: Du, Jusen, et autres
Publié: (2025)
par: Du, Jusen, et autres
Publié: (2025)
Less Noise, More Voice: Reinforcement Learning for Reasoning via Instruction Purification
par: Guo, Yiju, et autres
Publié: (2026)
par: Guo, Yiju, et autres
Publié: (2026)
Training Optimal Large Diffusion Language Models
par: Ni, Jinjie, et autres
Publié: (2025)
par: Ni, Jinjie, et autres
Publié: (2025)
NoiseBench: Benchmarking the Impact of Real Label Noise on Named Entity Recognition
par: Merdjanovska, Elena, et autres
Publié: (2024)
par: Merdjanovska, Elena, et autres
Publié: (2024)
The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language Models
par: Ni, Zanlin, et autres
Publié: (2026)
par: Ni, Zanlin, et autres
Publié: (2026)
Language Diffusion Models are Associative Memories Capable of Retrieving Unseen Data
par: Pham, Bao, et autres
Publié: (2026)
par: Pham, Bao, et autres
Publié: (2026)
Pretrained Generative Language Models as General Learning Frameworks for Sequence-Based Tasks
par: Fauber, Ben
Publié: (2024)
par: Fauber, Ben
Publié: (2024)
Training-free LLM Merging for Multi-task Learning
par: Fu, Zichuan, et autres
Publié: (2025)
par: Fu, Zichuan, et autres
Publié: (2025)
LASP-2: Rethinking Sequence Parallelism for Linear Attention and Its Hybrid
par: Sun, Weigao, et autres
Publié: (2025)
par: Sun, Weigao, et autres
Publié: (2025)
Clip Your Sequences Fairly: Enforcing Length Fairness for Sequence-Level RL
par: Mao, Hanyi, et autres
Publié: (2025)
par: Mao, Hanyi, et autres
Publié: (2025)
Taming Sensitive Weights : Noise Perturbation Fine-tuning for Robust LLM Quantization
par: Wang, Dongwei, et autres
Publié: (2024)
par: Wang, Dongwei, et autres
Publié: (2024)
From Word Sequences to Behavioral Sequences: Adapting Modeling and Evaluation Paradigms for Longitudinal NLP
par: Ganesan, Adithya V, et autres
Publié: (2026)
par: Ganesan, Adithya V, et autres
Publié: (2026)
Masked Diffusion Models are Secretly Time-Agnostic Masked Models and Exploit Inaccurate Categorical Sampling
par: Zheng, Kaiwen, et autres
Publié: (2024)
par: Zheng, Kaiwen, et autres
Publié: (2024)
Lossless Token Sequence Compression via Meta-Tokens
par: Harvill, John, et autres
Publié: (2025)
par: Harvill, John, et autres
Publié: (2025)
Documents similaires
-
Diffusion Language Models Can Perform Many Tasks with Scaling and Instruction-Finetuning
par: Ye, Jiasheng, et autres
Publié: (2023) -
Text Diffusion with Reinforced Conditioning
par: Liu, Yuxuan, et autres
Publié: (2024) -
Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance
par: Ye, Jiasheng, et autres
Publié: (2024) -
Meta-DiffuB: A Contextualized Sequence-to-Sequence Text Diffusion Model with Meta-Exploration
par: Chuang, Yun-Yen, et autres
Publié: (2024) -
Distantly-Supervised Joint Extraction with Noise-Robust Learning
par: Li, Yufei, et autres
Publié: (2023)