Enregistré dans:
| Auteurs principaux: | Zhang, Shuibai, Peng, Fred Zhangzhi, Zhang, Yiheng, Pan, Jin, Chrysos, Grigorios G. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2512.15596 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Planner Aware Path Learning in Diffusion Language Models Training
par: Peng, Fred Zhangzhi, et autres
Publié: (2025)
par: Peng, Fred Zhangzhi, et autres
Publié: (2025)
Expert-Choice Routing Enables Adaptive Computation in Diffusion Language Models
par: Zhang, Shuibai, et autres
Publié: (2026)
par: Zhang, Shuibai, et autres
Publié: (2026)
Don't Retrain, Align: Adapting Autoregressive LMs to Diffusion LMs via Representation Alignment
par: Peng, Fred Zhangzhi, et autres
Publié: (2026)
par: Peng, Fred Zhangzhi, et autres
Publié: (2026)
Activation-Free Backbones for Image Recognition: Polynomial Alternatives within MetaFormer-Style Vision Models
par: Wang, Jeffrey, et autres
Publié: (2026)
par: Wang, Jeffrey, et autres
Publié: (2026)
Mitigating Diffusion Model Hallucinations with Dynamic Guidance
par: Triaridis, Kostas, et autres
Publié: (2025)
par: Triaridis, Kostas, et autres
Publié: (2025)
Coupling Models for One-Step Discrete Generation
par: Peng, Fred Zhangzhi, et autres
Publié: (2026)
par: Peng, Fred Zhangzhi, et autres
Publié: (2026)
Revisiting Character-level Adversarial Attacks for Language Models
par: Rocamora, Elias Abad, et autres
Publié: (2024)
par: Rocamora, Elias Abad, et autres
Publié: (2024)
Certified Robustness Under Bounded Levenshtein Distance
par: Rocamora, Elias Abad, et autres
Publié: (2025)
par: Rocamora, Elias Abad, et autres
Publié: (2025)
Single-pass Detection of Jailbreaking Input in Large Language Models
par: Candogan, Leyla Naz, et autres
Publié: (2025)
par: Candogan, Leyla Naz, et autres
Publié: (2025)
LJ-Bench: Ontology-Based Benchmark for U.S. Crime
par: Tseng, Hung Yun, et autres
Publié: (2026)
par: Tseng, Hung Yun, et autres
Publié: (2026)
Leveraging the Context through Multi-Round Interactions for Jailbreaking Attacks
par: Cheng, Yixin, et autres
Publié: (2024)
par: Cheng, Yixin, et autres
Publié: (2024)
Multilinear Operator Networks
par: Cheng, Yixin, et autres
Publié: (2024)
par: Cheng, Yixin, et autres
Publié: (2024)
REST: Efficient and Accelerated EEG Seizure Analysis through Residual State Updates
par: Afzal, Arshia, et autres
Publié: (2024)
par: Afzal, Arshia, et autres
Publié: (2024)
Hadamard product in deep learning: Introduction, Advances and Challenges
par: Chrysos, Grigorios G, et autres
Publié: (2025)
par: Chrysos, Grigorios G, et autres
Publié: (2025)
Generalization of Scaled Deep ResNets in the Mean-Field Regime
par: Chen, Yihang, et autres
Publié: (2024)
par: Chen, Yihang, et autres
Publié: (2024)
Learning to Remove Cuts in Integer Linear Programming
par: Puigdemont, Pol, et autres
Publié: (2024)
par: Puigdemont, Pol, et autres
Publié: (2024)
The Last Mile to Supervised Performance: Semi-Supervised Domain Adaptation for Semantic Segmentation
par: Morales-Brotons, Daniel, et autres
Publié: (2024)
par: Morales-Brotons, Daniel, et autres
Publié: (2024)
Path Planning for Masked Diffusion Model Sampling
par: Peng, Fred Zhangzhi, et autres
Publié: (2025)
par: Peng, Fred Zhangzhi, et autres
Publié: (2025)
Robust NAS under adversarial training: benchmark, theory, and beyond
par: Wu, Yongtao, et autres
Publié: (2024)
par: Wu, Yongtao, et autres
Publié: (2024)
Towards Interpretability Without Sacrifice: Faithful Dense Layer Decomposition with Mixture of Decoders
par: Oldfield, James, et autres
Publié: (2025)
par: Oldfield, James, et autres
Publié: (2025)
Efficient local linearity regularization to overcome catastrophic overfitting
par: Rocamora, Elias Abad, et autres
Publié: (2024)
par: Rocamora, Elias Abad, et autres
Publié: (2024)
Continuous Diffusion Scales Competitively with Discrete Diffusion for Language
par: Yang, Zhihan, et autres
Publié: (2026)
par: Yang, Zhihan, et autres
Publié: (2026)
Why DDIM Hallucinates More Than DDPM: A Theoretical Analysis of Reverse Dynamics
par: Ashiq, Muhammad H., et autres
Publié: (2026)
par: Ashiq, Muhammad H., et autres
Publié: (2026)
ConTSG-Bench: A Unified Benchmark for Conditional Time Series Generation
par: Lan, Shaocheng, et autres
Publié: (2026)
par: Lan, Shaocheng, et autres
Publié: (2026)
Multilinear Mixture of Experts: Scalable Expert Specialization through Factorization
par: Oldfield, James, et autres
Publié: (2024)
par: Oldfield, James, et autres
Publié: (2024)
Diffusion Models Preferentially Memorize Prototypical Examples or: Why Does My Diffusion Model Love Slop?
par: Rodriguez, Marta Aparicio, et autres
Publié: (2026)
par: Rodriguez, Marta Aparicio, et autres
Publié: (2026)
Exploring the Potential of Probabilistic Transformer for Time Series Modeling: A Report on the ST-PT Framework
par: Xiong, Zhangzhi, et autres
Publié: (2026)
par: Xiong, Zhangzhi, et autres
Publié: (2026)
Steering Masked Discrete Diffusion Models via Discrete Denoising Posterior Prediction
par: Rector-Brooks, Jarrid, et autres
Publié: (2024)
par: Rector-Brooks, Jarrid, et autres
Publié: (2024)
D2ACE: Multi-Label Batch Selection Guided by Dual Dynamics and Adaptive Correlation Enhancement
par: Liu, Bin, et autres
Publié: (2026)
par: Liu, Bin, et autres
Publié: (2026)
ParallelBench: Understanding the Trade-offs of Parallel Decoding in Diffusion LLMs
par: Kang, Wonjun, et autres
Publié: (2025)
par: Kang, Wonjun, et autres
Publié: (2025)
Is Your Diffusion Sampler Actually Correct? A Sampler-Centric Evaluation of Discrete Diffusion Language Models
par: Tang, Luhan, et autres
Publié: (2026)
par: Tang, Luhan, et autres
Publié: (2026)
Inducing Uncertainty on Open-Weight Models for Test-Time Privacy in Image Recognition
par: Ashiq, Muhammad H., et autres
Publié: (2025)
par: Ashiq, Muhammad H., et autres
Publié: (2025)
Unlocking the Power of Diffusion Models in Sequential Recommendation: A Simple and Effective Approach
par: Chen, Jialei, et autres
Publié: (2025)
par: Chen, Jialei, et autres
Publié: (2025)
BackPlay: Head-Only Look-Back Self-Correction for Diffusion Language Models
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
Towards Best Practices of Activation Patching in Language Models: Metrics and Methods
par: Zhang, Fred, et autres
Publié: (2023)
par: Zhang, Fred, et autres
Publié: (2023)
Multi-Label Adaptive Batch Selection by Highlighting Hard and Imbalanced Samples
par: Zhou, Ao, et autres
Publié: (2024)
par: Zhou, Ao, et autres
Publié: (2024)
Batch Selection for Multi-Label Classification Guided by Uncertainty and Dynamic Label Correlations
par: Zhou, Ao, et autres
Publié: (2024)
par: Zhou, Ao, et autres
Publié: (2024)
Cross-Domain Pre-training with Language Models for Transferable Time Series Representations
par: Cheng, Mingyue, et autres
Publié: (2024)
par: Cheng, Mingyue, et autres
Publié: (2024)
Evo: Autoregressive-Diffusion Large Language Models with Evolving Balance
par: Wu, Junde, et autres
Publié: (2026)
par: Wu, Junde, et autres
Publié: (2026)
Advancing Time Series Classification with Multimodal Language Modeling
par: Cheng, Mingyue, et autres
Publié: (2024)
par: Cheng, Mingyue, et autres
Publié: (2024)
Documents similaires
-
Planner Aware Path Learning in Diffusion Language Models Training
par: Peng, Fred Zhangzhi, et autres
Publié: (2025) -
Expert-Choice Routing Enables Adaptive Computation in Diffusion Language Models
par: Zhang, Shuibai, et autres
Publié: (2026) -
Don't Retrain, Align: Adapting Autoregressive LMs to Diffusion LMs via Representation Alignment
par: Peng, Fred Zhangzhi, et autres
Publié: (2026) -
Activation-Free Backbones for Image Recognition: Polynomial Alternatives within MetaFormer-Style Vision Models
par: Wang, Jeffrey, et autres
Publié: (2026) -
Mitigating Diffusion Model Hallucinations with Dynamic Guidance
par: Triaridis, Kostas, et autres
Publié: (2025)