The Surprising Effectiveness of Skip-Tuning in Diffusion Sampling
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Jiajun, Xue, Shuchen, Hu, Tianyang, Wang, Wenjia, Liu, Zhaoqiang, Li, Zhenguo, Ma, Zhi-Ming, Kawaguchi, Kenji |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Accelerating Diffusion Sampling with Optimized Time Steps
di: Xue, Shuchen, et al.
Pubblicazione: (2024)
di: Xue, Shuchen, et al.
Pubblicazione: (2024)
Referee Can Play: An Alternative Approach to Conditional Generation via Model Inversion
di: Liu, Xuantong, et al.
Pubblicazione: (2024)
di: Liu, Xuantong, et al.
Pubblicazione: (2024)
Improved Diffusion-based Generative Model with Better Adversarial Robustness
di: Wang, Zekun, et al.
Pubblicazione: (2025)
di: Wang, Zekun, et al.
Pubblicazione: (2025)
Any-Order GPT as Masked Diffusion Model: Decoupling Formulation and Architecture
di: Xue, Shuchen, et al.
Pubblicazione: (2025)
di: Xue, Shuchen, et al.
Pubblicazione: (2025)
Graffe: Graph Representation Learning via Diffusion Probabilistic Models
di: Chen, Dingshuo, et al.
Pubblicazione: (2025)
di: Chen, Dingshuo, et al.
Pubblicazione: (2025)
On Surprising Effectiveness of Masking Updates in Adaptive Optimizers
di: Joo, Taejong, et al.
Pubblicazione: (2026)
di: Joo, Taejong, et al.
Pubblicazione: (2026)
AlgoFormer: An Efficient Transformer Framework with Algorithmic Structures
di: Gao, Yihang, et al.
Pubblicazione: (2024)
di: Gao, Yihang, et al.
Pubblicazione: (2024)
SA-Solver: Stochastic Adams Solver for Fast Sampling of Diffusion Models
di: Xue, Shuchen, et al.
Pubblicazione: (2023)
di: Xue, Shuchen, et al.
Pubblicazione: (2023)
ES-dLLM: Efficient Inference for Diffusion Large Language Models by Early-Skipping
di: Zhu, Zijian, et al.
Pubblicazione: (2026)
di: Zhu, Zijian, et al.
Pubblicazione: (2026)
On the Adversarial Transferability of Generalized "Skip Connections"
di: Wang, Yisen, et al.
Pubblicazione: (2024)
di: Wang, Yisen, et al.
Pubblicazione: (2024)
Understanding and Guiding Layer Placement in Parameter-Efficient Fine-Tuning of Large Language Models
di: Xu, Yichen, et al.
Pubblicazione: (2026)
di: Xu, Yichen, et al.
Pubblicazione: (2026)
Simple Hierarchical Planning with Diffusion
di: Chen, Chang, et al.
Pubblicazione: (2024)
di: Chen, Chang, et al.
Pubblicazione: (2024)
World Model Robustness via Surprise Recognition
di: Zollicoffer, Geigh, et al.
Pubblicazione: (2025)
di: Zollicoffer, Geigh, et al.
Pubblicazione: (2025)
On the Surprising Effectiveness of Large Learning Rates under Standard Width Scaling
di: Haas, Moritz, et al.
Pubblicazione: (2025)
di: Haas, Moritz, et al.
Pubblicazione: (2025)
LoReUn: Data Itself Implicitly Provides Cues to Improve Machine Unlearning
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
Better Neural PDE Solvers Through Data-Free Mesh Movers
di: Hu, Peiyan, et al.
Pubblicazione: (2023)
di: Hu, Peiyan, et al.
Pubblicazione: (2023)
Straight-Line Diffusion Model for Efficient 3D Molecular Generation
di: Ni, Yuyan, et al.
Pubblicazione: (2025)
di: Ni, Yuyan, et al.
Pubblicazione: (2025)
Learning Single Index Models with Diffusion Priors
di: Tang, Anqi, et al.
Pubblicazione: (2025)
di: Tang, Anqi, et al.
Pubblicazione: (2025)
The Surprising Effectiveness of Test-Time Training for Few-Shot Learning
di: Akyürek, Ekin, et al.
Pubblicazione: (2024)
di: Akyürek, Ekin, et al.
Pubblicazione: (2024)
When AI Levels the Playing Field: Skill Homogenization, Asset Concentration, and Two Regimes of Inequality
di: Chen, Xupeng, et al.
Pubblicazione: (2026)
di: Chen, Xupeng, et al.
Pubblicazione: (2026)
SNOO: Step-K Nesterov Outer Optimizer - The Surprising Effectiveness of Nesterov Momentum Applied to Pseudo-Gradients
di: Kallusky, Dominik, et al.
Pubblicazione: (2025)
di: Kallusky, Dominik, et al.
Pubblicazione: (2025)
Variational Autoencoding Discrete Diffusion with Enhanced Dimensional Correlations Modeling
di: Xie, Tianyu, et al.
Pubblicazione: (2025)
di: Xie, Tianyu, et al.
Pubblicazione: (2025)
UniFluids: Unified Neural Operator Learning with Conditional Flow-matching
di: Li, Haosen, et al.
Pubblicazione: (2026)
di: Li, Haosen, et al.
Pubblicazione: (2026)
Fine-Tuning Diffusion Models for Molecular Generation via Reinforcement Learning and Fast Sampling
di: Lin, Guang, et al.
Pubblicazione: (2026)
di: Lin, Guang, et al.
Pubblicazione: (2026)
A Dual-Perspective Approach to Evaluating Feature Attribution Methods
di: Li, Yawei, et al.
Pubblicazione: (2023)
di: Li, Yawei, et al.
Pubblicazione: (2023)
Advantage Weighted Matching: Aligning RL with Pretraining in Diffusion Models
di: Xue, Shuchen, et al.
Pubblicazione: (2025)
di: Xue, Shuchen, et al.
Pubblicazione: (2025)
From Uniform to Adaptive: General Skip-Block Mechanisms for Efficient PDE Neural Operators
di: Liu, Lei, et al.
Pubblicazione: (2025)
di: Liu, Lei, et al.
Pubblicazione: (2025)
Understanding and Preserving Safety in Fine-Tuned LLMs
di: Zhang, Jiawen, et al.
Pubblicazione: (2026)
di: Zhang, Jiawen, et al.
Pubblicazione: (2026)
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
di: Hu, Shengchao, et al.
Pubblicazione: (2024)
Understanding the Language Model to Solve the Symbolic Multi-Step Reasoning Problem from the Perspective of Buffer Mechanism
di: Wang, Zhiwei, et al.
Pubblicazione: (2024)
di: Wang, Zhiwei, et al.
Pubblicazione: (2024)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
di: Ma, Hao, et al.
Pubblicazione: (2026)
di: Ma, Hao, et al.
Pubblicazione: (2026)
The Structural Origin of Attention Sink: Variance Discrepancy, Super Neurons, and Dimension Disparity
di: Li, Siquan, et al.
Pubblicazione: (2026)
di: Li, Siquan, et al.
Pubblicazione: (2026)
Reduce Computational Complexity for Convolutional Layers by Skipping Zeros
di: Zhang, Zhiyi, et al.
Pubblicazione: (2023)
di: Zhang, Zhiyi, et al.
Pubblicazione: (2023)
Implicit Search via Discrete Diffusion: A Study on Chess
di: Ye, Jiacheng, et al.
Pubblicazione: (2025)
di: Ye, Jiacheng, et al.
Pubblicazione: (2025)
A method for quantifying the generalization capabilities of generative models for solving Ising models
di: Ma, Qunlong, et al.
Pubblicazione: (2024)
di: Ma, Qunlong, et al.
Pubblicazione: (2024)
Set-based Meta-Interpolation for Few-Task Meta-Learning
di: Lee, Seanie, et al.
Pubblicazione: (2022)
di: Lee, Seanie, et al.
Pubblicazione: (2022)
RIFT: Repurposing Negative Samples via Reward-Informed Fine-Tuning
di: Liu, Zehua, et al.
Pubblicazione: (2026)
di: Liu, Zehua, et al.
Pubblicazione: (2026)
Saber: An Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model
di: Dong, Yihong, et al.
Pubblicazione: (2025)
di: Dong, Yihong, et al.
Pubblicazione: (2025)
On the Surprising Effectiveness of Attention Transfer for Vision Transformers
di: Li, Alexander C., et al.
Pubblicazione: (2024)
di: Li, Alexander C., et al.
Pubblicazione: (2024)
Hebbian Learning with Global Direction
di: Hua, Wenjia, et al.
Pubblicazione: (2026)
di: Hua, Wenjia, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Accelerating Diffusion Sampling with Optimized Time Steps
di: Xue, Shuchen, et al.
Pubblicazione: (2024) -
Referee Can Play: An Alternative Approach to Conditional Generation via Model Inversion
di: Liu, Xuantong, et al.
Pubblicazione: (2024) -
Improved Diffusion-based Generative Model with Better Adversarial Robustness
di: Wang, Zekun, et al.
Pubblicazione: (2025) -
Any-Order GPT as Masked Diffusion Model: Decoupling Formulation and Architecture
di: Xue, Shuchen, et al.
Pubblicazione: (2025) -
Graffe: Graph Representation Learning via Diffusion Probabilistic Models
di: Chen, Dingshuo, et al.
Pubblicazione: (2025)