Linear Combination of Saved Checkpoints Makes Consistency and Diffusion Models Better
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Enshu, Zhu, Junyi, Lin, Zinan, Ning, Xuefei, Wang, Shuaiqi, Blaschko, Matthew B., Yekhanin, Sergey, Yan, Shengen, Dai, Guohao, Yang, Huazhong, Wang, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs
di: Liu, Enshu, et al.
Pubblicazione: (2024)
di: Liu, Enshu, et al.
Pubblicazione: (2024)
Latent Zoning Network: A Unified Principle for Generative Modeling, Representation Learning, and Classification
di: Lin, Zinan, et al.
Pubblicazione: (2025)
di: Lin, Zinan, et al.
Pubblicazione: (2025)
Distilled Decoding 2: One-step Sampling of Image Auto-regressive Models with Conditional Score Distillation
di: Liu, Enshu, et al.
Pubblicazione: (2025)
di: Liu, Enshu, et al.
Pubblicazione: (2025)
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
Can LLMs Learn by Teaching for Better Reasoning? A Preliminary Study
di: Ning, Xuefei, et al.
Pubblicazione: (2024)
di: Ning, Xuefei, et al.
Pubblicazione: (2024)
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
di: Zhao, Tianchen, et al.
Pubblicazione: (2024)
NI Sampling: Accelerating Discrete Diffusion Sampling by Token Order Optimization
di: Liu, Enshu, et al.
Pubblicazione: (2026)
di: Liu, Enshu, et al.
Pubblicazione: (2026)
FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
FlashEval: Towards Fast and Accurate Evaluation of Text-to-image Diffusion Generative Models
di: Zhao, Lin, et al.
Pubblicazione: (2024)
di: Zhao, Lin, et al.
Pubblicazione: (2024)
Distilled Decoding 1: One-step Sampling of Image Auto-regressive Models with Flow Matching
di: Liu, Enshu, et al.
Pubblicazione: (2024)
di: Liu, Enshu, et al.
Pubblicazione: (2024)
R2R: Efficiently Navigating Divergent Reasoning Paths with Small-Large Model Token Routing
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
Evaluating Quantized Large Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
PE-means: Improved Differentially Private $k$-means Clustering through Private Evolution
di: Humphries, Thomas, et al.
Pubblicazione: (2026)
di: Humphries, Thomas, et al.
Pubblicazione: (2026)
BitSnap: Checkpoint Sparsification and Quantization in LLM Training
di: Peng, Yanxin, et al.
Pubblicazione: (2025)
di: Peng, Yanxin, et al.
Pubblicazione: (2025)
Differentially Private Synthetic Data via APIs 3: Using Simulators Instead of Foundation Model
di: Lin, Zinan, et al.
Pubblicazione: (2025)
di: Lin, Zinan, et al.
Pubblicazione: (2025)
CSKV: Training-Efficient Channel Shrinking for KV Cache in Long-Context Scenarios
di: Wang, Luning, et al.
Pubblicazione: (2024)
di: Wang, Luning, et al.
Pubblicazione: (2024)
Jaccard Metric Losses: Optimizing the Jaccard Index with Soft Labels
di: Wang, Zifu, et al.
Pubblicazione: (2023)
di: Wang, Zifu, et al.
Pubblicazione: (2023)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
Skeleton-of-Thought: Prompting LLMs for Efficient Parallel Generation
di: Ning, Xuefei, et al.
Pubblicazione: (2023)
di: Ning, Xuefei, et al.
Pubblicazione: (2023)
Mixture-of-Linear-Experts for Long-term Time Series Forecasting
di: Ni, Ronghao, et al.
Pubblicazione: (2023)
di: Ni, Ronghao, et al.
Pubblicazione: (2023)
MBQ: Modality-Balanced Quantization for Large Vision-Language Models
di: Li, Shiyao, et al.
Pubblicazione: (2024)
di: Li, Shiyao, et al.
Pubblicazione: (2024)
Mixture of Attention Spans: Optimizing LLM Inference Efficiency with Heterogeneous Sliding-Window Lengths
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
di: Fu, Tianyu, et al.
Pubblicazione: (2024)
Differentially Private Synthetic Data via Foundation Model APIs 1: Images
di: Lin, Zinan, et al.
Pubblicazione: (2023)
di: Lin, Zinan, et al.
Pubblicazione: (2023)
Struct-Bench: A Benchmark for Differentially Private Structured Text Generation
di: Wang, Shuaiqi, et al.
Pubblicazione: (2025)
di: Wang, Shuaiqi, et al.
Pubblicazione: (2025)
Statistic Maximal Leakage
di: Wang, Shuaiqi, et al.
Pubblicazione: (2024)
di: Wang, Shuaiqi, et al.
Pubblicazione: (2024)
VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
PM-KVQ: Progressive Mixed-precision KV Cache Quantization for Long-CoT LLMs
di: Liu, Tengxuan, et al.
Pubblicazione: (2025)
di: Liu, Tengxuan, et al.
Pubblicazione: (2025)
SynAE: A Framework for Measuring the Quality of Synthetic Data for Tool-Calling Agent Evaluations
di: Wang, Shuaiqi, et al.
Pubblicazione: (2026)
di: Wang, Shuaiqi, et al.
Pubblicazione: (2026)
DiTFastAttnV2: Head-wise Attention Compression for Multi-Modality Diffusion Transformers
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
di: Zhang, Hanling, et al.
Pubblicazione: (2025)
Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
di: Fu, Tianyu, et al.
Pubblicazione: (2025)
DiM: Diffusion Mamba for Efficient High-Resolution Image Synthesis
di: Teng, Yao, et al.
Pubblicazione: (2024)
di: Teng, Yao, et al.
Pubblicazione: (2024)
Elastic-dLLM: Position Preserving Context Compression and Augmentation of Diffusion LLMs
di: Wu, Junyi, et al.
Pubblicazione: (2026)
di: Wu, Junyi, et al.
Pubblicazione: (2026)
HETHUB: A Distributed Training System with Heterogeneous Cluster for Large-Scale Models
di: Xu, Si, et al.
Pubblicazione: (2024)
di: Xu, Si, et al.
Pubblicazione: (2024)
LV-Eval: A Balanced Long-Context Benchmark with 5 Length Levels Up to 256K
di: Yuan, Tao, et al.
Pubblicazione: (2024)
di: Yuan, Tao, et al.
Pubblicazione: (2024)
DLFR-VAE: Dynamic Latent Frame Rate VAE for Video Generation
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
di: Yuan, Zhihang, et al.
Pubblicazione: (2025)
Inferentially-Private Private Information
di: Wang, Shuaiqi, et al.
Pubblicazione: (2024)
di: Wang, Shuaiqi, et al.
Pubblicazione: (2024)
Jigsaw-R1: A Study of Rule-based Visual Reinforcement Learning with Jigsaw Puzzles
di: Wang, Zifu, et al.
Pubblicazione: (2025)
di: Wang, Zifu, et al.
Pubblicazione: (2025)
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
Implicit Neural Representations for Robust Joint Sparse-View CT Reconstruction
di: Shi, Jiayang, et al.
Pubblicazione: (2024)
di: Shi, Jiayang, et al.
Pubblicazione: (2024)
GenMAC: Compositional Text-to-Video Generation with Multi-Agent Collaboration
di: Huang, Kaiyi, et al.
Pubblicazione: (2024)
di: Huang, Kaiyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Efficient Expert Pruning for Sparse Mixture-of-Experts Language Models: Enhancing Performance and Reducing Inference Costs
di: Liu, Enshu, et al.
Pubblicazione: (2024) -
Latent Zoning Network: A Unified Principle for Generative Modeling, Representation Learning, and Classification
di: Lin, Zinan, et al.
Pubblicazione: (2025) -
Distilled Decoding 2: One-step Sampling of Image Auto-regressive Models with Conditional Score Distillation
di: Liu, Enshu, et al.
Pubblicazione: (2025) -
MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization
di: Zhao, Tianchen, et al.
Pubblicazione: (2024) -
Can LLMs Learn by Teaching for Better Reasoning? A Preliminary Study
di: Ning, Xuefei, et al.
Pubblicazione: (2024)