Salvato in:
| Autori principali: | Wang, Yixiao, Jiang, Ting, Shao, Zishan, Ye, Hancheng, Sun, Jingwei, Ma, Mingyuan, Zhang, Jianyi, Chen, Yiran, Li, Hai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.01552 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SADA: Stability-guided Adaptive Diffusion Acceleration
di: Jiang, Ting, et al.
Pubblicazione: (2025)
di: Jiang, Ting, et al.
Pubblicazione: (2025)
FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models
di: Shao, Zishan, et al.
Pubblicazione: (2025)
di: Shao, Zishan, et al.
Pubblicazione: (2025)
CoreInfer: Accelerating Large Language Model Inference with Semantics-Inspired Adaptive Sparse Activation
di: Wang, Qinsi, et al.
Pubblicazione: (2024)
di: Wang, Qinsi, et al.
Pubblicazione: (2024)
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
di: Wang, Qinsi, et al.
Pubblicazione: (2025)
di: Wang, Qinsi, et al.
Pubblicazione: (2025)
FlashSVD v1.5: Making Low-Rank Transformers Inference Actually Fast
di: Wu, Wenhao, et al.
Pubblicazione: (2026)
di: Wu, Wenhao, et al.
Pubblicazione: (2026)
Enhanced Cyclic Coordinate Descent Methods for Elastic Net Penalized Linear Models
di: Wang, Yixiao, et al.
Pubblicazione: (2025)
di: Wang, Yixiao, et al.
Pubblicazione: (2025)
KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems
di: Ye, Hancheng, et al.
Pubblicazione: (2025)
di: Ye, Hancheng, et al.
Pubblicazione: (2025)
PrivAct: Internalizing Contextual Privacy Preservation via Multi-Agent Preference Training
di: Cheng, Yuhan, et al.
Pubblicazione: (2026)
di: Cheng, Yuhan, et al.
Pubblicazione: (2026)
Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing
di: Liu, Yudong, et al.
Pubblicazione: (2025)
di: Liu, Yudong, et al.
Pubblicazione: (2025)
Angles Don't Lie: Unlocking Training-Efficient RL Through the Model's Own Signals
di: Wang, Qinsi, et al.
Pubblicazione: (2025)
di: Wang, Qinsi, et al.
Pubblicazione: (2025)
DPad: Efficient Diffusion Language Models with Suffix Dropout
di: Chen, Xinhua, et al.
Pubblicazione: (2025)
di: Chen, Xinhua, et al.
Pubblicazione: (2025)
LoBAM: LoRA-Based Backdoor Attack on Model Merging
di: Yin, Ming, et al.
Pubblicazione: (2024)
di: Yin, Ming, et al.
Pubblicazione: (2024)
Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models
di: Zhang, Jingyang, et al.
Pubblicazione: (2024)
di: Zhang, Jingyang, et al.
Pubblicazione: (2024)
ZEUS: Zero-shot Embeddings for Unsupervised Separation of Tabular Data
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
di: Marszałek, Patryk, et al.
Pubblicazione: (2025)
FlashFPS: Efficient Farthest Point Sampling for Large-Scale Point Clouds via Pruning and Caching
di: Fu, Yuzhe, et al.
Pubblicazione: (2026)
di: Fu, Yuzhe, et al.
Pubblicazione: (2026)
Distributionally Robust Optimization via Diffusion Ambiguity Modeling
di: Wen, Jiaqi, et al.
Pubblicazione: (2025)
di: Wen, Jiaqi, et al.
Pubblicazione: (2025)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
di: Zhang, Jianyi, et al.
Pubblicazione: (2024)
di: Zhang, Jianyi, et al.
Pubblicazione: (2024)
MLLM-LLaVA-FL: Multimodal Large Language Model Assisted Federated Learning
di: Zhang, Jianyi, et al.
Pubblicazione: (2024)
di: Zhang, Jianyi, et al.
Pubblicazione: (2024)
ZEUS EQUILIBRADO
di: Frederico Sabino
Pubblicazione: (2019)
di: Frederico Sabino
Pubblicazione: (2019)
IoT-MCP: Bridging LLMs and IoT Systems Through Model Context Protocol
di: Yang, Ningyuan, et al.
Pubblicazione: (2025)
di: Yang, Ningyuan, et al.
Pubblicazione: (2025)
SCoNE: Spherical Consistent Neighborhoods Ensemble for Effective and Efficient Multi-View Anomaly Detection
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
di: Chen, Tianqi, et al.
Pubblicazione: (2025)
di: Chen, Tianqi, et al.
Pubblicazione: (2025)
Scalable Dual Coordinate Descent for Kernel Methods
di: Shao, Zishan, et al.
Pubblicazione: (2024)
di: Shao, Zishan, et al.
Pubblicazione: (2024)
Calibration and Transformation-Free Weight-Only LLMs Quantization via Dynamic Grouping
di: Zheng, Xinzhe, et al.
Pubblicazione: (2025)
di: Zheng, Xinzhe, et al.
Pubblicazione: (2025)
Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity
di: Ran, Yide, et al.
Pubblicazione: (2025)
di: Ran, Yide, et al.
Pubblicazione: (2025)
SpeechPrune: Context-aware Token Pruning for Speech Information Retrieval
di: Lin, Yueqian, et al.
Pubblicazione: (2024)
di: Lin, Yueqian, et al.
Pubblicazione: (2024)
SiDA-MoE: Sparsity-Inspired Data-Aware Serving for Efficient and Scalable Large Mixture-of-Experts Models
di: Du, Zhixu, et al.
Pubblicazione: (2023)
di: Du, Zhixu, et al.
Pubblicazione: (2023)
Improving Routability Prediction via NAS Using a Smooth One-shot Augmented Predictor
di: Sridhar, Arjun, et al.
Pubblicazione: (2024)
di: Sridhar, Arjun, et al.
Pubblicazione: (2024)
SeisFusion: Constrained Diffusion Model with Input Guidance for 3D Seismic Data Interpolation and Reconstruction
di: Wang, Shuang, et al.
Pubblicazione: (2024)
di: Wang, Shuang, et al.
Pubblicazione: (2024)
Score Forgetting Distillation: A Swift, Data-Free Method for Machine Unlearning in Diffusion Models
di: Chen, Tianqi, et al.
Pubblicazione: (2024)
di: Chen, Tianqi, et al.
Pubblicazione: (2024)
You Only Look One Step: Accelerating Backpropagation in Diffusion Sampling with Gradient Shortcuts
di: Dou, Hongkun, et al.
Pubblicazione: (2025)
di: Dou, Hongkun, et al.
Pubblicazione: (2025)
Catch-Up Distillation: You Only Need to Train Once for Accelerating Sampling
di: Shao, Shitong, et al.
Pubblicazione: (2023)
di: Shao, Shitong, et al.
Pubblicazione: (2023)
Advancing Deep Learning through Probability Engineering: A Pragmatic Paradigm for Modern AI
di: Zhang, Jianyi
Pubblicazione: (2025)
di: Zhang, Jianyi
Pubblicazione: (2025)
Policy Gradient with Second Order Momentum
di: Sun, Tianyu
Pubblicazione: (2025)
di: Sun, Tianyu
Pubblicazione: (2025)
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
di: Zhou, Mingyuan, et al.
Pubblicazione: (2024)
Score Distillation Beyond Acceleration: Generative Modeling from Corrupted Data
di: Zhang, Yasi, et al.
Pubblicazione: (2025)
di: Zhang, Yasi, et al.
Pubblicazione: (2025)
TAP: A Token-Adaptive Predictor Framework for Training-Free Diffusion Acceleration
di: Zhu, Haowei, et al.
Pubblicazione: (2026)
di: Zhu, Haowei, et al.
Pubblicazione: (2026)
PIDS: Joint Point Interaction-Dimension Search for 3D Point Cloud
di: Zhang, Tunhou, et al.
Pubblicazione: (2022)
di: Zhang, Tunhou, et al.
Pubblicazione: (2022)
Towards Intrinsically Calibrated Uncertainty Quantification in Industrial Data-Driven Models via Diffusion Sampler
di: Ma, Yiran, et al.
Pubblicazione: (2026)
di: Ma, Yiran, et al.
Pubblicazione: (2026)
MARS: Efficient, Adaptive Co-Scheduling for Heterogeneous Agentic Systems
di: Wang, Yifei, et al.
Pubblicazione: (2026)
di: Wang, Yifei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SADA: Stability-guided Adaptive Diffusion Acceleration
di: Jiang, Ting, et al.
Pubblicazione: (2025) -
FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models
di: Shao, Zishan, et al.
Pubblicazione: (2025) -
CoreInfer: Accelerating Large Language Model Inference with Semantics-Inspired Adaptive Sparse Activation
di: Wang, Qinsi, et al.
Pubblicazione: (2024) -
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
di: Wang, Qinsi, et al.
Pubblicazione: (2025) -
FlashSVD v1.5: Making Low-Rank Transformers Inference Actually Fast
di: Wu, Wenhao, et al.
Pubblicazione: (2026)