Guardado en:
| Autores principales: | Wang, Yixiao, Jiang, Ting, Shao, Zishan, Ye, Hancheng, Sun, Jingwei, Ma, Mingyuan, Zhang, Jianyi, Chen, Yiran, Li, Hai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.01552 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SADA: Stability-guided Adaptive Diffusion Acceleration
por: Jiang, Ting, et al.
Publicado: (2025)
por: Jiang, Ting, et al.
Publicado: (2025)
FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models
por: Shao, Zishan, et al.
Publicado: (2025)
por: Shao, Zishan, et al.
Publicado: (2025)
CoreInfer: Accelerating Large Language Model Inference with Semantics-Inspired Adaptive Sparse Activation
por: Wang, Qinsi, et al.
Publicado: (2024)
por: Wang, Qinsi, et al.
Publicado: (2024)
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
por: Wang, Qinsi, et al.
Publicado: (2025)
por: Wang, Qinsi, et al.
Publicado: (2025)
FlashSVD v1.5: Making Low-Rank Transformers Inference Actually Fast
por: Wu, Wenhao, et al.
Publicado: (2026)
por: Wu, Wenhao, et al.
Publicado: (2026)
Enhanced Cyclic Coordinate Descent Methods for Elastic Net Penalized Linear Models
por: Wang, Yixiao, et al.
Publicado: (2025)
por: Wang, Yixiao, et al.
Publicado: (2025)
KVCOMM: Online Cross-context KV-cache Communication for Efficient LLM-based Multi-agent Systems
por: Ye, Hancheng, et al.
Publicado: (2025)
por: Ye, Hancheng, et al.
Publicado: (2025)
PrivAct: Internalizing Contextual Privacy Preservation via Multi-Agent Preference Training
por: Cheng, Yuhan, et al.
Publicado: (2026)
por: Cheng, Yuhan, et al.
Publicado: (2026)
Keyframe-oriented Vision Token Pruning: Enhancing Efficiency of Large Vision Language Models on Long-Form Video Processing
por: Liu, Yudong, et al.
Publicado: (2025)
por: Liu, Yudong, et al.
Publicado: (2025)
Angles Don't Lie: Unlocking Training-Efficient RL Through the Model's Own Signals
por: Wang, Qinsi, et al.
Publicado: (2025)
por: Wang, Qinsi, et al.
Publicado: (2025)
DPad: Efficient Diffusion Language Models with Suffix Dropout
por: Chen, Xinhua, et al.
Publicado: (2025)
por: Chen, Xinhua, et al.
Publicado: (2025)
LoBAM: LoRA-Based Backdoor Attack on Model Merging
por: Yin, Ming, et al.
Publicado: (2024)
por: Yin, Ming, et al.
Publicado: (2024)
Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models
por: Zhang, Jingyang, et al.
Publicado: (2024)
por: Zhang, Jingyang, et al.
Publicado: (2024)
ZEUS: Zero-shot Embeddings for Unsupervised Separation of Tabular Data
por: Marszałek, Patryk, et al.
Publicado: (2025)
por: Marszałek, Patryk, et al.
Publicado: (2025)
FlashFPS: Efficient Farthest Point Sampling for Large-Scale Point Clouds via Pruning and Caching
por: Fu, Yuzhe, et al.
Publicado: (2026)
por: Fu, Yuzhe, et al.
Publicado: (2026)
Distributionally Robust Optimization via Diffusion Ambiguity Modeling
por: Wen, Jiaqi, et al.
Publicado: (2025)
por: Wen, Jiaqi, et al.
Publicado: (2025)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
por: Zhang, Jianyi, et al.
Publicado: (2024)
por: Zhang, Jianyi, et al.
Publicado: (2024)
MLLM-LLaVA-FL: Multimodal Large Language Model Assisted Federated Learning
por: Zhang, Jianyi, et al.
Publicado: (2024)
por: Zhang, Jianyi, et al.
Publicado: (2024)
ZEUS EQUILIBRADO
por: Frederico Sabino
Publicado: (2019)
por: Frederico Sabino
Publicado: (2019)
IoT-MCP: Bridging LLMs and IoT Systems Through Model Context Protocol
por: Yang, Ningyuan, et al.
Publicado: (2025)
por: Yang, Ningyuan, et al.
Publicado: (2025)
SCoNE: Spherical Consistent Neighborhoods Ensemble for Effective and Efficient Multi-View Anomaly Detection
por: Xu, Yang, et al.
Publicado: (2025)
por: Xu, Yang, et al.
Publicado: (2025)
DLM-One: Diffusion Language Models for One-Step Sequence Generation
por: Chen, Tianqi, et al.
Publicado: (2025)
por: Chen, Tianqi, et al.
Publicado: (2025)
Scalable Dual Coordinate Descent for Kernel Methods
por: Shao, Zishan, et al.
Publicado: (2024)
por: Shao, Zishan, et al.
Publicado: (2024)
Calibration and Transformation-Free Weight-Only LLMs Quantization via Dynamic Grouping
por: Zheng, Xinzhe, et al.
Publicado: (2025)
por: Zheng, Xinzhe, et al.
Publicado: (2025)
Mitigating Non-IID Drift in Zeroth-Order Federated LLM Fine-Tuning with Transferable Sparsity
por: Ran, Yide, et al.
Publicado: (2025)
por: Ran, Yide, et al.
Publicado: (2025)
SpeechPrune: Context-aware Token Pruning for Speech Information Retrieval
por: Lin, Yueqian, et al.
Publicado: (2024)
por: Lin, Yueqian, et al.
Publicado: (2024)
SiDA-MoE: Sparsity-Inspired Data-Aware Serving for Efficient and Scalable Large Mixture-of-Experts Models
por: Du, Zhixu, et al.
Publicado: (2023)
por: Du, Zhixu, et al.
Publicado: (2023)
Improving Routability Prediction via NAS Using a Smooth One-shot Augmented Predictor
por: Sridhar, Arjun, et al.
Publicado: (2024)
por: Sridhar, Arjun, et al.
Publicado: (2024)
SeisFusion: Constrained Diffusion Model with Input Guidance for 3D Seismic Data Interpolation and Reconstruction
por: Wang, Shuang, et al.
Publicado: (2024)
por: Wang, Shuang, et al.
Publicado: (2024)
Score Forgetting Distillation: A Swift, Data-Free Method for Machine Unlearning in Diffusion Models
por: Chen, Tianqi, et al.
Publicado: (2024)
por: Chen, Tianqi, et al.
Publicado: (2024)
You Only Look One Step: Accelerating Backpropagation in Diffusion Sampling with Gradient Shortcuts
por: Dou, Hongkun, et al.
Publicado: (2025)
por: Dou, Hongkun, et al.
Publicado: (2025)
Catch-Up Distillation: You Only Need to Train Once for Accelerating Sampling
por: Shao, Shitong, et al.
Publicado: (2023)
por: Shao, Shitong, et al.
Publicado: (2023)
Advancing Deep Learning through Probability Engineering: A Pragmatic Paradigm for Modern AI
por: Zhang, Jianyi
Publicado: (2025)
por: Zhang, Jianyi
Publicado: (2025)
Policy Gradient with Second Order Momentum
por: Sun, Tianyu
Publicado: (2025)
por: Sun, Tianyu
Publicado: (2025)
Score identity Distillation: Exponentially Fast Distillation of Pretrained Diffusion Models for One-Step Generation
por: Zhou, Mingyuan, et al.
Publicado: (2024)
por: Zhou, Mingyuan, et al.
Publicado: (2024)
Score Distillation Beyond Acceleration: Generative Modeling from Corrupted Data
por: Zhang, Yasi, et al.
Publicado: (2025)
por: Zhang, Yasi, et al.
Publicado: (2025)
TAP: A Token-Adaptive Predictor Framework for Training-Free Diffusion Acceleration
por: Zhu, Haowei, et al.
Publicado: (2026)
por: Zhu, Haowei, et al.
Publicado: (2026)
PIDS: Joint Point Interaction-Dimension Search for 3D Point Cloud
por: Zhang, Tunhou, et al.
Publicado: (2022)
por: Zhang, Tunhou, et al.
Publicado: (2022)
Towards Intrinsically Calibrated Uncertainty Quantification in Industrial Data-Driven Models via Diffusion Sampler
por: Ma, Yiran, et al.
Publicado: (2026)
por: Ma, Yiran, et al.
Publicado: (2026)
MARS: Efficient, Adaptive Co-Scheduling for Heterogeneous Agentic Systems
por: Wang, Yifei, et al.
Publicado: (2026)
por: Wang, Yifei, et al.
Publicado: (2026)
Ejemplares similares
-
SADA: Stability-guided Adaptive Diffusion Acceleration
por: Jiang, Ting, et al.
Publicado: (2025) -
FlashSVD: Memory-Efficient Inference with Streaming for Low-Rank Models
por: Shao, Zishan, et al.
Publicado: (2025) -
CoreInfer: Accelerating Large Language Model Inference with Semantics-Inspired Adaptive Sparse Activation
por: Wang, Qinsi, et al.
Publicado: (2024) -
CoreMatching: A Co-adaptive Sparse Inference Framework with Token and Neuron Pruning for Comprehensive Acceleration of Vision-Language Models
por: Wang, Qinsi, et al.
Publicado: (2025) -
FlashSVD v1.5: Making Low-Rank Transformers Inference Actually Fast
por: Wu, Wenhao, et al.
Publicado: (2026)