LeMiCa: Lexicographic Minimax Path Caching for Efficient Diffusion-Based Video Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Huanlin, Chen, Ping, Shi, Fuyuan, Tan, Chao, Liu, Zhaoxiang, Zhao, Fang, Wang, Kai, Lian, Shiguo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MeanCache: From Instantaneous to Average Velocity for Accelerating Flow Matching Inference
por: Gao, Huanlin, et al.
Publicado: (2026)
por: Gao, Huanlin, et al.
Publicado: (2026)
MediaClaw: Multimodal Intelligent-Agent Platform Technical Report
por: Zhao, Shaoan, et al.
Publicado: (2026)
por: Zhao, Shaoan, et al.
Publicado: (2026)
HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment
por: Wu, Ruijia, et al.
Publicado: (2025)
por: Wu, Ruijia, et al.
Publicado: (2025)
Optimizing for the Shortest Path in Denoising Diffusion Model
por: Chen, Ping, et al.
Publicado: (2025)
por: Chen, Ping, et al.
Publicado: (2025)
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
por: Gao, Kaifeng, et al.
Publicado: (2024)
por: Gao, Kaifeng, et al.
Publicado: (2024)
Patch-wise Auto-Encoder for Visual Anomaly Detection
por: Cui, Yajie, et al.
Publicado: (2023)
por: Cui, Yajie, et al.
Publicado: (2023)
TP3M: Transformer-based Pseudo 3D Image Matching with Reference Image
por: Han, Liming, et al.
Publicado: (2024)
por: Han, Liming, et al.
Publicado: (2024)
KAConvNet: Kolmogorov-Arnold Convolutional Networks for Vision Recognition
por: Liu, Zhaoxiang, et al.
Publicado: (2026)
por: Liu, Zhaoxiang, et al.
Publicado: (2026)
GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization
por: Wu, Zihui, et al.
Publicado: (2024)
por: Wu, Zihui, et al.
Publicado: (2024)
A Large Vision-Language Model based Environment Perception System for Visually Impaired People
por: Chen, Zezhou, et al.
Publicado: (2025)
por: Chen, Zezhou, et al.
Publicado: (2025)
Piculet: Specialized Models-Guided Hallucination Decrease for MultiModal Large Language Models
por: Wang, Kohou, et al.
Publicado: (2024)
por: Wang, Kohou, et al.
Publicado: (2024)
Chain-of-Trajectories: Unlocking the Intrinsic Generative Optimality of Diffusion Models via Graph-Theoretic Planning
por: Chen, Ping, et al.
Publicado: (2026)
por: Chen, Ping, et al.
Publicado: (2026)
PSTF-AttControl: Per-Subject-Tuning-Free Personalized Image Generation with Controllable Face Attributes
por: liu, Xiang, et al.
Publicado: (2025)
por: liu, Xiang, et al.
Publicado: (2025)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
por: Liu, Xiang, et al.
Publicado: (2025)
por: Liu, Xiang, et al.
Publicado: (2025)
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
por: Zhang, Wenjing, et al.
Publicado: (2024)
por: Zhang, Wenjing, et al.
Publicado: (2024)
Efficient Lexicographic Optimization for Prioritized Robot Control and Planning
por: Pfeiffer, Kai, et al.
Publicado: (2024)
por: Pfeiffer, Kai, et al.
Publicado: (2024)
Uniform Discrete Diffusion with Metric Path for Video Generation
por: Deng, Haoge, et al.
Publicado: (2025)
por: Deng, Haoge, et al.
Publicado: (2025)
Hierarchical Deep Fusion Framework for Multi-dimensional Facial Forgery Detection -- The 2024 Global Deepfake Image Detection Challenge
por: Wang, Kohou, et al.
Publicado: (2025)
por: Wang, Kohou, et al.
Publicado: (2025)
Mixture of Heterogeneous Grouped Experts for Language Modeling
por: Ma, Zhicheng, et al.
Publicado: (2026)
por: Ma, Zhicheng, et al.
Publicado: (2026)
A Multimodal Benchmark Dataset and Model for Crop Disease Diagnosis
por: Liu, Xiang, et al.
Publicado: (2025)
por: Liu, Xiang, et al.
Publicado: (2025)
HEAL: Hindsight Entropy-Assisted Learning for Reasoning Distillation
por: Zhang, Wenjing, et al.
Publicado: (2026)
por: Zhang, Wenjing, et al.
Publicado: (2026)
Fuzzy Reasoning Chain (FRC): An Innovative Reasoning Framework from Fuzziness to Clarity
por: Chen, Ping, et al.
Publicado: (2025)
por: Chen, Ping, et al.
Publicado: (2025)
What is the best model? Application-driven Evaluation for Large Language Models
por: Lian, Shiguo, et al.
Publicado: (2024)
por: Lian, Shiguo, et al.
Publicado: (2024)
A Systematic Security Evaluation of OpenClaw and Its Variants
por: Wang, Yuhang, et al.
Publicado: (2026)
por: Wang, Yuhang, et al.
Publicado: (2026)
DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching
por: Zou, Chang, et al.
Publicado: (2026)
por: Zou, Chang, et al.
Publicado: (2026)
Motion-Aware Caching for Efficient Autoregressive Video Generation
por: Xu, Jing, et al.
Publicado: (2026)
por: Xu, Jing, et al.
Publicado: (2026)
PreciseCache: Precise Feature Caching for Efficient and High-fidelity Video Generation
por: Wang, Jiangshan, et al.
Publicado: (2026)
por: Wang, Jiangshan, et al.
Publicado: (2026)
Fatigue Life Analysis of Cranes Based on Load Spectrum Prediction and Fracture Mechanics
por: Mantang Hu, et al.
Publicado: (2025)
por: Mantang Hu, et al.
Publicado: (2025)
TIR-Agent: Training an Explorative and Efficient Agent for Image Restoration
por: Zhang, Yisheng, et al.
Publicado: (2026)
por: Zhang, Yisheng, et al.
Publicado: (2026)
PaLMR: Towards Faithful Visual Reasoning via Multimodal Process Alignment
por: Li, Yantao, et al.
Publicado: (2026)
por: Li, Yantao, et al.
Publicado: (2026)
Multi-Objective Multi-Agent Path Finding with Lexicographic Cost Preferences
por: Rustagi, Pulkit, et al.
Publicado: (2025)
por: Rustagi, Pulkit, et al.
Publicado: (2025)
Sparser Block-Sparse Attention via Token Permutation
por: Wang, Xinghao, et al.
Publicado: (2025)
por: Wang, Xinghao, et al.
Publicado: (2025)
Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model
por: Liu, Feng, et al.
Publicado: (2024)
por: Liu, Feng, et al.
Publicado: (2024)
Adaptive Caching for Faster Video Generation with Diffusion Transformers
por: Kahatapitiya, Kumara, et al.
Publicado: (2024)
por: Kahatapitiya, Kumara, et al.
Publicado: (2024)
DAST: Difficulty-Adaptive Slow-Thinking for Large Reasoning Models
por: Shen, Yi, et al.
Publicado: (2025)
por: Shen, Yi, et al.
Publicado: (2025)
Lexicographic Multi-Objective Stochastic Shortest Path with Mixed Max-Sum Costs
por: Zhang, Zhiquan, et al.
Publicado: (2025)
por: Zhang, Zhiquan, et al.
Publicado: (2025)
Minimax Signal Detection in Sparse Additive Models
por: Kotekal, Subhodh, et al.
Publicado: (2023)
por: Kotekal, Subhodh, et al.
Publicado: (2023)
Efficient Dataset Distillation via Minimax Diffusion
por: Gu, Jianyang, et al.
Publicado: (2023)
por: Gu, Jianyang, et al.
Publicado: (2023)
Unsupervised Industrial Anomaly Detection via Pattern Generative and Contrastive Networks
por: Huang, Jianfeng, et al.
Publicado: (2022)
por: Huang, Jianfeng, et al.
Publicado: (2022)
MITS: A Large-Scale Multimodal Benchmark Dataset for Intelligent Traffic Surveillance
por: Zhao, Kaikai, et al.
Publicado: (2025)
por: Zhao, Kaikai, et al.
Publicado: (2025)
Ejemplares similares
-
MeanCache: From Instantaneous to Average Velocity for Accelerating Flow Matching Inference
por: Gao, Huanlin, et al.
Publicado: (2026) -
MediaClaw: Multimodal Intelligent-Agent Platform Technical Report
por: Zhao, Shaoan, et al.
Publicado: (2026) -
HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment
por: Wu, Ruijia, et al.
Publicado: (2025) -
Optimizing for the Shortest Path in Denoising Diffusion Model
por: Chen, Ping, et al.
Publicado: (2025) -
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
por: Gao, Kaifeng, et al.
Publicado: (2024)