Mosaic: Cross-Modal Clustering for Efficient Video Understanding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Tuowei, Zhou, He, Song, Chengru, Li, Qiushi, Ren, Ju |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Swarm: Co-Activation Aware KVCache Offloading Across Multiple SSDs
par: Wang, Tuowei, et autres
Publié: (2026)
par: Wang, Tuowei, et autres
Publié: (2026)
Matryoshka: Optimization of Dynamic Diverse Quantum Chemistry Systems via Elastic Parallelism Transformation
par: Wang, Tuowei, et autres
Publié: (2024)
par: Wang, Tuowei, et autres
Publié: (2024)
Neuralink: Fast LLM Inference on Smartphones with Neuron Co-Activation Linking
par: Wang, Tuowei, et autres
Publié: (2024)
par: Wang, Tuowei, et autres
Publié: (2024)
Scaler: Efficient and Effective Cross Flow Analysis
par: Steven, et autres
Publié: (2024)
par: Steven, et autres
Publié: (2024)
Long-term Monitoring of Kernel and Hardware Events to Understand Latency Variance
par: Zhou, Fang, et autres
Publié: (2026)
par: Zhou, Fang, et autres
Publié: (2026)
The Price of Interoperability: Exploring Cross-Chain Bridges and Their Economic Consequences
par: Cao, Yiyue, et autres
Publié: (2026)
par: Cao, Yiyue, et autres
Publié: (2026)
Efficient Data-Driven Production Scheduling in Pharmaceutical Manufacturing
par: Balatsos, Ioannis, et autres
Publié: (2026)
par: Balatsos, Ioannis, et autres
Publié: (2026)
Fine-Grained Clustering-Based Power Identification for Multicores
par: Elshamy, Mohamed R., et autres
Publié: (2024)
par: Elshamy, Mohamed R., et autres
Publié: (2024)
DeepContext: A Context-aware, Cross-platform, and Cross-framework Tool for Performance Profiling and Analysis of Deep Learning Workloads
par: Zhao, Qidong, et autres
Publié: (2024)
par: Zhao, Qidong, et autres
Publié: (2024)
SysOM-AI: Continuous Cross-Layer Performance Diagnosis for Production AI Training
par: Zheng, Yusheng, et autres
Publié: (2026)
par: Zheng, Yusheng, et autres
Publié: (2026)
EDAN: Towards Understanding Memory Parallelism and Latency Sensitivity in HPC
par: Shen, Siyuan, et autres
Publié: (2025)
par: Shen, Siyuan, et autres
Publié: (2025)
Understanding the Impact of Synchronous, Asynchronous, and Hybrid In-Situ Techniques in Computational Fluid Dynamics Applications
par: Ju, Yi, et autres
Publié: (2024)
par: Ju, Yi, et autres
Publié: (2024)
How Much Parallelism Is "Free"? A Principle of Near-Free Parallelism for Parallel Decoding
par: He, Minghua, et autres
Publié: (2026)
par: He, Minghua, et autres
Publié: (2026)
H2EAL: Hybrid-Bonding Architecture with Hybrid Sparse Attention for Efficient Long-Context LLM Inference
par: Fu, Zizhuo, et autres
Publié: (2025)
par: Fu, Zizhuo, et autres
Publié: (2025)
PerfSeer: An Efficient and Accurate Deep Learning Models Performance Predictor
par: Zhao, Xinlong, et autres
Publié: (2025)
par: Zhao, Xinlong, et autres
Publié: (2025)
Polymorph: Energy-Efficient Multi-Label Classification for Video Streams on Embedded Devices
par: Ghafouri, Saeid, et autres
Publié: (2025)
par: Ghafouri, Saeid, et autres
Publié: (2025)
SparseX: Efficient Segment-Level KV Cache Sharing for Interleaved LLM Serving
par: Zhang, Quqing, et autres
Publié: (2026)
par: Zhang, Quqing, et autres
Publié: (2026)
Tail Bounds for Queues with Abandonment: Constant, Moderate, Large Deviations, and Efficient Concentration
par: Wang, Zedong, et autres
Publié: (2026)
par: Wang, Zedong, et autres
Publié: (2026)
Machine Learning-Guided Memory Optimization for DLRM Inference on Tiered Memory
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
Fault-Tolerant Hybrid-Parallel Training at Scale with Reliable and Efficient In-memory Checkpointing
par: Wang, Yuxin, et autres
Publié: (2023)
par: Wang, Yuxin, et autres
Publié: (2023)
SPEC CPU2026: Characterization, Representativeness, and Cross-Suite Comparison
par: Li, Ruihao, et autres
Publié: (2026)
par: Li, Ruihao, et autres
Publié: (2026)
On Efficient Topology Management in Service-Oriented 6G Networks: An Edge Video Distribution Case Study
par: Ennaceur, Zied, et autres
Publié: (2024)
par: Ennaceur, Zied, et autres
Publié: (2024)
Efficient Hybrid Amplitude-Phase Quantization for Multi-Antenna Relay System
par: Kim, Changdae, et autres
Publié: (2025)
par: Kim, Changdae, et autres
Publié: (2025)
GreenLLM: SLO-Aware Dynamic Frequency Scaling for Energy-Efficient LLM Serving
par: Liu, Qunyou, et autres
Publié: (2025)
par: Liu, Qunyou, et autres
Publié: (2025)
Atys: An Efficient Profiling Framework for Identifying Hotspot Functions in Large-scale Cloud Microservices
par: Sun, Jiaqi, et autres
Publié: (2025)
par: Sun, Jiaqi, et autres
Publié: (2025)
An Experimental Study of Low-Latency Video Streaming over 5G
par: Khan, Imran, et autres
Publié: (2024)
par: Khan, Imran, et autres
Publié: (2024)
Achieving Consistent and Comparable CPU Evaluation
par: Wang, Chenxi, et autres
Publié: (2024)
par: Wang, Chenxi, et autres
Publié: (2024)
Waltz: Temperature-Aware Cooperative Compression for High-Performance Compression-Based CSDs
par: Yu, Dingcui, et autres
Publié: (2025)
par: Yu, Dingcui, et autres
Publié: (2025)
A Scalable k-Medoids Clustering via Whale Optimization Algorithm
par: Chenan, Huang, et autres
Publié: (2024)
par: Chenan, Huang, et autres
Publié: (2024)
Anomaly Detection and Improvement of Clusters using Enhanced K-Means Algorithm
par: Shorewala, Vardhan, et autres
Publié: (2025)
par: Shorewala, Vardhan, et autres
Publié: (2025)
DSO: A GPU Energy Efficiency Optimizer by Fusing Dynamic and Static Information
par: Wang, Qiang, et autres
Publié: (2024)
par: Wang, Qiang, et autres
Publié: (2024)
PIM or CXL-PIM? Understanding Architectural Trade-offs Through Large-Scale Benchmarking
par: Lee, I-Ting, et autres
Publié: (2025)
par: Lee, I-Ting, et autres
Publié: (2025)
Architectural Trade-offs in the Energy-Efficient Era: A Comparative Study of power-capping NVIDIA H100 and H200
par: Ujeniya, Aditya, et autres
Publié: (2026)
par: Ujeniya, Aditya, et autres
Publié: (2026)
Two-Timescale Dynamic Service Deployment and Task Scheduling with Spatiotemporal Collaboration in Mobile Edge Networks
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
Efficient Reinforcement Learning for Routing Jobs in Heterogeneous Queueing Systems
par: Jali, Neharika, et autres
Publié: (2024)
par: Jali, Neharika, et autres
Publié: (2024)
Cluster-BPI: Efficient Fine-Grain Blind Power Identification for Defending against Hardware Thermal Trojans in Multicore SoCs
par: Elshamy, Mohamed R., et autres
Publié: (2024)
par: Elshamy, Mohamed R., et autres
Publié: (2024)
Systematic Performance Evaluation Framework for LEO Mega-Constellation Satellite Networks
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Efficient scheduling in redundancy systems with general service times
par: Anton, Elene, et autres
Publié: (2022)
par: Anton, Elene, et autres
Publié: (2022)
DistZO2: High-Throughput and Memory-Efficient Zeroth-Order Fine-tuning LLMs with Distributed Parallel Computing
par: Wang, Liangyu, et autres
Publié: (2025)
par: Wang, Liangyu, et autres
Publié: (2025)
gDist: Efficient Distance Computation between 3D Meshes on GPU
par: Fang, Peng, et autres
Publié: (2024)
par: Fang, Peng, et autres
Publié: (2024)
Documents similaires
-
Swarm: Co-Activation Aware KVCache Offloading Across Multiple SSDs
par: Wang, Tuowei, et autres
Publié: (2026) -
Matryoshka: Optimization of Dynamic Diverse Quantum Chemistry Systems via Elastic Parallelism Transformation
par: Wang, Tuowei, et autres
Publié: (2024) -
Neuralink: Fast LLM Inference on Smartphones with Neuron Co-Activation Linking
par: Wang, Tuowei, et autres
Publié: (2024) -
Scaler: Efficient and Effective Cross Flow Analysis
par: Steven, et autres
Publié: (2024) -
Long-term Monitoring of Kernel and Hardware Events to Understand Latency Variance
par: Zhou, Fang, et autres
Publié: (2026)