QuickGrasp: Responsive Video-Language Querying Service via Accelerated Tokenization and Edge-Augmented Inference
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Miao, Zhang, Ruixiao, Shi, Jianxin, Wang, Hengzhi, Fang, Hao, Liu, Jiangchuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
XRFlux: Virtual Reality Benchmark for Edge Caching Systems
par: Alfares, Nader, et autres
Publié: (2024)
par: Alfares, Nader, et autres
Publié: (2024)
An Experimental Study of Low-Latency Video Streaming over 5G
par: Khan, Imran, et autres
Publié: (2024)
par: Khan, Imran, et autres
Publié: (2024)
ViTMAlis: Towards Latency-Critical Mobile Video Analytics with Vision Transformers
par: Zhang, Miao, et autres
Publié: (2026)
par: Zhang, Miao, et autres
Publié: (2026)
Balancing Semantic Relevance and Engagement in Related Video Recommendations
par: Jaspal, Amit, et autres
Publié: (2025)
par: Jaspal, Amit, et autres
Publié: (2025)
Frozen LVLMs for Micro-Video Recommendation: A Systematic Study of Feature Extraction and Fusion
par: Sun, Huatuan, et autres
Publié: (2025)
par: Sun, Huatuan, et autres
Publié: (2025)
Rethink Web Service Resilience in Space: A Radiation-Aware and Sustainable Transmission Solution
par: Chen, Long, et autres
Publié: (2026)
par: Chen, Long, et autres
Publié: (2026)
Disentangled Graph Variational Auto-Encoder for Multimodal Recommendation with Interpretability
par: Zhou, Xin, et autres
Publié: (2024)
par: Zhou, Xin, et autres
Publié: (2024)
Let Multimodal Embedders Learn When to Augment Query via Adaptive Query Augmentation
par: Kim, Wongyu, et autres
Publié: (2025)
par: Kim, Wongyu, et autres
Publié: (2025)
VCR: Video representation for Contextual Retrieval
par: Nir, Oron, et autres
Publié: (2024)
par: Nir, Oron, et autres
Publié: (2024)
Results of the 2025 Video Browser Showdown
par: Rossetto, Luca, et autres
Publié: (2025)
par: Rossetto, Luca, et autres
Publié: (2025)
Results of the 2024 Video Browser Showdown
par: Rossetto, Luca, et autres
Publié: (2024)
par: Rossetto, Luca, et autres
Publié: (2024)
Sustainable Real-Time 8K60 HEVC Encoding for V2X: Repurposing Legacy NVENC Hardware at the Vehicular Edge
par: Arunruangsirilert, Kasidis, et autres
Publié: (2026)
par: Arunruangsirilert, Kasidis, et autres
Publié: (2026)
QuMAB: Query-based Multi-Annotator Behavior Modeling with Reliability under Sparse Labels
par: Zhang, Liyun, et autres
Publié: (2025)
par: Zhang, Liyun, et autres
Publié: (2025)
Ten Ways in which Virtual Reality Differs from Video Streaming
par: de Veciana, Gustavo, et autres
Publié: (2024)
par: de Veciana, Gustavo, et autres
Publié: (2024)
RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation
par: Tourani, Ali, et autres
Publié: (2025)
par: Tourani, Ali, et autres
Publié: (2025)
Robust Relevance Feedback for Interactive Known-Item Video Search
par: Ma, Zhixin, et autres
Publié: (2025)
par: Ma, Zhixin, et autres
Publié: (2025)
Leveraging User-Generated Metadata of Online Videos for Cover Song Identification
par: Hachmeier, Simon, et autres
Publié: (2024)
par: Hachmeier, Simon, et autres
Publié: (2024)
Magic Tokens: Select Diverse Tokens for Multi-modal Object Re-Identification
par: Zhang, Pingping, et autres
Publié: (2024)
par: Zhang, Pingping, et autres
Publié: (2024)
OTCR: Optimal Transmission, Compression and Representation for Multimodal Information Extraction
par: Li, Yang, et autres
Publié: (2025)
par: Li, Yang, et autres
Publié: (2025)
DREAM: A Dual Representation Learning Model for Multimodal Recommendation
par: Zhang, Kangning, et autres
Publié: (2024)
par: Zhang, Kangning, et autres
Publié: (2024)
Learning Item Representations Directly from Multimodal Features for Effective Recommendation
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Does Multimodality Improve Recommender Systems as Expected? A Critical Analysis and Future Directions
par: Zhou, Hongyu, et autres
Publié: (2025)
par: Zhou, Hongyu, et autres
Publié: (2025)
Multimodal Pre-training Framework for Sequential Recommendation via Contrastive Learning
par: Zhang, Lingzi, et autres
Publié: (2023)
par: Zhang, Lingzi, et autres
Publié: (2023)
HistLLM: A Unified Framework for LLM-Based Multimodal Recommendation with User History Encoding and Compression
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
Knowledge-aware Diffusion-Enhanced Multimedia Recommendation
par: Mo, Xian, et autres
Publié: (2025)
par: Mo, Xian, et autres
Publié: (2025)
MMSRARec: Summarization and Retrieval Augumented Sequential Recommendation Based on Multimodal Large Language Model
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
par: Ma, Hongjian, et autres
Publié: (2026)
par: Ma, Hongjian, et autres
Publié: (2026)
Small Stickers, Big Meanings: A Multilingual Sticker Semantic Understanding Dataset with a Gamified Approach
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
Cross-Modal Retrieval: A Systematic Review of Methods and Future Directions
par: Wang, Tianshi, et autres
Publié: (2023)
par: Wang, Tianshi, et autres
Publié: (2023)
U-Sticker: A Large-Scale Multi-Domain User Sticker Dataset for Retrieval and Personalization
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
Robust Live Streaming over LEO Satellite Constellations: Measurement, Analysis, and Handover-Aware Adaptation
par: Fang, Hao, et autres
Publié: (2025)
par: Fang, Hao, et autres
Publié: (2025)
CLEAR: Null-Space Projection for Cross-Modal De-Redundancy in Multimodal Recommendation
par: Zhan, Hao, et autres
Publié: (2026)
par: Zhan, Hao, et autres
Publié: (2026)
Multimodal Pretraining, Adaptation, and Generation for Recommendation: A Survey
par: Liu, Qijiong, et autres
Publié: (2024)
par: Liu, Qijiong, et autres
Publié: (2024)
Hardware Acceleration for Knowledge Graph Processing: Challenges & Recent Developments
par: Besta, Maciej, et autres
Publié: (2024)
par: Besta, Maciej, et autres
Publié: (2024)
RAGPerf: An End-to-End Benchmarking Framework for Retrieval-Augmented Generation Systems
par: Li, Shaobo, et autres
Publié: (2026)
par: Li, Shaobo, et autres
Publié: (2026)
A Global Perspective on the Past, Present, and Future of Video Streaming over Starlink
par: Izhikevich, Liz, et autres
Publié: (2024)
par: Izhikevich, Liz, et autres
Publié: (2024)
Adaptive Multi-Agent Reasoning for Text-to-Video Retrieval
par: Wu, Jiaxin, et autres
Publié: (2025)
par: Wu, Jiaxin, et autres
Publié: (2025)
GenState-AI: State-Aware Dataset for Text-to-Video Retrieval on AI-Generated Videos
par: Li, Minghan, et autres
Publié: (2026)
par: Li, Minghan, et autres
Publié: (2026)
REMOTE: A Unified Multimodal Relation Extraction Framework with Multilevel Optimal Transport and Mixture-of-Experts
par: Lin, Xinkui, et autres
Publié: (2025)
par: Lin, Xinkui, et autres
Publié: (2025)
Uni-Retrieval: A Multi-Style Retrieval Framework for STEM's Education
par: Jia, Yanhao, et autres
Publié: (2025)
par: Jia, Yanhao, et autres
Publié: (2025)
Documents similaires
-
XRFlux: Virtual Reality Benchmark for Edge Caching Systems
par: Alfares, Nader, et autres
Publié: (2024) -
An Experimental Study of Low-Latency Video Streaming over 5G
par: Khan, Imran, et autres
Publié: (2024) -
ViTMAlis: Towards Latency-Critical Mobile Video Analytics with Vision Transformers
par: Zhang, Miao, et autres
Publié: (2026) -
Balancing Semantic Relevance and Engagement in Related Video Recommendations
par: Jaspal, Amit, et autres
Publié: (2025) -
Frozen LVLMs for Micro-Video Recommendation: A Systematic Study of Feature Extraction and Fusion
par: Sun, Huatuan, et autres
Publié: (2025)