A review on Machine Learning based User-Centric Multimedia Streaming Techniques
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghosh, Monalisa, Singhal, Chetna |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Detecting Multimedia Generated by Large AI Models: A Survey
par: Lin, Li, et autres
Publié: (2024)
par: Lin, Li, et autres
Publié: (2024)
Harmful Visual Content Manipulation Matters in Misinformation Detection Under Multimedia Scenarios
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
FairStream: Fair Multimedia Streaming Benchmark for Reinforcement Learning Agents
par: Weil, Jannis, et autres
Publié: (2024)
par: Weil, Jannis, et autres
Publié: (2024)
InteractiveVideo: User-Centric Controllable Video Generation with Synergistic Multimodal Instructions
par: Zhang, Yiyuan, et autres
Publié: (2024)
par: Zhang, Yiyuan, et autres
Publié: (2024)
Adaptive Social Metaverse Streaming based on Federated Multi-Agent Deep Reinforcement Learning
par: Long, Zijian, et autres
Publié: (2025)
par: Long, Zijian, et autres
Publié: (2025)
Harmony: A Unified Framework for Modality Incremental Learning
par: Song, Yaguang, et autres
Publié: (2025)
par: Song, Yaguang, et autres
Publié: (2025)
EquiAV: Leveraging Equivariance for Audio-Visual Contrastive Learning
par: Kim, Jongsuk, et autres
Publié: (2024)
par: Kim, Jongsuk, et autres
Publié: (2024)
Enhancing Modality Representation and Alignment for Multimodal Cold-start Active Learning
par: Shen, Meng, et autres
Publié: (2024)
par: Shen, Meng, et autres
Publié: (2024)
HeLo: Heterogeneous Multi-Modal Fusion with Label Correlation for Emotion Distribution Learning
par: Zheng, Chuhang, et autres
Publié: (2025)
par: Zheng, Chuhang, et autres
Publié: (2025)
GRAFT: GRaPH and Table Reasoning for Textual Alignment -- A Benchmark for Structured Instruction Following and Visual Reasoning
par: Verma, Abhigya, et autres
Publié: (2025)
par: Verma, Abhigya, et autres
Publié: (2025)
Unveiling Covert Toxicity in Multimodal Data via Toxicity Association Graphs: A Graph-Based Metric and Interpretable Detection Framework
par: Wu, Guanzong, et autres
Publié: (2026)
par: Wu, Guanzong, et autres
Publié: (2026)
Human-Centric Foundation Models: Perception, Generation and Agentic Modeling
par: Tang, Shixiang, et autres
Publié: (2025)
par: Tang, Shixiang, et autres
Publié: (2025)
MixEval-X: Any-to-Any Evaluations from Real-World Data Mixtures
par: Ni, Jinjie, et autres
Publié: (2024)
par: Ni, Jinjie, et autres
Publié: (2024)
Predicting Outcomes in Video Games with Long Short Term Memory Networks
par: Chulajata, Kittimate, et autres
Publié: (2024)
par: Chulajata, Kittimate, et autres
Publié: (2024)
BI-MDRG: Bridging Image History in Multimodal Dialogue Response Generation
par: Yoon, Hee Suk, et autres
Publié: (2024)
par: Yoon, Hee Suk, et autres
Publié: (2024)
Identifying Multi-modal Knowledge Neurons in Pretrained Transformers via Two-stage Filtering
par: Sato, Yugen, et autres
Publié: (2025)
par: Sato, Yugen, et autres
Publié: (2025)
Time-RA: Towards Time Series Reasoning for Anomaly Diagnosis with LLM Feedback
par: Yang, Yiyuan, et autres
Publié: (2025)
par: Yang, Yiyuan, et autres
Publié: (2025)
OmniMER: Auxiliary-Enhanced LLM Adaptation for Indonesian Multimodal Emotion Recognition
par: Yan, Xueming, et autres
Publié: (2025)
par: Yan, Xueming, et autres
Publié: (2025)
AI-Integrated Decision Support System for Real-Time Market Growth Forecasting and Multi-Source Content Diffusion Analytics
par: Yin, Ziqing, et autres
Publié: (2025)
par: Yin, Ziqing, et autres
Publié: (2025)
Comparing Contrastive and Triplet Loss: Variance Analysis and Optimization Behavior
par: Zeng, Donghuo
Publié: (2025)
par: Zeng, Donghuo
Publié: (2025)
FedNano: Toward Lightweight Federated Tuning for Pretrained Multimodal Large Language Models
par: Zhang, Yao, et autres
Publié: (2025)
par: Zhang, Yao, et autres
Publié: (2025)
From Load Tests to Live Streams: Graph Embedding-Based Anomaly Detection in Microservice Architectures
par: Madabhushi, Srinidhi, et autres
Publié: (2026)
par: Madabhushi, Srinidhi, et autres
Publié: (2026)
Contestable Multi-Agent Debate with Arena-based Argumentative Computation for Multimedia Verification
par: Nguyen, Truong Thanh Hung, et autres
Publié: (2026)
par: Nguyen, Truong Thanh Hung, et autres
Publié: (2026)
FISHER: A Foundation Model for Multi-Modal Industrial Signal Comprehensive Representation
par: Fan, Pingyi, et autres
Publié: (2025)
par: Fan, Pingyi, et autres
Publié: (2025)
MMTB: Evaluating Terminal Agents on Multimedia-File Tasks
par: Heo, Chiyeong, et autres
Publié: (2026)
par: Heo, Chiyeong, et autres
Publié: (2026)
Instruction-Guided Editing Controls for Images and Multimedia: A Survey in LLM era
par: Nguyen, Thanh Tam, et autres
Publié: (2024)
par: Nguyen, Thanh Tam, et autres
Publié: (2024)
End-to-End Learning-based Video Streaming Enhancement Pipeline: A Generative AI Approach
par: Artioli, Emanuele, et autres
Publié: (2025)
par: Artioli, Emanuele, et autres
Publié: (2025)
Human-Machine Ritual: Synergic Performance through Real-Time Motion Recognition
par: Cai, Zhuodi, et autres
Publié: (2025)
par: Cai, Zhuodi, et autres
Publié: (2025)
Adaptive Prototype Knowledge Transfer for Federated Learning with Mixed Modalities and Heterogeneous Tasks
par: Gai, Keke, et autres
Publié: (2025)
par: Gai, Keke, et autres
Publié: (2025)
Machine Learning-Based Prediction of Quality Shifts on Video Streaming Over 5G
par: Mustafa, Raza Ul, et autres
Publié: (2025)
par: Mustafa, Raza Ul, et autres
Publié: (2025)
Understanding the Fine-Grained Knowledge Capabilities of Vision-Language Models
par: Ghosh, Dhruba, et autres
Publié: (2026)
par: Ghosh, Dhruba, et autres
Publié: (2026)
MuPHI: Learning Implicit Multimodal Harm Reasoning via Semantically Grounded Reward Optimization
par: Saha, Anisha, et autres
Publié: (2026)
par: Saha, Anisha, et autres
Publié: (2026)
Machine Learning-Driven Open-Source Framework for Assessing QoE in Multimedia Networks
par: Panahi, Parsa Hassani Shariat, et autres
Publié: (2024)
par: Panahi, Parsa Hassani Shariat, et autres
Publié: (2024)
LASPA: Language Agnostic Speaker Disentanglement with Prefix-Tuned Cross-Attention
par: Menon, Aditya Srinivas, et autres
Publié: (2025)
par: Menon, Aditya Srinivas, et autres
Publié: (2025)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
par: Novack, Zachary, et autres
Publié: (2026)
par: Novack, Zachary, et autres
Publié: (2026)
DRAGON: Distributional Rewards Optimize Diffusion Generative Models
par: Bai, Yatong, et autres
Publié: (2025)
par: Bai, Yatong, et autres
Publié: (2025)
Finding Distributed Object-Centric Properties in Self-Supervised Transformers
par: Rawlekar, Samyak, et autres
Publié: (2026)
par: Rawlekar, Samyak, et autres
Publié: (2026)
LUST: A Multi-Modal Framework with Hierarchical LLM-based Scoring for Learned Thematic Significance Tracking in Multimedia Content
par: Luiz, Anderson de Lima
Publié: (2025)
par: Luiz, Anderson de Lima
Publié: (2025)
Doctor Sun: A Bilingual Multimodal Large Language Model for Biomedical AI
par: Xue, Dong, et autres
Publié: (2025)
par: Xue, Dong, et autres
Publié: (2025)
Decoding the Hook: A Multimodal LLM Framework for Analyzing the Hooking Period of Video Ads
par: Zhang, Kunpeng, et autres
Publié: (2026)
par: Zhang, Kunpeng, et autres
Publié: (2026)
Documents similaires
-
Detecting Multimedia Generated by Large AI Models: A Survey
par: Lin, Li, et autres
Publié: (2024) -
Harmful Visual Content Manipulation Matters in Misinformation Detection Under Multimedia Scenarios
par: Wang, Bing, et autres
Publié: (2026) -
FairStream: Fair Multimedia Streaming Benchmark for Reinforcement Learning Agents
par: Weil, Jannis, et autres
Publié: (2024) -
InteractiveVideo: User-Centric Controllable Video Generation with Synergistic Multimodal Instructions
par: Zhang, Yiyuan, et autres
Publié: (2024) -
Adaptive Social Metaverse Streaming based on Federated Multi-Agent Deep Reinforcement Learning
par: Long, Zijian, et autres
Publié: (2025)