DyRoNet: Dynamic Routing and Low-Rank Adapters for Autonomous Driving Streaming Perception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Xiang, Cheng, Zhi-Qi, He, Jun-Yan, Li, Chenyang, Xiang, Wangmeng, Sun, Baigui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MetaDesigner: Advancing Artistic Typography Through AI-Driven, User-Centric, and Multilingual WordArt Synthesis
par: He, Jun-Yan, et autres
Publié: (2024)
par: He, Jun-Yan, et autres
Publié: (2024)
WordArt Designer API: User-Driven Artistic Typography Synthesis with Large Language Models on ModelScope
par: He, Jun-Yan, et autres
Publié: (2024)
par: He, Jun-Yan, et autres
Publié: (2024)
UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval
par: Jiang, Haoyu, et autres
Publié: (2024)
par: Jiang, Haoyu, et autres
Publié: (2024)
UMETTS: A Unified Framework for Emotional Text-to-Speech Synthesis with Multimodal Prompts
par: Cheng, Zhi-Qi, et autres
Publié: (2024)
par: Cheng, Zhi-Qi, et autres
Publié: (2024)
Optimizing QoE-Privacy Tradeoff for Proactive VR Streaming
par: Wei, Xing, et autres
Publié: (2025)
par: Wei, Xing, et autres
Publié: (2025)
Routing Experts: Learning to Route Dynamic Experts in Multi-modal Large Language Models
par: Wu, Qiong, et autres
Publié: (2024)
par: Wu, Qiong, et autres
Publié: (2024)
Plasticity-Aware Mixture of Experts for Learning Under QoE Shifts in Adaptive Video Streaming
par: He, Zhiqiang, et autres
Publié: (2025)
par: He, Zhiqiang, et autres
Publié: (2025)
Emotion-LLaMA: Multimodal Emotion Recognition and Reasoning with Instruction Tuning
par: Cheng, Zebang, et autres
Publié: (2024)
par: Cheng, Zebang, et autres
Publié: (2024)
MolCA: Molecular Graph-Language Modeling with Cross-Modal Projector and Uni-Modal Adapter
par: Liu, Zhiyuan, et autres
Publié: (2023)
par: Liu, Zhiyuan, et autres
Publié: (2023)
FakeSV-VLM: Taming VLM for Detecting Fake Short-Video News via Progressive Mixture-Of-Experts Adapter
par: Wang, Junxi, et autres
Publié: (2025)
par: Wang, Junxi, et autres
Publié: (2025)
Predicting Encoding Energy from Low-Pass Anchors for Green Video Streaming
par: Azimi, Zoha, et autres
Publié: (2025)
par: Azimi, Zoha, et autres
Publié: (2025)
Why We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models
par: Lin, Yuxiang, et autres
Publié: (2025)
par: Lin, Yuxiang, et autres
Publié: (2025)
Scalable On-the-fly Transcoding for Adaptive Streaming of Dynamic Point Clouds
par: Rudolph, Michael, et autres
Publié: (2026)
par: Rudolph, Michael, et autres
Publié: (2026)
Hybrid CNN-Mamba Enhancement Network for Robust Multimodal Sentiment Analysis
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
Prediction, Communication, and Computing Duration Optimization for VR Video Streaming
par: Wei, Xing, et autres
Publié: (2019)
par: Wei, Xing, et autres
Publié: (2019)
A 3D Framework for Improving Low-Latency Multi-Channel Live Streaming
par: Aiersilan, Aizierjiang, et autres
Publié: (2024)
par: Aiersilan, Aizierjiang, et autres
Publié: (2024)
Optimal Quality and Efficiency in Adaptive Live Streaming with JND-Aware Low latency Encoding
par: Menon, Vignesh V, et autres
Publié: (2024)
par: Menon, Vignesh V, et autres
Publié: (2024)
Subjective Evaluation of Frame Rate in Bitrate-Constrained Live Streaming
par: He, Jiaqi, et autres
Publié: (2026)
par: He, Jiaqi, et autres
Publié: (2026)
Quality-Aware Dynamic Resolution Adaptation Framework for Adaptive Video Streaming
par: Premkumar, Amritha, et autres
Publié: (2024)
par: Premkumar, Amritha, et autres
Publié: (2024)
RoSMM: A Robust and Secure Multi-Modal Watermarking Framework for Diffusion Models
par: Fang, ZhongLi, et autres
Publié: (2025)
par: Fang, ZhongLi, et autres
Publié: (2025)
Compression Metadata-assisted RoI Extraction and Adaptive Inference for Efficient Video Analytics
par: Wang, Chengzhi, et autres
Publié: (2025)
par: Wang, Chengzhi, et autres
Publié: (2025)
Energy-efficient Adaptive Video Streaming with Latency-Aware Dynamic Resolution Encoding
par: Menon, Vignesh V, et autres
Publié: (2024)
par: Menon, Vignesh V, et autres
Publié: (2024)
An Experimental Study of Low-Latency Video Streaming over 5G
par: Khan, Imran, et autres
Publié: (2024)
par: Khan, Imran, et autres
Publié: (2024)
Multimodal Framework for Explainable Autonomous Driving: Integrating Video, Sensor, and Textual Data for Enhanced Decision-Making and Transparency
par: Zarghani, Abolfazl, et autres
Publié: (2025)
par: Zarghani, Abolfazl, et autres
Publié: (2025)
Towards Low-Latency and Energy-Efficient Hybrid P2P-CDN Live Video Streaming
par: Farahani, Reza, et autres
Publié: (2024)
par: Farahani, Reza, et autres
Publié: (2024)
TF-Mamba: Text-enhanced Fusion Mamba with Missing Modalities for Robust Multimodal Sentiment Analysis
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
Inter-Frame Coding for Dynamic Meshes via Coarse-to-Fine Anchor Mesh Generation
par: Huang, He, et autres
Publié: (2024)
par: Huang, He, et autres
Publié: (2024)
RoboTron-Drive: All-in-One Large Multimodal Model for Autonomous Driving
par: Huang, Zhijian, et autres
Publié: (2024)
par: Huang, Zhijian, et autres
Publié: (2024)
ISMAF: Intrinsic-Social Modality Alignment and Fusion for Multimodal Rumor Detection
par: Yu, Zihao, et autres
Publié: (2025)
par: Yu, Zihao, et autres
Publié: (2025)
Think before You Leap: Content-Aware Low-Cost Edge-Assisted Video Semantic Segmentation
par: Yan, Mingxuan, et autres
Publié: (2024)
par: Yan, Mingxuan, et autres
Publié: (2024)
VARFVV: View-Adaptive Real-Time Interactive Free-View Video Streaming with Edge Computing
par: Hu, Qiang, et autres
Publié: (2025)
par: Hu, Qiang, et autres
Publié: (2025)
NavigScene: Bridging Local Perception and Global Navigation for Beyond-Visual-Range Autonomous Driving
par: Peng, Qucheng, et autres
Publié: (2025)
par: Peng, Qucheng, et autres
Publié: (2025)
EyEar: Learning Audio Synchronized Human Gaze Trajectory Based on Physics-Informed Dynamics
par: Liu, Xiaochuan, et autres
Publié: (2025)
par: Liu, Xiaochuan, et autres
Publié: (2025)
Camel: Frame-Level Bandwidth Estimation for Low-Latency Live Streaming under Video Bitrate Undershooting
par: Liu, Liming, et autres
Publié: (2026)
par: Liu, Liming, et autres
Publié: (2026)
ITEACH-Net: Inverted Teacher-studEnt seArCH Network for Emotion Recognition in Conversation
par: Sun, Haiyang, et autres
Publié: (2023)
par: Sun, Haiyang, et autres
Publié: (2023)
Towards Railways Remote Driving: Analysis of Video Streaming Latency and Adaptive Rate Control
par: Mejias, Daniel, et autres
Publié: (2024)
par: Mejias, Daniel, et autres
Publié: (2024)
RMAdapter: Reconstruction-based Multi-Modal Adapter for Vision-Language Models
par: Lin, Xiang, et autres
Publié: (2025)
par: Lin, Xiang, et autres
Publié: (2025)
Mixture of Disentangled Experts with Missing Modalities for Robust Multimodal Sentiment Analysis
par: Li, Xiang, et autres
Publié: (2026)
par: Li, Xiang, et autres
Publié: (2026)
DeepStream: Prototyping Deep Joint Source-Channel Coding for Real-Time Multimedia Transmissions
par: Chi, Kaiyi, et autres
Publié: (2025)
par: Chi, Kaiyi, et autres
Publié: (2025)
Listen, Look, Drive: Coupling Audio Instructions for User-aware VLA-based Autonomous Driving
par: Guo, Ziang, et autres
Publié: (2026)
par: Guo, Ziang, et autres
Publié: (2026)
Documents similaires
-
MetaDesigner: Advancing Artistic Typography Through AI-Driven, User-Centric, and Multilingual WordArt Synthesis
par: He, Jun-Yan, et autres
Publié: (2024) -
WordArt Designer API: User-Driven Artistic Typography Synthesis with Large Language Models on ModelScope
par: He, Jun-Yan, et autres
Publié: (2024) -
UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval
par: Jiang, Haoyu, et autres
Publié: (2024) -
UMETTS: A Unified Framework for Emotional Text-to-Speech Synthesis with Multimodal Prompts
par: Cheng, Zhi-Qi, et autres
Publié: (2024) -
Optimizing QoE-Privacy Tradeoff for Proactive VR Streaming
par: Wei, Xing, et autres
Publié: (2025)