ORXE: Orchestrating Experts for Dynamically Configurable Efficiency
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Qingyuan, Wang, Guoxin, Cardiff, Barry, John, Deepu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TinyDrop: Tiny Model Guided Token Dropping for Vision Transformers
por: Wang, Guoxin, et al.
Publicado: (2025)
por: Wang, Guoxin, et al.
Publicado: (2025)
Optimal Brain Connection: Towards Efficient Structural Pruning
por: Chen, Shaowu, et al.
Publicado: (2025)
por: Chen, Shaowu, et al.
Publicado: (2025)
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
por: Huang, Binhua, et al.
Publicado: (2025)
por: Huang, Binhua, et al.
Publicado: (2025)
Scope: Selective Cross-modal Orchestration of Visual Perception Experts
por: Zhang, Tianyu, et al.
Publicado: (2025)
por: Zhang, Tianyu, et al.
Publicado: (2025)
DyCE: Dynamically Configurable Exiting for Deep Learning Compression and Real-time Scaling
por: Wang, Qingyuan, et al.
Publicado: (2024)
por: Wang, Qingyuan, et al.
Publicado: (2024)
VersaVogue: Visual Expert Orchestration and Preference Alignment for Unified Fashion Synthesis
por: Yu, Jian, et al.
Publicado: (2026)
por: Yu, Jian, et al.
Publicado: (2026)
VisionLaw: Inferring Interpretable Intrinsic Dynamics from Visual Observations via Bilevel Optimization
por: Lin, Jiajing, et al.
Publicado: (2025)
por: Lin, Jiajing, et al.
Publicado: (2025)
Synergistic Perception and Generative Recomposition: A Multi-Agent Orchestration for Expert-Level Building Inspection
por: Zhong, Hui, et al.
Publicado: (2026)
por: Zhong, Hui, et al.
Publicado: (2026)
VOST-SGG: VLM-Aided One-Stage Spatio-Temporal Scene Graph Generation
por: Sugandhika, Chinthani, et al.
Publicado: (2025)
por: Sugandhika, Chinthani, et al.
Publicado: (2025)
Know-Show: Benchmarking Video-Language Models on Spatio-Temporal Grounded Reasoning
por: Sugandhika, Chinthani, et al.
Publicado: (2025)
por: Sugandhika, Chinthani, et al.
Publicado: (2025)
Situational Scene Graph for Structured Human-centric Situation Understanding
por: Sugandhika, Chinthani, et al.
Publicado: (2024)
por: Sugandhika, Chinthani, et al.
Publicado: (2024)
Part Segmentation and Motion Estimation for Articulated Objects with Dynamic 3D Gaussians
por: Chao, Jun-Jee, et al.
Publicado: (2025)
por: Chao, Jun-Jee, et al.
Publicado: (2025)
JoyHallo: Digital human model for Mandarin
por: Shi, Sheng, et al.
Publicado: (2024)
por: Shi, Sheng, et al.
Publicado: (2024)
Next-Frame Feature Prediction for Multimodal Deepfake Detection and Temporal Localization
por: Anshul, Ashutosh, et al.
Publicado: (2025)
por: Anshul, Ashutosh, et al.
Publicado: (2025)
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
por: Wang, Xiangchen, et al.
Publicado: (2025)
por: Wang, Xiangchen, et al.
Publicado: (2025)
Chain of Modality: From Static Fusion to Dynamic Orchestration in Omni-MLLMs
por: Luo, Ziyang, et al.
Publicado: (2026)
por: Luo, Ziyang, et al.
Publicado: (2026)
Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
por: Zhao, Wangbo, et al.
Publicado: (2024)
por: Zhao, Wangbo, et al.
Publicado: (2024)
CoReS: Orchestrating the Dance of Reasoning and Segmentation
por: Bao, Xiaoyi, et al.
Publicado: (2024)
por: Bao, Xiaoyi, et al.
Publicado: (2024)
JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation
por: Cao, Xuyang, et al.
Publicado: (2024)
por: Cao, Xuyang, et al.
Publicado: (2024)
JoyType: A Robust Design for Multilingual Visual Text Creation
por: Li, Chao, et al.
Publicado: (2024)
por: Li, Chao, et al.
Publicado: (2024)
SAMCL: Empowering SAM to Continually Learn from Dynamic Domains with Extreme Storage Efficiency
por: Wang, Zeqing, et al.
Publicado: (2024)
por: Wang, Zeqing, et al.
Publicado: (2024)
Unlocking the Potential: Multi-task Deep Learning for Spaceborne Quantitative Monitoring of Fugitive Methane Plumes
por: Si, Guoxin, et al.
Publicado: (2024)
por: Si, Guoxin, et al.
Publicado: (2024)
EchoVLM: Dynamic Mixture-of-Experts Vision-Language Model for Universal Ultrasound Intelligence
por: She, Chaoyin, et al.
Publicado: (2025)
por: She, Chaoyin, et al.
Publicado: (2025)
MoDES: Accelerating Mixture-of-Experts Multimodal Large Language Models via Dynamic Expert Skipping
por: Huang, Yushi, et al.
Publicado: (2025)
por: Huang, Yushi, et al.
Publicado: (2025)
Dynamic Mixture of Curriculum LoRA Experts for Continual Multimodal Instruction Tuning
por: Ge, Chendi, et al.
Publicado: (2025)
por: Ge, Chendi, et al.
Publicado: (2025)
DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models
por: Qin, Mengxin, et al.
Publicado: (2026)
por: Qin, Mengxin, et al.
Publicado: (2026)
A Bi-Pyramid Multimodal Fusion Method for the Diagnosis of Bipolar Disorders
por: Wang, Guoxin, et al.
Publicado: (2024)
por: Wang, Guoxin, et al.
Publicado: (2024)
Dynamic Mixture-of-Experts for Visual Autoregressive Model
por: Vincenti, Jort, et al.
Publicado: (2025)
por: Vincenti, Jort, et al.
Publicado: (2025)
MUSE: A Multi-agent Framework for Unconstrained Story Envisioning via Closed-Loop Cognitive Orchestration
por: Sun, Wenzhang, et al.
Publicado: (2026)
por: Sun, Wenzhang, et al.
Publicado: (2026)
S3Net: Innovating Stereo Matching and Semantic Segmentation with a Single-Branch Semantic Stereo Network in Satellite Epipolar Imagery
por: Yang, Qingyuan, et al.
Publicado: (2024)
por: Yang, Qingyuan, et al.
Publicado: (2024)
3SHNet: Boosting Image-Sentence Retrieval via Visual Semantic-Spatial Self-Highlighting
por: Ge, Xuri, et al.
Publicado: (2024)
por: Ge, Xuri, et al.
Publicado: (2024)
VideoMem: Enhancing Ultra-Long Video Understanding via Adaptive Memory Management
por: Jin, Hongbo, et al.
Publicado: (2025)
por: Jin, Hongbo, et al.
Publicado: (2025)
MMGait: Towards Multi-Modal Gait Recognition
por: Wang, Chenye, et al.
Publicado: (2026)
por: Wang, Chenye, et al.
Publicado: (2026)
Cross-Modality Attack Boosted by Gradient-Evolutionary Multiform Optimization
por: Gong, Yunpeng, et al.
Publicado: (2024)
por: Gong, Yunpeng, et al.
Publicado: (2024)
Polymorph: Energy-Efficient Multi-Label Classification for Video Streams on Embedded Devices
por: Ghafouri, Saeid, et al.
Publicado: (2025)
por: Ghafouri, Saeid, et al.
Publicado: (2025)
Solution for OOD-CV UNICORN Challenge 2024 Object Detection Assistance LLM Counting Ability Improvement
por: Chi, Zhouyang, et al.
Publicado: (2024)
por: Chi, Zhouyang, et al.
Publicado: (2024)
AVoCaDO: An Audiovisual Video Captioner Driven by Temporal Orchestration
por: Chen, Xinlong, et al.
Publicado: (2025)
por: Chen, Xinlong, et al.
Publicado: (2025)
FGU3R: Fine-Grained Fusion via Unified 3D Representation for Multimodal 3D Object Detection
por: Zhang, Guoxin, et al.
Publicado: (2025)
por: Zhang, Guoxin, et al.
Publicado: (2025)
Small but Mighty: Dynamic Wavelet Expert-Guided Fine-Tuning of Large-Scale Models for Optical Remote Sensing Object Segmentation
por: Sun, Yanguang, et al.
Publicado: (2026)
por: Sun, Yanguang, et al.
Publicado: (2026)
Mesoscopic Insights: Orchestrating Multi-scale & Hybrid Architecture for Image Manipulation Localization
por: Zhu, Xuekang, et al.
Publicado: (2024)
por: Zhu, Xuekang, et al.
Publicado: (2024)
Ejemplares similares
-
TinyDrop: Tiny Model Guided Token Dropping for Vision Transformers
por: Wang, Guoxin, et al.
Publicado: (2025) -
Optimal Brain Connection: Towards Efficient Structural Pruning
por: Chen, Shaowu, et al.
Publicado: (2025) -
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
por: Huang, Binhua, et al.
Publicado: (2025) -
Scope: Selective Cross-modal Orchestration of Visual Perception Experts
por: Zhang, Tianyu, et al.
Publicado: (2025) -
DyCE: Dynamically Configurable Exiting for Deep Learning Compression and Real-time Scaling
por: Wang, Qingyuan, et al.
Publicado: (2024)