Chimera: Improving Generalist Model with Domain-Specific Experts
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Peng, Tianshuo, Li, Mingsheng, Yuan, Jiakang, Zhou, Hongbin, Xia, Renqiu, Zhang, Renrui, Bai, Lei, Mao, Song, Wang, Bin, Zhou, Aojun, Shi, Botian, Chen, Tao, Zhang, Bo, Yue, Xiangyu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
par: Xia, Renqiu, et autres
Publié: (2024)
par: Xia, Renqiu, et autres
Publié: (2024)
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
par: Ye, Hancheng, et autres
Publié: (2024)
par: Ye, Hancheng, et autres
Publié: (2024)
SurveyForge: On the Outline Heuristics, Memory-Driven Generation, and Multi-dimensional Evaluation for Automated Survey Writing
par: Yan, Xiangchao, et autres
Publié: (2025)
par: Yan, Xiangchao, et autres
Publié: (2025)
MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs
par: Yuan, Jiakang, et autres
Publié: (2025)
par: Yuan, Jiakang, et autres
Publié: (2025)
SPOT: Scalable 3D Pre-training via Occupancy Prediction for Learning Transferable 3D Representations
par: Yan, Xiangchao, et autres
Publié: (2023)
par: Yan, Xiangchao, et autres
Publié: (2023)
ReSimAD: Zero-Shot 3D Domain Transfer for Autonomous Driving with Source Reconstruction and Target Simulation
par: Zhang, Bo, et autres
Publié: (2023)
par: Zhang, Bo, et autres
Publié: (2023)
TrustGeoGen: Formal-Verified Data Engine for Trustworthy Multi-modal Geometric Problem Solving
par: Fu, Daocheng, et autres
Publié: (2025)
par: Fu, Daocheng, et autres
Publié: (2025)
StructChart: On the Schema, Metric, and Augmentation for Visual Chart Understanding
par: Xia, Renqiu, et autres
Publié: (2023)
par: Xia, Renqiu, et autres
Publié: (2023)
Dolphin: Moving Towards Closed-loop Auto-research through Thinking, Practice, and Feedback
par: Yuan, Jiakang, et autres
Publié: (2025)
par: Yuan, Jiakang, et autres
Publié: (2025)
SPP: Sparsity-Preserved Parameter-Efficient Fine-Tuning for Large Language Models
par: Lu, Xudong, et autres
Publié: (2024)
par: Lu, Xudong, et autres
Publié: (2024)
ChartX & ChartVLM: A Versatile Benchmark and Foundation Model for Complicated Chart Reasoning
par: Xia, Renqiu, et autres
Publié: (2024)
par: Xia, Renqiu, et autres
Publié: (2024)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
par: Lu, Xudong, et autres
Publié: (2024)
par: Lu, Xudong, et autres
Publié: (2024)
MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning
par: Chen, Xinyan, et autres
Publié: (2025)
par: Chen, Xinyan, et autres
Publié: (2025)
Ultrafast Photoexcitation Induced Nonthermal Lattice Expansion in 2D Perovskite
par: Xiangyu Chen, et autres
Publié: (2025)
par: Xiangyu Chen, et autres
Publié: (2025)
WeatherGFM: Learning A Weather Generalist Foundation Model via In-context Learning
par: Zhao, Xiangyu, et autres
Publié: (2024)
par: Zhao, Xiangyu, et autres
Publié: (2024)
NODI: Out-Of-Distribution Detection with Noise from Diffusion
par: Zhou, Jingqiu, et autres
Publié: (2024)
par: Zhou, Jingqiu, et autres
Publié: (2024)
2Xplat: Two Experts Are Better Than One Generalist
par: Jeong, Hwasik, et autres
Publié: (2026)
par: Jeong, Hwasik, et autres
Publié: (2026)
From Generalist to Specialist: Adapting Vision Language Models via Task-Specific Visual Instruction Tuning
par: Bai, Yang, et autres
Publié: (2024)
par: Bai, Yang, et autres
Publié: (2024)
Omni-SMoLA: Boosting Generalist Multimodal Models with Soft Mixture of Low-rank Experts
par: Wu, Jialin, et autres
Publié: (2023)
par: Wu, Jialin, et autres
Publié: (2023)
Mixing Element Structure in Direct Fiber Feeding Injection Molding: Correlating Microstructure and Fiber Morphology With Length Retention and Mechanical Properties in GF / PP Composites
par: Qiang Gong, et autres
Publié: (2026)
par: Qiang Gong, et autres
Publié: (2026)
Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
DocGenome: An Open Large-scale Scientific Document Benchmark for Training and Testing Multi-modal Large Language Models
par: Xia, Renqiu, et autres
Publié: (2024)
par: Xia, Renqiu, et autres
Publié: (2024)
DevFD: Developmental Face Forgery Detection by Learning Shared and Orthogonal LoRA Subspaces
par: Zhang, Tianshuo, et autres
Publié: (2025)
par: Zhang, Tianshuo, et autres
Publié: (2025)
3D Face Reconstruction with the Geometric Guidance of Facial Part Segmentation
par: Wang, Zidu, et autres
Publié: (2023)
par: Wang, Zidu, et autres
Publié: (2023)
S2TD-Face: Reconstruct a Detailed 3D Face with Controllable Texture from a Single Sketch
par: Wang, Zidu, et autres
Publié: (2024)
par: Wang, Zidu, et autres
Publié: (2024)
Near‐Infrared Light‐Activated Transcription Factor‐Targeted Proteolysis‐Targeting Chimeras Nanomachine for Targeted Degradation of Transcription Factors
par: Bei Zhou, et autres
Publié: (2025)
par: Bei Zhou, et autres
Publié: (2025)
Deep Expert Injection for Anchoring Retinal VLMs with Domain-Specific Knowledge
par: Lu, Shuai, et autres
Publié: (2026)
par: Lu, Shuai, et autres
Publié: (2026)
Symbolic Specification and Reasoning for Quantum Data and Operations
par: Ying, Mingsheng
Publié: (2025)
par: Ying, Mingsheng
Publié: (2025)
ZOPP: A Framework of Zero-shot Offboard Panoptic Perception for Autonomous Driving
par: Ma, Tao, et autres
Publié: (2024)
par: Ma, Tao, et autres
Publié: (2024)
NOAH: Learning Pairwise Object Category Attentions for Image Classification
par: Li, Chao, et autres
Publié: (2024)
par: Li, Chao, et autres
Publié: (2024)
Learning A Low-Level Vision Generalist via Visual Task Prompt
par: Chen, Xiangyu, et autres
Publié: (2024)
par: Chen, Xiangyu, et autres
Publié: (2024)
Direct Discrepancy Replay: Distribution-Discrepancy Condensation and Manifold-Consistent Replay for Continual Face Forgery Detection
par: Zhang, Tianshuo, et autres
Publié: (2026)
par: Zhang, Tianshuo, et autres
Publié: (2026)
Unifying Locality of KANs and Feature Drift Compensation Projection for Data-free Replay based Continual Face Forgery Detection
par: Zhang, Tianshuo, et autres
Publié: (2025)
par: Zhang, Tianshuo, et autres
Publié: (2025)
Once for Both: Single Stage of Importance and Sparsity Search for Vision Transformer Compression
par: Ye, Hancheng, et autres
Publié: (2024)
par: Ye, Hancheng, et autres
Publié: (2024)
IFIR: A Comprehensive Benchmark for Evaluating Instruction-Following in Expert-Domain Information Retrieval
par: Song, Tingyu, et autres
Publié: (2025)
par: Song, Tingyu, et autres
Publié: (2025)
Bearing Fault Prediction Based on Mixed Domain Features and GWO‐SVM
par: Xuan Zhou, et autres
Publié: (2024)
par: Xuan Zhou, et autres
Publié: (2024)
LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention
par: Zhang, Renrui, et autres
Publié: (2023)
par: Zhang, Renrui, et autres
Publié: (2023)
TerDiT: Ternary Diffusion Models with Transformers
par: Lu, Xudong, et autres
Publié: (2024)
par: Lu, Xudong, et autres
Publié: (2024)
OmniCaptioner: One Captioner to Rule Them All
par: Lu, Yiting, et autres
Publié: (2025)
par: Lu, Yiting, et autres
Publié: (2025)
BTS: Harmonizing Specialized Experts into a Generalist LLM
par: Zhang, Qizhen, et autres
Publié: (2025)
par: Zhang, Qizhen, et autres
Publié: (2025)
Documents similaires
-
GeoX: Geometric Problem Solving Through Unified Formalized Vision-Language Pre-training
par: Xia, Renqiu, et autres
Publié: (2024) -
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
par: Ye, Hancheng, et autres
Publié: (2024) -
SurveyForge: On the Outline Heuristics, Memory-Driven Generation, and Multi-dimensional Evaluation for Automated Survey Writing
par: Yan, Xiangchao, et autres
Publié: (2025) -
MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs
par: Yuan, Jiakang, et autres
Publié: (2025) -
SPOT: Scalable 3D Pre-training via Occupancy Prediction for Learning Transferable 3D Representations
par: Yan, Xiangchao, et autres
Publié: (2023)