Mora: Enabling Generalist Video Generation via A Multi-Agent Framework
Fuente:
arXiv
Salvato in:
| Autori principali: | Yuan, Zhengqing, Liu, Yixin, Cao, Yihan, Sun, Weixiang, Jia, Haolong, Chen, Ruoxi, Li, Zhaoxu, Lin, Bin, Yuan, Li, He, Lifang, Wang, Chi, Ye, Yanfang, Sun, Lichao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bora: Biomedical Generalist Video Generation Model
di: Sun, Weixiang, et al.
Pubblicazione: (2024)
di: Sun, Weixiang, et al.
Pubblicazione: (2024)
TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
Horizon-LM: A RAM-Centric Architecture for LLM Training
di: Yuan, Zhengqing, et al.
Pubblicazione: (2026)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2026)
ViT-1.58b: Mobile Vision Transformers in the 1-bit Era
di: Yuan, Zhengqing, et al.
Pubblicazione: (2024)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2024)
MegaTrain: Full Precision Training of 100B+ Parameter Large Language Models on a Single GPU
di: Yuan, Zhengqing, et al.
Pubblicazione: (2026)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2026)
3D4D: An Interactive, Editable, 4D World Model via 3D Video Generation
di: He, Yunhong, et al.
Pubblicazione: (2025)
di: He, Yunhong, et al.
Pubblicazione: (2025)
TTT-Unet: Enhancing U-Net with Test-Time Training Layers for Biomedical Image Segmentation
di: Zhou, Rong, et al.
Pubblicazione: (2024)
di: Zhou, Rong, et al.
Pubblicazione: (2024)
ArtGPT-4: Towards Artistic-understanding Large Vision-Language Models with Enhanced Adapter
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023)
Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
EfficientLLM: Efficiency in Large Language Models
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
Biomedical SAM 2: Segment Anything in Biomedical Images and Videos
di: Yan, Zhiling, et al.
Pubblicazione: (2024)
di: Yan, Zhiling, et al.
Pubblicazione: (2024)
Sora: A Review on Background, Technology, Limitations, and Opportunities of Large Vision Models
di: Liu, Yixin, et al.
Pubblicazione: (2024)
di: Liu, Yixin, et al.
Pubblicazione: (2024)
BLURR: A Boosted Low-Resource Inference for Vision-Language-Action Models
di: Ma, Xiaoyu, et al.
Pubblicazione: (2025)
di: Ma, Xiaoyu, et al.
Pubblicazione: (2025)
MLP-KAN: Unifying Deep Representation and Function Learning
di: He, Yunhong, et al.
Pubblicazione: (2024)
di: He, Yunhong, et al.
Pubblicazione: (2024)
Social Science Meets LLMs: How Reliable Are Large Language Models in Social Simulations?
di: Huang, Yue, et al.
Pubblicazione: (2024)
di: Huang, Yue, et al.
Pubblicazione: (2024)
CiteAudit: You Cited It, But Did You Read It? A Benchmark for Verifying Scientific References in the LLM Era
di: Shi, Kaiwen, et al.
Pubblicazione: (2026)
di: Shi, Kaiwen, et al.
Pubblicazione: (2026)
MetaAgents: Large Language Model Based Agents for Decision-Making on Teaming
di: Li, Yuan, et al.
Pubblicazione: (2023)
di: Li, Yuan, et al.
Pubblicazione: (2023)
Rethinking and Red-Teaming Protective Perturbation in Personalized Diffusion Models
di: Liu, Yixin, et al.
Pubblicazione: (2024)
di: Liu, Yixin, et al.
Pubblicazione: (2024)
Medical Unlearnable Examples: Securing Medical Data from Unauthorized Training via Sparsity-Aware Local Masking
di: Sun, Weixiang, et al.
Pubblicazione: (2024)
di: Sun, Weixiang, et al.
Pubblicazione: (2024)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2023)
di: Cao, Yihan, et al.
Pubblicazione: (2023)
MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine
di: Zhang, Kai, et al.
Pubblicazione: (2026)
di: Zhang, Kai, et al.
Pubblicazione: (2026)
Drift-Bench: Diagnosing Cooperative Breakdowns in LLM Agents under Input Faults via Multi-Turn Interaction
di: Bao, Han, et al.
Pubblicazione: (2026)
di: Bao, Han, et al.
Pubblicazione: (2026)
Temporal Graph Pattern Machine
di: Ma, Yijun, et al.
Pubblicazione: (2026)
di: Ma, Yijun, et al.
Pubblicazione: (2026)
NG-Router: Graph-Supervised Multi-Agent Collaboration for Nutrition Question Answering
di: Shi, Kaiwen, et al.
Pubblicazione: (2025)
di: Shi, Kaiwen, et al.
Pubblicazione: (2025)
EditShield: Protecting Unauthorized Image Editing by Instruction-guided Diffusion Models
di: Chen, Ruoxi, et al.
Pubblicazione: (2023)
di: Chen, Ruoxi, et al.
Pubblicazione: (2023)
NodeRAG: Structuring Graph-based RAG with Heterogeneous Nodes
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
Interpretable Graph-Language Modeling for Detecting Youth Illicit Drug Use
di: Li, Yiyang, et al.
Pubblicazione: (2025)
di: Li, Yiyang, et al.
Pubblicazione: (2025)
AgentRouter: A Knowledge-Graph-Guided LLM Router for Collaborative Multi-Agent Question Answering
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
Empirical Perturbation Analysis of Linear System Solvers from a Data Poisoning Perspective
di: Liu, Yixin, et al.
Pubblicazione: (2024)
di: Liu, Yixin, et al.
Pubblicazione: (2024)
Expert Threshold Routing for Autoregressive Language Modeling with Dynamic Computation Allocation and Load Balancing
di: Sun, Hanchi, et al.
Pubblicazione: (2026)
di: Sun, Hanchi, et al.
Pubblicazione: (2026)
EIA: Environmental Injection Attack on Generalist Web Agents for Privacy Leakage
di: Liao, Zeyi, et al.
Pubblicazione: (2024)
di: Liao, Zeyi, et al.
Pubblicazione: (2024)
MAViS: A Multi-Agent Framework for Long-Sequence Video Storytelling
di: Wang, Qian, et al.
Pubblicazione: (2025)
di: Wang, Qian, et al.
Pubblicazione: (2025)
Large Language Models Often Say One Thing and Do Another
di: Xu, Ruoxi, et al.
Pubblicazione: (2025)
di: Xu, Ruoxi, et al.
Pubblicazione: (2025)
andrewx101/track_analysis: v2.22
di: Weixiang Sun
Pubblicazione: (2026)
di: Weixiang Sun
Pubblicazione: (2026)
NeuroClaw Technical Report
di: Wang, Cheng, et al.
Pubblicazione: (2026)
di: Wang, Cheng, et al.
Pubblicazione: (2026)
BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical Tasks
di: Zhang, Kai, et al.
Pubblicazione: (2023)
di: Zhang, Kai, et al.
Pubblicazione: (2023)
Stroke Modeling Enables Vectorized Character Generation with Large Vectorized Glyph Model
di: Zhang, Xinyue, et al.
Pubblicazione: (2025)
di: Zhang, Xinyue, et al.
Pubblicazione: (2025)
LLM4Brain: Training a Large Language Model for Brain Video Understanding
di: Zheng, Ruizhe, et al.
Pubblicazione: (2024)
di: Zheng, Ruizhe, et al.
Pubblicazione: (2024)
Safe Bilevel Delegation (SBD): A Formal Framework for Runtime Delegation Safety in Multi-Agent Systems
di: Sun, Yuan
Pubblicazione: (2026)
di: Sun, Yuan
Pubblicazione: (2026)
SAMed-2: Selective Memory Enhanced Medical Segment Anything Model
di: Yan, Zhiling, et al.
Pubblicazione: (2025)
di: Yan, Zhiling, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bora: Biomedical Generalist Video Generation Model
di: Sun, Weixiang, et al.
Pubblicazione: (2024) -
TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones
di: Yuan, Zhengqing, et al.
Pubblicazione: (2023) -
Horizon-LM: A RAM-Centric Architecture for LLM Training
di: Yuan, Zhengqing, et al.
Pubblicazione: (2026) -
ViT-1.58b: Mobile Vision Transformers in the 1-bit Era
di: Yuan, Zhengqing, et al.
Pubblicazione: (2024) -
MegaTrain: Full Precision Training of 100B+ Parameter Large Language Models on a Single GPU
di: Yuan, Zhengqing, et al.
Pubblicazione: (2026)