AutoDirector: Online Auto-scheduling Agents for Multi-sensory Composition
Fuente:
arXiv
Guardado en:
| Autores principales: | Ni, Minheng, Wu, Chenfei, Yuan, Huaying, Yang, Zhengyuan, Gong, Ming, Wang, Lijuan, Liu, Zicheng, Zuo, Wangmeng, Duan, Nan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning
por: Ni, Minheng, et al.
Publicado: (2025)
por: Ni, Minheng, et al.
Publicado: (2025)
Visual-O1: Understanding Ambiguous Instructions via Multi-modal Multi-turn Chain-of-thoughts Reasoning
por: Ni, Minheng, et al.
Publicado: (2024)
por: Ni, Minheng, et al.
Publicado: (2024)
Measurement of LLM's Philosophies of Human Nature
por: Ni, Minheng, et al.
Publicado: (2025)
por: Ni, Minheng, et al.
Publicado: (2025)
CoEditor++: Instruction-based Visual Editing via Cognitive Reasoning
por: Ni, Minheng, et al.
Publicado: (2026)
por: Ni, Minheng, et al.
Publicado: (2026)
Responsible Visual Editing
por: Ni, Minheng, et al.
Publicado: (2024)
por: Ni, Minheng, et al.
Publicado: (2024)
StrokeNUWA: Tokenizing Strokes for Vector Graphic Synthesis
por: Tang, Zecheng, et al.
Publicado: (2024)
por: Tang, Zecheng, et al.
Publicado: (2024)
MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM
por: Dong, Bowen, et al.
Publicado: (2025)
por: Dong, Bowen, et al.
Publicado: (2025)
TechImage-Bench: Rubric-Based Evaluation for Technical Image Generation
por: Ni, Minheng, et al.
Publicado: (2025)
por: Ni, Minheng, et al.
Publicado: (2025)
AutoPatent: A Multi-Agent Framework for Automatic Patent Generation
por: Wang, Qiyao, et al.
Publicado: (2024)
por: Wang, Qiyao, et al.
Publicado: (2024)
Auto-FlexSwitch: Efficient Dynamic Model Merging via Learnable Task Vector Compression
por: Gao, Junqi, et al.
Publicado: (2026)
por: Gao, Junqi, et al.
Publicado: (2026)
AutoML-Agent: A Multi-Agent LLM Framework for Full-Pipeline AutoML
por: Trirat, Patara, et al.
Publicado: (2024)
por: Trirat, Patara, et al.
Publicado: (2024)
Auto-Calibration and Biconvex Compressive Sensing with Applications to Parallel MRI
por: Ni, Yuan, et al.
Publicado: (2024)
por: Ni, Yuan, et al.
Publicado: (2024)
Auto-scaling Continuous Memory for GUI Agent
por: Wu, Wenyi, et al.
Publicado: (2025)
por: Wu, Wenyi, et al.
Publicado: (2025)
DoVer: Intervention-Driven Auto Debugging for LLM Multi-Agent Systems
por: Ma, Ming, et al.
Publicado: (2025)
por: Ma, Ming, et al.
Publicado: (2025)
Don't Let Your Robot be Harmful: Responsible Robotic Manipulation via Safety-as-Policy
por: Ni, Minheng, et al.
Publicado: (2024)
por: Ni, Minheng, et al.
Publicado: (2024)
AutoDefense: Multi-Agent LLM Defense against Jailbreak Attacks
por: Zeng, Yifan, et al.
Publicado: (2024)
por: Zeng, Yifan, et al.
Publicado: (2024)
Auto-Linear Phenomenon in Subsurface Imaging
por: Feng, Yinan, et al.
Publicado: (2023)
por: Feng, Yinan, et al.
Publicado: (2023)
A Vision for Auto Research with LLM Agents
por: Liu, Chengwei, et al.
Publicado: (2025)
por: Liu, Chengwei, et al.
Publicado: (2025)
AutoMV: An Automatic Multi-Agent System for Music Video Generation
por: Tang, Xiaoxuan, et al.
Publicado: (2025)
por: Tang, Xiaoxuan, et al.
Publicado: (2025)
Auto-bidding and Auctions in Online Advertising: A Survey
por: Aggarwal, Gagan, et al.
Publicado: (2024)
por: Aggarwal, Gagan, et al.
Publicado: (2024)
Constrained Auto-Bidding via Generative Response Modeling
por: Yang, Eunseok, et al.
Publicado: (2026)
por: Yang, Eunseok, et al.
Publicado: (2026)
AutoMCU: Feasibility-First MCU Neural Network Customization via LLM-based Multi-Agent Systems
por: Dai, Penglin, et al.
Publicado: (2026)
por: Dai, Penglin, et al.
Publicado: (2026)
HALO: Hindsight-Augmented Learning for Online Auto-Bidding
por: Dong, Pusen, et al.
Publicado: (2025)
por: Dong, Pusen, et al.
Publicado: (2025)
ARMATA: Auto-Regressive Multi-Agent Task Assignment
por: Youssef, Yazan, et al.
Publicado: (2026)
por: Youssef, Yazan, et al.
Publicado: (2026)
GenDoP: Auto-regressive Camera Trajectory Generation as a Director of Photography
por: Zhang, Mengchen, et al.
Publicado: (2025)
por: Zhang, Mengchen, et al.
Publicado: (2025)
AutoPrep: Natural Language Question-Aware Data Preparation with a Multi-Agent Framework
por: Fan, Meihao, et al.
Publicado: (2024)
por: Fan, Meihao, et al.
Publicado: (2024)
AutoMAS: A Generic Multi-Agent System for Algorithm Self-Adaptation in Wireless Networks
por: Yuan, Dingli, et al.
Publicado: (2025)
por: Yuan, Dingli, et al.
Publicado: (2025)
SAM2Auto: Auto Annotation Using FLASH
por: Rocky, Arash, et al.
Publicado: (2025)
por: Rocky, Arash, et al.
Publicado: (2025)
Auto-Slides: An Interactive Multi-Agent System for Creating and Customizing Research Presentations
por: Yang, Yuheng, et al.
Publicado: (2025)
por: Yang, Yuheng, et al.
Publicado: (2025)
AutoNumerics: An Autonomous, PDE-Agnostic Multi-Agent Pipeline for Scientific Computing
por: Du, Jianda, et al.
Publicado: (2026)
por: Du, Jianda, et al.
Publicado: (2026)
AutoOEP -- A Multi-modal Framework for Online Exam Proctoring
por: Naveen, Aryan Kashyap
Publicado: (2025)
por: Naveen, Aryan Kashyap
Publicado: (2025)
Deep Reinforcement Learning and Auto‐Differential Evolution Co‐Guided Coal Washing
por: Mingcheng Zuo
Publicado: (2024)
por: Mingcheng Zuo
Publicado: (2024)
Multimodal Multi-Agent Ransomware Analysis Using AutoGen
por: Khan, Asifullah, et al.
Publicado: (2026)
por: Khan, Asifullah, et al.
Publicado: (2026)
AutoGLM: Autonomous Foundation Agents for GUIs
por: Liu, Xiao, et al.
Publicado: (2024)
por: Liu, Xiao, et al.
Publicado: (2024)
AutoGluon-Multimodal (AutoMM): Supercharging Multimodal AutoML with Foundation Models
por: Tang, Zhiqiang, et al.
Publicado: (2024)
por: Tang, Zhiqiang, et al.
Publicado: (2024)
OPERA: An Agent for Image Restoration with End-to-End Joint Planning-Execution Optimization
por: Zhu, Feng, et al.
Publicado: (2026)
por: Zhu, Feng, et al.
Publicado: (2026)
Auto-Regressively Generating Multi-View Consistent Images
por: Hu, JiaKui, et al.
Publicado: (2025)
por: Hu, JiaKui, et al.
Publicado: (2025)
Bring Metric Functions into Diffusion Models
por: An, Jie, et al.
Publicado: (2024)
por: An, Jie, et al.
Publicado: (2024)
AutoGenesisAgent: Self-Generating Multi-Agent Systems for Complex Tasks
por: Harper, Jeremy
Publicado: (2024)
por: Harper, Jeremy
Publicado: (2024)
EdgeRunner: Auto-regressive Auto-encoder for Artistic Mesh Generation
por: Tang, Jiaxiang, et al.
Publicado: (2024)
por: Tang, Jiaxiang, et al.
Publicado: (2024)
Ejemplares similares
-
Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning
por: Ni, Minheng, et al.
Publicado: (2025) -
Visual-O1: Understanding Ambiguous Instructions via Multi-modal Multi-turn Chain-of-thoughts Reasoning
por: Ni, Minheng, et al.
Publicado: (2024) -
Measurement of LLM's Philosophies of Human Nature
por: Ni, Minheng, et al.
Publicado: (2025) -
CoEditor++: Instruction-based Visual Editing via Cognitive Reasoning
por: Ni, Minheng, et al.
Publicado: (2026) -
Responsible Visual Editing
por: Ni, Minheng, et al.
Publicado: (2024)