OMG: Towards Open-vocabulary Motion Generation via Mixture of Controllers
Fuente:
arXiv
Guardado en:
| Autores principales: | Liang, Han, Bao, Jiacheng, Zhang, Ruichi, Ren, Sihan, Xu, Yuecheng, Yang, Sibei, Chen, Xin, Yu, Jingyi, Xu, Lan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PhyGile: Physics-Prefix Guided Motion Generation for Agile General Humanoid Motion Tracking
por: Bao, Jiacheng, et al.
Publicado: (2026)
por: Bao, Jiacheng, et al.
Publicado: (2026)
DetCLIPv3: Towards Versatile Generative Open-vocabulary Object Detection
por: Yao, Lewei, et al.
Publicado: (2024)
por: Yao, Lewei, et al.
Publicado: (2024)
InterAgent: Physics-based Multi-agent Command Execution via Diffusion on Interaction Graphs
por: Li, Bin, et al.
Publicado: (2025)
por: Li, Bin, et al.
Publicado: (2025)
InterGen: Diffusion-based Multi-human Motion Generation under Complex Interactions
por: Liang, Han, et al.
Publicado: (2023)
por: Liang, Han, et al.
Publicado: (2023)
LLaVA-SLT: Visual Language Tuning for Sign Language Translation
por: Liang, Han, et al.
Publicado: (2024)
por: Liang, Han, et al.
Publicado: (2024)
HandDiffuse: Generative Controllers for Two-Hand Interactions via Diffusion Models
por: Lin, Pei, et al.
Publicado: (2023)
por: Lin, Pei, et al.
Publicado: (2023)
SCOPE: Sign Language Contextual Processing with Embedding from LLMs
por: Liu, Yuqi, et al.
Publicado: (2024)
por: Liu, Yuqi, et al.
Publicado: (2024)
OMG-Avatar: One-shot Multi-LOD Gaussian Head Avatar
por: Ren, Jianqiang, et al.
Publicado: (2026)
por: Ren, Jianqiang, et al.
Publicado: (2026)
SMGDiff: Soccer Motion Generation using diffusion probabilistic models
por: Yang, Hongdi, et al.
Publicado: (2024)
por: Yang, Hongdi, et al.
Publicado: (2024)
OMG: Occlusion-friendly Personalized Multi-concept Generation in Diffusion Models
por: Kong, Zhe, et al.
Publicado: (2024)
por: Kong, Zhe, et al.
Publicado: (2024)
Weakly Supervised 3D Open-vocabulary Segmentation
por: Liu, Kunhao, et al.
Publicado: (2023)
por: Liu, Kunhao, et al.
Publicado: (2023)
Open-RGBT: Open-vocabulary RGB-T Zero-shot Semantic Segmentation in Open-world Environments
por: Yu, Meng, et al.
Publicado: (2024)
por: Yu, Meng, et al.
Publicado: (2024)
MIND: Multi-Scale Intent Diffusion for Text-Driven Physics-Based Humanoid Control
por: Li, Bin, et al.
Publicado: (2026)
por: Li, Bin, et al.
Publicado: (2026)
OpenTie: Open-vocabulary Sequential Rebar Tying System
por: Liu, Mingze, et al.
Publicado: (2025)
por: Liu, Mingze, et al.
Publicado: (2025)
OMG-Bench: A New Challenging Benchmark for Skeleton-based Online Micro Hand Gesture Recognition
por: Chang, Haochen, et al.
Publicado: (2025)
por: Chang, Haochen, et al.
Publicado: (2025)
Dissecting and Mitigating Diffusion Bias via Mechanistic Interpretability
por: Shi, Yingdong, et al.
Publicado: (2025)
por: Shi, Yingdong, et al.
Publicado: (2025)
SCRIPT: Scalable Diffusion Policy with Multi-stage Training for Language-driven Physics-based Humanoid Control
por: Zhang, Jingyan, et al.
Publicado: (2026)
por: Zhang, Jingyan, et al.
Publicado: (2026)
Towards Immersive Human-X Interaction: A Real-Time Framework for Physically Plausible Motion Synthesis
por: Ji, Kaiyang, et al.
Publicado: (2025)
por: Ji, Kaiyang, et al.
Publicado: (2025)
Decision Boundary-aware Generation for Long-tailed Learning
por: Yang, Jiacheng, et al.
Publicado: (2026)
por: Yang, Jiacheng, et al.
Publicado: (2026)
IGLOSS: Image Generation for Lidar Open-vocabulary Semantic Segmentation
por: Samet, Nermin, et al.
Publicado: (2026)
por: Samet, Nermin, et al.
Publicado: (2026)
Semantic Consistent Language Gaussian Splatting for Point-Level Open-vocabulary Querying
por: Yin, Hairong, et al.
Publicado: (2025)
por: Yin, Hairong, et al.
Publicado: (2025)
Generalizing Motion Planners with Mixture of Experts for Autonomous Driving
por: Sun, Qiao, et al.
Publicado: (2024)
por: Sun, Qiao, et al.
Publicado: (2024)
Artemis: Articulated Neural Pets with Appearance and Motion synthesis
por: Luo, Haimin, et al.
Publicado: (2022)
por: Luo, Haimin, et al.
Publicado: (2022)
Parameter-efficient Fine-tuning in Hyperspherical Space for Open-vocabulary Semantic Segmentation
por: Peng, Zelin, et al.
Publicado: (2024)
por: Peng, Zelin, et al.
Publicado: (2024)
OMG: Opacity Matters in Material Modeling with Gaussian Splatting
por: Yong, Silong, et al.
Publicado: (2025)
por: Yong, Silong, et al.
Publicado: (2025)
CUE: Concept-Aware Multi-Label Expansion to Mitigate Concept Confusion in Long-Tailed Learning
por: Zhang, Ruichi, et al.
Publicado: (2026)
por: Zhang, Ruichi, et al.
Publicado: (2026)
Eyes Wide Open: Ego Proactive Video-LLM for Streaming Video
por: Zhang, Yulin, et al.
Publicado: (2025)
por: Zhang, Yulin, et al.
Publicado: (2025)
SeqAfford: Sequential 3D Affordance Reasoning via Multimodal Large Language Model
por: Yu, Chunlin, et al.
Publicado: (2024)
por: Yu, Chunlin, et al.
Publicado: (2024)
OpenVIS: Open-vocabulary Video Instance Segmentation
por: Guo, Pinxue, et al.
Publicado: (2023)
por: Guo, Pinxue, et al.
Publicado: (2023)
A Unified Diffusion Framework for Scene-aware Human Motion Estimation from Sparse Signals
por: Tang, Jiangnan, et al.
Publicado: (2024)
por: Tang, Jiangnan, et al.
Publicado: (2024)
Customizing Visual Emotion Evaluation for MLLMs: An Open-vocabulary, Multifaceted, and Scalable Approach
por: Wu, Daiqing, et al.
Publicado: (2025)
por: Wu, Daiqing, et al.
Publicado: (2025)
UniCtrl: Improving the Spatiotemporal Consistency of Text-to-Video Diffusion Models via Training-Free Unified Attention Control
por: Xia, Tian, et al.
Publicado: (2024)
por: Xia, Tian, et al.
Publicado: (2024)
From Data to Modeling: Fully Open-vocabulary Scene Graph Generation
por: Chen, Zuyao, et al.
Publicado: (2025)
por: Chen, Zuyao, et al.
Publicado: (2025)
MagicSeg: Open-World Segmentation Pretraining via Counterfactural Diffusion-Based Auto-Generation
por: Cai, Kaixin, et al.
Publicado: (2026)
por: Cai, Kaixin, et al.
Publicado: (2026)
LLaVA-SpaceSGG: Visual Instruct Tuning for Open-vocabulary Scene Graph Generation with Enhanced Spatial Relations
por: Xu, Mingjie, et al.
Publicado: (2024)
por: Xu, Mingjie, et al.
Publicado: (2024)
MADiff: Motion-Aware Mamba Diffusion Models for Hand Trajectory Prediction on Egocentric Videos
por: Ma, Junyi, et al.
Publicado: (2024)
por: Ma, Junyi, et al.
Publicado: (2024)
OMG-Seg: Is One Model Good Enough For All Segmentation?
por: Li, Xiangtai, et al.
Publicado: (2024)
por: Li, Xiangtai, et al.
Publicado: (2024)
Kinematify: Open-Vocabulary Synthesis of High-DoF Articulated Objects
por: Wang, Jiawei, et al.
Publicado: (2025)
por: Wang, Jiawei, et al.
Publicado: (2025)
Adaptive Part Learning for Fine-Grained Generalized Category Discovery: A Plug-and-Play Enhancement
por: Dai, Qiyuan, et al.
Publicado: (2025)
por: Dai, Qiyuan, et al.
Publicado: (2025)
Programmable Motion Generation for Open-Set Motion Control Tasks
por: Liu, Hanchao, et al.
Publicado: (2024)
por: Liu, Hanchao, et al.
Publicado: (2024)
Ejemplares similares
-
PhyGile: Physics-Prefix Guided Motion Generation for Agile General Humanoid Motion Tracking
por: Bao, Jiacheng, et al.
Publicado: (2026) -
DetCLIPv3: Towards Versatile Generative Open-vocabulary Object Detection
por: Yao, Lewei, et al.
Publicado: (2024) -
InterAgent: Physics-based Multi-agent Command Execution via Diffusion on Interaction Graphs
por: Li, Bin, et al.
Publicado: (2025) -
InterGen: Diffusion-based Multi-human Motion Generation under Complex Interactions
por: Liang, Han, et al.
Publicado: (2023) -
LLaVA-SLT: Visual Language Tuning for Sign Language Translation
por: Liang, Han, et al.
Publicado: (2024)