UniMo: Unified Motion Generation and Understanding with Chain of Thought
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Guocun, Liu, Kenkun, Lin, Jing, Song, Guorui, Li, Jian, Han, Xiaoguang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Fine-Grained Human Motion Video Captioning
por: Song, Guorui, et al.
Publicado: (2025)
por: Song, Guorui, et al.
Publicado: (2025)
UniMotion: A Unified Framework for Motion-Text-Vision Understanding and Generation
por: Wang, Ziyi, et al.
Publicado: (2026)
por: Wang, Ziyi, et al.
Publicado: (2026)
UniT: Unified Multimodal Chain-of-Thought Test-time Scaling
por: Chen, Leon Liangyu, et al.
Publicado: (2026)
por: Chen, Leon Liangyu, et al.
Publicado: (2026)
UniMo: Unifying 2D Video and 3D Human Motion with an Autoregressive Framework
por: Pang, Youxin, et al.
Publicado: (2025)
por: Pang, Youxin, et al.
Publicado: (2025)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
por: Li, Yi, et al.
Publicado: (2025)
por: Li, Yi, et al.
Publicado: (2025)
Towards Enhanced Image Generation Via Multi-modal Chain of Thought in Unified Generative Models
por: Wang, Yi, et al.
Publicado: (2025)
por: Wang, Yi, et al.
Publicado: (2025)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
por: Xu, Chenkai, et al.
Publicado: (2025)
por: Xu, Chenkai, et al.
Publicado: (2025)
Uni-RS: A Spatially Faithful Unified Understanding and Generation Model for Remote Sensing
por: Zhang, Weiyu, et al.
Publicado: (2026)
por: Zhang, Weiyu, et al.
Publicado: (2026)
X-UniMotion: Animating Human Images with Expressive, Unified and Identity-Agnostic Motion Latents
por: Song, Guoxian, et al.
Publicado: (2025)
por: Song, Guoxian, et al.
Publicado: (2025)
UniHOI: Unified Human-Object Interaction Understanding via Unified Token Space
por: Yang, Panqi, et al.
Publicado: (2025)
por: Yang, Panqi, et al.
Publicado: (2025)
Understanding Chain-of-Thought in Large Language Models via Topological Data Analysis
por: Li, Chenghao, et al.
Publicado: (2025)
por: Li, Chenghao, et al.
Publicado: (2025)
Why Chain of Thought Fails in Clinical Text Understanding
por: Wu, Jiageng, et al.
Publicado: (2025)
por: Wu, Jiageng, et al.
Publicado: (2025)
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
por: Jiao, Yang, et al.
Publicado: (2025)
por: Jiao, Yang, et al.
Publicado: (2025)
UniTok: A Unified Tokenizer for Visual Generation and Understanding
por: Ma, Chuofan, et al.
Publicado: (2025)
por: Ma, Chuofan, et al.
Publicado: (2025)
Uni-MoE: Scaling Unified Multimodal LLMs with Mixture of Experts
por: Li, Yunxin, et al.
Publicado: (2024)
por: Li, Yunxin, et al.
Publicado: (2024)
UniSVG: A Unified Dataset for Vector Graphic Understanding and Generation with Multimodal Large Language Models
por: Li, Jinke, et al.
Publicado: (2025)
por: Li, Jinke, et al.
Publicado: (2025)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
por: Hu, Lijie, et al.
Publicado: (2024)
por: Hu, Lijie, et al.
Publicado: (2024)
Ming-UniAudio: Speech LLM for Joint Understanding, Generation and Editing with Unified Representation
por: Yan, Canxiang, et al.
Publicado: (2025)
por: Yan, Canxiang, et al.
Publicado: (2025)
UniCA: Unified Covariate Adaptation for Time Series Foundation Model
por: Han, Lu, et al.
Publicado: (2025)
por: Han, Lu, et al.
Publicado: (2025)
Intention Chain-of-Thought Prompting with Dynamic Routing for Code Generation
por: Li, Shen, et al.
Publicado: (2025)
por: Li, Shen, et al.
Publicado: (2025)
UniMTS: Unified Pre-training for Motion Time Series
por: Zhang, Xiyuan, et al.
Publicado: (2024)
por: Zhang, Xiyuan, et al.
Publicado: (2024)
UniPlanner: A Unified Motion Planning Framework for Autonomous Vehicle Decision-Making Systems via Multi-Dataset Integration
por: Yang, Xin, et al.
Publicado: (2025)
por: Yang, Xin, et al.
Publicado: (2025)
UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and Generation
por: Lin, Bin, et al.
Publicado: (2025)
por: Lin, Bin, et al.
Publicado: (2025)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
por: Li, Chengzhengxu, et al.
Publicado: (2025)
por: Li, Chengzhengxu, et al.
Publicado: (2025)
UniMoT: Unified Molecule-Text Language Model with Discrete Token Representation
por: Guo, Shuhan, et al.
Publicado: (2024)
por: Guo, Shuhan, et al.
Publicado: (2024)
What Makes a Good Reasoning Chain? Uncovering Structural Patterns in Long Chain-of-Thought Reasoning
por: Jiang, Gangwei, et al.
Publicado: (2025)
por: Jiang, Gangwei, et al.
Publicado: (2025)
Reinforcing Structured Chain-of-Thought for Video Understanding
por: Wang, Peiyao, et al.
Publicado: (2026)
por: Wang, Peiyao, et al.
Publicado: (2026)
Understanding Chain-of-Thought in LLMs through Information Theory
por: Ton, Jean-Francois, et al.
Publicado: (2024)
por: Ton, Jean-Francois, et al.
Publicado: (2024)
KinMo: Kinematic-aware Human Motion Understanding and Generation
por: Zhang, Pengfei, et al.
Publicado: (2024)
por: Zhang, Pengfei, et al.
Publicado: (2024)
Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator
por: Qin, Luozheng, et al.
Publicado: (2026)
por: Qin, Luozheng, et al.
Publicado: (2026)
Dynamics Within Latent Chain-of-Thought: An Empirical Study of Causal Structure
por: Li, Zirui, et al.
Publicado: (2026)
por: Li, Zirui, et al.
Publicado: (2026)
Latent Chain-of-Thought for Visual Reasoning
por: Sun, Guohao, et al.
Publicado: (2025)
por: Sun, Guohao, et al.
Publicado: (2025)
LLM Reasoning Is Latent, Not the Chain of Thought
por: Wang, Wenshuo
Publicado: (2026)
por: Wang, Wenshuo
Publicado: (2026)
When More is Less: Understanding Chain-of-Thought Length in LLMs
por: Wu, Yuyang, et al.
Publicado: (2025)
por: Wu, Yuyang, et al.
Publicado: (2025)
Mixture of insighTful Experts (MoTE): The Synergy of Thought Chains and Expert Mixtures in Self-Alignment
por: Liu, Zhili, et al.
Publicado: (2024)
por: Liu, Zhili, et al.
Publicado: (2024)
UniG2U-Bench: Do Unified Models Advance Multimodal Understanding?
por: Wen, Zimo, et al.
Publicado: (2026)
por: Wen, Zimo, et al.
Publicado: (2026)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
por: Ye, Jiacheng, et al.
Publicado: (2024)
por: Ye, Jiacheng, et al.
Publicado: (2024)
Copilot-Assisted Second-Thought Framework for Brain-to-Robot Hand Motion Decoding
por: Li, Yizhe, et al.
Publicado: (2026)
por: Li, Yizhe, et al.
Publicado: (2026)
SIM-CoT: Supervised Implicit Chain-of-Thought
por: Wei, Xilin, et al.
Publicado: (2025)
por: Wei, Xilin, et al.
Publicado: (2025)
Chain-of-Thought Hijacking
por: Zhao, Jianli, et al.
Publicado: (2025)
por: Zhao, Jianli, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Fine-Grained Human Motion Video Captioning
por: Song, Guorui, et al.
Publicado: (2025) -
UniMotion: A Unified Framework for Motion-Text-Vision Understanding and Generation
por: Wang, Ziyi, et al.
Publicado: (2026) -
UniT: Unified Multimodal Chain-of-Thought Test-time Scaling
por: Chen, Leon Liangyu, et al.
Publicado: (2026) -
UniMo: Unifying 2D Video and 3D Human Motion with an Autoregressive Framework
por: Pang, Youxin, et al.
Publicado: (2025) -
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
por: Li, Yi, et al.
Publicado: (2025)