MIND: Benchmarking Memory Consistency and Action Control in World Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Ye, Yixuan, Lu, Xuanyu, Jiang, Yuxin, Gu, Yuchao, Zhao, Rui, Liang, Qiwei, Pan, Jiachun, Zhang, Fengda, Wu, Weijia, Wang, Alex Jinpeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Olaf-World: Orienting Latent Actions for Video World Modeling
por: Jiang, Yuxin, et al.
Publicado: (2026)
por: Jiang, Yuxin, et al.
Publicado: (2026)
WEAVE: Unleashing and Benchmarking the In-context Interleaved Comprehension and Generation
por: Chow, Wei, et al.
Publicado: (2025)
por: Chow, Wei, et al.
Publicado: (2025)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
por: Hu, Zijing, et al.
Publicado: (2025)
por: Hu, Zijing, et al.
Publicado: (2025)
Long-Context Autoregressive Video Modeling with Next-Frame Prediction
por: Gu, Yuchao, et al.
Publicado: (2025)
por: Gu, Yuchao, et al.
Publicado: (2025)
AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
por: Gu, Yuchao, et al.
Publicado: (2026)
por: Gu, Yuchao, et al.
Publicado: (2026)
ConsistNav: Closing the Action Consistency Gap in Zero-Shot Object Navigation with Semantic Executive Control
por: Wang, Haosen, et al.
Publicado: (2026)
por: Wang, Haosen, et al.
Publicado: (2026)
iWorld-Bench: A Benchmark for Interactive World Models with a Unified Action Generation Framework
por: Fang, Jianjie, et al.
Publicado: (2026)
por: Fang, Jianjie, et al.
Publicado: (2026)
WorldMem: Long-term Consistent World Simulation with Memory
por: Xiao, Zeqi, et al.
Publicado: (2025)
por: Xiao, Zeqi, et al.
Publicado: (2025)
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
por: Wang, Yihao, et al.
Publicado: (2026)
por: Wang, Yihao, et al.
Publicado: (2026)
Reconceptualising Intensive Motivation in Language Learning: Towards a Metamotivation‐Embedded Model of Directed Motivational Currents
por: Xuanyu Gu
Publicado: (2026)
por: Xuanyu Gu
Publicado: (2026)
Hierarchical‐Split Multi‐Scale Convolution Network With Multi‐Task Learning for Human Activity Recognition in Wearable Devices
por: Pengwei Zhang, et al.
Publicado: (2026)
por: Pengwei Zhang, et al.
Publicado: (2026)
LoopNav: Benchmarking Spatial Consistency in World Models
por: Lian, Kewei, et al.
Publicado: (2025)
por: Lian, Kewei, et al.
Publicado: (2025)
DragAnything: Motion Control for Anything using Entity Representation
por: Wu, Weijia, et al.
Publicado: (2024)
por: Wu, Weijia, et al.
Publicado: (2024)
Consistent3D: Towards Consistent High-Fidelity Text-to-3D Generation with Deterministic Sampling Prior
por: Wu, Zike, et al.
Publicado: (2024)
por: Wu, Zike, et al.
Publicado: (2024)
Personalized Vision via Visual In-Context Learning
por: Jiang, Yuxin, et al.
Publicado: (2025)
por: Jiang, Yuxin, et al.
Publicado: (2025)
RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation
por: Wu, Kun, et al.
Publicado: (2024)
por: Wu, Kun, et al.
Publicado: (2024)
Enhancing Long Video Generation Consistency without Tuning
por: Li, Xingyao, et al.
Publicado: (2024)
por: Li, Xingyao, et al.
Publicado: (2024)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
por: Jin, Zhuoran, et al.
Publicado: (2024)
por: Jin, Zhuoran, et al.
Publicado: (2024)
Surfer: Progressive Reasoning with World Models for Robotic Manipulation
por: Ren, Pengzhen, et al.
Publicado: (2023)
por: Ren, Pengzhen, et al.
Publicado: (2023)
From Knowing to Doing: A Memory-Controlled Benchmark for LLM Trading Agents on Stock Markets
por: Zhu, Taojie, et al.
Publicado: (2026)
por: Zhu, Taojie, et al.
Publicado: (2026)
Towards Deviation-Robust Agent Navigation via Perturbation-Aware Contrastive Learning
por: Lin, Bingqian, et al.
Publicado: (2024)
por: Lin, Bingqian, et al.
Publicado: (2024)
edhutch1/marm_MIND: marm_MIND
por: edhutch1
Publicado: (2026)
por: edhutch1
Publicado: (2026)
The Design of SPRINT MIND and SPRINT MIND 2020
por: Stephen R. Rapp, et al.
Publicado: (2024)
por: Stephen R. Rapp, et al.
Publicado: (2024)
The DAWN of World-Action Interactive Models
por: Lu, Hongbo, et al.
Publicado: (2026)
por: Lu, Hongbo, et al.
Publicado: (2026)
Understanding Real-World Traffic Safety through RoadSafe365 Benchmark
por: Liu, Xinyu, et al.
Publicado: (2026)
por: Liu, Xinyu, et al.
Publicado: (2026)
Global Prior Meets Local Consistency: Dual-Memory Augmented Vision-Language-Action Model for Efficient Robotic Manipulation
por: Li, Zaijing, et al.
Publicado: (2026)
por: Li, Zaijing, et al.
Publicado: (2026)
MEMO: Memory-Guided Diffusion for Expressive Talking Video Generation
por: Zheng, Longtao, et al.
Publicado: (2024)
por: Zheng, Longtao, et al.
Publicado: (2024)
Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning
por: Wang, Bohan, et al.
Publicado: (2025)
por: Wang, Bohan, et al.
Publicado: (2025)
Reasoning through Verifiable Forecast Actions: Consistency-Grounded RL for Financial LLMs
por: Chen, Jialin, et al.
Publicado: (2026)
por: Chen, Jialin, et al.
Publicado: (2026)
Morphology-Consistent Humanoid Interaction through Robot-Centric Video Synthesis
por: Xu, Weisheng, et al.
Publicado: (2026)
por: Xu, Weisheng, et al.
Publicado: (2026)
SSR: A Training-Free Approach for Streaming 3D Reconstruction
por: Deng, Hui, et al.
Publicado: (2026)
por: Deng, Hui, et al.
Publicado: (2026)
MIND-Skill: Quality-Guaranteed Skill Generation via Multi-Agent Induction and Deduction
por: Li, Yixuan, et al.
Publicado: (2026)
por: Li, Yixuan, et al.
Publicado: (2026)
IN THE MIND OF THE TERRORIST
Publicado: (1996)
Publicado: (1996)
FramePrompt: In-context Controllable Animation with Zero Structural Changes
por: Fang, Guian, et al.
Publicado: (2025)
por: Fang, Guian, et al.
Publicado: (2025)
Stability of Gel'fand's inverse interior spectral problem for Schrödinger operators
por: Lu, Jinpeng
Publicado: (2025)
por: Lu, Jinpeng
Publicado: (2025)
CEED-VLA: Consistency Vision-Language-Action Model with Early-Exit Decoding
por: Song, Wenxuan, et al.
Publicado: (2025)
por: Song, Wenxuan, et al.
Publicado: (2025)
MBench: A Comprehensive Benchmark on Memory Capability for Video World Models
por: Zhang, Shengjun, et al.
Publicado: (2026)
por: Zhang, Shengjun, et al.
Publicado: (2026)
StyleChat: Learning Recitation-Augmented Memory in LLMs for Stylized Dialogue Generation
por: Li, Jinpeng, et al.
Publicado: (2024)
por: Li, Jinpeng, et al.
Publicado: (2024)
Tensor-based Model Reduction and Identification for Generalized Memory Polynomial
por: Wang, Yuchao, et al.
Publicado: (2025)
por: Wang, Yuchao, et al.
Publicado: (2025)
MIND: Multi-Scale Intent Diffusion for Text-Driven Physics-Based Humanoid Control
por: Li, Bin, et al.
Publicado: (2026)
por: Li, Bin, et al.
Publicado: (2026)
Ejemplares similares
-
Olaf-World: Orienting Latent Actions for Video World Modeling
por: Jiang, Yuxin, et al.
Publicado: (2026) -
WEAVE: Unleashing and Benchmarking the In-context Interleaved Comprehension and Generation
por: Chow, Wei, et al.
Publicado: (2025) -
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
por: Hu, Zijing, et al.
Publicado: (2025) -
Long-Context Autoregressive Video Modeling with Next-Frame Prediction
por: Gu, Yuchao, et al.
Publicado: (2025) -
AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
por: Gu, Yuchao, et al.
Publicado: (2026)