World-in-World: World Models in a Closed-Loop World
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Jiahan, Jiang, Muqing, Dai, Nanru, Lu, Taiming, Uzunoglu, Arda, Zhang, Shunchi, Wei, Yana, Wang, Jiahao, Patel, Vishal M., Liang, Paul Pu, Khashabi, Daniel, Peng, Cheng, Chellappa, Rama, Shu, Tianmin, Yuille, Alan, Du, Yilun, Chen, Jieneng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generative World Explorer
par: Lu, Taiming, et autres
Publié: (2024)
par: Lu, Taiming, et autres
Publié: (2024)
GenEx: Generating an Explorable World
par: Lu, Taiming, et autres
Publié: (2024)
par: Lu, Taiming, et autres
Publié: (2024)
EvoWorld: Evolving Panoramic World Generation with Explicit 3D Memory
par: Wang, Jiahao, et autres
Publié: (2025)
par: Wang, Jiahao, et autres
Publié: (2025)
WorldAPIs: The World Is Worth How Many APIs? A Thought Experiment
par: Ou, Jiefu, et autres
Publié: (2024)
par: Ou, Jiefu, et autres
Publié: (2024)
Thinking with Spatial Code for Physical-World Video Reasoning
par: Chen, Jieneng, et autres
Publié: (2026)
par: Chen, Jieneng, et autres
Publié: (2026)
Medical World Model: Generative Simulation of Tumor Evolution for Treatment Planning
par: Yang, Yijun, et autres
Publié: (2025)
par: Yang, Yijun, et autres
Publié: (2025)
Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher
par: Uzunoglu, Arda, et autres
Publié: (2026)
par: Uzunoglu, Arda, et autres
Publié: (2026)
The Flaw of Averages: Quantifying Uniformity of Performance on Benchmarks
par: Uzunoglu, Arda, et autres
Publié: (2025)
par: Uzunoglu, Arda, et autres
Publié: (2025)
World-VLA-Loop: Closed-Loop Learning of Video World Model and VLA Policy
par: Liu, Xiaokang, et autres
Publié: (2026)
par: Liu, Xiaokang, et autres
Publié: (2026)
COMBO: Compositional World Models for Embodied Multi-Agent Cooperation
par: Zhang, Hongxin, et autres
Publié: (2024)
par: Zhang, Hongxin, et autres
Publié: (2024)
GENFIG1: Visual Summaries of Scholarly Work as a Challenge for Vision-Language Models
par: Guan, Yaohan, et autres
Publié: (2026)
par: Guan, Yaohan, et autres
Publié: (2026)
AdaWorld: Learning Adaptable World Models with Latent Actions
par: Gao, Shenyuan, et autres
Publié: (2025)
par: Gao, Shenyuan, et autres
Publié: (2025)
DiffRegCD: Integrated Registration and Change Detection with Diffusion Features
par: Madani, Seyedehanita, et autres
Publié: (2025)
par: Madani, Seyedehanita, et autres
Publié: (2025)
WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark
par: Lin, Wang, et autres
Publié: (2026)
par: Lin, Wang, et autres
Publié: (2026)
Efficient Large Multi-modal Models via Visual Context Compression
par: Chen, Jieneng, et autres
Publié: (2024)
par: Chen, Jieneng, et autres
Publié: (2024)
AutoToM: Scaling Model-based Mental Inference via Automated Agent Modeling
par: Zhang, Zhining, et autres
Publié: (2025)
par: Zhang, Zhining, et autres
Publié: (2025)
CausalSpatial: A Benchmark for Object-Centric Causal Spatial Reasoning
par: Ma, Wenxin, et autres
Publié: (2026)
par: Ma, Wenxin, et autres
Publié: (2026)
MindZero: Learning Online Mental Reasoning With Zero Annotations
par: Zhang, Shunchi, et autres
Publié: (2026)
par: Zhang, Shunchi, et autres
Publié: (2026)
Shared LoRA Subspaces for almost Strict Continual Learning
par: Kaushik, Prakhar, et autres
Publié: (2026)
par: Kaushik, Prakhar, et autres
Publié: (2026)
The Universal Weight Subspace Hypothesis
par: Kaushik, Prakhar, et autres
Publié: (2025)
par: Kaushik, Prakhar, et autres
Publié: (2025)
Captain Safari: A World Engine with Pose-Aligned 3D Memory
par: Chou, Yu-Cheng, et autres
Publié: (2025)
par: Chou, Yu-Cheng, et autres
Publié: (2025)
Endless World: Real-Time 3D-Aware Long Video Generation
par: Zhang, Ke, et autres
Publié: (2025)
par: Zhang, Ke, et autres
Publié: (2025)
FaceXFormer: A Unified Transformer for Facial Analysis
par: Narayan, Kartik, et autres
Publié: (2024)
par: Narayan, Kartik, et autres
Publié: (2024)
Doe-1: Closed-Loop Autonomous Driving with Large World Model
par: Zheng, Wenzhao, et autres
Publié: (2024)
par: Zheng, Wenzhao, et autres
Publié: (2024)
WorldQA: Multimodal World Knowledge in Videos through Long-Chain Reasoning
par: Zhang, Yuanhan, et autres
Publié: (2024)
par: Zhang, Yuanhan, et autres
Publié: (2024)
Benchmarking Procedural Language Understanding for Low-Resource Languages: A Case Study on Turkish
par: Uzunoglu, Arda, et autres
Publié: (2023)
par: Uzunoglu, Arda, et autres
Publié: (2023)
RealWebAssist: A Benchmark for Long-Horizon Web Assistance with Real-World Users
par: Ye, Suyu, et autres
Publié: (2025)
par: Ye, Suyu, et autres
Publié: (2025)
World Action Verifier: Self-Improving World Models via Forward-Inverse Asymmetry
par: Liu, Yuejiang, et autres
Publié: (2026)
par: Liu, Yuejiang, et autres
Publié: (2026)
Mesh-Gait: A Unified Framework for Gait Recognition Through Multi-Modal Representation Learning from 2D Silhouettes
par: Wang, Zhao-Yang, et autres
Publié: (2025)
par: Wang, Zhao-Yang, et autres
Publié: (2025)
SimWorld: An Open-ended Realistic Simulator for Autonomous Agents in Physical and Social Worlds
par: Ren, Jiawei, et autres
Publié: (2025)
par: Ren, Jiawei, et autres
Publié: (2025)
GeoWorld: Geometric World Models
par: Zhang, Zeyu, et autres
Publié: (2026)
par: Zhang, Zeyu, et autres
Publié: (2026)
DreamWorld: Unified World Modeling in Video Generation
par: Tan, Boming, et autres
Publié: (2026)
par: Tan, Boming, et autres
Publié: (2026)
Software Testing Beyond Closed Worlds: Open-World Games as an Extreme Case
par: Kato, Yusaku, et autres
Publié: (2026)
par: Kato, Yusaku, et autres
Publié: (2026)
The Era of Real-World Human Interaction: RL from User Conversations
par: Jin, Chuanyang, et autres
Publié: (2025)
par: Jin, Chuanyang, et autres
Publié: (2025)
Can World Models Benefit VLMs for World Dynamics?
par: Zhang, Kevin, et autres
Publié: (2025)
par: Zhang, Kevin, et autres
Publié: (2025)
FreeAskWorld: An Interactive and Closed-Loop Simulator for Human-Centric Embodied AI
par: Peng, Yuhang, et autres
Publié: (2025)
par: Peng, Yuhang, et autres
Publié: (2025)
DV-World: Benchmarking Data Visualization Agents in Real-World Scenarios
par: Meng, Jinxiang, et autres
Publié: (2026)
par: Meng, Jinxiang, et autres
Publié: (2026)
MolWorld: Molecule World Models for Actionable Molecular Optimization
par: Qiao, Yang, et autres
Publié: (2026)
par: Qiao, Yang, et autres
Publié: (2026)
From Word to World: Can Large Language Models be Implicit Text-based World Models?
par: Li, Yixia, et autres
Publié: (2025)
par: Li, Yixia, et autres
Publié: (2025)
Cuba in the World, the World in Cuba
par: Lorini, Alessandra, et autres
Publié: (2010)
par: Lorini, Alessandra, et autres
Publié: (2010)
Documents similaires
-
Generative World Explorer
par: Lu, Taiming, et autres
Publié: (2024) -
GenEx: Generating an Explorable World
par: Lu, Taiming, et autres
Publié: (2024) -
EvoWorld: Evolving Panoramic World Generation with Explicit 3D Memory
par: Wang, Jiahao, et autres
Publié: (2025) -
WorldAPIs: The World Is Worth How Many APIs? A Thought Experiment
par: Ou, Jiefu, et autres
Publié: (2024) -
Thinking with Spatial Code for Physical-World Video Reasoning
par: Chen, Jieneng, et autres
Publié: (2026)