IC-World: In-Context Generation for Shared World Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Fan, Wei, Jiacheng, Li, Ruibo, Xu, Yi, Li, Junyou, Ye, Deheng, Lin, Guosheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation
por: Wu, Fan, et al.
Publicado: (2025)
por: Wu, Fan, et al.
Publicado: (2025)
StateSpaceDiffuser: Bringing Long Context to Diffusion World Models
por: Savov, Nedko, et al.
Publicado: (2025)
por: Savov, Nedko, et al.
Publicado: (2025)
Weakly and Self-Supervised Class-Agnostic Motion Prediction for Autonomous Driving
por: Li, Ruibo, et al.
Publicado: (2025)
por: Li, Ruibo, et al.
Publicado: (2025)
UrbanWorld: An Urban World Model for 3D City Generation
por: Shang, Yu, et al.
Publicado: (2024)
por: Shang, Yu, et al.
Publicado: (2024)
GigaWorld-Policy: An Efficient Action-Centered World--Action Model
por: Ye, Angen, et al.
Publicado: (2026)
por: Ye, Angen, et al.
Publicado: (2026)
Human-in-Context: Unified Cross-Domain 3D Human Motion Modeling via In-Context Learning
por: Liu, Mengyuan, et al.
Publicado: (2025)
por: Liu, Mengyuan, et al.
Publicado: (2025)
ShareVerse: Multi-Agent Consistent Video Generation for Shared World Modeling
por: Zhu, Jiayi, et al.
Publicado: (2026)
por: Zhu, Jiayi, et al.
Publicado: (2026)
IC-Custom: Diverse Image Customization via In-Context Learning
por: Li, Yaowei, et al.
Publicado: (2025)
por: Li, Yaowei, et al.
Publicado: (2025)
Point-In-Context: Understanding Point Cloud via In-Context Learning
por: Liu, Mengyuan, et al.
Publicado: (2024)
por: Liu, Mengyuan, et al.
Publicado: (2024)
Prim2Room: Layout-Controllable Room Mesh Generation from Primitives
por: Feng, Chengzeng, et al.
Publicado: (2024)
por: Feng, Chengzeng, et al.
Publicado: (2024)
DreamWorld: Unified World Modeling in Video Generation
por: Tan, Boming, et al.
Publicado: (2026)
por: Tan, Boming, et al.
Publicado: (2026)
WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
por: Feng, Weilun, et al.
Publicado: (2026)
por: Feng, Weilun, et al.
Publicado: (2026)
GigaWorld-0: World Models as Data Engine to Empower Embodied AI
por: GigaWorld Team, et al.
Publicado: (2025)
por: GigaWorld Team, et al.
Publicado: (2025)
DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation
por: Zhao, Guosheng, et al.
Publicado: (2024)
por: Zhao, Guosheng, et al.
Publicado: (2024)
Puppeteer: Rig and Animate Your 3D Models
por: Song, Chaoyue, et al.
Publicado: (2025)
por: Song, Chaoyue, et al.
Publicado: (2025)
Dense Supervision Propagation for Weakly Supervised Semantic Segmentation on 3D Point Clouds
por: Wei, Jiacheng, et al.
Publicado: (2021)
por: Wei, Jiacheng, et al.
Publicado: (2021)
LongScape: Advancing Long-Horizon Embodied World Models with Context-Aware MoE
por: Shang, Yu, et al.
Publicado: (2025)
por: Shang, Yu, et al.
Publicado: (2025)
WonderTurbo: Generating Interactive 3D World in 0.72 Seconds
por: Ni, Chaojun, et al.
Publicado: (2025)
por: Ni, Chaojun, et al.
Publicado: (2025)
DreamDance: Animating Character Art via Inpainting Stable Gaussian Worlds
por: Zhang, Jiaxu, et al.
Publicado: (2025)
por: Zhang, Jiaxu, et al.
Publicado: (2025)
WorldGrow: Generating Infinite 3D World
por: Li, Sikuang, et al.
Publicado: (2025)
por: Li, Sikuang, et al.
Publicado: (2025)
WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation
por: Zhao, Baining, et al.
Publicado: (2026)
por: Zhao, Baining, et al.
Publicado: (2026)
TrackingWorld: World-centric Monocular 3D Tracking of Almost All Pixels
por: Lu, Jiahao, et al.
Publicado: (2025)
por: Lu, Jiahao, et al.
Publicado: (2025)
WorldEval: World Model as Real-World Robot Policies Evaluator
por: Li, Yaxuan, et al.
Publicado: (2025)
por: Li, Yaxuan, et al.
Publicado: (2025)
MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts
por: Liang, Hao, et al.
Publicado: (2024)
por: Liang, Hao, et al.
Publicado: (2024)
Geometry-Aware Implicit Memory for Video World Models
por: Wei, Zhengxuan, et al.
Publicado: (2026)
por: Wei, Zhengxuan, et al.
Publicado: (2026)
WildWorld: A Large-Scale Dataset for Dynamic World Modeling with Actions and Explicit State toward Generative ARPG
por: Li, Zhen, et al.
Publicado: (2026)
por: Li, Zhen, et al.
Publicado: (2026)
Generalized Dynamics Generation towards Scannable Physical World Model
por: Li, Yichen, et al.
Publicado: (2025)
por: Li, Yichen, et al.
Publicado: (2025)
HY-World 2.0: A Multi-Modal World Model for Reconstructing, Generating, and Simulating 3D Worlds
por: HY-World, Team, et al.
Publicado: (2026)
por: HY-World, Team, et al.
Publicado: (2026)
Light Interaction: Training-Free Inference Acceleration for Interactive Video World Models
por: Lu, Jiacheng, et al.
Publicado: (2026)
por: Lu, Jiacheng, et al.
Publicado: (2026)
Xiaomi Auto World Model: A Joint World Model Integrating Reconstruction and Generation for Autonomous Driving
por: Zhou, Lijun, et al.
Publicado: (2026)
por: Zhou, Lijun, et al.
Publicado: (2026)
REACTO: Reconstructing Articulated Objects from a Single Video
por: Song, Chaoyue, et al.
Publicado: (2024)
por: Song, Chaoyue, et al.
Publicado: (2024)
Latent-WAM: Latent World Action Modeling for End-to-End Autonomous Driving
por: Wang, Linbo, et al.
Publicado: (2026)
por: Wang, Linbo, et al.
Publicado: (2026)
WorldSimBench: Towards Video Generation Models as World Simulators
por: Qin, Yiran, et al.
Publicado: (2024)
por: Qin, Yiran, et al.
Publicado: (2024)
PanoWorld: A Generative Spatial World Model for Consistent Whole-House Panorama Synthesis
por: Jia, Jinrang, et al.
Publicado: (2026)
por: Jia, Jinrang, et al.
Publicado: (2026)
Boosting Diffusion-Based Text Image Super-Resolution Model Towards Generalized Real-World Scenarios
por: Pan, Chenglu, et al.
Publicado: (2025)
por: Pan, Chenglu, et al.
Publicado: (2025)
FantasyWorld: Geometry-Consistent World Modeling via Unified Video and 3D Prediction
por: Dai, Yixiang, et al.
Publicado: (2025)
por: Dai, Yixiang, et al.
Publicado: (2025)
An Efficient Occupancy World Model via Decoupled Dynamic Flow and Image-assisted Training
por: Zhang, Haiming, et al.
Publicado: (2024)
por: Zhang, Haiming, et al.
Publicado: (2024)
World-in-World: World Models in a Closed-Loop World
por: Zhang, Jiahan, et al.
Publicado: (2025)
por: Zhang, Jiahan, et al.
Publicado: (2025)
Open World Object Detection: A Survey
por: Li, Yiming, et al.
Publicado: (2024)
por: Li, Yiming, et al.
Publicado: (2024)
EyeWorld: A Generative World Model of Ocular State and Dynamics
por: Gao, Ziyu, et al.
Publicado: (2026)
por: Gao, Ziyu, et al.
Publicado: (2026)
Ejemplares similares
-
PhyCustom: Towards Realistic Physical Customization in Text-to-Image Generation
por: Wu, Fan, et al.
Publicado: (2025) -
StateSpaceDiffuser: Bringing Long Context to Diffusion World Models
por: Savov, Nedko, et al.
Publicado: (2025) -
Weakly and Self-Supervised Class-Agnostic Motion Prediction for Autonomous Driving
por: Li, Ruibo, et al.
Publicado: (2025) -
UrbanWorld: An Urban World Model for 3D City Generation
por: Shang, Yu, et al.
Publicado: (2024) -
GigaWorld-Policy: An Efficient Action-Centered World--Action Model
por: Ye, Angen, et al.
Publicado: (2026)