EvoWorld: Evolving Panoramic World Generation with Explicit 3D Memory
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Jiahao, Ye, Luoxin, Lu, TaiMing, Xiao, Junfei, Zhang, Jiahan, Guo, Yuxiang, Liu, Xijun, Chellappa, Rama, Peng, Cheng, Yuille, Alan, Chen, Jieneng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GenEx: Generating an Explorable World
di: Lu, Taiming, et al.
Pubblicazione: (2024)
di: Lu, Taiming, et al.
Pubblicazione: (2024)
World-in-World: World Models in a Closed-Loop World
di: Zhang, Jiahan, et al.
Pubblicazione: (2025)
di: Zhang, Jiahan, et al.
Pubblicazione: (2025)
SpatialLLM: A Compound 3D-Informed Design towards Spatially-Intelligent Large Multimodal Models
di: Ma, Wufei, et al.
Pubblicazione: (2025)
di: Ma, Wufei, et al.
Pubblicazione: (2025)
Captain Safari: A World Engine with Pose-Aligned 3D Memory
di: Chou, Yu-Cheng, et al.
Pubblicazione: (2025)
di: Chou, Yu-Cheng, et al.
Pubblicazione: (2025)
An Immersive Multi-Elevation Multi-Seasonal Dataset for 3D Reconstruction and Visualization
di: Liu, Xijun, et al.
Pubblicazione: (2024)
di: Liu, Xijun, et al.
Pubblicazione: (2024)
Generative World Explorer
di: Lu, Taiming, et al.
Pubblicazione: (2024)
di: Lu, Taiming, et al.
Pubblicazione: (2024)
Efficient Large Multi-modal Models via Visual Context Compression
di: Chen, Jieneng, et al.
Pubblicazione: (2024)
di: Chen, Jieneng, et al.
Pubblicazione: (2024)
Medical World Model: Generative Simulation of Tumor Evolution for Treatment Planning
di: Yang, Yijun, et al.
Pubblicazione: (2025)
di: Yang, Yijun, et al.
Pubblicazione: (2025)
Mesh-Gait: A Unified Framework for Gait Recognition Through Multi-Modal Representation Learning from 2D Silhouettes
di: Wang, Zhao-Yang, et al.
Pubblicazione: (2025)
di: Wang, Zhao-Yang, et al.
Pubblicazione: (2025)
Thinking with Spatial Code for Physical-World Video Reasoning
di: Chen, Jieneng, et al.
Pubblicazione: (2026)
di: Chen, Jieneng, et al.
Pubblicazione: (2026)
Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning
di: Liu, Qihao, et al.
Pubblicazione: (2025)
di: Liu, Qihao, et al.
Pubblicazione: (2025)
Shared LoRA Subspaces for almost Strict Continual Learning
di: Kaushik, Prakhar, et al.
Pubblicazione: (2026)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2026)
The Universal Weight Subspace Hypothesis
di: Kaushik, Prakhar, et al.
Pubblicazione: (2025)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2025)
Vision-Language-Vision Auto-Encoder: Scalable Knowledge Distillation from Diffusion Models
di: Zhang, Tiezheng, et al.
Pubblicazione: (2025)
di: Zhang, Tiezheng, et al.
Pubblicazione: (2025)
VILLS -- Video-Image Learning to Learn Semantics for Person Re-Identification
di: Huang, Siyuan, et al.
Pubblicazione: (2023)
di: Huang, Siyuan, et al.
Pubblicazione: (2023)
FusionRF: High-Fidelity Satellite Neural Radiance Fields from Multispectral and Panchromatic Acquisitions
di: Sprintson, Michael, et al.
Pubblicazione: (2024)
di: Sprintson, Michael, et al.
Pubblicazione: (2024)
BAGS: Blur Agnostic Gaussian Splatting through Multi-Scale Kernel Modeling
di: Peng, Cheng, et al.
Pubblicazione: (2024)
di: Peng, Cheng, et al.
Pubblicazione: (2024)
Prompt-Based Exemplar Super-Compression and Regeneration for Class-Incremental Learning
di: Duan, Ruxiao, et al.
Pubblicazione: (2023)
di: Duan, Ruxiao, et al.
Pubblicazione: (2023)
GaitContour: Efficient Gait Recognition based on a Contour-Pose Representation
di: Guo, Yuxiang, et al.
Pubblicazione: (2023)
di: Guo, Yuxiang, et al.
Pubblicazione: (2023)
PaLM2-VAdapter: Progressively Aligned Language Model Makes a Strong Vision-language Adapter
di: Xiao, Junfei, et al.
Pubblicazione: (2024)
di: Xiao, Junfei, et al.
Pubblicazione: (2024)
ViTamin: Designing Scalable Vision Models in the Vision-Language Era
di: Chen, Jieneng, et al.
Pubblicazione: (2024)
di: Chen, Jieneng, et al.
Pubblicazione: (2024)
SPIDER: Spatial Image CorresponDence Estimator for Robust Calibration
di: Shao, Zhimin, et al.
Pubblicazione: (2025)
di: Shao, Zhimin, et al.
Pubblicazione: (2025)
CAM3R: Camera-Agnostic Model for 3D Reconstruction
di: Guruprasad, Namitha, et al.
Pubblicazione: (2026)
di: Guruprasad, Namitha, et al.
Pubblicazione: (2026)
Distillation-guided Representation Learning for Unconstrained Gait Recognition
di: Guo, Yuxiang, et al.
Pubblicazione: (2023)
di: Guo, Yuxiang, et al.
Pubblicazione: (2023)
Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory
di: Wei, Tianxin, et al.
Pubblicazione: (2025)
di: Wei, Tianxin, et al.
Pubblicazione: (2025)
Template-based Multi-Domain Face Recognition
di: Nanduri, Anirudh, et al.
Pubblicazione: (2024)
di: Nanduri, Anirudh, et al.
Pubblicazione: (2024)
DiffInf: Influence-Guided Diffusion for Supervision Alignment in Facial Attribute Learning
di: Pal, Basudha, et al.
Pubblicazione: (2026)
di: Pal, Basudha, et al.
Pubblicazione: (2026)
MimicGait: A Model Agnostic approach for Occluded Gait Recognition using Correlational Knowledge Distillation
di: Gupta, Ayush, et al.
Pubblicazione: (2025)
di: Gupta, Ayush, et al.
Pubblicazione: (2025)
ViT-Linearizer: Distilling Quadratic Knowledge into Linear-Time Vision Models
di: Wei, Guoyizhe, et al.
Pubblicazione: (2025)
di: Wei, Guoyizhe, et al.
Pubblicazione: (2025)
CLR-Face: Conditional Latent Refinement for Blind Face Restoration Using Score-Based Diffusion Models
di: Suin, Maitreya, et al.
Pubblicazione: (2024)
di: Suin, Maitreya, et al.
Pubblicazione: (2024)
GENFIG1: Visual Summaries of Scholarly Work as a Challenge for Vision-Language Models
di: Guan, Yaohan, et al.
Pubblicazione: (2026)
di: Guan, Yaohan, et al.
Pubblicazione: (2026)
EvoCodeBench: An Evolving Code Generation Benchmark Aligned with Real-World Code Repositories
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
EvoWiki: Evaluating LLMs on Evolving Knowledge
di: Tang, Wei, et al.
Pubblicazione: (2024)
di: Tang, Wei, et al.
Pubblicazione: (2024)
Uncertainty-quantified Pulse Signal Recovery from Facial Video using Regularized Stochastic Interpolants
di: Shenoy, Vineet R., et al.
Pubblicazione: (2026)
di: Shenoy, Vineet R., et al.
Pubblicazione: (2026)
PanoWorld: Geometry-Consistent Panoramic Video World Modeling
di: Jiang, Le, et al.
Pubblicazione: (2026)
di: Jiang, Le, et al.
Pubblicazione: (2026)
Combo-Gait: Unified Transformer Framework for Multi-Modal Gait Recognition and Attribute Analysis
di: Wang, Zhao-Yang, et al.
Pubblicazione: (2025)
di: Wang, Zhao-Yang, et al.
Pubblicazione: (2025)
Play to Generalize: Learning to Reason Through Game Play
di: Xie, Yunfei, et al.
Pubblicazione: (2025)
di: Xie, Yunfei, et al.
Pubblicazione: (2025)
Rejuvenating image-GPT as Strong Visual Representation Learners
di: Ren, Sucheng, et al.
Pubblicazione: (2023)
di: Ren, Sucheng, et al.
Pubblicazione: (2023)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
di: Wang, Yuyao, et al.
Pubblicazione: (2026)
di: Wang, Yuyao, et al.
Pubblicazione: (2026)
HyEvo: Self-Evolving Hybrid Agentic Workflows for Efficient Reasoning
di: Xu, Beibei, et al.
Pubblicazione: (2026)
di: Xu, Beibei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GenEx: Generating an Explorable World
di: Lu, Taiming, et al.
Pubblicazione: (2024) -
World-in-World: World Models in a Closed-Loop World
di: Zhang, Jiahan, et al.
Pubblicazione: (2025) -
SpatialLLM: A Compound 3D-Informed Design towards Spatially-Intelligent Large Multimodal Models
di: Ma, Wufei, et al.
Pubblicazione: (2025) -
Captain Safari: A World Engine with Pose-Aligned 3D Memory
di: Chou, Yu-Cheng, et al.
Pubblicazione: (2025) -
An Immersive Multi-Elevation Multi-Seasonal Dataset for 3D Reconstruction and Visualization
di: Liu, Xijun, et al.
Pubblicazione: (2024)