Spatial-TTT: Streaming Visual-based Spatial Intelligence with Test-Time Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Fangfu, Wu, Diankun, Chi, Jiawei, Cai, Yimo, Hung, Yi-Hsin, Yu, Xumin, Li, Hao, Hu, Han, Rao, Yongming, Duan, Yueqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial Intelligence
di: Wu, Diankun, et al.
Pubblicazione: (2025)
di: Wu, Diankun, et al.
Pubblicazione: (2025)
Video-T1: Test-Time Scaling for Video Generation
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
DreamCinema: Cinematic Transfer with Free Camera and 3D Character
di: Chen, Weiliang, et al.
Pubblicazione: (2024)
di: Chen, Weiliang, et al.
Pubblicazione: (2024)
RW-TTT: Batched Serving for Request-Owned Test-Time Training State
di: Yang, Jian, et al.
Pubblicazione: (2026)
di: Yang, Jian, et al.
Pubblicazione: (2026)
ForgeryTTT: Zero-Shot Image Manipulation Localization with Test-Time Training
di: Liu, Weihuang, et al.
Pubblicazione: (2024)
di: Liu, Weihuang, et al.
Pubblicazione: (2024)
CFG-Ctrl: Control-Based Classifier-Free Diffusion Guidance
di: Wang, Hanyang, et al.
Pubblicazione: (2026)
di: Wang, Hanyang, et al.
Pubblicazione: (2026)
Vision-TTT: Efficient and Expressive Visual Representation Learning with Test-Time Training
di: Kong, Quan, et al.
Pubblicazione: (2026)
di: Kong, Quan, et al.
Pubblicazione: (2026)
LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
di: Liu, Fangfu, et al.
Pubblicazione: (2025)
Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial Intelligence
di: Gao, Yuanyuan, et al.
Pubblicazione: (2026)
di: Gao, Yuanyuan, et al.
Pubblicazione: (2026)
SR-TTT: Surprisal-Aware Residual Test-Time Training
di: P, Swamynathan V
Pubblicazione: (2026)
di: P, Swamynathan V
Pubblicazione: (2026)
NC-TTT: A Noise Contrastive Approach for Test-Time Training
di: Osowiechi, David, et al.
Pubblicazione: (2024)
di: Osowiechi, David, et al.
Pubblicazione: (2024)
ReC-TTT: Contrastive Feature Reconstruction for Test-Time Training
di: Colussi, Marco, et al.
Pubblicazione: (2024)
di: Colussi, Marco, et al.
Pubblicazione: (2024)
TTT-Parkour: Rapid Test-Time Training for Perceptive Robot Parkour
di: Zhu, Shaoting, et al.
Pubblicazione: (2026)
di: Zhu, Shaoting, et al.
Pubblicazione: (2026)
TTT3R: 3D Reconstruction as Test-Time Training
di: Chen, Xingyu, et al.
Pubblicazione: (2025)
di: Chen, Xingyu, et al.
Pubblicazione: (2025)
NeuroTTT: Bridging Pretraining-Downstream Task Misalignment in EEG Foundation Models via Test-Time Training
di: Wang, Suli, et al.
Pubblicazione: (2025)
di: Wang, Suli, et al.
Pubblicazione: (2025)
Med-TTT: Vision Test-Time Training model for Medical Image Segmentation
di: Xu, Jiashu
Pubblicazione: (2024)
di: Xu, Jiashu
Pubblicazione: (2024)
Meta-TTT: A Meta-learning Minimax Framework For Test-Time Training
di: Tao, Chen, et al.
Pubblicazione: (2024)
di: Tao, Chen, et al.
Pubblicazione: (2024)
ClipTTT: CLIP-Guided Test-Time Training Helps LVLMs See Better
di: Nath, Mriganka, et al.
Pubblicazione: (2026)
di: Nath, Mriganka, et al.
Pubblicazione: (2026)
AU-TTT: Vision Test-Time Training model for Facial Action Unit Detection
di: Xing, Bohao, et al.
Pubblicazione: (2025)
di: Xing, Bohao, et al.
Pubblicazione: (2025)
CustomTTT: Motion and Appearance Customized Video Generation via Test-Time Training
di: Bi, Xiuli, et al.
Pubblicazione: (2024)
di: Bi, Xiuli, et al.
Pubblicazione: (2024)
LoRA-TTT: Low-Rank Test-Time Training for Vision-Language Models
di: Kojima, Yuto, et al.
Pubblicazione: (2025)
di: Kojima, Yuto, et al.
Pubblicazione: (2025)
REE-TTT: Highly Adaptive Radar Echo Extrapolation Based on Test-Time Training
di: Di, Xin, et al.
Pubblicazione: (2026)
di: Di, Xin, et al.
Pubblicazione: (2026)
OnlineX: Unified Online 3D Reconstruction and Understanding with Active-to-Stable State Evolution
di: Xia, Chong, et al.
Pubblicazione: (2026)
di: Xia, Chong, et al.
Pubblicazione: (2026)
Gaussian Graph Network: Learning Efficient and Generalizable Gaussian Representations from Multi-view Images
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
Make-Your-3D: Fast and Consistent Subject-Driven 3D Content Generation
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
scFusionTTT: Single-cell transcriptomics and proteomics fusion with Test-Time Training layers
di: Meng, Dian, et al.
Pubblicazione: (2024)
di: Meng, Dian, et al.
Pubblicazione: (2024)
DocTTT: Test-Time Training for Handwritten Document Recognition Using Meta-Auxiliary Learning
di: Gu, Wenhao, et al.
Pubblicazione: (2025)
di: Gu, Wenhao, et al.
Pubblicazione: (2025)
TTT-Unet: Enhancing U-Net with Test-Time Training Layers for Biomedical Image Segmentation
di: Zhou, Rong, et al.
Pubblicazione: (2024)
di: Zhou, Rong, et al.
Pubblicazione: (2024)
TTT4Rec: A Test-Time Training Approach for Rapid Adaption in Sequential Recommendation
di: Yang, Zhaoqi, et al.
Pubblicazione: (2024)
di: Yang, Zhaoqi, et al.
Pubblicazione: (2024)
Oryx MLLM: On-Demand Spatial-Temporal Understanding at Arbitrary Resolution
di: Liu, Zuyan, et al.
Pubblicazione: (2024)
di: Liu, Zuyan, et al.
Pubblicazione: (2024)
CoTBox-TTT: Grounding Medical VQA with Visual Chain-of-Thought Boxes During Test-time Training
di: Qian, Jiahe, et al.
Pubblicazione: (2025)
di: Qian, Jiahe, et al.
Pubblicazione: (2025)
Unique3D: High-Quality and Efficient 3D Mesh Generation from a Single Image
di: Wu, Kailu, et al.
Pubblicazione: (2024)
di: Wu, Kailu, et al.
Pubblicazione: (2024)
Fast Spatial Memory with Elastic Test-Time Training
di: Ma, Ziqiao, et al.
Pubblicazione: (2026)
di: Ma, Ziqiao, et al.
Pubblicazione: (2026)
TTSA3R: Training-Free Temporal-Spatial Adaptive Persistent State for Streaming 3D Reconstruction
di: Zheng, Zhijie, et al.
Pubblicazione: (2026)
di: Zheng, Zhijie, et al.
Pubblicazione: (2026)
MotionTTT: 2D Test-Time-Training Motion Estimation for 3D Motion Corrected MRI
di: Klug, Tobit, et al.
Pubblicazione: (2024)
di: Klug, Tobit, et al.
Pubblicazione: (2024)
Physics3D: Learning Physical Properties of 3D Gaussians via Video Diffusion
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
di: Liu, Fangfu, et al.
Pubblicazione: (2024)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
di: Xia, Chong, et al.
Pubblicazione: (2025)
di: Xia, Chong, et al.
Pubblicazione: (2025)
SimRecon: SimReady Compositional Scene Reconstruction from Real Videos
di: Xia, Chong, et al.
Pubblicazione: (2026)
di: Xia, Chong, et al.
Pubblicazione: (2026)
Geometry Forcing: Marrying Video Diffusion and 3D Representation for Consistent World Modeling
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
di: Wu, Haoyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial Intelligence
di: Wu, Diankun, et al.
Pubblicazione: (2025) -
Video-T1: Test-Time Scaling for Video Generation
di: Liu, Fangfu, et al.
Pubblicazione: (2025) -
VideoScene: Distilling Video Diffusion Model to Generate 3D Scenes in One Step
di: Wang, Hanyang, et al.
Pubblicazione: (2025) -
DreamCinema: Cinematic Transfer with Free Camera and 3D Character
di: Chen, Weiliang, et al.
Pubblicazione: (2024) -
RW-TTT: Batched Serving for Request-Owned Test-Time Training State
di: Yang, Jian, et al.
Pubblicazione: (2026)