LTM3D: Bridging Token Spaces for Conditional 3D Generation with Auto-Regressive Diffusion Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Xin, Zheng, Zihan, Chu, Lei, Gao, Yue, Li, Jiahao, Pan, Hao, Chen, Xuejin, Lu, Yan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ResGS: Residual Densification of 3D Gaussian for Efficient Detail Recovery
par: Lyu, Yanzhe, et autres
Publié: (2024)
par: Lyu, Yanzhe, et autres
Publié: (2024)
MARS: Mesh AutoRegressive Model for 3D Shape Detailization
par: Gao, Jingnan, et autres
Publié: (2025)
par: Gao, Jingnan, et autres
Publié: (2025)
VAR-3D: View-aware Auto-Regressive Model for Text-to-3D Generation via a 3D Tokenizer
par: Han, Zongcheng, et autres
Publié: (2026)
par: Han, Zongcheng, et autres
Publié: (2026)
AutoRegressive Generation with B-rep Holistic Token Sequence Representation
par: Li, Jiahao, et autres
Publié: (2026)
par: Li, Jiahao, et autres
Publié: (2026)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
par: Geng, Zichen, et autres
Publié: (2025)
par: Geng, Zichen, et autres
Publié: (2025)
Dual Attribute-Spatial Relation Alignment for 3D Visual Grounding
par: Xu, Yue, et autres
Publié: (2024)
par: Xu, Yue, et autres
Publié: (2024)
Giving Faces Their Feelings Back: Explicit Emotion Control for Feedforward Single-Image 3D Head Avatars
par: Gong, Yicheng, et autres
Publié: (2026)
par: Gong, Yicheng, et autres
Publié: (2026)
Bringing Your Portrait to 3D Presence
par: Zhang, Jiawei, et autres
Publié: (2025)
par: Zhang, Jiawei, et autres
Publié: (2025)
MVD$^2$: Efficient Multiview 3D Reconstruction for Multiview Diffusion
par: Zheng, Xin-Yang, et autres
Publié: (2024)
par: Zheng, Xin-Yang, et autres
Publié: (2024)
ArtiFixer: Enhancing and Extending 3D Reconstruction with Auto-Regressive Diffusion Models
par: de Lutio, Riccardo, et autres
Publié: (2026)
par: de Lutio, Riccardo, et autres
Publié: (2026)
CausalEmbed: Auto-Regressive Multi-Vector Generation in Latent Space for Visual Document Embedding
par: Huo, Jiahao, et autres
Publié: (2026)
par: Huo, Jiahao, et autres
Publié: (2026)
Diff-PCC: Diffusion-based Neural Compression for 3D Point Clouds
par: Liu, Kai, et autres
Publié: (2024)
par: Liu, Kai, et autres
Publié: (2024)
Symbolic-Diffusion: Deep Learning Based Symbolic Regression with D3PM Discrete Token Diffusion
par: Tymkow, Ryan T., et autres
Publié: (2025)
par: Tymkow, Ryan T., et autres
Publié: (2025)
3D Feature Prediction for Masked-AutoEncoder-Based Point Cloud Pretraining
par: Yan, Siming, et autres
Publié: (2023)
par: Yan, Siming, et autres
Publié: (2023)
PnP-U3D: Plug-and-Play 3D Framework Bridging Autoregression and Diffusion for Unified Understanding and Generation
par: Chen, Yongwei, et autres
Publié: (2026)
par: Chen, Yongwei, et autres
Publié: (2026)
Dynam3D: Dynamic Layered 3D Tokens Empower VLM for Vision-and-Language Navigation
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Bridging Semantic and Kinematic Conditions with Diffusion-based Discrete Motion Tokenizer
par: Gu, Chenyang, et autres
Publié: (2026)
par: Gu, Chenyang, et autres
Publié: (2026)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
par: Asim, Mohammad, et autres
Publié: (2026)
par: Asim, Mohammad, et autres
Publié: (2026)
CoD: A Diffusion Foundation Model for Image Compression
par: Jia, Zhaoyang, et autres
Publié: (2025)
par: Jia, Zhaoyang, et autres
Publié: (2025)
Diff3DETR:Agent-based Diffusion Model for Semi-supervised 3D Object Detection
par: Deng, Jiacheng, et autres
Publié: (2024)
par: Deng, Jiacheng, et autres
Publié: (2024)
Contextual Bandits and Reconfigurable Intelligent Surfaces for Predictive LTM Handover Decisions
par: Moreno-Locubiche, Ainna Yue, et autres
Publié: (2025)
par: Moreno-Locubiche, Ainna Yue, et autres
Publié: (2025)
Hierarchical Part-based Generative Model for Realistic 3D Blood Vessel
par: Chen, Siqi, et autres
Publié: (2025)
par: Chen, Siqi, et autres
Publié: (2025)
HiPART: Hierarchical Pose AutoRegressive Transformer for Occluded 3D Human Pose Estimation
par: Zheng, Hongwei, et autres
Publié: (2025)
par: Zheng, Hongwei, et autres
Publié: (2025)
LinkD: AutoRegressive Diffusion Model for Mechanical Linkage Synthesis
par: Jadhav, Yayati, et autres
Publié: (2026)
par: Jadhav, Yayati, et autres
Publié: (2026)
Region-Enhanced Feature Learning for Scene Semantic Segmentation
par: Kang, Xin, et autres
Publié: (2023)
par: Kang, Xin, et autres
Publié: (2023)
Bridging Diffusion Models and 3D Representations: A 3D Consistent Super-Resolution Framework
par: Chen, Yi-Ting, et autres
Publié: (2025)
par: Chen, Yi-Ting, et autres
Publié: (2025)
iLTM: Integrated Large Tabular Model
par: Bonet, David, et autres
Publié: (2025)
par: Bonet, David, et autres
Publié: (2025)
3D-TAFS: A Training-free Framework for 3D Affordance Segmentation
par: Chu, Meng, et autres
Publié: (2024)
par: Chu, Meng, et autres
Publié: (2024)
Hi3DGen: High-fidelity 3D Geometry Generation from Images via Normal Bridging
par: Ye, Chongjie, et autres
Publié: (2025)
par: Ye, Chongjie, et autres
Publié: (2025)
On Diffusion Process in SE(3)-invariant Space
par: Zhou, Zihan, et autres
Publié: (2024)
par: Zhou, Zihan, et autres
Publié: (2024)
CBDiff:Conditional Bernoulli Diffusion Models for Image Forgery Localization
par: Lei, Zhou, et autres
Publié: (2025)
par: Lei, Zhou, et autres
Publié: (2025)
Auto-Regressive Model with Exogenous Input--ARX--based traffic-flow prediction
par: Ying, Jun, et autres
Publié: (2024)
par: Ying, Jun, et autres
Publié: (2024)
Stepwise Think-Critique: A Unified Framework for Robust and Interpretable LLM Reasoning
par: Xu, Jiaqi, et autres
Publié: (2025)
par: Xu, Jiaqi, et autres
Publié: (2025)
BridgeNet: A Unified Multimodal Framework for Bridging 2D and 3D Industrial Anomaly Detection
par: Xiang, An, et autres
Publié: (2025)
par: Xiang, An, et autres
Publié: (2025)
Ouroboros3D: Image-to-3D Generation via 3D-aware Recursive Diffusion
par: Wen, Hao, et autres
Publié: (2024)
par: Wen, Hao, et autres
Publié: (2024)
Daniel-Gong/Orienting-in-WM-and-LTM: Analysis code
par: Dongyu Gong
Publié: (2025)
par: Dongyu Gong
Publié: (2025)
AvatarPointillist: AutoRegressive 4D Gaussian Avatarization
par: Liu, Hongyu, et autres
Publié: (2026)
par: Liu, Hongyu, et autres
Publié: (2026)
CoD-Lite: Real-Time Diffusion-Based Generative Image Compression
par: Jia, Zhaoyang, et autres
Publié: (2026)
par: Jia, Zhaoyang, et autres
Publié: (2026)
LTM: Scalable and Black-box Similarity-based Test Suite Minimization based on Language Models
par: Pan, Rongqi, et autres
Publié: (2023)
par: Pan, Rongqi, et autres
Publié: (2023)
Velocity-Space 3D Asset Editing
par: Liu, Hao, et autres
Publié: (2026)
par: Liu, Hao, et autres
Publié: (2026)
Documents similaires
-
ResGS: Residual Densification of 3D Gaussian for Efficient Detail Recovery
par: Lyu, Yanzhe, et autres
Publié: (2024) -
MARS: Mesh AutoRegressive Model for 3D Shape Detailization
par: Gao, Jingnan, et autres
Publié: (2025) -
VAR-3D: View-aware Auto-Regressive Model for Text-to-3D Generation via a 3D Tokenizer
par: Han, Zongcheng, et autres
Publié: (2026) -
AutoRegressive Generation with B-rep Holistic Token Sequence Representation
par: Li, Jiahao, et autres
Publié: (2026) -
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
par: Geng, Zichen, et autres
Publié: (2025)