Synthesizing 3D Abstractions by Inverting Procedural Buildings with Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dax, Maximilian, Berbel, Jordi, Stria, Jan, Guibas, Leonidas, Bergmann, Urs |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PASTA: Controllable Part-Aware Shape Generation with Autoregressive Transformers
par: Li, Songlin, et autres
Publié: (2024)
par: Li, Songlin, et autres
Publié: (2024)
Support-Set Context Matters for Bongard Problems
par: Raghuraman, Nikhil, et autres
Publié: (2023)
par: Raghuraman, Nikhil, et autres
Publié: (2023)
pi-Flow: Policy-Based Few-Step Generation via Imitation Distillation
par: Chen, Hansheng, et autres
Publié: (2025)
par: Chen, Hansheng, et autres
Publié: (2025)
Diffusion Self-Distillation for Zero-Shot Customized Image Generation
par: Cai, Shengqu, et autres
Publié: (2024)
par: Cai, Shengqu, et autres
Publié: (2024)
GEM3D: GEnerative Medial Abstractions for 3D Shape Synthesis
par: Petrov, Dmitry, et autres
Publié: (2024)
par: Petrov, Dmitry, et autres
Publié: (2024)
HouseLayout3D: A Benchmark and Training-Free Baseline for 3D Layout Estimation in the Wild
par: Bieri, Valentin, et autres
Publié: (2025)
par: Bieri, Valentin, et autres
Publié: (2025)
OpenSUN3D: 1st Workshop Challenge on Open-Vocabulary 3D Scene Understanding
par: Engelmann, Francis, et autres
Publié: (2024)
par: Engelmann, Francis, et autres
Publié: (2024)
View-Consistent Hierarchical 3D Segmentation Using Ultrametric Feature Fields
par: He, Haodi, et autres
Publié: (2024)
par: He, Haodi, et autres
Publié: (2024)
How Do I Do That? Synthesizing 3D Hand Motion and Contacts for Everyday Interactions
par: Prakash, Aditya, et autres
Publié: (2025)
par: Prakash, Aditya, et autres
Publié: (2025)
SpaceControl: Introducing Test-Time Spatial Control to 3D Generative Modeling
par: Fedele, Elisabetta, et autres
Publié: (2025)
par: Fedele, Elisabetta, et autres
Publié: (2025)
3DCodeBench: Benchmarking Agentic Procedural 3D Modeling Via Code
par: Gao, Yipeng, et autres
Publié: (2026)
par: Gao, Yipeng, et autres
Publié: (2026)
MaizeField3D: A Curated 3D Point Cloud and Procedural Model Dataset of Field-Grown Maize from a Diversity Panel
par: Kimara, Elvis, et autres
Publié: (2025)
par: Kimara, Elvis, et autres
Publié: (2025)
Aligning Machine and Human Visual Representations across Abstraction Levels
par: Muttenthaler, Lukas, et autres
Publié: (2024)
par: Muttenthaler, Lukas, et autres
Publié: (2024)
Learning from Trials and Errors: Reflective Test-Time Planning for Embodied LLMs
par: Hong, Yining, et autres
Publié: (2026)
par: Hong, Yining, et autres
Publié: (2026)
Beyond Perfect Scores: Proof-by-Contradiction for Trustworthy Machine Learning
par: Wadduwage, Dushan N., et autres
Publié: (2026)
par: Wadduwage, Dushan N., et autres
Publié: (2026)
Geometric Point Attention Transformer for 3D Shape Reassembly
par: Li, Jiahan, et autres
Publié: (2024)
par: Li, Jiahan, et autres
Publié: (2024)
ESI-Bench: Towards Embodied Spatial Intelligence that Closes the Perception-Action Loop
par: Hong, Yining, et autres
Publié: (2026)
par: Hong, Yining, et autres
Publié: (2026)
Refining Pre-Trained Motion Models
par: Sun, Xinglong, et autres
Publié: (2024)
par: Sun, Xinglong, et autres
Publié: (2024)
2D-3D Interlaced Transformer for Point Cloud Segmentation with Scene-Level Supervision
par: Yang, Cheng-Kun, et autres
Publié: (2023)
par: Yang, Cheng-Kun, et autres
Publié: (2023)
SceneCraft: An LLM Agent for Synthesizing 3D Scene as Blender Code
par: Hu, Ziniu, et autres
Publié: (2024)
par: Hu, Ziniu, et autres
Publié: (2024)
Guiding Video Prediction with Explicit Procedural Knowledge
par: Takenaka, Patrick, et autres
Publié: (2024)
par: Takenaka, Patrick, et autres
Publié: (2024)
MonoSOWA: Scalable monocular 3D Object detector Without human Annotations
par: Skvrna, Jan, et autres
Publié: (2025)
par: Skvrna, Jan, et autres
Publié: (2025)
Hourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation
par: Li, Wenhao, et autres
Publié: (2023)
par: Li, Wenhao, et autres
Publié: (2023)
FakeInversion: Learning to Detect Images from Unseen Text-to-Image Models by Inverting Stable Diffusion
par: Cazenavette, George, et autres
Publié: (2024)
par: Cazenavette, George, et autres
Publié: (2024)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
par: Asim, Mohammad, et autres
Publié: (2026)
par: Asim, Mohammad, et autres
Publié: (2026)
LmPT: Conditional Point Transformer for Anatomical Landmark Detection on 3D Point Clouds
par: Bastico, Matteo, et autres
Publié: (2026)
par: Bastico, Matteo, et autres
Publié: (2026)
Paint Outside the Box: Synthesizing and Selecting Training Data for Visual Grounding
par: Du, Zilin, et autres
Publié: (2024)
par: Du, Zilin, et autres
Publié: (2024)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024)
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024)
Revisiting MAE pre-training for 3D medical image segmentation
par: Wald, Tassilo, et autres
Publié: (2024)
par: Wald, Tassilo, et autres
Publié: (2024)
Streaming 4D Visual Geometry Transformer
par: Zhuo, Dong, et autres
Publié: (2025)
par: Zhuo, Dong, et autres
Publié: (2025)
Model Stitching and Visualization How GAN Generators can Invert Networks in Real-Time
par: Herdt, Rudolf, et autres
Publié: (2023)
par: Herdt, Rudolf, et autres
Publié: (2023)
Closing the Gap in Human Behavior Analysis: A Pipeline for Synthesizing Trimodal Data
par: Stippel, Christian, et autres
Publié: (2024)
par: Stippel, Christian, et autres
Publié: (2024)
DiffiT: Diffusion Vision Transformers for Image Generation
par: Hatamizadeh, Ali, et autres
Publié: (2023)
par: Hatamizadeh, Ali, et autres
Publié: (2023)
Optimizing LaneSegNet for Real-Time Lane Topology Prediction in Autonomous Vehicles
par: Stevens, William, et autres
Publié: (2024)
par: Stevens, William, et autres
Publié: (2024)
TORE: Token Recycling in Vision Transformers for Efficient Active Visual Exploration
par: Olszewski, Jan, et autres
Publié: (2023)
par: Olszewski, Jan, et autres
Publié: (2023)
Erwin: A Tree-based Hierarchical Transformer for Large-scale Physical Systems
par: Zhdanov, Maksim, et autres
Publié: (2025)
par: Zhdanov, Maksim, et autres
Publié: (2025)
Building Efficient Lightweight CNN Models
par: Isong, Nathan
Publié: (2025)
par: Isong, Nathan
Publié: (2025)
Neural Implicit Representation for Building Digital Twins of Unknown Articulated Objects
par: Weng, Yijia, et autres
Publié: (2024)
par: Weng, Yijia, et autres
Publié: (2024)
ViPro: Enabling and Controlling Video Prediction for Complex Dynamical Scenarios using Procedural Knowledge
par: Takenaka, Patrick, et autres
Publié: (2024)
par: Takenaka, Patrick, et autres
Publié: (2024)
FasterViT: Fast Vision Transformers with Hierarchical Attention
par: Hatamizadeh, Ali, et autres
Publié: (2023)
par: Hatamizadeh, Ali, et autres
Publié: (2023)
Documents similaires
-
PASTA: Controllable Part-Aware Shape Generation with Autoregressive Transformers
par: Li, Songlin, et autres
Publié: (2024) -
Support-Set Context Matters for Bongard Problems
par: Raghuraman, Nikhil, et autres
Publié: (2023) -
pi-Flow: Policy-Based Few-Step Generation via Imitation Distillation
par: Chen, Hansheng, et autres
Publié: (2025) -
Diffusion Self-Distillation for Zero-Shot Customized Image Generation
par: Cai, Shengqu, et autres
Publié: (2024) -
GEM3D: GEnerative Medial Abstractions for 3D Shape Synthesis
par: Petrov, Dmitry, et autres
Publié: (2024)