DORSal: Diffusion for Object-centric Representations of Scenes et al
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jabri, Allan, van Steenkiste, Sjoerd, Hoogeboom, Emiel, Sajjadi, Mehdi S. M., Kipf, Thomas |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DyST: Towards Dynamic Neural Scene Representations on Real-World Videos
par: Seitzer, Maximilian, et autres
Publié: (2023)
par: Seitzer, Maximilian, et autres
Publié: (2023)
Neural USD: An object-centric framework for iterative editing and control
par: Escontrela, Alejandro, et autres
Publié: (2025)
par: Escontrela, Alejandro, et autres
Publié: (2025)
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2024)
par: Wu, Ziyi, et autres
Publié: (2024)
Moving Off-the-Grid: Scene-Grounded Video Representations
par: van Steenkiste, Sjoerd, et autres
Publié: (2024)
par: van Steenkiste, Sjoerd, et autres
Publié: (2024)
Conditional Diffusion on Web-Scale Image Pairs leads to Diverse Image Variations
par: Kumar, Manoj, et autres
Publié: (2024)
par: Kumar, Manoj, et autres
Publié: (2024)
Multistep Distillation of Diffusion Models via Moment Matching
par: Salimans, Tim, et autres
Publié: (2024)
par: Salimans, Tim, et autres
Publié: (2024)
Blurring Diffusion Models
par: Hoogeboom, Emiel, et autres
Publié: (2022)
par: Hoogeboom, Emiel, et autres
Publié: (2022)
From Image to Video: An Empirical Study of Diffusion Representations
par: Vélez, Pedro, et autres
Publié: (2025)
par: Vélez, Pedro, et autres
Publié: (2025)
Scaling 4D Representations
par: Carreira, João, et autres
Publié: (2024)
par: Carreira, João, et autres
Publié: (2024)
Model Integrity when Unlearning with T2I Diffusion Models
par: Schioppa, Andrea, et autres
Publié: (2024)
par: Schioppa, Andrea, et autres
Publié: (2024)
EvObj: Learning Evolving Object-centric Representations for 3D Instance Segmentation without Scene Supervision
par: Chen, Jiahao, et autres
Publié: (2026)
par: Chen, Jiahao, et autres
Publié: (2026)
Learning Physical Dynamics for Object-centric Visual Prediction
par: Xu, Huilin, et autres
Publié: (2024)
par: Xu, Huilin, et autres
Publié: (2024)
Object-centric Binding in Contrastive Language-Image Pretraining
par: Assouel, Rim, et autres
Publié: (2025)
par: Assouel, Rim, et autres
Publié: (2025)
Direct Motion Models for Assessing Generated Videos
par: Allen, Kelsey, et autres
Publié: (2025)
par: Allen, Kelsey, et autres
Publié: (2025)
Benchmarking Vision Language Models for Cultural Understanding
par: Nayak, Shravan, et autres
Publié: (2024)
par: Nayak, Shravan, et autres
Publié: (2024)
CulturalFrames: Assessing Cultural Expectation Alignment in Text-to-Image Models and Evaluation Metrics
par: Nayak, Shravan, et autres
Publié: (2025)
par: Nayak, Shravan, et autres
Publié: (2025)
SceneCraft: An LLM Agent for Synthesizing 3D Scene as Blender Code
par: Hu, Ziniu, et autres
Publié: (2024)
par: Hu, Ziniu, et autres
Publié: (2024)
Beyond Single Tokens: Distilling Discrete Diffusion Models via Discrete MMD
par: Hoogeboom, Emiel, et autres
Publié: (2026)
par: Hoogeboom, Emiel, et autres
Publié: (2026)
Successes and Limitations of Object-centric Models at Compositional Generalisation
par: Montero, Milton L., et autres
Publié: (2024)
par: Montero, Milton L., et autres
Publié: (2024)
Multistep Consistency Models
par: Heek, Jonathan, et autres
Publié: (2024)
par: Heek, Jonathan, et autres
Publié: (2024)
UNO: Unifying One-stage Video Scene Graph Generation via Object-Centric Visual Representation Learning
par: Le, Huy, et autres
Publié: (2025)
par: Le, Huy, et autres
Publié: (2025)
InsertAnywhere: Bridging 4D Scene Geometry and Diffusion Models for Realistic Video Object Insertion
par: Jin, Hoiyeong, et autres
Publié: (2025)
par: Jin, Hoiyeong, et autres
Publié: (2025)
Weakly Supervised Concept Learning for Object-centric Visual Reasoning
par: Tiwari, Sparsh, et autres
Publié: (2026)
par: Tiwari, Sparsh, et autres
Publié: (2026)
SlotPi: Physics-informed Object-centric Reasoning Models
par: Li, Jian, et autres
Publié: (2025)
par: Li, Jian, et autres
Publié: (2025)
SceneAdapt: Scene-aware Adaptation of Human Motion Diffusion
par: Cho, Jungbin, et autres
Publié: (2025)
par: Cho, Jungbin, et autres
Publié: (2025)
Unified Latents (UL): How to train your latents
par: Heek, Jonathan, et autres
Publié: (2026)
par: Heek, Jonathan, et autres
Publié: (2026)
BetterScene: 3D Scene Synthesis with Representation-Aligned Generative Model
par: Han, Yuci, et autres
Publié: (2026)
par: Han, Yuci, et autres
Publié: (2026)
HetScene: Heterogeneity-Aware Diffusion for Dense Indoor Scene Generation
par: Chen, Zini, et autres
Publié: (2026)
par: Chen, Zini, et autres
Publié: (2026)
BeyondScene: Higher-Resolution Human-Centric Scene Generation With Pretrained Diffusion
par: Kim, Gwanghyun, et autres
Publié: (2024)
par: Kim, Gwanghyun, et autres
Publié: (2024)
Edge-case Synthesis for Fisheye Object Detection: A Data-centric Perspective
par: Kim, Seunghyeon, et autres
Publié: (2025)
par: Kim, Seunghyeon, et autres
Publié: (2025)
DOCTR: Disentangled Object-Centric Transformer for Point Scene Understanding
par: Yu, Xiaoxuan, et autres
Publié: (2024)
par: Yu, Xiaoxuan, et autres
Publié: (2024)
Ref-AVS: Refer and Segment Objects in Audio-Visual Scenes
par: Wang, Yaoting, et autres
Publié: (2024)
par: Wang, Yaoting, et autres
Publié: (2024)
SlotMatch: Distilling Object-Centric Representations for Unsupervised Video Segmentation
par: Grigore, Diana-Nicoleta, et autres
Publié: (2025)
par: Grigore, Diana-Nicoleta, et autres
Publié: (2025)
PEFT-DML: Parameter-Efficient Fine-Tuning Deep Metric Learning for Robust Multi-Modal 3D Object Detection in Autonomous Driving
par: Rezaei, Abdolazim, et autres
Publié: (2025)
par: Rezaei, Abdolazim, et autres
Publié: (2025)
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
par: Ke, Tsung-Wei, et autres
Publié: (2024)
par: Ke, Tsung-Wei, et autres
Publié: (2024)
Shape2Scene: 3D Scene Representation Learning Through Pre-training on Shape Data
par: Feng, Tuo, et autres
Publié: (2024)
par: Feng, Tuo, et autres
Publié: (2024)
InteractMove: Text-Controlled Human-Object Interaction Generation in 3D Scenes with Movable Objects
par: Cai, Xinhao, et autres
Publié: (2025)
par: Cai, Xinhao, et autres
Publié: (2025)
Dual-Rate Diffusion: Accelerating diffusion models with an interleaved heavy-light network
par: Bartosh, Grigory, et autres
Publié: (2026)
par: Bartosh, Grigory, et autres
Publié: (2026)
How to Spin an Object: First, Get the Shape Right
par: Kabra, Rishabh, et autres
Publié: (2024)
par: Kabra, Rishabh, et autres
Publié: (2024)
HexPlane Representation for 3D Semantic Scene Understanding
par: Chen, Zeren, et autres
Publié: (2025)
par: Chen, Zeren, et autres
Publié: (2025)
Documents similaires
-
DyST: Towards Dynamic Neural Scene Representations on Real-World Videos
par: Seitzer, Maximilian, et autres
Publié: (2023) -
Neural USD: An object-centric framework for iterative editing and control
par: Escontrela, Alejandro, et autres
Publié: (2025) -
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2024) -
Moving Off-the-Grid: Scene-Grounded Video Representations
par: van Steenkiste, Sjoerd, et autres
Publié: (2024) -
Conditional Diffusion on Web-Scale Image Pairs leads to Diverse Image Variations
par: Kumar, Manoj, et autres
Publié: (2024)