Generative Learning of Differentiable Object Models for Compositional Interpretation of Complex Scenes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nowinowski, Antoni, Krawiec, Krzysztof |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Disentangling Visual Priors: Unsupervised Learning of Scene Interpretations with Compositional Autoencoder
par: Krawiec, Krzysztof, et autres
Publié: (2024)
par: Krawiec, Krzysztof, et autres
Publié: (2024)
Improving Generative Adversarial Networks with Self-Distillation
par: Nowinowski, Antoni, et autres
Publié: (2026)
par: Nowinowski, Antoni, et autres
Publié: (2026)
Modeling Retinal Ganglion Cells with Neural Differential Equations
par: Dobek, Kacper, et autres
Publié: (2025)
par: Dobek, Kacper, et autres
Publié: (2025)
Structure over Pixels: Learning Variable-Length Visual Programs
par: Wyrwiński, Piotr, et autres
Publié: (2026)
par: Wyrwiński, Piotr, et autres
Publié: (2026)
Density-based Object Detection in Crowded Scenes
par: Zhao, Chenyang, et autres
Publié: (2025)
par: Zhao, Chenyang, et autres
Publié: (2025)
Scene Graph Disentanglement and Composition for Generalizable Complex Image Generation
par: Wang, Yunnan, et autres
Publié: (2024)
par: Wang, Yunnan, et autres
Publié: (2024)
Pair2Scene: Learning Local Object Relations for Procedural Scene Generation
par: Ran, Xingjian, et autres
Publié: (2026)
par: Ran, Xingjian, et autres
Publié: (2026)
Scene-Conditional 3D Object Stylization and Composition
par: Zhou, Jinghao, et autres
Publié: (2023)
par: Zhou, Jinghao, et autres
Publié: (2023)
Compositional Scene Understanding through Inverse Generative Modeling
par: Wang, Yanbo, et autres
Publié: (2025)
par: Wang, Yanbo, et autres
Publié: (2025)
MOS: Modeling Object-Scene Associations in Generalized Category Discovery
par: Peng, Zhengyuan, et autres
Publié: (2025)
par: Peng, Zhengyuan, et autres
Publié: (2025)
Object Style Diffusion for Generalized Object Detection in Urban Scene
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
Improving Computer Vision Interpretability: Transparent Two-level Classification for Complex Scenes
par: Scholz, Stefan, et autres
Publié: (2024)
par: Scholz, Stefan, et autres
Publié: (2024)
Draw Like an Artist: Complex Scene Generation with Diffusion Model via Composition, Painting, and Retouching
par: Liu, Minghao, et autres
Publié: (2024)
par: Liu, Minghao, et autres
Publié: (2024)
IMPRINT: Generative Object Compositing by Learning Identity-Preserving Representation
par: Song, Yizhi, et autres
Publié: (2024)
par: Song, Yizhi, et autres
Publié: (2024)
HOSIG: Full-Body Human-Object-Scene Interaction Generation with Hierarchical Scene Perception
par: Yao, Wei, et autres
Publié: (2025)
par: Yao, Wei, et autres
Publié: (2025)
Toward Scene Graph and Layout Guided Complex 3D Scene Generation
par: Huang, Yu-Hsiang, et autres
Publié: (2024)
par: Huang, Yu-Hsiang, et autres
Publié: (2024)
Learning Abstract Visual Reasoning via Task Decomposition: A Case Study in Raven Progressive Matrices
par: Kwiatkowski, Jakub, et autres
Publié: (2023)
par: Kwiatkowski, Jakub, et autres
Publié: (2023)
Compositional Feature Augmentation for Unbiased Scene Graph Generation
par: Li, Lin, et autres
Publié: (2023)
par: Li, Lin, et autres
Publié: (2023)
SceneLinker: Compositional 3D Scene Generation via Semantic Scene Graph from RGB Sequences
par: Kim, Seok-Young, et autres
Publié: (2026)
par: Kim, Seok-Young, et autres
Publié: (2026)
MOSEv2: A More Challenging Dataset for Video Object Segmentation in Complex Scenes
par: Ding, Henghui, et autres
Publié: (2025)
par: Ding, Henghui, et autres
Publié: (2025)
DreamScene4D: Dynamic Multi-Object Scene Generation from Monocular Videos
par: Chu, Wen-Hsuan, et autres
Publié: (2024)
par: Chu, Wen-Hsuan, et autres
Publié: (2024)
Slot-VAE: Object-Centric Scene Generation with Slot Attention
par: Wang, Yanbo, et autres
Publié: (2023)
par: Wang, Yanbo, et autres
Publié: (2023)
Chat-Scene: Bridging 3D Scene and Large Language Models with Object Identifiers
par: Huang, Haifeng, et autres
Publié: (2023)
par: Huang, Haifeng, et autres
Publié: (2023)
Evaluating Compositional Scene Understanding in Multimodal Generative Models
par: Fu, Shuhao, et autres
Publié: (2025)
par: Fu, Shuhao, et autres
Publié: (2025)
ComGS: Efficient 3D Object-Scene Composition via Surface Octahedral Probes
par: Gao, Jian, et autres
Publié: (2025)
par: Gao, Jian, et autres
Publié: (2025)
Camera-Only 3D Panoptic Scene Completion for Autonomous Driving through Differentiable Object Shapes
par: Marinello, Nicola, et autres
Publié: (2025)
par: Marinello, Nicola, et autres
Publié: (2025)
SocialTrack: Multi-Object Tracking in Complex Urban Traffic Scenes Inspired by Social Behavior
par: Tao, Wenguang, et autres
Publié: (2025)
par: Tao, Wenguang, et autres
Publié: (2025)
Object-level Scene Deocclusion
par: Liu, Zhengzhe, et autres
Publié: (2024)
par: Liu, Zhengzhe, et autres
Publié: (2024)
Scene Generation at Absolute Scale: Utilizing Semantic and Geometric Guidance From Text for Accurate and Interpretable 3D Indoor Scene Generation
par: Ainetter, Stefan, et autres
Publié: (2026)
par: Ainetter, Stefan, et autres
Publié: (2026)
SCORP: Scene-Consistent Object Refinement via Proxy Generation and Tuning
par: Chen, Ziwei, et autres
Publié: (2025)
par: Chen, Ziwei, et autres
Publié: (2025)
Leveraging Image Augmentation for Object Manipulation: Towards Interpretable Controllability in Object-Centric Learning
par: Kim, Jinwoo, et autres
Publié: (2023)
par: Kim, Jinwoo, et autres
Publié: (2023)
TOPIC: A Parallel Association Paradigm for Multi-Object Tracking under Complex Motions and Diverse Scenes
par: Cao, Xiaoyan, et autres
Publié: (2023)
par: Cao, Xiaoyan, et autres
Publié: (2023)
GEM: A Generalizable Ego-Vision Multimodal World Model for Fine-Grained Ego-Motion, Object Dynamics, and Scene Composition Control
par: Hassan, Mariam, et autres
Publié: (2024)
par: Hassan, Mariam, et autres
Publié: (2024)
RoamScene3D: Immersive Text-to-3D Scene Generation via Adaptive Object-aware Roaming
par: Chu, Jisheng, et autres
Publié: (2026)
par: Chu, Jisheng, et autres
Publié: (2026)
Generative 4D Scene Gaussian Splatting with Object View-Synthesis Priors
par: Chu, Wen-Hsuan, et autres
Publié: (2025)
par: Chu, Wen-Hsuan, et autres
Publié: (2025)
Frame-Level Captions for Long Video Generation with Complex Multi Scenes
par: Zheng, Guangcong, et autres
Publié: (2025)
par: Zheng, Guangcong, et autres
Publié: (2025)
YOLO-Count: Differentiable Object Counting for Text-to-Image Generation
par: Zeng, Guanning, et autres
Publié: (2025)
par: Zeng, Guanning, et autres
Publié: (2025)
Controllable 3D Placement of Objects with Scene-Aware Diffusion Models
par: Omran, Mohamed, et autres
Publié: (2025)
par: Omran, Mohamed, et autres
Publié: (2025)
Scene-Aware Location Modeling for Data Augmentation in Automotive Object Detection
par: Petersen, Jens, et autres
Publié: (2025)
par: Petersen, Jens, et autres
Publié: (2025)
On the Potential of Open-Vocabulary Models for Object Detection in Unusual Street Scenes
par: Ilyas, Sadia, et autres
Publié: (2024)
par: Ilyas, Sadia, et autres
Publié: (2024)
Documents similaires
-
Disentangling Visual Priors: Unsupervised Learning of Scene Interpretations with Compositional Autoencoder
par: Krawiec, Krzysztof, et autres
Publié: (2024) -
Improving Generative Adversarial Networks with Self-Distillation
par: Nowinowski, Antoni, et autres
Publié: (2026) -
Modeling Retinal Ganglion Cells with Neural Differential Equations
par: Dobek, Kacper, et autres
Publié: (2025) -
Structure over Pixels: Learning Variable-Length Visual Programs
par: Wyrwiński, Piotr, et autres
Publié: (2026) -
Density-based Object Detection in Crowded Scenes
par: Zhao, Chenyang, et autres
Publié: (2025)