Spatial Reasoning with Denoising Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wewer, Christopher, Pogodzinski, Bart, Schiele, Bernt, Lenssen, Jan Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Spatial Reasoners for Continuous Variables in Any Domain
par: Pogodzinski, Bart, et autres
Publié: (2025)
par: Pogodzinski, Bart, et autres
Publié: (2025)
MEt3R: Measuring Multi-View Consistency in Generated Images
par: Asim, Mohammad, et autres
Publié: (2025)
par: Asim, Mohammad, et autres
Publié: (2025)
SimNP: Learning Self-Similarity Priors Between Neural Points
par: Wewer, Christopher, et autres
Publié: (2023)
par: Wewer, Christopher, et autres
Publié: (2023)
Sp2360: Sparse-view 360 Scene Reconstruction using Cascaded 2D Diffusion Priors
par: Paul, Soumava, et autres
Publié: (2024)
par: Paul, Soumava, et autres
Publié: (2024)
MixFlow: Mixed Source Distributions Improve Rectified Flows
par: Nayal, Nazir, et autres
Publié: (2026)
par: Nayal, Nazir, et autres
Publié: (2026)
latentSplat: Autoencoding Variational Gaussians for Fast Generalizable 3D Reconstruction
par: Wewer, Christopher, et autres
Publié: (2024)
par: Wewer, Christopher, et autres
Publié: (2024)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
par: Asim, Mohammad, et autres
Publié: (2026)
par: Asim, Mohammad, et autres
Publié: (2026)
AnyUp: Universal Feature Upsampling
par: Wimmer, Thomas, et autres
Publié: (2025)
par: Wimmer, Thomas, et autres
Publié: (2025)
PersonaHOI: Effortlessly Improving Personalized Face with Human-Object Interaction Generation
par: Hu, Xinting, et autres
Publié: (2025)
par: Hu, Xinting, et autres
Publié: (2025)
Optimising for Interpretability: Convolutional Dynamic Alignment Networks
par: Böhle, Moritz, et autres
Publié: (2021)
par: Böhle, Moritz, et autres
Publié: (2021)
Towards Better Understanding Attribution Methods
par: Rao, Sukrut, et autres
Publié: (2022)
par: Rao, Sukrut, et autres
Publié: (2022)
Rewis3d: Reconstruction Improves Weakly-Supervised Semantic Segmentation
par: Ernst, Jonas, et autres
Publié: (2026)
par: Ernst, Jonas, et autres
Publié: (2026)
Scribbles for All: Benchmarking Scribble Supervised Segmentation Across Datasets
par: Boettcher, Wolfgang, et autres
Publié: (2024)
par: Boettcher, Wolfgang, et autres
Publié: (2024)
Adaptive Hierarchical Certification for Segmentation using Randomized Smoothing
par: Anani, Alaa, et autres
Publié: (2024)
par: Anani, Alaa, et autres
Publié: (2024)
Better Understanding Differences in Attribution Methods via Systematic Evaluations
par: Rao, Sukrut, et autres
Publié: (2023)
par: Rao, Sukrut, et autres
Publié: (2023)
Adversarial Training against Location-Optimized Adversarial Patches
par: Rao, Sukrut, et autres
Publié: (2020)
par: Rao, Sukrut, et autres
Publié: (2020)
Beyond Accuracy: What Matters in Designing Well-Behaved Image Classification Models?
par: Hesse, Robin, et autres
Publié: (2025)
par: Hesse, Robin, et autres
Publié: (2025)
SemanticNVS: Improving Semantic Scene Understanding in Generative Novel View Synthesis
par: Chen, Xinya, et autres
Publié: (2026)
par: Chen, Xinya, et autres
Publié: (2026)
Neural Parametric Gaussians for Monocular Non-Rigid Object Reconstruction
par: Das, Devikalyan, et autres
Publié: (2023)
par: Das, Devikalyan, et autres
Publié: (2023)
Spurfies: Sparse Surface Reconstruction using Local Geometry Priors
par: Raj, Kevin, et autres
Publié: (2024)
par: Raj, Kevin, et autres
Publié: (2024)
Neural Point Cloud Diffusion for Disentangled 3D Shape and Appearance Generation
par: Schröppel, Philipp, et autres
Publié: (2023)
par: Schröppel, Philipp, et autres
Publié: (2023)
Test-Time Visual In-Context Tuning
par: Xie, Jiahao, et autres
Publié: (2025)
par: Xie, Jiahao, et autres
Publié: (2025)
Studying How to Efficiently and Effectively Guide Models with Explanations
par: Rao, Sukrut, et autres
Publié: (2023)
par: Rao, Sukrut, et autres
Publié: (2023)
What is Missing? Explaining Neurons Activated by Absent Concepts
par: Hesse, Robin, et autres
Publié: (2026)
par: Hesse, Robin, et autres
Publié: (2026)
Interpretability Without Tradeoffs: Disentangling Polysemanticity At Equal Predictive Performance
par: Bağcı, Doğukan, et autres
Publié: (2026)
par: Bağcı, Doğukan, et autres
Publié: (2026)
Pixel-level Certified Explanations via Randomized Smoothing
par: Anani, Alaa, et autres
Publié: (2025)
par: Anani, Alaa, et autres
Publié: (2025)
B-cosification: Transforming Deep Neural Networks to be Inherently Interpretable
par: Arya, Shreyash, et autres
Publié: (2024)
par: Arya, Shreyash, et autres
Publié: (2024)
Discover-then-Name: Task-Agnostic Concept Bottlenecks via Automated Concept Discovery
par: Rao, Sukrut, et autres
Publié: (2024)
par: Rao, Sukrut, et autres
Publié: (2024)
CFM: Language-aligned Concept Foundation Model for Vision
par: Wittenmayer, Kai, et autres
Publié: (2026)
par: Wittenmayer, Kai, et autres
Publié: (2026)
FaCT: Faithful Concept Traces for Explaining Neural Network Decisions
par: Parchami-Araghi, Amin, et autres
Publié: (2025)
par: Parchami-Araghi, Amin, et autres
Publié: (2025)
Good Teachers Explain: Explanation-Enhanced Knowledge Distillation
par: Parchami-Araghi, Amin, et autres
Publié: (2024)
par: Parchami-Araghi, Amin, et autres
Publié: (2024)
Solving Inverse Problems with FLAIR
par: Erbach, Julius, et autres
Publié: (2025)
par: Erbach, Julius, et autres
Publié: (2025)
RefAM: Attention Magnets for Zero-Shot Referral Segmentation
par: Kukleva, Anna, et autres
Publié: (2025)
par: Kukleva, Anna, et autres
Publié: (2025)
ELODI: Ensemble Logit Difference Inhibition for Positive-Congruent Training
par: Zhao, Yue, et autres
Publié: (2022)
par: Zhao, Yue, et autres
Publié: (2022)
Denoising-GS: Gaussian Splatting with Spatial-aware Denoising
par: Zhou, Qingyuan, et autres
Publié: (2026)
par: Zhou, Qingyuan, et autres
Publié: (2026)
PARCEL: Pool-Anchored Resampling with Conditioned Elastic Queries for Efficient Vision-Language Understanding
par: Kuzucu, Selim, et autres
Publié: (2026)
par: Kuzucu, Selim, et autres
Publié: (2026)
The Dual Mechanisms of Spatial Reasoning in Vision-Language Models
par: Cui, Kelly, et autres
Publié: (2026)
par: Cui, Kelly, et autres
Publié: (2026)
DAVE: Distribution-aware Attribution via ViT Gradient Decomposition
par: Wróbel, Adam, et autres
Publié: (2026)
par: Wróbel, Adam, et autres
Publié: (2026)
Residual Denoising Diffusion Models
par: Liu, Jiawei, et autres
Publié: (2023)
par: Liu, Jiawei, et autres
Publié: (2023)
An Embarrassingly Simple Baseline for Imbalanced Semi-Supervised Learning
par: Chen, Hao, et autres
Publié: (2022)
par: Chen, Hao, et autres
Publié: (2022)
Documents similaires
-
Spatial Reasoners for Continuous Variables in Any Domain
par: Pogodzinski, Bart, et autres
Publié: (2025) -
MEt3R: Measuring Multi-View Consistency in Generated Images
par: Asim, Mohammad, et autres
Publié: (2025) -
SimNP: Learning Self-Similarity Priors Between Neural Points
par: Wewer, Christopher, et autres
Publié: (2023) -
Sp2360: Sparse-view 360 Scene Reconstruction using Cascaded 2D Diffusion Priors
par: Paul, Soumava, et autres
Publié: (2024) -
MixFlow: Mixed Source Distributions Improve Rectified Flows
par: Nayal, Nazir, et autres
Publié: (2026)