Geometry Fidelity for Spherical Images
Fuente:
arXiv
Guardado en:
| Autores principales: | Christensen, Anders, Mojab, Nooshin, Patel, Khushman, Ahuja, Karan, Akata, Zeynep, Winther, Ole, Gonzalez-Franco, Mar, Colaco, Andrea |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DiffEnc: Variational Diffusion with a Learned Encoder
por: Nielsen, Beatrix M. G., et al.
Publicado: (2023)
por: Nielsen, Beatrix M. G., et al.
Publicado: (2023)
SurfaceXR: Fusing Smartwatch IMUs and Egocentric Hand Pose for Seamless Surface Interactions
por: Xu, Vasco, et al.
Publicado: (2026)
por: Xu, Vasco, et al.
Publicado: (2026)
Sparse Autoencoders are Topic Models
por: Girrbach, Leander, et al.
Publicado: (2025)
por: Girrbach, Leander, et al.
Publicado: (2025)
VGGRPO: Towards World-Consistent Video Generation with 4D Latent Reward
por: An, Zhaochong, et al.
Publicado: (2026)
por: An, Zhaochong, et al.
Publicado: (2026)
Explaining CLIP Zero-shot Predictions Through Concepts
por: Ozdemir, Onat, et al.
Publicado: (2026)
por: Ozdemir, Onat, et al.
Publicado: (2026)
DeLoRA: Decoupling Angles and Strength in Low-rank Adaptation
por: Bini, Massimo, et al.
Publicado: (2025)
por: Bini, Massimo, et al.
Publicado: (2025)
From Drop-off to Recovery: A Mechanistic Analysis of Segmentation in MLLMs
por: Wu, Boyong, et al.
Publicado: (2026)
por: Wu, Boyong, et al.
Publicado: (2026)
The Manifold Hypothesis for Gradient-Based Explanations
por: Bordt, Sebastian, et al.
Publicado: (2022)
por: Bordt, Sebastian, et al.
Publicado: (2022)
Diffuse, Attend, and Segment: Unsupervised Zero-Shot Segmentation using Stable Diffusion
por: Tian, Junjiao, et al.
Publicado: (2023)
por: Tian, Junjiao, et al.
Publicado: (2023)
Noise Hypernetworks: Amortizing Test-Time Compute in Diffusion Models
por: Eyring, Luca, et al.
Publicado: (2025)
por: Eyring, Luca, et al.
Publicado: (2025)
SUB: Benchmarking CBM Generalization via Synthetic Attribute Substitutions
por: Bader, Jessica, et al.
Publicado: (2025)
por: Bader, Jessica, et al.
Publicado: (2025)
ETHER: Efficient Finetuning of Large-Scale Models with Hyperplane Reflections
por: Bini, Massimo, et al.
Publicado: (2024)
por: Bini, Massimo, et al.
Publicado: (2024)
Vision-by-Language for Training-Free Compositional Image Retrieval
por: Karthik, Shyamgopal, et al.
Publicado: (2023)
por: Karthik, Shyamgopal, et al.
Publicado: (2023)
Vision Transformers Exhibit Human-Like Biases: Evidence of Orientation and Color Selectivity, Categorical Perception, and Phase Transitions
por: Bahador, Nooshin
Publicado: (2025)
por: Bahador, Nooshin
Publicado: (2025)
Reflecting on the State of Rehearsal-free Continual Learning with Pretrained Models
por: Thede, Lukas, et al.
Publicado: (2024)
por: Thede, Lukas, et al.
Publicado: (2024)
DataDream: Few-shot Guided Dataset Generation
por: Kim, Jae Myung, et al.
Publicado: (2024)
por: Kim, Jae Myung, et al.
Publicado: (2024)
Practical and Rich User Digitization
por: Ahuja, Karan
Publicado: (2024)
por: Ahuja, Karan
Publicado: (2024)
Improving Intervention Efficacy via Concept Realignment in Concept Bottleneck Models
por: Singhi, Nishad, et al.
Publicado: (2024)
por: Singhi, Nishad, et al.
Publicado: (2024)
Disentangled Representation Learning with the Gromov-Monge Gap
por: Uscidda, Théo, et al.
Publicado: (2024)
por: Uscidda, Théo, et al.
Publicado: (2024)
Time Series Representations for Classification Lie Hidden in Pretrained Vision Transformers
por: Roschmann, Simon, et al.
Publicado: (2025)
por: Roschmann, Simon, et al.
Publicado: (2025)
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
por: Pach, Mateusz, et al.
Publicado: (2025)
por: Pach, Mateusz, et al.
Publicado: (2025)
The Latent Color Subspace: Emergent Order in High-Dimensional Chaos
por: Pach, Mateusz, et al.
Publicado: (2026)
por: Pach, Mateusz, et al.
Publicado: (2026)
Fantastic Gains and Where to Find Them: On the Existence and Prospect of General Knowledge Transfer between Any Pretrained Model
por: Roth, Karsten, et al.
Publicado: (2023)
por: Roth, Karsten, et al.
Publicado: (2023)
A Large Scale Analysis of Gender Biases in Text-to-Image Generative Models
por: Girrbach, Leander, et al.
Publicado: (2025)
por: Girrbach, Leander, et al.
Publicado: (2025)
ReNO: Enhancing One-step Text-to-Image Models through Reward-based Noise Optimization
por: Eyring, Luca, et al.
Publicado: (2024)
por: Eyring, Luca, et al.
Publicado: (2024)
Context-Aware Multimodal Pretraining
por: Roth, Karsten, et al.
Publicado: (2024)
por: Roth, Karsten, et al.
Publicado: (2024)
Stitch: Training-Free Position Control in Multimodal Diffusion Transformers
por: Bader, Jessica, et al.
Publicado: (2025)
por: Bader, Jessica, et al.
Publicado: (2025)
Fast Sphericity and Roundness approximation in 2D and 3D using Local Thickness
por: Pieta, Pawel Tomasz, et al.
Publicado: (2025)
por: Pieta, Pawel Tomasz, et al.
Publicado: (2025)
Concept-Guided Interpretability via Neural Chunking
por: Wu, Shuchen, et al.
Publicado: (2025)
por: Wu, Shuchen, et al.
Publicado: (2025)
MemLoRA: Distilling Expert Adapters for On-Device Memory Systems
por: Bini, Massimo, et al.
Publicado: (2025)
por: Bini, Massimo, et al.
Publicado: (2025)
Scalable Ranked Preference Optimization for Text-to-Image Generation
por: Karthik, Shyamgopal, et al.
Publicado: (2024)
por: Karthik, Shyamgopal, et al.
Publicado: (2024)
Post-hoc Probabilistic Vision-Language Models
por: Baumann, Anton, et al.
Publicado: (2024)
por: Baumann, Anton, et al.
Publicado: (2024)
Person-Centric Annotations of LAION-400M: Auditing Bias and Its Transfer to Models
por: Girrbach, Leander, et al.
Publicado: (2025)
por: Girrbach, Leander, et al.
Publicado: (2025)
EgoCVR: An Egocentric Benchmark for Fine-Grained Composed Video Retrieval
por: Hummel, Thomas, et al.
Publicado: (2024)
por: Hummel, Thomas, et al.
Publicado: (2024)
LoFT: LoRA-fused Training Dataset Generation with Few-shot Guidance
por: Kim, Jae Myung, et al.
Publicado: (2025)
por: Kim, Jae Myung, et al.
Publicado: (2025)
COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training
por: Kim, Sanghwan, et al.
Publicado: (2024)
por: Kim, Sanghwan, et al.
Publicado: (2024)
How to Merge Your Multimodal Models Over Time?
por: Dziadzio, Sebastian, et al.
Publicado: (2024)
por: Dziadzio, Sebastian, et al.
Publicado: (2024)
Unbalancedness in Neural Monge Maps Improves Unpaired Domain Translation
por: Eyring, Luca, et al.
Publicado: (2023)
por: Eyring, Luca, et al.
Publicado: (2023)
FLAIR: VLM with Fine-grained Language-informed Image Representations
por: Xiao, Rui, et al.
Publicado: (2024)
por: Xiao, Rui, et al.
Publicado: (2024)
SphereDrag: Spherical Geometry-Aware Panoramic Image Editing
por: Feng, Zhiao, et al.
Publicado: (2025)
por: Feng, Zhiao, et al.
Publicado: (2025)
Ejemplares similares
-
DiffEnc: Variational Diffusion with a Learned Encoder
por: Nielsen, Beatrix M. G., et al.
Publicado: (2023) -
SurfaceXR: Fusing Smartwatch IMUs and Egocentric Hand Pose for Seamless Surface Interactions
por: Xu, Vasco, et al.
Publicado: (2026) -
Sparse Autoencoders are Topic Models
por: Girrbach, Leander, et al.
Publicado: (2025) -
VGGRPO: Towards World-Consistent Video Generation with 4D Latent Reward
por: An, Zhaochong, et al.
Publicado: (2026) -
Explaining CLIP Zero-shot Predictions Through Concepts
por: Ozdemir, Onat, et al.
Publicado: (2026)