Coarse-To-Fine Tensor Trains for Compact Visual Representations
Fuente:
arXiv
Salvato in:
| Autori principali: | Loeschcke, Sebastian, Wang, Dan, Leth-Espensen, Christian, Belongie, Serge, Kastoryano, Michael J., Benaim, Sagie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Assessing Neural Network Robustness via Adversarial Pivotal Tuning
di: Christensen, Peter Ebert, et al.
Pubblicazione: (2022)
di: Christensen, Peter Ebert, et al.
Pubblicazione: (2022)
Designing a Conditional Prior Distribution for Flow-Based Generative Models
di: Issachar, Noam, et al.
Pubblicazione: (2025)
di: Issachar, Noam, et al.
Pubblicazione: (2025)
LoQT: Low-Rank Adapters for Quantized Pretraining
di: Loeschcke, Sebastian, et al.
Pubblicazione: (2024)
di: Loeschcke, Sebastian, et al.
Pubblicazione: (2024)
Generating Intermediate Representations for Compositional Text-To-Image Generation
di: Galun, Ran, et al.
Pubblicazione: (2024)
di: Galun, Ran, et al.
Pubblicazione: (2024)
LaMI: Augmenting Large Language Models via Late Multi-Image Fusion
di: Yariv, Guy, et al.
Pubblicazione: (2024)
di: Yariv, Guy, et al.
Pubblicazione: (2024)
RAD: Retrieval-Augmented Monocular Metric Depth Estimation for Underrepresented Classes
di: Baltaxe, Michael, et al.
Pubblicazione: (2026)
di: Baltaxe, Michael, et al.
Pubblicazione: (2026)
Familiarity-Based Open-Set Recognition Under Adversarial Attacks
di: Enevoldsen, Philip, et al.
Pubblicazione: (2023)
di: Enevoldsen, Philip, et al.
Pubblicazione: (2023)
RAIGen: Rare Attribute Identification in Text-to-Image Generative Models
di: Sreelatha, Silpa Vadakkeeveetil, et al.
Pubblicazione: (2026)
di: Sreelatha, Silpa Vadakkeeveetil, et al.
Pubblicazione: (2026)
MMEarth: Exploring Multi-Modal Pretext Tasks For Geospatial Representation Learning
di: Nedungadi, Vishal, et al.
Pubblicazione: (2024)
di: Nedungadi, Vishal, et al.
Pubblicazione: (2024)
Discriminative Class Tokens for Text-to-Image Diffusion Models
di: Schwartz, Idan, et al.
Pubblicazione: (2023)
di: Schwartz, Idan, et al.
Pubblicazione: (2023)
Stitch: Training-Free Position Control in Multimodal Diffusion Transformers
di: Bader, Jessica, et al.
Pubblicazione: (2025)
di: Bader, Jessica, et al.
Pubblicazione: (2025)
Unlearning-based Neural Interpretations
di: Choi, Ching Lam, et al.
Pubblicazione: (2024)
di: Choi, Ching Lam, et al.
Pubblicazione: (2024)
RespoDiff: Dual-Module Bottleneck Transformation for Responsible & Faithful T2I Generation
di: Sreelatha, Silpa Vadakkeeveetil, et al.
Pubblicazione: (2025)
di: Sreelatha, Silpa Vadakkeeveetil, et al.
Pubblicazione: (2025)
From Semantics to Pixels: Coarse-to-Fine Masked Autoencoders for Hierarchical Visual Understanding
di: Xiang, Wenzhao, et al.
Pubblicazione: (2026)
di: Xiang, Wenzhao, et al.
Pubblicazione: (2026)
Beyond Binary Success: A Diagnostic Meta-Evaluation Framework for Fine-Grained Manipulation
di: Xu, He-Yang, et al.
Pubblicazione: (2026)
di: Xu, He-Yang, et al.
Pubblicazione: (2026)
Colored Noise Diffusion Sampling
di: Davidson, Hadar, et al.
Pubblicazione: (2026)
di: Davidson, Hadar, et al.
Pubblicazione: (2026)
RewardSDS: Aligning Score Distillation via Reward-Weighted Sampling
di: Chachy, Itay, et al.
Pubblicazione: (2025)
di: Chachy, Itay, et al.
Pubblicazione: (2025)
Spherical Mask: Coarse-to-Fine 3D Point Cloud Instance Segmentation with Spherical Representation
di: Shin, Sangyun, et al.
Pubblicazione: (2023)
di: Shin, Sangyun, et al.
Pubblicazione: (2023)
Sparse Autoencoders Learn Monosemantic Features in Vision-Language Models
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
di: Pach, Mateusz, et al.
Pubblicazione: (2025)
The Latent Color Subspace: Emergent Order in High-Dimensional Chaos
di: Pach, Mateusz, et al.
Pubblicazione: (2026)
di: Pach, Mateusz, et al.
Pubblicazione: (2026)
SemanticMoments: Training-Free Motion Similarity via Third Moment Features
di: Huberman, Saar, et al.
Pubblicazione: (2026)
di: Huberman, Saar, et al.
Pubblicazione: (2026)
Through-The-Mask: Mask-based Motion Trajectories for Image-to-Video Generation
di: Yariv, Guy, et al.
Pubblicazione: (2025)
di: Yariv, Guy, et al.
Pubblicazione: (2025)
PhyGenHOI: Physically-Aware 4D Generation of Dynamic Human-Object Interactions
di: Benishu, Omer, et al.
Pubblicazione: (2026)
di: Benishu, Omer, et al.
Pubblicazione: (2026)
MV-RAG: Retrieval Augmented Multiview Diffusion
di: Dayani, Yosef, et al.
Pubblicazione: (2025)
di: Dayani, Yosef, et al.
Pubblicazione: (2025)
MMEarth-Bench: Global Model Adaptation via Multimodal Test-Time Training
di: Gordon, Lucia, et al.
Pubblicazione: (2026)
di: Gordon, Lucia, et al.
Pubblicazione: (2026)
Boosting Fine-Grained Visual Anomaly Detection with Coarse-Knowledge-Aware Adversarial Learning
di: Fang, Qingqing, et al.
Pubblicazione: (2024)
di: Fang, Qingqing, et al.
Pubblicazione: (2024)
Let it Snow! Animating 3D Gaussian Scenes with Dynamic Weather Effects via Physics-Guided Score Distillation
di: Fiebelman, Gal, et al.
Pubblicazione: (2025)
di: Fiebelman, Gal, et al.
Pubblicazione: (2025)
VideoFlexTok: Flexible-Length Coarse-to-Fine Video Tokenization
di: Atanov, Andrei, et al.
Pubblicazione: (2026)
di: Atanov, Andrei, et al.
Pubblicazione: (2026)
DGD: Dynamic 3D Gaussians Distillation
di: Labe, Isaac, et al.
Pubblicazione: (2024)
di: Labe, Isaac, et al.
Pubblicazione: (2024)
Structurally Disentangled Feature Fields Distillation for 3D Understanding and Editing
di: Levy, Yoel, et al.
Pubblicazione: (2025)
di: Levy, Yoel, et al.
Pubblicazione: (2025)
Explainable Adversarial Attacks on Coarse-to-Fine Classifiers
di: Heidarizadeh, Akram, et al.
Pubblicazione: (2025)
di: Heidarizadeh, Akram, et al.
Pubblicazione: (2025)
Geographical Context Matters: Bridging Fine and Coarse Spatial Information to Enhance Continental Land Cover Mapping
di: Ghassemi, Babak, et al.
Pubblicazione: (2025)
di: Ghassemi, Babak, et al.
Pubblicazione: (2025)
Extracting Symbolic Sequences from Visual Representations via Self-Supervised Learning
di: Pozos, Victor Sebastian Martinez, et al.
Pubblicazione: (2025)
di: Pozos, Victor Sebastian Martinez, et al.
Pubblicazione: (2025)
Hyperbolic Coarse-to-Fine Few-Shot Class-Incremental Learning
di: Dai, Jiaxin, et al.
Pubblicazione: (2025)
di: Dai, Jiaxin, et al.
Pubblicazione: (2025)
Lang3D-XL: Language Embedded 3D Gaussians for Large-scale Scenes
di: Krakovsky, Shai, et al.
Pubblicazione: (2025)
di: Krakovsky, Shai, et al.
Pubblicazione: (2025)
Compositional Adversarial Training for Robust Visual Watermarking
di: Satheesh, Anirudh, et al.
Pubblicazione: (2026)
di: Satheesh, Anirudh, et al.
Pubblicazione: (2026)
Contrastive Learning to Fine-Tune Feature Extraction Models for the Visual Cortex
di: Mulrooney, Alex, et al.
Pubblicazione: (2024)
di: Mulrooney, Alex, et al.
Pubblicazione: (2024)
Robust Data Clustering with Outliers via Transformed Tensor Low-Rank Representation
di: Wu, Tong
Pubblicazione: (2023)
di: Wu, Tong
Pubblicazione: (2023)
PhysConvex: Physics-Informed 3D Dynamic Convex Radiance Fields for Reconstruction and Simulation
di: Wang, Dan, et al.
Pubblicazione: (2026)
di: Wang, Dan, et al.
Pubblicazione: (2026)
CoatFusion: Controllable Material Coating in Images
di: Levy, Sagie, et al.
Pubblicazione: (2025)
di: Levy, Sagie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Assessing Neural Network Robustness via Adversarial Pivotal Tuning
di: Christensen, Peter Ebert, et al.
Pubblicazione: (2022) -
Designing a Conditional Prior Distribution for Flow-Based Generative Models
di: Issachar, Noam, et al.
Pubblicazione: (2025) -
LoQT: Low-Rank Adapters for Quantized Pretraining
di: Loeschcke, Sebastian, et al.
Pubblicazione: (2024) -
Generating Intermediate Representations for Compositional Text-To-Image Generation
di: Galun, Ran, et al.
Pubblicazione: (2024) -
LaMI: Augmenting Large Language Models via Late Multi-Image Fusion
di: Yariv, Guy, et al.
Pubblicazione: (2024)