Group Orthogonalization Regularization For Vision Models Adaptation and Robustness
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kurtz, Yoav, Bar, Noga, Giryes, Raja |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Diverse Subset Selection via Norm-Based Sampling and Orthogonality
von: Bar, Noga, et al.
Veröffentlicht: (2024)
von: Bar, Noga, et al.
Veröffentlicht: (2024)
Pruning at Initialization -- A Sketching Perspective
von: Bar, Noga, et al.
Veröffentlicht: (2023)
von: Bar, Noga, et al.
Veröffentlicht: (2023)
ProtoSAM: One-Shot Medical Image Segmentation With Foundational Models
von: Ayzenberg, Lev, et al.
Veröffentlicht: (2024)
von: Ayzenberg, Lev, et al.
Veröffentlicht: (2024)
DifuzCam: Replacing Camera Lens with a Mask and a Diffusion Model
von: Yosef, Erez, et al.
Veröffentlicht: (2024)
von: Yosef, Erez, et al.
Veröffentlicht: (2024)
PIP: Positional-encoding Image Prior
von: Shabtay, Nimrod, et al.
Veröffentlicht: (2022)
von: Shabtay, Nimrod, et al.
Veröffentlicht: (2022)
Guided Lensless Polarization Imaging
von: Kraicer, Noa, et al.
Veröffentlicht: (2026)
von: Kraicer, Noa, et al.
Veröffentlicht: (2026)
Mitigating Open-Vocabulary Caption Hallucinations
von: Ben-Kish, Assaf, et al.
Veröffentlicht: (2023)
von: Ben-Kish, Assaf, et al.
Veröffentlicht: (2023)
Efficient Adaptation of Pre-trained Vision Transformer underpinned by Approximately Orthogonal Fine-Tuning Strategy
von: Yang, Yiting, et al.
Veröffentlicht: (2025)
von: Yang, Yiting, et al.
Veröffentlicht: (2025)
Enhancing Adversarial Robustness of Vision-Language Models through Low-Rank Adaptation
von: Ji, Yuheng, et al.
Veröffentlicht: (2024)
von: Ji, Yuheng, et al.
Veröffentlicht: (2024)
CARES: Context-Aware Resolution Selector for VLMs
von: Kimhi, Moshe, et al.
Veröffentlicht: (2025)
von: Kimhi, Moshe, et al.
Veröffentlicht: (2025)
TTP: Test-Time Padding for Adversarial Detection and Robust Adaptation on Vision-Language Models
von: Li, Zhiwei, et al.
Veröffentlicht: (2025)
von: Li, Zhiwei, et al.
Veröffentlicht: (2025)
3VL: Using Trees to Improve Vision-Language Models' Interpretability
von: Yellinek, Nir, et al.
Veröffentlicht: (2023)
von: Yellinek, Nir, et al.
Veröffentlicht: (2023)
Bi-Orthogonal Factor Decomposition for Vision Transformers
von: Doshi, Fenil R., et al.
Veröffentlicht: (2026)
von: Doshi, Fenil R., et al.
Veröffentlicht: (2026)
Do multimodal models imagine electric sheep?
von: Ramakrishnan, Santhosh Kumar, et al.
Veröffentlicht: (2026)
von: Ramakrishnan, Santhosh Kumar, et al.
Veröffentlicht: (2026)
Look Where It Matters: High-Resolution Crops Retrieval for Efficient VLMs
von: Shabtay, Nimrod, et al.
Veröffentlicht: (2026)
von: Shabtay, Nimrod, et al.
Veröffentlicht: (2026)
ProtoDCS: Towards Robust and Efficient Open-Set Test-Time Adaptation for Vision-Language Models
von: Luo, Wei, et al.
Veröffentlicht: (2026)
von: Luo, Wei, et al.
Veröffentlicht: (2026)
Evolving Prompt Adaptation for Vision-Language Models
von: Zhang, Enming, et al.
Veröffentlicht: (2026)
von: Zhang, Enming, et al.
Veröffentlicht: (2026)
XBusNet: Text-Guided Breast Ultrasound Segmentation via Multimodal Vision-Language Learning
von: Mallina, Raja, et al.
Veröffentlicht: (2025)
von: Mallina, Raja, et al.
Veröffentlicht: (2025)
Orthogonal Quadratic Complements for Vision Transformer Feed-Forward Networks
von: Zixian, Wang
Veröffentlicht: (2026)
von: Zixian, Wang
Veröffentlicht: (2026)
Prompt-OT: An Optimal Transport Regularization Paradigm for Knowledge Preservation in Vision-Language Model Adaptation
von: Chen, Xiwen, et al.
Veröffentlicht: (2025)
von: Chen, Xiwen, et al.
Veröffentlicht: (2025)
Robust SAM: On the Adversarial Robustness of Vision Foundation Models
von: Long, Jiahuan, et al.
Veröffentlicht: (2025)
von: Long, Jiahuan, et al.
Veröffentlicht: (2025)
Abstracted Gaussian Prototypes for True One-Shot Concept Learning
von: Zou, Chelsea, et al.
Veröffentlicht: (2024)
von: Zou, Chelsea, et al.
Veröffentlicht: (2024)
Talk Less, Interact Better: Evaluating In-context Conversational Adaptation in Multimodal LLMs
von: Hua, Yilun, et al.
Veröffentlicht: (2024)
von: Hua, Yilun, et al.
Veröffentlicht: (2024)
Subspace Alignment for Vision-Language Model Test-time Adaptation
von: Zeng, Zhichen, et al.
Veröffentlicht: (2026)
von: Zeng, Zhichen, et al.
Veröffentlicht: (2026)
Frustratingly Easy Test-Time Adaptation of Vision-Language Models
von: Farina, Matteo, et al.
Veröffentlicht: (2024)
von: Farina, Matteo, et al.
Veröffentlicht: (2024)
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
von: Li, Jiajie, et al.
Veröffentlicht: (2026)
von: Li, Jiajie, et al.
Veröffentlicht: (2026)
BiomedAP: A Vision-Informed Dual-Anchor Framework with Gated Cross-Modal Fusion for Robust Medical Vision-Language Adaptation
von: Tong, Huanyang, et al.
Veröffentlicht: (2026)
von: Tong, Huanyang, et al.
Veröffentlicht: (2026)
ReHARK: Refined Hybrid Adaptive RBF Kernels for Robust One-Shot Vision-Language Adaptation
von: Islam, Md Jahidul
Veröffentlicht: (2026)
von: Islam, Md Jahidul
Veröffentlicht: (2026)
Open-Set Domain Adaptation Under Background Distribution Shift: Challenges and A Provably Efficient Solution
von: Chaudhari, Shravan, et al.
Veröffentlicht: (2025)
von: Chaudhari, Shravan, et al.
Veröffentlicht: (2025)
Robust Ensemble Person Re-Identification via Orthogonal Fusion with Occlusion Handling
von: Ferdous, Syeda Nyma, et al.
Veröffentlicht: (2024)
von: Ferdous, Syeda Nyma, et al.
Veröffentlicht: (2024)
Randomized-MLP Regularization Improves Domain Adaptation and Interpretability in DINOv2
von: Ortega, Joel Valdivia, et al.
Veröffentlicht: (2025)
von: Ortega, Joel Valdivia, et al.
Veröffentlicht: (2025)
Regularizing Subspace Redundancy of Low-Rank Adaptation
von: Zhu, Yue, et al.
Veröffentlicht: (2025)
von: Zhu, Yue, et al.
Veröffentlicht: (2025)
Adaptation of Multi-modal Representation Models for Multi-task Surgical Computer Vision
von: Walimbe, Soham, et al.
Veröffentlicht: (2025)
von: Walimbe, Soham, et al.
Veröffentlicht: (2025)
VLM-RobustBench: A Comprehensive Benchmark for Robustness of Vision-Language Models
von: Saxena, Rohit, et al.
Veröffentlicht: (2026)
von: Saxena, Rohit, et al.
Veröffentlicht: (2026)
DIP-GS: Deep Image Prior For Gaussian Splatting Sparse View Recovery
von: Khatib, Rajaei, et al.
Veröffentlicht: (2025)
von: Khatib, Rajaei, et al.
Veröffentlicht: (2025)
TriNeRFLet: A Wavelet Based Triplane NeRF Representation
von: Khatib, Rajaei, et al.
Veröffentlicht: (2024)
von: Khatib, Rajaei, et al.
Veröffentlicht: (2024)
Anthropogenic Regional Adaptation in Multimodal Vision-Language Model
von: Cahyawijaya, Samuel, et al.
Veröffentlicht: (2026)
von: Cahyawijaya, Samuel, et al.
Veröffentlicht: (2026)
A Study on Unsupervised Domain Adaptation for Semantic Segmentation in the Era of Vision-Language Models
von: Schwonberg, Manuel, et al.
Veröffentlicht: (2024)
von: Schwonberg, Manuel, et al.
Veröffentlicht: (2024)
Generalized Single-Image-Based Morphing Attack Detection Using Deep Representations from Vision Transformer
von: Zhang, Haoyu, et al.
Veröffentlicht: (2025)
von: Zhang, Haoyu, et al.
Veröffentlicht: (2025)
GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models
von: Huang, Mingzhe, et al.
Veröffentlicht: (2026)
von: Huang, Mingzhe, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Diverse Subset Selection via Norm-Based Sampling and Orthogonality
von: Bar, Noga, et al.
Veröffentlicht: (2024) -
Pruning at Initialization -- A Sketching Perspective
von: Bar, Noga, et al.
Veröffentlicht: (2023) -
ProtoSAM: One-Shot Medical Image Segmentation With Foundational Models
von: Ayzenberg, Lev, et al.
Veröffentlicht: (2024) -
DifuzCam: Replacing Camera Lens with a Mask and a Diffusion Model
von: Yosef, Erez, et al.
Veröffentlicht: (2024) -
PIP: Positional-encoding Image Prior
von: Shabtay, Nimrod, et al.
Veröffentlicht: (2022)