Combining inherent knowledge of vision-language models with unsupervised domain adaptation through strong-weak guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Westfechtel, Thomas, Zhang, Dexuan, Harada, Tatsuya |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unified modality separation: A vision-language framework for unsupervised domain adaptation
par: Li, Xinyao, et autres
Publié: (2025)
par: Li, Xinyao, et autres
Publié: (2025)
SceneProp: Combining Neural Network and Markov Random Field for Scene-Graph Grounding
par: Otani, Keita, et autres
Publié: (2025)
par: Otani, Keita, et autres
Publié: (2025)
SADA: Semantic adversarial unsupervised domain adaptation for Temporal Action Localization
par: Pujol-Perich, David, et autres
Publié: (2023)
par: Pujol-Perich, David, et autres
Publié: (2023)
MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output
par: Chen, Yanyuan, et autres
Publié: (2025)
par: Chen, Yanyuan, et autres
Publié: (2025)
SPGen: Stochastic scanpath generation for paintings using unsupervised domain adaptation
par: Kerkouri, Mohamed Amine, et autres
Publié: (2026)
par: Kerkouri, Mohamed Amine, et autres
Publié: (2026)
Live image-based neurosurgical guidance and roadmap generation using unsupervised embedding
par: Sarwin, Gary, et autres
Publié: (2023)
par: Sarwin, Gary, et autres
Publié: (2023)
Can language-guided unsupervised adaptation improve medical image classification using unpaired images and texts?
par: Rahman, Umaima, et autres
Publié: (2024)
par: Rahman, Umaima, et autres
Publié: (2024)
BTMuda: A Bi-level Multi-source unsupervised domain adaptation framework for breast cancer diagnosis
par: Yang, Yuxiang, et autres
Publié: (2024)
par: Yang, Yuxiang, et autres
Publié: (2024)
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
par: Huang, Weijian, et autres
Publié: (2024)
par: Huang, Weijian, et autres
Publié: (2024)
Initialization matters in few-shot adaptation of vision-language models for histopathological image classification
par: Meseguer, Pablo, et autres
Publié: (2026)
par: Meseguer, Pablo, et autres
Publié: (2026)
RAW-Adapter: Adapting Pre-trained Visual Model to Camera RAW Images
par: Cui, Ziteng, et autres
Publié: (2024)
par: Cui, Ziteng, et autres
Publié: (2024)
Detection Based Part-level Articulated Object Reconstruction from Single RGBD Image
par: Kawana, Yuki, et autres
Publié: (2025)
par: Kawana, Yuki, et autres
Publié: (2025)
MaGRITTe: Manipulative and Generative 3D Realization from Image, Topview and Text
par: Hara, Takayuki, et autres
Publié: (2024)
par: Hara, Takayuki, et autres
Publié: (2024)
Generalizing vision-language models to novel domains: A comprehensive survey
par: Li, Xinyao, et autres
Publié: (2025)
par: Li, Xinyao, et autres
Publié: (2025)
Explainable artificial intelligence (XAI): from inherent explainability to large language models
par: Mumuni, Fuseini, et autres
Publié: (2025)
par: Mumuni, Fuseini, et autres
Publié: (2025)
SituationalLLM: Proactive language models with scene awareness for dynamic, contextual task guidance
par: Khan, Muhammad Saif Ullah, et autres
Publié: (2024)
par: Khan, Muhammad Saif Ullah, et autres
Publié: (2024)
Self-adaptive vision-language model for 3D segmentation of pulmonary artery and vein
par: Guo, Xiaotong, et autres
Publié: (2025)
par: Guo, Xiaotong, et autres
Publié: (2025)
Generalizable and Animatable Gaussian Head Avatar
par: Chu, Xuangeng, et autres
Publié: (2024)
par: Chu, Xuangeng, et autres
Publié: (2024)
Exploring selective image matching methods for zero-shot and few-sample unsupervised domain adaptation of urban canopy prediction
par: Francis, John, et autres
Publié: (2024)
par: Francis, John, et autres
Publié: (2024)
An analysis of vision-language models for fabric retrieval
par: Giuliari, Francesco, et autres
Publié: (2025)
par: Giuliari, Francesco, et autres
Publié: (2025)
DeViDe: Faceted medical knowledge for improved medical vision-language pre-training
par: Luo, Haozhe, et autres
Publié: (2024)
par: Luo, Haozhe, et autres
Publié: (2024)
Discovering an Image-Adaptive Coordinate System for Photography Processing
par: Cui, Ziteng, et autres
Publié: (2025)
par: Cui, Ziteng, et autres
Publié: (2025)
RAW-Adapter: Adapting Pre-trained Visual Model to Camera RAW Images and A Benchmark
par: Cui, Ziteng, et autres
Publié: (2025)
par: Cui, Ziteng, et autres
Publié: (2025)
Luminance-GS: Adapting 3D Gaussian Splatting to Challenging Lighting Conditions with View-Adaptive Curve Adjustment
par: Cui, Ziteng, et autres
Publié: (2025)
par: Cui, Ziteng, et autres
Publié: (2025)
Upsampling DINOv2 features for unsupervised vision tasks and weakly supervised materials segmentation
par: Docherty, Ronan, et autres
Publié: (2024)
par: Docherty, Ronan, et autres
Publié: (2024)
Linking heterogeneous microstructure informatics with expert characterization knowledge through customized and hybrid vision-language representations for industrial qualification
par: Safdar, Mutahar, et autres
Publié: (2025)
par: Safdar, Mutahar, et autres
Publié: (2025)
Interpreting the linear structure of vision-language model embedding spaces
par: Papadimitriou, Isabel, et autres
Publié: (2025)
par: Papadimitriou, Isabel, et autres
Publié: (2025)
Improved 3D Scene Stylization via Text-Guided Generative Image Editing with Region-Based Control
par: Fujiwara, Haruo, et autres
Publié: (2025)
par: Fujiwara, Haruo, et autres
Publié: (2025)
Style-NeRF2NeRF: 3D Style Transfer From Style-Aligned Multi-View Images
par: Fujiwara, Haruo, et autres
Publié: (2024)
par: Fujiwara, Haruo, et autres
Publié: (2024)
Deep Gaussian mixture model for unsupervised image segmentation
par: Schwab, Matthias, et autres
Publié: (2024)
par: Schwab, Matthias, et autres
Publié: (2024)
Deep asymmetric mixture model for unsupervised cell segmentation
par: Nan, Yang, et autres
Publié: (2024)
par: Nan, Yang, et autres
Publié: (2024)
Expert-level vision-language foundation model for real-world radiology and comprehensive evaluation
par: Liu, Xiaohong, et autres
Publié: (2024)
par: Liu, Xiaohong, et autres
Publié: (2024)
MI-VisionShot: Few-shot adaptation of vision-language models for slide-level classification of histopathological images
par: Meseguer, Pablo, et autres
Publié: (2024)
par: Meseguer, Pablo, et autres
Publié: (2024)
Do large language vision models understand 3D shapes?
par: Eppel, Sagi
Publié: (2024)
par: Eppel, Sagi
Publié: (2024)
Visual symbolic mechanisms: Emergent symbol processing in vision language models
par: Assouel, Rim, et autres
Publié: (2025)
par: Assouel, Rim, et autres
Publié: (2025)
Are vision-language models ready to zero-shot replace supervised classification models in agriculture?
par: Ranario, Earl, et autres
Publié: (2025)
par: Ranario, Earl, et autres
Publié: (2025)
GeoGuide: Geometric guidance of diffusion models
par: Poleski, Mateusz, et autres
Publié: (2024)
par: Poleski, Mateusz, et autres
Publié: (2024)
Fine color guidance in diffusion models and its application to image compression at extremely low bitrates
par: Bordin, Tom, et autres
Publié: (2024)
par: Bordin, Tom, et autres
Publié: (2024)
Enhancing knowledge retention for continual learning with domain-specific adapters and features gating
par: Hedjazi, Mohamed Abbas, et autres
Publié: (2025)
par: Hedjazi, Mohamed Abbas, et autres
Publié: (2025)
Are vision language models robust to uncertain inputs?
par: Wang, Xi, et autres
Publié: (2025)
par: Wang, Xi, et autres
Publié: (2025)
Documents similaires
-
Unified modality separation: A vision-language framework for unsupervised domain adaptation
par: Li, Xinyao, et autres
Publié: (2025) -
SceneProp: Combining Neural Network and Markov Random Field for Scene-Graph Grounding
par: Otani, Keita, et autres
Publié: (2025) -
SADA: Semantic adversarial unsupervised domain adaptation for Temporal Action Localization
par: Pujol-Perich, David, et autres
Publié: (2023) -
MIMO: A medical vision language model with visual referring multimodal input and pixel grounding multimodal output
par: Chen, Yanyuan, et autres
Publié: (2025) -
SPGen: Stochastic scanpath generation for paintings using unsupervised domain adaptation
par: Kerkouri, Mohamed Amine, et autres
Publié: (2026)