Domain Generalization Using Large Pretrained Models with Mixture-of-Adapters
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lee, Gyuseong, Jang, Wooseok, Kim, Jinhyeon, Jung, Jaewoo, Kim, Seungryong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cross-View Completion Models are Zero-shot Correspondence Estimators
par: An, Honggyu, et autres
Publié: (2024)
par: An, Honggyu, et autres
Publié: (2024)
Emergent Outlier View Rejection in Visual Geometry Grounded Transformers
par: Han, Jisang, et autres
Publié: (2025)
par: Han, Jisang, et autres
Publié: (2025)
Diffusion Model for Dense Matching
par: Nam, Jisu, et autres
Publié: (2023)
par: Nam, Jisu, et autres
Publié: (2023)
V-Warper: Appearance-Consistent Video Diffusion Personalization via Value Warping
par: Lee, Hyunkoo, et autres
Publié: (2025)
par: Lee, Hyunkoo, et autres
Publié: (2025)
ControlFace: Harnessing Facial Parametric Control for Face Rigging
par: Jang, Wooseok, et autres
Publié: (2024)
par: Jang, Wooseok, et autres
Publié: (2024)
Deep Forcing: Training-Free Long Video Generation with Deep Sink and Participative Compression
par: Yi, Jung, et autres
Publié: (2025)
par: Yi, Jung, et autres
Publié: (2025)
WorldKV: Efficient World Memory with World Retrieval and Compression
par: Yi, Jung, et autres
Publié: (2026)
par: Yi, Jung, et autres
Publié: (2026)
Let 2D Diffusion Model Know 3D-Consistency for Robust Text-to-3D Generation
par: Seo, Junyoung, et autres
Publié: (2023)
par: Seo, Junyoung, et autres
Publié: (2023)
Entropy-Gradient Grounding: Training-Free Evidence Retrieval in Vision-Language Models
par: Gröpl, Marcel, et autres
Publié: (2026)
par: Gröpl, Marcel, et autres
Publié: (2026)
Retrieval-Augmented Score Distillation for Text-to-3D Generation
par: Seo, Junyoung, et autres
Publié: (2024)
par: Seo, Junyoung, et autres
Publié: (2024)
URECA: Unique Region Caption Anything
par: Lim, Sangbeom, et autres
Publié: (2025)
par: Lim, Sangbeom, et autres
Publié: (2025)
Relaxing Accurate Initialization Constraint for 3D Gaussian Splatting
par: Jung, Jaewoo, et autres
Publié: (2024)
par: Jung, Jaewoo, et autres
Publié: (2024)
Unifying Correspondence, Pose and NeRF for Pose-Free Novel View Synthesis from Stereo Pairs
par: Hong, Sunghwan, et autres
Publié: (2023)
par: Hong, Sunghwan, et autres
Publié: (2023)
Visual Representation Alignment for Multimodal Large Language Models
par: Yoon, Heeji, et autres
Publié: (2025)
par: Yoon, Heeji, et autres
Publié: (2025)
Repurposing Geometric Foundation Models for Multi-view Diffusion
par: Jang, Wooseok, et autres
Publié: (2026)
par: Jang, Wooseok, et autres
Publié: (2026)
APPLE: Attribute-Preserving Pseudo-Labeling for Diffusion-Based Face Swapping
par: Kang, Jiwon, et autres
Publié: (2026)
par: Kang, Jiwon, et autres
Publié: (2026)
TrackCraft3R: Repurposing Video Diffusion Transformers for Dense 3D Tracking
par: Nam, Jisu, et autres
Publié: (2026)
par: Nam, Jisu, et autres
Publié: (2026)
Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild
par: Jin, Siyoon, et autres
Publié: (2024)
par: Jin, Siyoon, et autres
Publié: (2024)
3D Scene Prompting for Scene-Consistent Camera-Controllable Video Generation
par: Lee, JoungBin, et autres
Publié: (2025)
par: Lee, JoungBin, et autres
Publié: (2025)
PF3plat: Pose-Free Feed-Forward 3D Gaussian Splatting
par: Hong, Sunghwan, et autres
Publié: (2024)
par: Hong, Sunghwan, et autres
Publié: (2024)
Soft Segmented Randomization: Enhancing Domain Generalization in SAR-ATR for Synthetic-to-Measured
par: Kim, Minjun, et autres
Publié: (2024)
par: Kim, Minjun, et autres
Publié: (2024)
Where and How to Perturb: On the Design of Perturbation Guidance in Diffusion and Flow Models
par: Ahn, Donghoon, et autres
Publié: (2025)
par: Ahn, Donghoon, et autres
Publié: (2025)
InterRVOS: Interaction-aware Referring Video Object Segmentation
par: Jin, Woojeong, et autres
Publié: (2025)
par: Jin, Woojeong, et autres
Publié: (2025)
D$^2$USt3R: Enhancing 3D Reconstruction for Dynamic Scenes
par: Han, Jisang, et autres
Publié: (2025)
par: Han, Jisang, et autres
Publié: (2025)
When Vision Models Meet Parameter Efficient Look-Aside Adapters Without Large-Scale Audio Pretraining
par: Yeo, Juan, et autres
Publié: (2024)
par: Yeo, Juan, et autres
Publié: (2024)
Balancing Saliency and Coverage: Semantic Prominence-Aware Budgeting for Visual Token Compression in VLMs
par: Lee, Jaehoon, et autres
Publié: (2026)
par: Lee, Jaehoon, et autres
Publié: (2026)
ChatEXAONEPath: An Expert-level Multimodal Large Language Model for Histopathology Using Whole Slide Images
par: Kim, Sangwook, et autres
Publié: (2025)
par: Kim, Sangwook, et autres
Publié: (2025)
MoDiTalker: Motion-Disentangled Diffusion Model for High-Fidelity Talking Head Generation
par: Kim, Seyeon, et autres
Publié: (2024)
par: Kim, Seyeon, et autres
Publié: (2024)
Hybrid Video Diffusion Models with 2D Triplane and 3D Wavelet Representation
par: Kim, Kihong, et autres
Publié: (2024)
par: Kim, Kihong, et autres
Publié: (2024)
Unified Domain Generalization and Adaptation for Multi-View 3D Object Detection
par: Chang, Gyusam, et autres
Publié: (2024)
par: Chang, Gyusam, et autres
Publié: (2024)
AgentRVOS: Reasoning over Object Tracks for Zero-Shot Referring Video Object Segmentation
par: Jin, Woojeong, et autres
Publié: (2026)
par: Jin, Woojeong, et autres
Publié: (2026)
Vid-CamEdit: Video Camera Trajectory Editing with Generative Rendering from Estimated Geometry
par: Seo, Junyoung, et autres
Publié: (2025)
par: Seo, Junyoung, et autres
Publié: (2025)
C3G: Learning Compact 3D Representations with 2K Gaussians
par: An, Honggyu, et autres
Publié: (2025)
par: An, Honggyu, et autres
Publié: (2025)
Earth-Adapter: Bridge the Geospatial Domain Gaps with Mixture of Frequency Adaptation
par: Hu, Xiaoxing, et autres
Publié: (2025)
par: Hu, Xiaoxing, et autres
Publié: (2025)
Exploring Temporally-Aware Features for Point Tracking
par: Kim, Inès Hyeonsu, et autres
Publié: (2025)
par: Kim, Inès Hyeonsu, et autres
Publié: (2025)
MORPHOS: Autoregressive 4D Generation with Temporal Structured Latents
par: Kwon, Minkyung, et autres
Publié: (2026)
par: Kwon, Minkyung, et autres
Publié: (2026)
DM-Adapter: Domain-Aware Mixture-of-Adapters for Text-Based Person Retrieval
par: Liu, Yating, et autres
Publié: (2025)
par: Liu, Yating, et autres
Publié: (2025)
From Tokens to Photons: Test-Time Physical Prompting for Vision-Language Models
par: Im, Boyeong, et autres
Publié: (2025)
par: Im, Boyeong, et autres
Publié: (2025)
Do We Need Perfect Data? Leveraging Noise for Domain Generalized Segmentation
par: Kim, Taeyeong, et autres
Publié: (2025)
par: Kim, Taeyeong, et autres
Publié: (2025)
MATRIX: Mask Track Alignment for Interaction-aware Video Generation
par: Jin, Siyoon, et autres
Publié: (2025)
par: Jin, Siyoon, et autres
Publié: (2025)
Documents similaires
-
Cross-View Completion Models are Zero-shot Correspondence Estimators
par: An, Honggyu, et autres
Publié: (2024) -
Emergent Outlier View Rejection in Visual Geometry Grounded Transformers
par: Han, Jisang, et autres
Publié: (2025) -
Diffusion Model for Dense Matching
par: Nam, Jisu, et autres
Publié: (2023) -
V-Warper: Appearance-Consistent Video Diffusion Personalization via Value Warping
par: Lee, Hyunkoo, et autres
Publié: (2025) -
ControlFace: Harnessing Facial Parametric Control for Face Rigging
par: Jang, Wooseok, et autres
Publié: (2024)