Few-shot Learner Parameterization by Diffusion Time-steps
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yue, Zhongqi, Zhou, Pan, Hong, Richang, Zhang, Hanwang, Sun, Qianru |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Diffusion Time-steps for Unsupervised Representation Learning
par: Yue, Zhongqi, et autres
Publié: (2024)
par: Yue, Zhongqi, et autres
Publié: (2024)
Controllable Relation Disentanglement for Few-Shot Class-Incremental Learning
par: Zhou, Yuan, et autres
Publié: (2024)
par: Zhou, Yuan, et autres
Publié: (2024)
Diffusion Time-step Curriculum for One Image to 3D Generation
par: Yi, Xuanyu, et autres
Publié: (2024)
par: Yi, Xuanyu, et autres
Publié: (2024)
Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration
par: Pan, Kaihang, et autres
Publié: (2024)
par: Pan, Kaihang, et autres
Publié: (2024)
Real-Time Motion-Controllable Autoregressive Video Diffusion
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
Generalized Logit Adjustment: Calibrating Fine-tuned Models by Removing Label Bias in Foundation Models
par: Zhu, Beier, et autres
Publié: (2023)
par: Zhu, Beier, et autres
Publié: (2023)
Unsupervised Visual Chain-of-Thought Reasoning via Preference Optimization
par: Zhao, Kesen, et autres
Publié: (2025)
par: Zhao, Kesen, et autres
Publié: (2025)
Generalized Visual Relation Detection with Diffusion Models
par: Gao, Kaifeng, et autres
Publié: (2025)
par: Gao, Kaifeng, et autres
Publié: (2025)
Few to Big: Prototype Expansion Network via Diffusion Learner for Point Cloud Few-shot Semantic Segmentation
par: Zhao, Qianguang, et autres
Publié: (2025)
par: Zhao, Qianguang, et autres
Publié: (2025)
Discffusion: Discriminative Diffusion Models as Few-shot Vision and Language Learners
par: He, Xuehai, et autres
Publié: (2023)
par: He, Xuehai, et autres
Publié: (2023)
Making Large Vision Language Models to be Good Few-shot Learners
par: Liu, Fan, et autres
Publié: (2024)
par: Liu, Fan, et autres
Publié: (2024)
Few-shot NeRF by Adaptive Rendering Loss Regularization
par: Xu, Qingshan, et autres
Publié: (2024)
par: Xu, Qingshan, et autres
Publié: (2024)
Generative Multimodal Pretraining with Discrete Diffusion Timestep Tokens
par: Pan, Kaihang, et autres
Publié: (2025)
par: Pan, Kaihang, et autres
Publié: (2025)
CARE Transformer: Mobile-Friendly Linear Visual Transformer via Decoupled Dual Interaction
par: Zhou, Yuan, et autres
Publié: (2024)
par: Zhou, Yuan, et autres
Publié: (2024)
Thinking with Images as Continuous Actions: Numerical Visual Chain-of-Thought
par: Zhao, Kesen, et autres
Publié: (2026)
par: Zhao, Kesen, et autres
Publié: (2026)
Selective Vision-Language Subspace Projection for Few-shot CLIP
par: Zhu, Xingyu, et autres
Publié: (2024)
par: Zhu, Xingyu, et autres
Publié: (2024)
Meta-Adapter: An Online Few-shot Learner for Vision-Language Model
par: Cheng, Cheng, et autres
Publié: (2023)
par: Cheng, Cheng, et autres
Publié: (2023)
Reasoning Physical Video Generation with Diffusion Timestep Tokens via Reinforcement Learning
par: Lin, Wang, et autres
Publié: (2025)
par: Lin, Wang, et autres
Publié: (2025)
Streaming Drag-Oriented Interactive Video Manipulation: Drag Anything, Anytime!
par: Zhou, Junbao, et autres
Publié: (2025)
par: Zhou, Junbao, et autres
Publié: (2025)
Diffusion Model as a Generalist Segmentation Learner
par: Wang, Haoxiao, et autres
Publié: (2026)
par: Wang, Haoxiao, et autres
Publié: (2026)
Class Is Invariant to Context and Vice Versa: On Learning Invariance for Out-Of-Distribution Generalization
par: Qi, Jiaxin, et autres
Publié: (2022)
par: Qi, Jiaxin, et autres
Publié: (2022)
DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
par: Lyu, Hengye, et autres
Publié: (2026)
par: Lyu, Hengye, et autres
Publié: (2026)
Doubly Abductive Counterfactual Inference for Text-based Image Editing
par: Song, Xue, et autres
Publié: (2024)
par: Song, Xue, et autres
Publié: (2024)
Uni-DAD: Unified Distillation and Adaptation of Diffusion Models for Few-step Few-shot Image Generation
par: Bahram, Yara, et autres
Publié: (2025)
par: Bahram, Yara, et autres
Publié: (2025)
DragNeXt: Rethinking Drag-Based Image Editing
par: Zhou, Yuan, et autres
Publié: (2025)
par: Zhou, Yuan, et autres
Publié: (2025)
Robust Fine-tuning of Zero-shot Models via Variance Reduction
par: Zhu, Beier, et autres
Publié: (2024)
par: Zhu, Beier, et autres
Publié: (2024)
3D Question Answering via only 2D Vision-Language Models
par: Wang, Fengyun, et autres
Publié: (2025)
par: Wang, Fengyun, et autres
Publié: (2025)
FLIER: Few-shot Language Image Models Embedded with Latent Representations
par: Zhou, Zhinuo, et autres
Publié: (2024)
par: Zhou, Zhinuo, et autres
Publié: (2024)
HypDAE: Hyperbolic Diffusion Autoencoders for Hierarchical Few-shot Image Generation
par: Li, Lingxiao, et autres
Publié: (2024)
par: Li, Lingxiao, et autres
Publié: (2024)
FishAI 2.0: Marine Fish Image Classification with Multi-modal Few-shot Learning
par: Yang, Chenghan, et autres
Publié: (2025)
par: Yang, Chenghan, et autres
Publié: (2025)
OFL-SAM2: Prompt SAM2 with Online Few-shot Learner for Efficient Medical Image Segmentation
par: Lan, Meng, et autres
Publié: (2025)
par: Lan, Meng, et autres
Publié: (2025)
The Devil is in the Few Shots: Iterative Visual Knowledge Completion for Few-shot Learning
par: Li, Yaohui, et autres
Publié: (2024)
par: Li, Yaohui, et autres
Publié: (2024)
MuSteerNet: Human Reaction Generation from Videos via Observation-Reaction Mutual Steering
par: Zhou, Yuan, et autres
Publié: (2026)
par: Zhou, Yuan, et autres
Publié: (2026)
Towards Few-shot Out-of-Distribution Detection
par: Dong, Jiuqing, et autres
Publié: (2023)
par: Dong, Jiuqing, et autres
Publié: (2023)
Few-shot Object Localization
par: Ren, Yunhan, et autres
Publié: (2024)
par: Ren, Yunhan, et autres
Publié: (2024)
Reducing Class-Wise Performance Disparity via Margin Regularization
par: Zhu, Beier, et autres
Publié: (2026)
par: Zhu, Beier, et autres
Publié: (2026)
Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning
par: Wang, Bohan, et autres
Publié: (2025)
par: Wang, Bohan, et autres
Publié: (2025)
Attn-Adapter: Attention Is All You Need for Online Few-shot Learner of Vision-Language Model
par: Bui, Phuoc-Nguyen, et autres
Publié: (2025)
par: Bui, Phuoc-Nguyen, et autres
Publié: (2025)
MGCA-Net: Multi-Grained Category-Aware Network for Open-Vocabulary Temporal Action Localization
par: Fang, Zhenying, et autres
Publié: (2025)
par: Fang, Zhenying, et autres
Publié: (2025)
Enhancing Test Time Adaptation with Few-shot Guidance
par: Luo, Siqi, et autres
Publié: (2024)
par: Luo, Siqi, et autres
Publié: (2024)
Documents similaires
-
Exploring Diffusion Time-steps for Unsupervised Representation Learning
par: Yue, Zhongqi, et autres
Publié: (2024) -
Controllable Relation Disentanglement for Few-Shot Class-Incremental Learning
par: Zhou, Yuan, et autres
Publié: (2024) -
Diffusion Time-step Curriculum for One Image to 3D Generation
par: Yi, Xuanyu, et autres
Publié: (2024) -
Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration
par: Pan, Kaihang, et autres
Publié: (2024) -
Real-Time Motion-Controllable Autoregressive Video Diffusion
par: Zhao, Kesen, et autres
Publié: (2025)