Fine-gained Zero-shot Video Sampling
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Dengsheng, Hu, Jie, Wei, Xiaoming, Wu, Enhua |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
High-Resolution Image Synthesis via Next-Token Prediction
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024)
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024)
Denoising with a Joint-Embedding Predictive Architecture
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024)
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024)
Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input
von: Liu, Jiajun, et al.
Veröffentlicht: (2024)
von: Liu, Jiajun, et al.
Veröffentlicht: (2024)
Space-time Reinforcement Network for Video Object Segmentation
von: Chen, Yadang, et al.
Veröffentlicht: (2024)
von: Chen, Yadang, et al.
Veröffentlicht: (2024)
Free Video-LLM: Prompt-guided Visual Perception for Efficient Training-free Video LLMs
von: Han, Kai, et al.
Veröffentlicht: (2024)
von: Han, Kai, et al.
Veröffentlicht: (2024)
Deformable 3D Shape Diffusion Model
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024)
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024)
Zero-shot Synthetic Video Realism Enhancement via Structure-aware Denoising
von: Wang, Yifan, et al.
Veröffentlicht: (2025)
von: Wang, Yifan, et al.
Veröffentlicht: (2025)
Few-shot Semantic Encoding and Decoding for Video Surveillance
von: Cheng, Baoping, et al.
Veröffentlicht: (2025)
von: Cheng, Baoping, et al.
Veröffentlicht: (2025)
DFVEdit: Conditional Delta Flow Vector for Zero-shot Video Editing
von: Cai, Lingling, et al.
Veröffentlicht: (2025)
von: Cai, Lingling, et al.
Veröffentlicht: (2025)
StarFT: Robust Fine-tuning of Zero-shot Models via Spuriosity Alignment
von: Kim, Younghyun, et al.
Veröffentlicht: (2025)
von: Kim, Younghyun, et al.
Veröffentlicht: (2025)
InstantID: Zero-shot Identity-Preserving Generation in Seconds
von: Wang, Qixun, et al.
Veröffentlicht: (2024)
von: Wang, Qixun, et al.
Veröffentlicht: (2024)
Anomagic: Crossmodal Prompt-driven Zero-shot Anomaly Generation
von: Jiang, Yuxin, et al.
Veröffentlicht: (2025)
von: Jiang, Yuxin, et al.
Veröffentlicht: (2025)
Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models
von: Liu, Huijie, et al.
Veröffentlicht: (2025)
von: Liu, Huijie, et al.
Veröffentlicht: (2025)
HecVL: Hierarchical Video-Language Pretraining for Zero-shot Surgical Phase Recognition
von: Yuan, Kun, et al.
Veröffentlicht: (2024)
von: Yuan, Kun, et al.
Veröffentlicht: (2024)
Prompt-based Visual Alignment for Zero-shot Policy Transfer
von: Gao, Haihan, et al.
Veröffentlicht: (2024)
von: Gao, Haihan, et al.
Veröffentlicht: (2024)
Zero-shot World Models Are Developmentally Efficient Learners
von: Aw, Khai Loong, et al.
Veröffentlicht: (2026)
von: Aw, Khai Loong, et al.
Veröffentlicht: (2026)
Zero-shot High-fidelity and Pose-controllable Character Animation
von: Zhu, Bingwen, et al.
Veröffentlicht: (2024)
von: Zhu, Bingwen, et al.
Veröffentlicht: (2024)
Visual Space Optimization for Zero-shot Learning
von: Wang, Xinsheng, et al.
Veröffentlicht: (2019)
von: Wang, Xinsheng, et al.
Veröffentlicht: (2019)
Enlighten-Your-Voice: When Multimodal Meets Zero-shot Low-light Image Enhancement
von: Zhang, Xiaofeng, et al.
Veröffentlicht: (2023)
von: Zhang, Xiaofeng, et al.
Veröffentlicht: (2023)
RDPM: Solve Diffusion Probabilistic Models via Recurrent Token Prediction
von: Wu, Xiaoping, et al.
Veröffentlicht: (2024)
von: Wu, Xiaoping, et al.
Veröffentlicht: (2024)
Enhancing Zero-shot Personalized Image Aesthetics Assessment with Profile-aware Multimodal LLM
von: Wang, Chun, et al.
Veröffentlicht: (2026)
von: Wang, Chun, et al.
Veröffentlicht: (2026)
Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
von: Gan, Yaozong, et al.
Veröffentlicht: (2024)
von: Gan, Yaozong, et al.
Veröffentlicht: (2024)
Spherical Linear Interpolation and Text-Anchoring for Zero-shot Composed Image Retrieval
von: Jang, Young Kyun, et al.
Veröffentlicht: (2024)
von: Jang, Young Kyun, et al.
Veröffentlicht: (2024)
Unlabeled Data Improves Fine-Grained Image Zero-shot Classification with Multimodal LLMs
von: Hong, Yunqi, et al.
Veröffentlicht: (2025)
von: Hong, Yunqi, et al.
Veröffentlicht: (2025)
ViGoR-Bench: How Far Are Visual Generative Models From Zero-Shot Visual Reasoners?
von: Han, Haonan, et al.
Veröffentlicht: (2026)
von: Han, Haonan, et al.
Veröffentlicht: (2026)
How Far Are Surgeons from Surgical World Models? A Pilot Study on Zero-shot Surgical Video Generation with Expert Assessment
von: Chen, Zhen, et al.
Veröffentlicht: (2025)
von: Chen, Zhen, et al.
Veröffentlicht: (2025)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
von: Chen, Houlun, et al.
Veröffentlicht: (2024)
von: Chen, Houlun, et al.
Veröffentlicht: (2024)
SAM2Point: Segment Any 3D as Videos in Zero-shot and Promptable Manners
von: Guo, Ziyu, et al.
Veröffentlicht: (2024)
von: Guo, Ziyu, et al.
Veröffentlicht: (2024)
AIR: Zero-shot Generative Model Adaptation with Iterative Refinement
von: Liu, Guimeng, et al.
Veröffentlicht: (2025)
von: Liu, Guimeng, et al.
Veröffentlicht: (2025)
Conceptrol: Concept Control of Zero-shot Personalized Image Generation
von: He, Qiyuan, et al.
Veröffentlicht: (2025)
von: He, Qiyuan, et al.
Veröffentlicht: (2025)
Zero-shot Vision-Language Reranking for Cross-View Geolocalization
von: Erzurumlu, Yunus Talha, et al.
Veröffentlicht: (2026)
von: Erzurumlu, Yunus Talha, et al.
Veröffentlicht: (2026)
FB-CLIP: Fine-Grained Zero-Shot Anomaly Detection with Foreground-Background Disentanglement
von: Hu, Ming, et al.
Veröffentlicht: (2026)
von: Hu, Ming, et al.
Veröffentlicht: (2026)
AA-CLIP: Enhancing Zero-shot Anomaly Detection via Anomaly-Aware CLIP
von: Ma, Wenxin, et al.
Veröffentlicht: (2025)
von: Ma, Wenxin, et al.
Veröffentlicht: (2025)
Zoom-shot: Fast and Efficient Unsupervised Zero-Shot Transfer of CLIP to Vision Encoders with Multimodal Loss
von: Shipard, Jordan, et al.
Veröffentlicht: (2024)
von: Shipard, Jordan, et al.
Veröffentlicht: (2024)
Ground-A-Video: Zero-shot Grounded Video Editing using Text-to-image Diffusion Models
von: Jeong, Hyeonho, et al.
Veröffentlicht: (2023)
von: Jeong, Hyeonho, et al.
Veröffentlicht: (2023)
P2DNav: Panorama-to-Downview Reasoning for Zero-shot Vision-and-Language Navigation
von: Sheng, Kai, et al.
Veröffentlicht: (2026)
von: Sheng, Kai, et al.
Veröffentlicht: (2026)
Zero-shot Text-guided Infinite Image Synthesis with LLM guidance
von: Kwon, Soyeong, et al.
Veröffentlicht: (2024)
von: Kwon, Soyeong, et al.
Veröffentlicht: (2024)
Segment-Anything Models Achieve Zero-shot Robustness in Autonomous Driving
von: Yan, Jun, et al.
Veröffentlicht: (2024)
von: Yan, Jun, et al.
Veröffentlicht: (2024)
MoECLIP: Patch-Specialized Experts for Zero-shot Anomaly Detection
von: Park, Jun Yeong, et al.
Veröffentlicht: (2026)
von: Park, Jun Yeong, et al.
Veröffentlicht: (2026)
Gate-and-Merge: Zero-shot Compositional Personalization of Vision Language Models
von: Ding, Guodong, et al.
Veröffentlicht: (2026)
von: Ding, Guodong, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
High-Resolution Image Synthesis via Next-Token Prediction
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024) -
Denoising with a Joint-Embedding Predictive Architecture
von: Chen, Dengsheng, et al.
Veröffentlicht: (2024) -
Kangaroo: A Powerful Video-Language Model Supporting Long-context Video Input
von: Liu, Jiajun, et al.
Veröffentlicht: (2024) -
Space-time Reinforcement Network for Video Object Segmentation
von: Chen, Yadang, et al.
Veröffentlicht: (2024) -
Free Video-LLM: Prompt-guided Visual Perception for Efficient Training-free Video LLMs
von: Han, Kai, et al.
Veröffentlicht: (2024)