StoryTailor:A Zero-Shot Pipeline for Action-Rich Multi-Subject Visual Narratives
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Jinghao, Zhang, Yuhe, Geng, GuoHua, Li, Kang, Zhang, Han |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Color and Lines: Zero-Shot Style-Specific Image Variations with Coordinated Semantics
di: Hu, Jinghao, et al.
Pubblicazione: (2024)
di: Hu, Jinghao, et al.
Pubblicazione: (2024)
Telling Stories for Common Sense Zero-Shot Action Recognition
di: Gowda, Shreyank N, et al.
Pubblicazione: (2023)
di: Gowda, Shreyank N, et al.
Pubblicazione: (2023)
Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models
di: Shen, Fei, et al.
Pubblicazione: (2024)
di: Shen, Fei, et al.
Pubblicazione: (2024)
Zero-Shot Skeleton-based Action Recognition with Dual Visual-Text Alignment
di: Kuang, Jidong, et al.
Pubblicazione: (2024)
di: Kuang, Jidong, et al.
Pubblicazione: (2024)
SubZero: Composing Subject, Style, and Action via Zero-Shot Personalization
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)
DreamingComics: A Story Visualization Pipeline via Subject and Layout Customized Generation using Video Models
di: Kwon, Patrick, et al.
Pubblicazione: (2025)
di: Kwon, Patrick, et al.
Pubblicazione: (2025)
Expanding Zero-Shot Object Counting with Rich Prompts
di: Zhu, Huilin, et al.
Pubblicazione: (2025)
di: Zhu, Huilin, et al.
Pubblicazione: (2025)
Multi-Stage VLM Pipeline for Zero-Shot Traffic Accident Understanding
di: Tatematsu, Fumiya, et al.
Pubblicazione: (2026)
di: Tatematsu, Fumiya, et al.
Pubblicazione: (2026)
One Shot Learning for Edge Detection on Point Clouds
di: Tu, Zhikun, et al.
Pubblicazione: (2026)
di: Tu, Zhikun, et al.
Pubblicazione: (2026)
Zero-Shot Action Generalization with Limited Observations
di: Alchihabi, Abdullah, et al.
Pubblicazione: (2025)
di: Alchihabi, Abdullah, et al.
Pubblicazione: (2025)
Training-Free Zero-Shot Temporal Action Detection with Vision-Language Models
di: Han, Chaolei, et al.
Pubblicazione: (2025)
di: Han, Chaolei, et al.
Pubblicazione: (2025)
DreamStory: Open-Domain Story Visualization by LLM-Guided Multi-Subject Consistent Diffusion
di: He, Huiguo, et al.
Pubblicazione: (2024)
di: He, Huiguo, et al.
Pubblicazione: (2024)
Epsilon: Exploring Comprehensive Visual-Semantic Projection for Multi-Label Zero-Shot Learning
di: Liu, Ziming, et al.
Pubblicazione: (2024)
di: Liu, Ziming, et al.
Pubblicazione: (2024)
MuSS: A Large-Scale Dataset and Cinematic Narrative Benchmark for Multi-Shot Subject-to-Video Generation
di: Zhang, Haojie, et al.
Pubblicazione: (2026)
di: Zhang, Haojie, et al.
Pubblicazione: (2026)
Zero-Shot Skeleton-Based Action Recognition With Prototype-Guided Feature Alignment
di: Zhou, Kai, et al.
Pubblicazione: (2025)
di: Zhou, Kai, et al.
Pubblicazione: (2025)
SUGAR: Subject-Driven Video Customization in a Zero-Shot Manner
di: Zhou, Yufan, et al.
Pubblicazione: (2024)
di: Zhou, Yufan, et al.
Pubblicazione: (2024)
Subject-Aware Multi-Granularity Alignment for Zero-Shot EEG-to-Image Retrieval
di: Jiang, Lin, et al.
Pubblicazione: (2026)
di: Jiang, Lin, et al.
Pubblicazione: (2026)
OZ-TAL: Online Zero-Shot Temporal Action Localization
di: Han, Chaolei, et al.
Pubblicazione: (2026)
di: Han, Chaolei, et al.
Pubblicazione: (2026)
Multi-Granularity Mutual Refinement Network for Zero-Shot Learning
di: Wang, Ning, et al.
Pubblicazione: (2025)
di: Wang, Ning, et al.
Pubblicazione: (2025)
Neuron: Learning Context-Aware Evolving Representations for Zero-Shot Skeleton Action Recognition
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
Visual-Semantic Graph Matching Net for Zero-Shot Learning
di: Duan, Bowen, et al.
Pubblicazione: (2024)
di: Duan, Bowen, et al.
Pubblicazione: (2024)
Learning Visual Proxy for Compositional Zero-Shot Learning
di: Zhang, Shiyu, et al.
Pubblicazione: (2025)
di: Zhang, Shiyu, et al.
Pubblicazione: (2025)
VLCounter: Text-aware Visual Representation for Zero-Shot Object Counting
di: Kang, Seunggu, et al.
Pubblicazione: (2023)
di: Kang, Seunggu, et al.
Pubblicazione: (2023)
Diverse and Tailored Image Generation for Zero-shot Multi-label Classification
di: Zhang, Kaixin, et al.
Pubblicazione: (2024)
di: Zhang, Kaixin, et al.
Pubblicazione: (2024)
ZEBRA: Towards Zero-Shot Cross-Subject Generalization for Universal Brain Visual Decoding
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control
di: Wei, Yujie, et al.
Pubblicazione: (2024)
di: Wei, Yujie, et al.
Pubblicazione: (2024)
SVIP: Semantically Contextualized Visual Patches for Zero-Shot Learning
di: Chen, Zhi, et al.
Pubblicazione: (2025)
di: Chen, Zhi, et al.
Pubblicazione: (2025)
FALIP: Visual Prompt as Foveal Attention Boosts CLIP Zero-Shot Performance
di: Zhuang, Jiedong, et al.
Pubblicazione: (2024)
di: Zhuang, Jiedong, et al.
Pubblicazione: (2024)
VisAgent: Narrative-Preserving Story Visualization Framework
di: Kim, Seungkwon, et al.
Pubblicazione: (2025)
di: Kim, Seungkwon, et al.
Pubblicazione: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
di: Zhuang, Cailin, et al.
Pubblicazione: (2025)
Text-Enhanced Zero-Shot Action Recognition: A training-free approach
di: Bosetti, Massimo, et al.
Pubblicazione: (2024)
di: Bosetti, Massimo, et al.
Pubblicazione: (2024)
LAGO: Language-Guided Adaptive Object-Region Focus for Zero-Shot Visual-Text Alignment
di: Hu, Junyi, et al.
Pubblicazione: (2026)
di: Hu, Junyi, et al.
Pubblicazione: (2026)
Continual Learning Improves Zero-Shot Action Recognition
di: Gowda, Shreyank N, et al.
Pubblicazione: (2024)
di: Gowda, Shreyank N, et al.
Pubblicazione: (2024)
Novel Semantic Prompting for Zero-Shot Action Recognition
di: Iqbal, Salman, et al.
Pubblicazione: (2026)
di: Iqbal, Salman, et al.
Pubblicazione: (2026)
Test-Time Zero-Shot Temporal Action Localization
di: Liberatori, Benedetta, et al.
Pubblicazione: (2024)
di: Liberatori, Benedetta, et al.
Pubblicazione: (2024)
AnyLogo: Symbiotic Subject-Driven Diffusion System with Gemini Status
di: Zhang, Jinghao, et al.
Pubblicazione: (2024)
di: Zhang, Jinghao, et al.
Pubblicazione: (2024)
Dual Expert Distillation Network for Generalized Zero-Shot Learning
di: Rao, Zhijie, et al.
Pubblicazione: (2024)
di: Rao, Zhijie, et al.
Pubblicazione: (2024)
Visual and Semantic Prompt Collaboration for Generalized Zero-Shot Learning
di: Jiang, Huajie, et al.
Pubblicazione: (2025)
di: Jiang, Huajie, et al.
Pubblicazione: (2025)
Attend and Enrich: Enhanced Visual Prompt for Zero-Shot Learning
di: Liu, Man, et al.
Pubblicazione: (2024)
di: Liu, Man, et al.
Pubblicazione: (2024)
Shot2Story: A New Benchmark for Comprehensive Understanding of Multi-shot Videos
di: Han, Mingfei, et al.
Pubblicazione: (2023)
di: Han, Mingfei, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Beyond Color and Lines: Zero-Shot Style-Specific Image Variations with Coordinated Semantics
di: Hu, Jinghao, et al.
Pubblicazione: (2024) -
Telling Stories for Common Sense Zero-Shot Action Recognition
di: Gowda, Shreyank N, et al.
Pubblicazione: (2023) -
Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models
di: Shen, Fei, et al.
Pubblicazione: (2024) -
Zero-Shot Skeleton-based Action Recognition with Dual Visual-Text Alignment
di: Kuang, Jidong, et al.
Pubblicazione: (2024) -
SubZero: Composing Subject, Style, and Action via Zero-Shot Personalization
di: Borse, Shubhankar, et al.
Pubblicazione: (2025)