Your Interest, Your Summaries: Query-Focused Long Video Summarization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Patel, Nirav, Prajapati, Payal, Shah, Maitrik |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Edit-Your-Interest: Efficient Video Editing via Feature Most-Similar Propagation
par: Zuo, Yi, et autres
Publié: (2025)
par: Zuo, Yi, et autres
Publié: (2025)
Let Your Video Listen to Your Music!
par: Zhang, Xinyu, et autres
Publié: (2025)
par: Zhang, Xinyu, et autres
Publié: (2025)
Control Your Queries: Heterogeneous Query Interaction for Camera-Radar Fusion
par: Wu, Jialong, et autres
Publié: (2026)
par: Wu, Jialong, et autres
Publié: (2026)
Does Your Vision-Language Model Get Lost in the Long Video Sampling Dilemma?
par: Qu, Tianyuan, et autres
Publié: (2025)
par: Qu, Tianyuan, et autres
Publié: (2025)
Where to Focus: Query-Modulated Multimodal Keyframe Selection for Long Video Understanding
par: Wang, Shaoguang, et autres
Publié: (2026)
par: Wang, Shaoguang, et autres
Publié: (2026)
How Video Meetings Change Your Expression
par: Sarin, Sumit, et autres
Publié: (2024)
par: Sarin, Sumit, et autres
Publié: (2024)
Video, How Do Your Tokens Merge?
par: Pollard, Sam, et autres
Publié: (2025)
par: Pollard, Sam, et autres
Publié: (2025)
Prompts to Summaries: Zero-Shot Language-Guided Video Summarization with Large Language and Video Models
par: Barbara, Mario, et autres
Publié: (2025)
par: Barbara, Mario, et autres
Publié: (2025)
Pack and Force Your Memory: Long-form and Consistent Video Generation
par: Wu, Xiaofei, et autres
Publié: (2025)
par: Wu, Xiaofei, et autres
Publié: (2025)
Waver: Wave Your Way to Lifelike Video Generation
par: Zhang, Yifu, et autres
Publié: (2025)
par: Zhang, Yifu, et autres
Publié: (2025)
Generate Your Talking Avatar from Video Reference
par: Guo, Zujin, et autres
Publié: (2026)
par: Guo, Zujin, et autres
Publié: (2026)
Animate Your Motion: Turning Still Images into Dynamic Videos
par: Li, Mingxiao, et autres
Publié: (2024)
par: Li, Mingxiao, et autres
Publié: (2024)
StyleMaster: Stylize Your Video with Artistic Generation and Translation
par: Ye, Zixuan, et autres
Publié: (2024)
par: Ye, Zixuan, et autres
Publié: (2024)
Bring Your Dreams to Life: Continual Text-to-Video Customization
par: Dong, Jiahua, et autres
Publié: (2025)
par: Dong, Jiahua, et autres
Publié: (2025)
ALIVE: Animate Your World with Lifelike Audio-Video Generation
par: Guo, Ying, et autres
Publié: (2026)
par: Guo, Ying, et autres
Publié: (2026)
Mind Your Margin and Boundary: Are Your Distilled Datasets Truly Robust?
par: Li, Muquan, et autres
Publié: (2026)
par: Li, Muquan, et autres
Publié: (2026)
LVSum: A Benchmark for Timestamp-Aware Long Video Summarization
par: Patel, Alkesh, et autres
Publié: (2026)
par: Patel, Alkesh, et autres
Publié: (2026)
Focus Your Attention: Towards Data-Intuitive Lightweight Vision Transformers
par: Gaurav, Suyash, et autres
Publié: (2025)
par: Gaurav, Suyash, et autres
Publié: (2025)
ViFeEdit: A Video-Free Tuner of Your Video Diffusion Transformer
par: Yu, Ruonan, et autres
Publié: (2026)
par: Yu, Ruonan, et autres
Publié: (2026)
Be-Your-Outpainter: Mastering Video Outpainting through Input-Specific Adaptation
par: Wang, Fu-Yun, et autres
Publié: (2024)
par: Wang, Fu-Yun, et autres
Publié: (2024)
Make Your Training Flexible: Towards Deployment-Efficient Video Models
par: Wang, Chenting, et autres
Publié: (2025)
par: Wang, Chenting, et autres
Publié: (2025)
MagicInfinite: Generating Infinite Talking Videos with Your Words and Voice
par: Yi, Hongwei, et autres
Publié: (2025)
par: Yi, Hongwei, et autres
Publié: (2025)
How to Design and Train Your Implicit Neural Representation for Video Compression
par: Gwilliam, Matthew, et autres
Publié: (2025)
par: Gwilliam, Matthew, et autres
Publié: (2025)
Attention Surgery: An Efficient Recipe to Linearize Your Video Diffusion Transformer
par: Ghafoorian, Mohsen, et autres
Publié: (2025)
par: Ghafoorian, Mohsen, et autres
Publié: (2025)
Your Pre-trained Diffusion Model Secretly Knows Restoration
par: Rajagopalan, Sudarshan, et autres
Publié: (2026)
par: Rajagopalan, Sudarshan, et autres
Publié: (2026)
Follow Your Pose: Pose-Guided Text-to-Video Generation using Pose-Free Videos
par: Ma, Yue, et autres
Publié: (2023)
par: Ma, Yue, et autres
Publié: (2023)
TIIF-Bench: How Does Your T2I Model Follow Your Instructions?
par: Wei, Xinyu, et autres
Publié: (2025)
par: Wei, Xinyu, et autres
Publié: (2025)
Put Myself in Your Shoes: Lifting the Egocentric Perspective from Exocentric Videos
par: Luo, Mi, et autres
Publié: (2024)
par: Luo, Mi, et autres
Publié: (2024)
Follow-Your-Canvas: Higher-Resolution Video Outpainting with Extensive Content Generation
par: Chen, Qihua, et autres
Publié: (2024)
par: Chen, Qihua, et autres
Publié: (2024)
Why Not Use Your Textbook? Knowledge-Enhanced Procedure Planning of Instructional Videos
par: Nagasinghe, Kumaranage Ravindu Yasas, et autres
Publié: (2024)
par: Nagasinghe, Kumaranage Ravindu Yasas, et autres
Publié: (2024)
Follow-Your-Creation: Empowering 4D Creation through Video Inpainting
par: Ma, Yue, et autres
Publié: (2025)
par: Ma, Yue, et autres
Publié: (2025)
Personalized Video Summarization using Text-Based Queries and Conditional Modeling
par: Huang, Jia-Hong
Publié: (2024)
par: Huang, Jia-Hong
Publié: (2024)
KAN See Your Face
par: Han, Dong, et autres
Publié: (2024)
par: Han, Dong, et autres
Publié: (2024)
Stop Denoising Your Blurs
par: Parvathireddy, Sasidhar, et autres
Publié: (2026)
par: Parvathireddy, Sasidhar, et autres
Publié: (2026)
PRIME: Protect Your Videos From Malicious Editing
par: Li, Guanlin, et autres
Publié: (2024)
par: Li, Guanlin, et autres
Publié: (2024)
Temporal Regularization Makes Your Video Generator Stronger
par: Chen, Harold Haodong, et autres
Publié: (2025)
par: Chen, Harold Haodong, et autres
Publié: (2025)
Is Your Video Language Model a Reliable Judge?
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
VideoVerse: Does Your T2V Generator Have World Model Capability to Synthesize Videos?
par: Wang, Zeqing, et autres
Publié: (2025)
par: Wang, Zeqing, et autres
Publié: (2025)
Let Your Image Move with Your Motion! -- Implicit Multi-Object Multi-Motion Transfer
par: Li, Yuze, et autres
Publié: (2026)
par: Li, Yuze, et autres
Publié: (2026)
CacheFlow: Compressive Streaming Memory for Efficient Long-Form Video Understanding
par: Patel, Shrenik, et autres
Publié: (2025)
par: Patel, Shrenik, et autres
Publié: (2025)
Documents similaires
-
Edit-Your-Interest: Efficient Video Editing via Feature Most-Similar Propagation
par: Zuo, Yi, et autres
Publié: (2025) -
Let Your Video Listen to Your Music!
par: Zhang, Xinyu, et autres
Publié: (2025) -
Control Your Queries: Heterogeneous Query Interaction for Camera-Radar Fusion
par: Wu, Jialong, et autres
Publié: (2026) -
Does Your Vision-Language Model Get Lost in the Long Video Sampling Dilemma?
par: Qu, Tianyuan, et autres
Publié: (2025) -
Where to Focus: Query-Modulated Multimodal Keyframe Selection for Long Video Understanding
par: Wang, Shaoguang, et autres
Publié: (2026)