See More, Store Less: Memory-Efficient Resolution for Video Moment Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jeon, Mingyu, Han, Sungjin, Hwang, Jinkwon, Kwon, Minchol, Kim, Jonghee, Kim, Junyeong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Point to Span: Zero-Shot Moment Retrieval for Navigating Unseen Hour-Long Videos
par: Jeon, Mingyu, et autres
Publié: (2025)
par: Jeon, Mingyu, et autres
Publié: (2025)
GranAlign: Granularity-Aware Alignment Framework for Zero-Shot Video Moment Retrieval
par: Jeon, Mingyu, et autres
Publié: (2026)
par: Jeon, Mingyu, et autres
Publié: (2026)
Selective Query-guided Debiasing for Video Corpus Moment Retrieval
par: Yoon, Sunjae, et autres
Publié: (2022)
par: Yoon, Sunjae, et autres
Publié: (2022)
Background-aware Moment Detection for Video Moment Retrieval
par: Jung, Minjoon, et autres
Publié: (2023)
par: Jung, Minjoon, et autres
Publié: (2023)
Seeing More with Less: Video Capsule Endoscopy with Multi-Task Learning
par: Werner, Julia, et autres
Publié: (2025)
par: Werner, Julia, et autres
Publié: (2025)
Visual Funnel: Resolving Contextual Blindness in Multimodal Large Language Models
par: Jung, Woojun, et autres
Publié: (2025)
par: Jung, Woojun, et autres
Publié: (2025)
QEVA: A Reference-Free Evaluation Metric for Narrative Video Summarization with Multimodal Question Answering
par: Jung, Woojun, et autres
Publié: (2026)
par: Jung, Woojun, et autres
Publié: (2026)
Learning More by Seeing Less: Structure First Learning for Efficient, Transferable, and Human-Aligned Vision
par: Li, Tianqin, et autres
Publié: (2025)
par: Li, Tianqin, et autres
Publié: (2025)
See, Rank, and Filter: Important Word-Aware Clip Filtering via Scene Understanding for Moment Retrieval and Highlight Detection
par: Lee, YuEun, et autres
Publié: (2025)
par: Lee, YuEun, et autres
Publié: (2025)
Less is More: Decoder-Free Masked Modeling for Efficient Skeleton Representation Learning
par: Do, Jeonghyeok, et autres
Publié: (2026)
par: Do, Jeonghyeok, et autres
Publié: (2026)
See More, Change Less: Anatomy-Aware Diffusion for Contrast Enhancement
par: Liu, Junqi, et autres
Publié: (2025)
par: Liu, Junqi, et autres
Publié: (2025)
Less is More: Improving Motion Diffusion Models with Sparse Keyframes
par: Bae, Jinseok, et autres
Publié: (2025)
par: Bae, Jinseok, et autres
Publié: (2025)
Sali4Vid: Saliency-Aware Video Reweighting and Adaptive Caption Retrieval for Dense Video Captioning
par: Jeon, MinJu, et autres
Publié: (2025)
par: Jeon, MinJu, et autres
Publié: (2025)
Factorized Multi-Resolution HashGrid for Efficient Neural Radiance Fields: Execution on Edge-Devices
par: Jun-Seong, Kim, et autres
Publié: (2026)
par: Jun-Seong, Kim, et autres
Publié: (2026)
SCANet: Scene Complexity Aware Network for Weakly-Supervised Video Moment Retrieval
par: Yoon, Sunjae, et autres
Publié: (2023)
par: Yoon, Sunjae, et autres
Publié: (2023)
Do You Remember? Dense Video Captioning with Cross-Modal Memory Retrieval
par: Kim, Minkuk, et autres
Publié: (2024)
par: Kim, Minkuk, et autres
Publié: (2024)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
par: Song, Peipei, et autres
Publié: (2025)
par: Song, Peipei, et autres
Publié: (2025)
WorldKV: Efficient World Memory with World Retrieval and Compression
par: Yi, Jung, et autres
Publié: (2026)
par: Yi, Jung, et autres
Publié: (2026)
Visualizing the loss landscape of Self-supervised Vision Transformer
par: Lee, Youngwan, et autres
Publié: (2024)
par: Lee, Youngwan, et autres
Publié: (2024)
Moment of Untruth: Dealing with Negative Queries in Video Moment Retrieval
par: Flanagan, Kevin, et autres
Publié: (2025)
par: Flanagan, Kevin, et autres
Publié: (2025)
Supervise Less, See More: Training-free Nuclear Instance Segmentation with Prototype-Guided Prompting
par: Zhang, Wen, et autres
Publié: (2025)
par: Zhang, Wen, et autres
Publié: (2025)
Denoise-then-Retrieve: Text-Conditioned Video Denoising for Video Moment Retrieval
par: Liu, Weijia, et autres
Publié: (2025)
par: Liu, Weijia, et autres
Publié: (2025)
See-Saw Modality Balance: See Gradient, and Sew Impaired Vision-Language Balance to Mitigate Dominant Modality Bias
par: Kwon, JuneHyoung, et autres
Publié: (2025)
par: Kwon, JuneHyoung, et autres
Publié: (2025)
Watch Video, Catch Keyword: Context-aware Keyword Attention for Moment Retrieval and Highlight Detection
par: Um, Sung Jin, et autres
Publié: (2025)
par: Um, Sung Jin, et autres
Publié: (2025)
See More Details: Efficient Image Super-Resolution by Experts Mining
par: Zamfir, Eduard, et autres
Publié: (2024)
par: Zamfir, Eduard, et autres
Publié: (2024)
DepthFocus: Controllable Depth Estimation for See-Through Scenes
par: Min, Junhong, et autres
Publié: (2025)
par: Min, Junhong, et autres
Publié: (2025)
Object-Centric Framework for Video Moment Retrieval
par: Li, Zongyao, et autres
Publié: (2025)
par: Li, Zongyao, et autres
Publié: (2025)
Seeing More, Saying More: Lightweight Language Experts are Dynamic Video Token Compressors
par: Wang, Xiangchen, et autres
Publié: (2025)
par: Wang, Xiangchen, et autres
Publié: (2025)
Less is More: Token-Efficient Video-QA via Adaptive Frame-Pruning and Semantic Graph Integration
par: Wang, Shaoguang, et autres
Publié: (2025)
par: Wang, Shaoguang, et autres
Publié: (2025)
One Look is Enough: Seamless Patchwise Refinement for Zero-Shot Monocular Depth Estimation on High-Resolution Images
par: Kwon, Byeongjun, et autres
Publié: (2025)
par: Kwon, Byeongjun, et autres
Publié: (2025)
More Thinking, Less Seeing? Assessing Amplified Hallucination in Multimodal Reasoning Models
par: Liu, Chengzhi, et autres
Publié: (2025)
par: Liu, Chengzhi, et autres
Publié: (2025)
Beyond Caption-Based Queries for Video Moment Retrieval
par: Pujol-Perich, David, et autres
Publié: (2026)
par: Pujol-Perich, David, et autres
Publié: (2026)
Follow the Saliency: Supervised Saliency for Retrieval-augmented Dense Video Captioning
par: Choi, Seung hee, et autres
Publié: (2026)
par: Choi, Seung hee, et autres
Publié: (2026)
MLLM as Video Narrator: Mitigating Modality Imbalance in Video Moment Retrieval
par: Cai, Weitong, et autres
Publié: (2024)
par: Cai, Weitong, et autres
Publié: (2024)
Generative Video Diffusion for Unseen Novel Semantic Video Moment Retrieval
par: Luo, Dezhao, et autres
Publié: (2024)
par: Luo, Dezhao, et autres
Publié: (2024)
The More You See in 2D, the More You Perceive in 3D
par: Han, Xinyang, et autres
Publié: (2024)
par: Han, Xinyang, et autres
Publié: (2024)
See Less, See Right: Bi-directional Perceptual Shaping For Multimodal Reasoning
par: Zhang, Shuoshuo, et autres
Publié: (2025)
par: Zhang, Shuoshuo, et autres
Publié: (2025)
PLATYPUS: Progressive Local Surface Estimator for Arbitrary-Scale Point Cloud Upsampling
par: Kim, Donghyun, et autres
Publié: (2024)
par: Kim, Donghyun, et autres
Publié: (2024)
Delaunay Canopy: Building Wireframe Reconstruction from Airborne LiDAR Point Clouds via Delaunay Graph
par: Kim, Donghyun, et autres
Publié: (2026)
par: Kim, Donghyun, et autres
Publié: (2026)
Finding Optimal Video Moment without Training: Gaussian Boundary Optimization for Weakly Supervised Video Grounding
par: Kim, Sunoh, et autres
Publié: (2026)
par: Kim, Sunoh, et autres
Publié: (2026)
Documents similaires
-
Point to Span: Zero-Shot Moment Retrieval for Navigating Unseen Hour-Long Videos
par: Jeon, Mingyu, et autres
Publié: (2025) -
GranAlign: Granularity-Aware Alignment Framework for Zero-Shot Video Moment Retrieval
par: Jeon, Mingyu, et autres
Publié: (2026) -
Selective Query-guided Debiasing for Video Corpus Moment Retrieval
par: Yoon, Sunjae, et autres
Publié: (2022) -
Background-aware Moment Detection for Video Moment Retrieval
par: Jung, Minjoon, et autres
Publié: (2023) -
Seeing More with Less: Video Capsule Endoscopy with Multi-Task Learning
par: Werner, Julia, et autres
Publié: (2025)