Enhanced Partially Relevant Video Retrieval through Inter- and Intra-Sample Analysis with Coherence Prediction
Fuente:
arXiv
Guardado en:
| Autores principales: | Ren, Junlong, Zhang, Gangjian, Hu, Yu, Shu, Jian, Xiong, Hui, Wang, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WaMo: Wavelet-Enhanced Multi-Frequency Trajectory Analysis for Fine-Grained Text-Motion Retrieval
por: Ren, Junlong, et al.
Publicado: (2025)
por: Ren, Junlong, et al.
Publicado: (2025)
Diversified Augmentation with Domain Adaptation for Debiased Video Temporal Grounding
por: Ren, Junlong, et al.
Publicado: (2025)
por: Ren, Junlong, et al.
Publicado: (2025)
FastAnimate: Towards Learnable Template Construction and Pose Deformation for Fast 3D Human Avatar Animation
por: Shu, Jian, et al.
Publicado: (2025)
por: Shu, Jian, et al.
Publicado: (2025)
SCA3D: Enhancing Cross-modal 3D Retrieval via 3D Shape and Caption Paired Data Augmentation
por: Ren, Junlong, et al.
Publicado: (2025)
por: Ren, Junlong, et al.
Publicado: (2025)
Enhanced Cross-modal 3D Retrieval via Tri-modal Reconstruction
por: Ren, Junlong, et al.
Publicado: (2025)
por: Ren, Junlong, et al.
Publicado: (2025)
HLFormer: Enhancing Partially Relevant Video Retrieval with Hyperbolic Learning
por: Li, Jun, et al.
Publicado: (2025)
por: Li, Jun, et al.
Publicado: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
por: Zhang, Long, et al.
Publicado: (2025)
por: Zhang, Long, et al.
Publicado: (2025)
PRVR: Partially Relevant Video Retrieval
por: Chen, Xianke, et al.
Publicado: (2022)
por: Chen, Xianke, et al.
Publicado: (2022)
GMMFormer v2: An Uncertainty-aware Framework for Partially Relevant Video Retrieval
por: Wang, Yuting, et al.
Publicado: (2024)
por: Wang, Yuting, et al.
Publicado: (2024)
Uneven Event Modeling for Partially Relevant Video Retrieval
por: Zhu, Sa, et al.
Publicado: (2025)
por: Zhu, Sa, et al.
Publicado: (2025)
Imagine Before Concentration: Diffusion-Guided Registers Enhance Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026)
por: Li, Jun, et al.
Publicado: (2026)
Generator-Refiner-Examiner: A Tri-Module Data Augmentation Framework for 3D Human Avatar Learning from Monocular Videos
por: Zhang, Gangjian, et al.
Publicado: (2026)
por: Zhang, Gangjian, et al.
Publicado: (2026)
MotionGRPO: Overcoming Low Intra-Group Diversity in GRPO-Based Egocentric Motion Recovery
por: Yao, Nanjie, et al.
Publicado: (2026)
por: Yao, Nanjie, et al.
Publicado: (2026)
Real-Time Neural Video Compression with Unified Intra and Inter Coding
por: Xiang, Hui, et al.
Publicado: (2025)
por: Xiang, Hui, et al.
Publicado: (2025)
Towards Efficient Partially Relevant Video Retrieval with Active Moment Discovering
por: Song, Peipei, et al.
Publicado: (2025)
por: Song, Peipei, et al.
Publicado: (2025)
Mitigating Semantic Collapse in Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025)
por: Moon, WonJun, et al.
Publicado: (2025)
SAT: Supervisor Regularization and Animation Augmentation for Two-process Monocular Texture 3D Human Reconstruction
por: Zhang, Gangjian, et al.
Publicado: (2025)
por: Zhang, Gangjian, et al.
Publicado: (2025)
Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval
por: Li, Jun, et al.
Publicado: (2026)
por: Li, Jun, et al.
Publicado: (2026)
MamFusion: Multi-Mamba with Temporal Fusion for Partially Relevant Video Retrieval
por: Ying, Xinru, et al.
Publicado: (2025)
por: Ying, Xinru, et al.
Publicado: (2025)
Improving Video Corpus Moment Retrieval with Partial Relevance Enhancement
por: Hou, Danyang, et al.
Publicado: (2024)
por: Hou, Danyang, et al.
Publicado: (2024)
Ambiguity-Restrained Text-Video Representation Learning for Partially Relevant Video Retrieval
por: Cho, CH, et al.
Publicado: (2025)
por: Cho, CH, et al.
Publicado: (2025)
Dual Learning with Dynamic Knowledge Distillation and Soft Alignment for Partially Relevant Video Retrieval
por: Dong, Jianfeng, et al.
Publicado: (2025)
por: Dong, Jianfeng, et al.
Publicado: (2025)
Prototypes are Balanced Units for Efficient and Effective Partially Relevant Video Retrieval
por: Moon, WonJun, et al.
Publicado: (2025)
por: Moon, WonJun, et al.
Publicado: (2025)
Unify3D: An Augmented Holistic End-to-end Monocular 3D Human Reconstruction via Anatomy Shaping and Twins Negotiating
por: Yao, Nanjie, et al.
Publicado: (2025)
por: Yao, Nanjie, et al.
Publicado: (2025)
Video Super-Resolution Transformer with Masked Inter&Intra-Frame Attention
por: Zhou, Xingyu, et al.
Publicado: (2024)
por: Zhou, Xingyu, et al.
Publicado: (2024)
ProPy: Building Interactive Prompt Pyramids upon CLIP for Partially Relevant Video Retrieval
por: Pan, Yi, et al.
Publicado: (2025)
por: Pan, Yi, et al.
Publicado: (2025)
MultiGO++: Monocular 3D Clothed Human Reconstruction via Geometry-Texture Collaboration
por: Yao, Nanjie, et al.
Publicado: (2026)
por: Yao, Nanjie, et al.
Publicado: (2026)
GMMFormer: Gaussian-Mixture-Model Based Transformer for Efficient Partially Relevant Video Retrieval
por: Wang, Yuting, et al.
Publicado: (2023)
por: Wang, Yuting, et al.
Publicado: (2023)
Vision-Language Models Learn Super Images for Efficient Partially Relevant Video Retrieval
por: Nishimura, Taichi, et al.
Publicado: (2023)
por: Nishimura, Taichi, et al.
Publicado: (2023)
Knowledge-Refined Dual Context-Aware Network for Partially Relevant Video Retrieval
por: Yang, Junkai, et al.
Publicado: (2026)
por: Yang, Junkai, et al.
Publicado: (2026)
Detail-Enhanced Intra- and Inter-modal Interaction for Audio-Visual Emotion Recognition
por: Shi, Tong, et al.
Publicado: (2024)
por: Shi, Tong, et al.
Publicado: (2024)
PhysAlign: Physics-Coherent Image-to-Video Generation through Feature and 3D Representation Alignment
por: Xiong, Zhexiao, et al.
Publicado: (2026)
por: Xiong, Zhexiao, et al.
Publicado: (2026)
Missing Target-Relevant Information Prediction with World Model for Accurate Zero-Shot Composed Image Retrieval
por: Tang, Yuanmin, et al.
Publicado: (2025)
por: Tang, Yuanmin, et al.
Publicado: (2025)
Dose Prediction Driven Radiotherapy Paramters Regression via Intra- and Inter-Relation Modeling
por: Cui, Jiaqi, et al.
Publicado: (2024)
por: Cui, Jiaqi, et al.
Publicado: (2024)
QuRe: Query-Relevant Retrieval through Hard Negative Sampling in Composed Image Retrieval
por: Kwak, Jaehyun, et al.
Publicado: (2025)
por: Kwak, Jaehyun, et al.
Publicado: (2025)
Decoding Ancient Oracle Bone Script via Generative Dictionary Retrieval
por: Wu, Yin, et al.
Publicado: (2026)
por: Wu, Yin, et al.
Publicado: (2026)
Relevance-guided Audio Visual Fusion for Video Saliency Prediction
por: Yu, Li, et al.
Publicado: (2024)
por: Yu, Li, et al.
Publicado: (2024)
Inter- and Intra-image Refinement for Few Shot Segmentation
por: Fu, Ourui, et al.
Publicado: (2025)
por: Fu, Ourui, et al.
Publicado: (2025)
Swin Transformer for Robust Differentiation of Real and Synthetic Images: Intra- and Inter-Dataset Analysis
por: Mehta, Preetu, et al.
Publicado: (2024)
por: Mehta, Preetu, et al.
Publicado: (2024)
$I^{2}$-World: Intra-Inter Tokenization for Efficient Dynamic 4D Scene Forecasting
por: Liao, Zhimin, et al.
Publicado: (2025)
por: Liao, Zhimin, et al.
Publicado: (2025)
Ejemplares similares
-
WaMo: Wavelet-Enhanced Multi-Frequency Trajectory Analysis for Fine-Grained Text-Motion Retrieval
por: Ren, Junlong, et al.
Publicado: (2025) -
Diversified Augmentation with Domain Adaptation for Debiased Video Temporal Grounding
por: Ren, Junlong, et al.
Publicado: (2025) -
FastAnimate: Towards Learnable Template Construction and Pose Deformation for Fast 3D Human Avatar Animation
por: Shu, Jian, et al.
Publicado: (2025) -
SCA3D: Enhancing Cross-modal 3D Retrieval via 3D Shape and Caption Paired Data Augmentation
por: Ren, Junlong, et al.
Publicado: (2025) -
Enhanced Cross-modal 3D Retrieval via Tri-modal Reconstruction
por: Ren, Junlong, et al.
Publicado: (2025)