Bias-Conflict Sample Synthesis and Adversarial Removal Debias Strategy for Temporal Sentence Grounding in Video
Fuente:
arXiv
Salvato in:
| Autori principali: | Qi, Zhaobo, Yuan, Yibo, Ruan, Xiaowen, Wang, Shuhui, Zhang, Weigang, Huang, Qingming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty-boosted Robust Video Activity Anticipation
di: Qi, Zhaobo, et al.
Pubblicazione: (2024)
di: Qi, Zhaobo, et al.
Pubblicazione: (2024)
Masked Temporal Interpolation Diffusion for Procedure Planning in Instructional Videos
di: Zhou, Yufan, et al.
Pubblicazione: (2025)
di: Zhou, Yufan, et al.
Pubblicazione: (2025)
Enhancing Pre-trained Representation Classifiability can Boost its Interpretability
di: Shen, Shufan, et al.
Pubblicazione: (2025)
di: Shen, Shufan, et al.
Pubblicazione: (2025)
Weakly Supervised Temporal Sentence Grounding via Positive Sample Mining
di: Dong, Lu, et al.
Pubblicazione: (2025)
di: Dong, Lu, et al.
Pubblicazione: (2025)
Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning for Video Temporal Grounding
di: Zheng, Zelin, et al.
Pubblicazione: (2026)
di: Zheng, Zelin, et al.
Pubblicazione: (2026)
Context Consistency Learning via Sentence Removal for Semi-Supervised Video Paragraph Grounding
di: Zhong, Yaokun, et al.
Pubblicazione: (2025)
di: Zhong, Yaokun, et al.
Pubblicazione: (2025)
Efficient Temporal Sentence Grounding in Videos with Multi-Teacher Knowledge Distillation
di: Liang, Renjie, et al.
Pubblicazione: (2023)
di: Liang, Renjie, et al.
Pubblicazione: (2023)
A Paradigm Shift: Fully End-to-End Training for Temporal Sentence Grounding in Videos
di: He, Allen, et al.
Pubblicazione: (2026)
di: He, Allen, et al.
Pubblicazione: (2026)
HERO: Hierarchical Embedding-Refinement for Open-Vocabulary Temporal Sentence Grounding in Videos
di: Han, Tingting, et al.
Pubblicazione: (2026)
di: Han, Tingting, et al.
Pubblicazione: (2026)
Prompting Video-Language Foundation Models with Domain-specific Fine-grained Heuristics for Video Question Answering
di: Yu, Ting, et al.
Pubblicazione: (2024)
di: Yu, Ting, et al.
Pubblicazione: (2024)
Let Me Finish My Sentence: Video Temporal Grounding with Holistic Text Understanding
di: Woo, Jongbhin, et al.
Pubblicazione: (2024)
di: Woo, Jongbhin, et al.
Pubblicazione: (2024)
Sim-DETR: Unlock DETR for Temporal Sentence Grounding
di: Tang, Jiajin, et al.
Pubblicazione: (2025)
di: Tang, Jiajin, et al.
Pubblicazione: (2025)
Contrast-Unity for Partially-Supervised Temporal Sentence Grounding
di: Wang, Haicheng, et al.
Pubblicazione: (2025)
di: Wang, Haicheng, et al.
Pubblicazione: (2025)
Multi-Sentence Grounding for Long-term Instructional Video
di: Li, Zeqian, et al.
Pubblicazione: (2023)
di: Li, Zeqian, et al.
Pubblicazione: (2023)
Length Matters: Length-Aware Transformer for Temporal Sentence Grounding
di: Wang, Yifan, et al.
Pubblicazione: (2025)
di: Wang, Yifan, et al.
Pubblicazione: (2025)
Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding
di: Sun, Xiaolong, et al.
Pubblicazione: (2024)
di: Sun, Xiaolong, et al.
Pubblicazione: (2024)
Boosting Temporal Sentence Grounding via Causal Inference
di: Tang, Kefan, et al.
Pubblicazione: (2025)
di: Tang, Kefan, et al.
Pubblicazione: (2025)
Locate-then-Sparsify: Attribution Guided Sparse Strategy for Visual Hallucination Mitigation
di: Dang, Tiantian, et al.
Pubblicazione: (2026)
di: Dang, Tiantian, et al.
Pubblicazione: (2026)
SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
BAM-DETR: Boundary-Aligned Moment Detection Transformer for Temporal Sentence Grounding in Videos
di: Lee, Pilhyeon, et al.
Pubblicazione: (2023)
di: Lee, Pilhyeon, et al.
Pubblicazione: (2023)
VL-SAE: Interpreting and Enhancing Vision-Language Alignment with a Unified Concept Set
di: Shen, Shufan, et al.
Pubblicazione: (2025)
di: Shen, Shufan, et al.
Pubblicazione: (2025)
Kernelized Sparse Fine-Tuning with Bi-level Parameter Competition for Vision Models
di: Shen, Shufan, et al.
Pubblicazione: (2025)
di: Shen, Shufan, et al.
Pubblicazione: (2025)
Bootstrapping Physics-Grounded Video Generation through VLM-Guided Iterative Self-Refinement
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
Collaborative Temporal Consistency Learning for Point-supervised Natural Language Video Localization
di: Tao, Zhuo, et al.
Pubblicazione: (2025)
di: Tao, Zhuo, et al.
Pubblicazione: (2025)
When the Future Becomes the Past: Taming Temporal Correspondence for Self-supervised Video Representation Learning
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
Exploring the Temporal Consistency for Point-Level Weakly-Supervised Temporal Action Localization
di: Ma, Yunchuan, et al.
Pubblicazione: (2026)
di: Ma, Yunchuan, et al.
Pubblicazione: (2026)
Empower Words: DualGround for Structured Phrase and Sentence-Level Temporal Grounding
di: Kang, Minseok, et al.
Pubblicazione: (2025)
di: Kang, Minseok, et al.
Pubblicazione: (2025)
GroundVTS: Visual Token Sampling in Multimodal Large Language Models for Video Temporal Grounding
di: Fan, Rong, et al.
Pubblicazione: (2026)
di: Fan, Rong, et al.
Pubblicazione: (2026)
Limb-Aware Virtual Try-On Network with Progressive Clothing Warping
di: Zhang, Shengping, et al.
Pubblicazione: (2025)
di: Zhang, Shengping, et al.
Pubblicazione: (2025)
Context-Guided Spatio-Temporal Video Grounding
di: Gu, Xin, et al.
Pubblicazione: (2024)
di: Gu, Xin, et al.
Pubblicazione: (2024)
Multi-Pair Temporal Sentence Grounding via Multi-Thread Knowledge Transfer Network
di: Fang, Xiang, et al.
Pubblicazione: (2024)
di: Fang, Xiang, et al.
Pubblicazione: (2024)
A Comprehensive Survey of 3D Dense Captioning: Localizing and Describing Objects in 3D Scenes
di: Yu, Ting, et al.
Pubblicazione: (2024)
di: Yu, Ting, et al.
Pubblicazione: (2024)
Expanding Sparse Tuning for Low Memory Usage
di: Shen, Shufan, et al.
Pubblicazione: (2024)
di: Shen, Shufan, et al.
Pubblicazione: (2024)
EvoGround: Self-Evolving Video Agents for Video Temporal Grounding
di: Jung, Minjoon, et al.
Pubblicazione: (2026)
di: Jung, Minjoon, et al.
Pubblicazione: (2026)
SOVC: Subject-Oriented Video Captioning
di: Teng, Chang, et al.
Pubblicazione: (2023)
di: Teng, Chang, et al.
Pubblicazione: (2023)
SLCFormer: Spectral-Local Context Transformer with Physics-Grounded Flare Synthesis for Nighttime Flare Removal
di: Zhu, Xiyu, et al.
Pubblicazione: (2025)
di: Zhu, Xiyu, et al.
Pubblicazione: (2025)
Jump-teaching: Combating Sample Selection Bias via Temporal Disagreement
di: Ji, Kangye, et al.
Pubblicazione: (2024)
di: Ji, Kangye, et al.
Pubblicazione: (2024)
Boosting Point-supervised Temporal Action Localization via Text Refinement and Alignment
di: Ma, Yunchuan, et al.
Pubblicazione: (2026)
di: Ma, Yunchuan, et al.
Pubblicazione: (2026)
Towards Long-Form Spatio-Temporal Video Grounding
di: Gu, Xin, et al.
Pubblicazione: (2026)
di: Gu, Xin, et al.
Pubblicazione: (2026)
Video-GroundingDINO: Towards Open-Vocabulary Spatio-Temporal Video Grounding
di: Wasim, Syed Talal, et al.
Pubblicazione: (2023)
di: Wasim, Syed Talal, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Uncertainty-boosted Robust Video Activity Anticipation
di: Qi, Zhaobo, et al.
Pubblicazione: (2024) -
Masked Temporal Interpolation Diffusion for Procedure Planning in Instructional Videos
di: Zhou, Yufan, et al.
Pubblicazione: (2025) -
Enhancing Pre-trained Representation Classifiability can Boost its Interpretability
di: Shen, Shufan, et al.
Pubblicazione: (2025) -
Weakly Supervised Temporal Sentence Grounding via Positive Sample Mining
di: Dong, Lu, et al.
Pubblicazione: (2025) -
Foresee-to-Ground: From Predictive Temporal Perception to Evidence-Driven Reasoning for Video Temporal Grounding
di: Zheng, Zelin, et al.
Pubblicazione: (2026)