SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
Fuente:
arXiv
Salvato in:
| Autori principali: | Mao, Lingtao, Dai, Huangyu, Sun, Xinyu, Liang, Zihan, Chen, Ben, Lei, Chenyi, Ou, Wenwu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
di: Sun, Xinyu, et al.
Pubblicazione: (2026)
di: Sun, Xinyu, et al.
Pubblicazione: (2026)
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
di: Ma, Yufei, et al.
Pubblicazione: (2026)
di: Ma, Yufei, et al.
Pubblicazione: (2026)
IG-Search: Step-Level Information Gain Rewards for Search-Augmented Reasoning
di: Liang, Zihan, et al.
Pubblicazione: (2026)
di: Liang, Zihan, et al.
Pubblicazione: (2026)
OneVision: An End-to-End Generative Framework for Multi-view E-commerce Vision Search
di: Zheng, Zexin, et al.
Pubblicazione: (2025)
di: Zheng, Zexin, et al.
Pubblicazione: (2025)
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
di: Nan, Xinyu, et al.
Pubblicazione: (2025)
di: Nan, Xinyu, et al.
Pubblicazione: (2025)
H-PRM: A Pluggable Hotword Pre-Retrieval Module for Various Speech Recognition Systems
di: Dai, Huangyu, et al.
Pubblicazione: (2025)
di: Dai, Huangyu, et al.
Pubblicazione: (2025)
Plan Before Search: Search Agents Need Plan
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
Search-E1: Self-Distillation Drives Self-Evolution in Search-Augmented Reasoning
di: Liang, Zihan, et al.
Pubblicazione: (2026)
di: Liang, Zihan, et al.
Pubblicazione: (2026)
InfoGain-RAG: Boosting Retrieval-Augmented Generation via Document Information Gain-based Reranking and Filtering
di: Wang, Zihan, et al.
Pubblicazione: (2025)
di: Wang, Zihan, et al.
Pubblicazione: (2025)
UniECS: Unified Multimodal E-Commerce Search Framework with Gated Cross-modal Fusion
di: Liang, Zihan, et al.
Pubblicazione: (2025)
di: Liang, Zihan, et al.
Pubblicazione: (2025)
OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Framework
di: Chen, Ben, et al.
Pubblicazione: (2026)
di: Chen, Ben, et al.
Pubblicazione: (2026)
KuaiSearch: A Large-Scale E-Commerce Search Dataset for Recall, Ranking, and Relevance
di: Li, Yupeng, et al.
Pubblicazione: (2026)
di: Li, Yupeng, et al.
Pubblicazione: (2026)
CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
di: Qian, Zhipeng, et al.
Pubblicazione: (2026)
Beyond Relevance: Improving User Engagement by Personalization for Short-Video Search
di: Bao, Wentian, et al.
Pubblicazione: (2024)
di: Bao, Wentian, et al.
Pubblicazione: (2024)
Towards Context-aware Reasoning-enhanced Generative Searching in E-commerce
di: Liu, Zhiding, et al.
Pubblicazione: (2025)
di: Liu, Zhiding, et al.
Pubblicazione: (2025)
Unbiased Multimodal Reranking for Long-Tail Short-Video Search
di: Xu, Wenyi, et al.
Pubblicazione: (2026)
di: Xu, Wenyi, et al.
Pubblicazione: (2026)
Contrastive Token Learning with Similarity Decay for Repetition Suppression in Machine Translation
di: Dai, Huangyu, et al.
Pubblicazione: (2024)
di: Dai, Huangyu, et al.
Pubblicazione: (2024)
DiffusionGS: Generative Search with Query Conditioned Diffusion in Kuaishou
di: Li, Qinyao, et al.
Pubblicazione: (2025)
di: Li, Qinyao, et al.
Pubblicazione: (2025)
Robust Interaction-Based Relevance Modeling for Online e-Commerce Search
di: Chen, Ben, et al.
Pubblicazione: (2024)
di: Chen, Ben, et al.
Pubblicazione: (2024)
FinMR: A Knowledge-Intensive Multimodal Benchmark for Advanced Financial Reasoning
di: Deng, Shuangyan, et al.
Pubblicazione: (2025)
di: Deng, Shuangyan, et al.
Pubblicazione: (2025)
MoDULA: Mixture of Domain-Specific and Universal LoRA for Multi-Task Learning
di: Ma, Yufei, et al.
Pubblicazione: (2024)
di: Ma, Yufei, et al.
Pubblicazione: (2024)
OneSearch: A Preliminary Exploration of the Unified End-to-End Generative Framework for E-commerce Search
di: Chen, Ben, et al.
Pubblicazione: (2025)
di: Chen, Ben, et al.
Pubblicazione: (2025)
COINS: SemantiC Ids Enhanced COLd Item RepresentatioN for Click-through Rate Prediction in E-commerce Search
di: Zhao, Qihang, et al.
Pubblicazione: (2025)
di: Zhao, Qihang, et al.
Pubblicazione: (2025)
Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering
di: Choi, Changin, et al.
Pubblicazione: (2025)
di: Choi, Changin, et al.
Pubblicazione: (2025)
Benchmarking Safety Risks of Knowledge-Intensive Reasoning under Malicious Knowledge Editing
di: Mao, Qinghua, et al.
Pubblicazione: (2026)
di: Mao, Qinghua, et al.
Pubblicazione: (2026)
Detecting Dark Matter Substructures on Small Scales with Fast Radio Bursts
di: Xiao, Huangyu, et al.
Pubblicazione: (2024)
di: Xiao, Huangyu, et al.
Pubblicazione: (2024)
HardMTBench: Stress-Testing Chinese-English Translation on Knowledge-Intensive Domains
di: Li, Zheng, et al.
Pubblicazione: (2026)
di: Li, Zheng, et al.
Pubblicazione: (2026)
GRADE: Personalized Multi-Task Fusion via Group-relative Reinforcement Learning with Adaptive Dirichlet Exploration
di: Hong, Tingfeng, et al.
Pubblicazione: (2025)
di: Hong, Tingfeng, et al.
Pubblicazione: (2025)
Knowledge-Intensive Video Generation
di: Wang, Chenxu, et al.
Pubblicazione: (2026)
di: Wang, Chenxu, et al.
Pubblicazione: (2026)
KARMA: Knowledge-Action Regularized Multimodal Alignment for Personalized Search at Taobao
di: Sun, Zhi, et al.
Pubblicazione: (2026)
di: Sun, Zhi, et al.
Pubblicazione: (2026)
Benchmarking Video Frame Interpolation
di: Kiefhaber, Simon, et al.
Pubblicazione: (2024)
di: Kiefhaber, Simon, et al.
Pubblicazione: (2024)
Knowledge-to-Verification: Exploring RLVR for LLMs in Knowledge-Intensive Domains
di: Yuan, Zhonghang, et al.
Pubblicazione: (2026)
di: Yuan, Zhonghang, et al.
Pubblicazione: (2026)
Exploring the Potential of Multimodal LLM with Knowledge-Intensive Multimodal ASR
di: Wang, Minghan, et al.
Pubblicazione: (2024)
di: Wang, Minghan, et al.
Pubblicazione: (2024)
Synthetic Data Powers Product Retrieval for Long-tail Knowledge-Intensive Queries in E-commerce Search
di: Ling, Gui, et al.
Pubblicazione: (2026)
di: Ling, Gui, et al.
Pubblicazione: (2026)
HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering
di: Ben-Ami, Dan, et al.
Pubblicazione: (2026)
di: Ben-Ami, Dan, et al.
Pubblicazione: (2026)
Video Finetuning Improves Reasoning Between Frames
di: Yang, Ruiqi, et al.
Pubblicazione: (2025)
di: Yang, Ruiqi, et al.
Pubblicazione: (2025)
TransportationGames: Benchmarking Transportation Knowledge of (Multimodal) Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2024)
di: Zhang, Xue, et al.
Pubblicazione: (2024)
VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge
di: Song, Yueqi, et al.
Pubblicazione: (2025)
di: Song, Yueqi, et al.
Pubblicazione: (2025)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
di: Wen, Haoyang, et al.
Pubblicazione: (2024)
di: Wen, Haoyang, et al.
Pubblicazione: (2024)
MEDMKG: Benchmarking Medical Knowledge Exploitation with Multimodal Knowledge Graph
di: Wang, Xiaochen, et al.
Pubblicazione: (2025)
di: Wang, Xiaochen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
di: Sun, Xinyu, et al.
Pubblicazione: (2026) -
SD-Search: On-Policy Hindsight Self-Distillation for Search-Augmented Reasoning
di: Ma, Yufei, et al.
Pubblicazione: (2026) -
IG-Search: Step-Level Information Gain Rewards for Search-Augmented Reasoning
di: Liang, Zihan, et al.
Pubblicazione: (2026) -
OneVision: An End-to-End Generative Framework for Multi-view E-commerce Vision Search
di: Zheng, Zexin, et al.
Pubblicazione: (2025) -
UniDGF: A Unified Detection-to-Generation Framework for Hierarchical Object Visual Recognition
di: Nan, Xinyu, et al.
Pubblicazione: (2025)