First Place Solution to the Multiple-choice Video QA Track of The Second Perception Test Challenge
Fuente:
arXiv
Guardado en:
| Autores principales: | Peng, Yingzhe, Yuan, Yixiao, Ao, Zitian, Zhou, Huapeng, Wang, Kangqi, Zhu, Qipeng, Yang, Xu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ICCV23 Visual-Dialog Emotion Explanation Challenge: SEU_309 Team Technical Report
por: Yuan, Yixiao, et al.
Publicado: (2024)
por: Yuan, Yixiao, et al.
Publicado: (2024)
Solution for Temporal Sound Localisation Task of ECCV Second Perception Test Challenge 2024
por: Gu, Haowei, et al.
Publicado: (2024)
por: Gu, Haowei, et al.
Publicado: (2024)
The Solution for the ICCV 2023 Perception Test Challenge 2023 -- Task 6 -- Grounded videoQA
por: Zhang, Hailiang, et al.
Publicado: (2024)
por: Zhang, Hailiang, et al.
Publicado: (2024)
The Solution for Single Object Tracking Task of Perception Test Challenge 2024
por: Zhong, Zhiqiang, et al.
Publicado: (2024)
por: Zhong, Zhiqiang, et al.
Publicado: (2024)
Solution for Point Tracking Task of ICCV 1st Perception Test Challenge 2023
por: Pan, Hongpeng, et al.
Publicado: (2024)
por: Pan, Hongpeng, et al.
Publicado: (2024)
Second Place Solution of WSDM2023 Toloka Visual Question Answering Challenge
por: Wu, Xiangyu, et al.
Publicado: (2024)
por: Wu, Xiangyu, et al.
Publicado: (2024)
Solution for Point Tracking Task of ECCV 2nd Perception Test Challenge 2024
por: Zhang, Yuxuan, et al.
Publicado: (2024)
por: Zhang, Yuxuan, et al.
Publicado: (2024)
FVOS for MOSE Track of 4th PVUW Challenge: 3rd Place Solution
por: Wang, Mengjiao, et al.
Publicado: (2025)
por: Wang, Mengjiao, et al.
Publicado: (2025)
DeQA-Doc: Adapting DeQA-Score to Document Image Quality Assessment
por: Gao, Junjie, et al.
Publicado: (2025)
por: Gao, Junjie, et al.
Publicado: (2025)
Perception Test 2024: Challenge Summary and a Novel Hour-Long VideoQA Benchmark
por: Heyward, Joseph, et al.
Publicado: (2024)
por: Heyward, Joseph, et al.
Publicado: (2024)
First Place Solution of 2023 Global Artificial Intelligence Technology Innovation Competition Track 1
por: Wu, Xiangyu, et al.
Publicado: (2024)
por: Wu, Xiangyu, et al.
Publicado: (2024)
The First Place Solution of WSDM Cup 2024: Leveraging Large Language Models for Conversational Multi-Doc QA
por: Li, Yiming, et al.
Publicado: (2024)
por: Li, Yiming, et al.
Publicado: (2024)
The Solution for Temporal Action Localisation Task of Perception Test Challenge 2024
por: Han, Yinan, et al.
Publicado: (2024)
por: Han, Yinan, et al.
Publicado: (2024)
Video Flow as Time Series: Discovering Temporal Consistency and Variability for VideoQA
por: Song, Zijie, et al.
Publicado: (2025)
por: Song, Zijie, et al.
Publicado: (2025)
First Place Solution to the MLCAS 2025 GWFSS Challenge: The Devil is in the Detail and Minority
por: Cao, Songliang, et al.
Publicado: (2025)
por: Cao, Songliang, et al.
Publicado: (2025)
First-Place Solution to NeurIPS 2024 Invisible Watermark Removal Challenge
por: Shamshad, Fahad, et al.
Publicado: (2025)
por: Shamshad, Fahad, et al.
Publicado: (2025)
Adapting SAM 2 for Visual Object Tracking: 1st Place Solution for MMVPR Challenge Multi-Modal Tracking
por: Yang, Cheng-Yen, et al.
Publicado: (2025)
por: Yang, Cheng-Yen, et al.
Publicado: (2025)
1st Place Solution of Multiview Egocentric Hand Tracking Challenge ECCV2024
por: Zou, Minqiang, et al.
Publicado: (2024)
por: Zou, Minqiang, et al.
Publicado: (2024)
The Instance-centric Transformer for the RVOS Track of LSVOS Challenge: 3rd Place Solution
por: Cao, Bin, et al.
Publicado: (2024)
por: Cao, Bin, et al.
Publicado: (2024)
MVP: Winning Solution to SMP Challenge 2025 Video Track
por: Ye, Liliang, et al.
Publicado: (2025)
por: Ye, Liliang, et al.
Publicado: (2025)
Adaptive Dense Evidence Refinement for Video Relational Reasoning for VRR-QA Challenge
por: Sun, Yuyang, et al.
Publicado: (2026)
por: Sun, Yuyang, et al.
Publicado: (2026)
3rd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Liu, Xinyu, et al.
Publicado: (2024)
por: Liu, Xinyu, et al.
Publicado: (2024)
3rd Place Solution for PVUW Challenge 2024: Video Panoptic Segmentation
por: Wu, Ruipu, et al.
Publicado: (2024)
por: Wu, Ruipu, et al.
Publicado: (2024)
2nd Place Solution for PVUW Challenge 2024: Video Panoptic Segmentation
por: Wu, Biao, et al.
Publicado: (2024)
por: Wu, Biao, et al.
Publicado: (2024)
2nd Place Solution for MOSE Track in CVPR 2024 PVUW workshop: Complex Video Object Segmentation
por: Xu, Zhensong, et al.
Publicado: (2024)
por: Xu, Zhensong, et al.
Publicado: (2024)
Rhyme-aware Chinese lyric generator based on GPT
por: Yuan, Yixiao, et al.
Publicado: (2024)
por: Yuan, Yixiao, et al.
Publicado: (2024)
1st Place Solution for 5th LSVOS Challenge: Referring Video Object Segmentation
por: Luo, Zhuoyan, et al.
Publicado: (2024)
por: Luo, Zhuoyan, et al.
Publicado: (2024)
LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL
por: Peng, Yingzhe, et al.
Publicado: (2025)
por: Peng, Yingzhe, et al.
Publicado: (2025)
AdsQA: Towards Advertisement Video Understanding
por: Long, Xinwei, et al.
Publicado: (2025)
por: Long, Xinwei, et al.
Publicado: (2025)
1st Place Solution for MOSE Track in CVPR 2024 PVUW Workshop: Complex Video Object Segmentation
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
Local Occupancy-Enhanced Object Grasping with Multiple Triplanar Projection
por: Ma, Kangqi, et al.
Publicado: (2024)
por: Ma, Kangqi, et al.
Publicado: (2024)
EgoEsportsQA: An Egocentric Video Benchmark for Perception and Reasoning in Esports
por: Ma, Jianzhe, et al.
Publicado: (2026)
por: Ma, Jianzhe, et al.
Publicado: (2026)
First Place Solution to the ECCV 2024 ROAD++ Challenge @ ROAD++ Spatiotemporal Agent Detection 2024
por: Zhang, Tengfei, et al.
Publicado: (2024)
por: Zhang, Tengfei, et al.
Publicado: (2024)
First Place Solution to the ECCV 2024 ROAD++ Challenge @ ROAD++ Atomic Activity Recognition 2024
por: Li, Ruyang, et al.
Publicado: (2024)
por: Li, Ruyang, et al.
Publicado: (2024)
The Solution for Temporal Sound Localisation Task of ICCV 1st Perception Test Challenge 2023
por: Huang, Yurui, et al.
Publicado: (2024)
por: Huang, Yurui, et al.
Publicado: (2024)
1st Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Gao, Mingqi, et al.
Publicado: (2024)
por: Gao, Mingqi, et al.
Publicado: (2024)
Solution for OOD-CV Workshop SSB Challenge 2024 (Open-Set Recognition Track)
por: Feng, Mingxu, et al.
Publicado: (2024)
por: Feng, Mingxu, et al.
Publicado: (2024)
1st Place Solution to the 1st SkatingVerse Challenge
por: Sun, Tao, et al.
Publicado: (2024)
por: Sun, Tao, et al.
Publicado: (2024)
Multi-Object Tracking Retrieval with LLaVA-Video: A Training-Free Solution to MOT25-StAG Challenge
por: Yang, Yi, et al.
Publicado: (2025)
por: Yang, Yi, et al.
Publicado: (2025)
First Place Solution to the ECCV 2024 BRAVO Challenge: Evaluating Robustness of Vision Foundation Models for Semantic Segmentation
por: Kerssies, Tommie, et al.
Publicado: (2024)
por: Kerssies, Tommie, et al.
Publicado: (2024)
Ejemplares similares
-
ICCV23 Visual-Dialog Emotion Explanation Challenge: SEU_309 Team Technical Report
por: Yuan, Yixiao, et al.
Publicado: (2024) -
Solution for Temporal Sound Localisation Task of ECCV Second Perception Test Challenge 2024
por: Gu, Haowei, et al.
Publicado: (2024) -
The Solution for the ICCV 2023 Perception Test Challenge 2023 -- Task 6 -- Grounded videoQA
por: Zhang, Hailiang, et al.
Publicado: (2024) -
The Solution for Single Object Tracking Task of Perception Test Challenge 2024
por: Zhong, Zhiqiang, et al.
Publicado: (2024) -
Solution for Point Tracking Task of ICCV 1st Perception Test Challenge 2023
por: Pan, Hongpeng, et al.
Publicado: (2024)