The Solution for the ICCV 2023 1st Scientific Figure Captioning Challenge
Fuente:
arXiv
Guardado en:
| Autores principales: | Chao, Dian, Song, Xin, Zhong, Shupeng, Wang, Boyuan, Wu, Xiangyu, Zhu, Chen, Yang, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Solution for the ICCV 2023 Perception Test Challenge 2023 -- Task 6 -- Grounded videoQA
por: Zhang, Hailiang, et al.
Publicado: (2024)
por: Zhang, Hailiang, et al.
Publicado: (2024)
The Solution for Temporal Sound Localisation Task of ICCV 1st Perception Test Challenge 2023
por: Huang, Yurui, et al.
Publicado: (2024)
por: Huang, Yurui, et al.
Publicado: (2024)
The Solution for the CVPR2024 NICE Image Captioning Challenge
por: Huang, Longfei, et al.
Publicado: (2024)
por: Huang, Longfei, et al.
Publicado: (2024)
Solution for Point Tracking Task of ICCV 1st Perception Test Challenge 2023
por: Pan, Hongpeng, et al.
Publicado: (2024)
por: Pan, Hongpeng, et al.
Publicado: (2024)
1st Place Solution for ICCV 2023 OmniObject3D Challenge: Sparse-View Reconstruction
por: Du, Hang, et al.
Publicado: (2024)
por: Du, Hang, et al.
Publicado: (2024)
The Solution for the CVPR2023 NICE Image Captioning Challenge
por: Wu, Xiangyu, et al.
Publicado: (2023)
por: Wu, Xiangyu, et al.
Publicado: (2023)
3rd Place Solution to ICCV LargeFineFoodAI Retrieval
por: Zhong, Yang, et al.
Publicado: (2025)
por: Zhong, Yang, et al.
Publicado: (2025)
Do Large Multimodal Models Solve Caption Generation for Scientific Figures? Lessons Learned from SciCap Challenge 2023
por: Hsu, Ting-Yao E., et al.
Publicado: (2025)
por: Hsu, Ting-Yao E., et al.
Publicado: (2025)
Figuring out Figures: Using Textual References to Caption Scientific Figures
por: Cao, Stanley, et al.
Publicado: (2024)
por: Cao, Stanley, et al.
Publicado: (2024)
ICCV23 Visual-Dialog Emotion Explanation Challenge: SEU_309 Team Technical Report
por: Yuan, Yixiao, et al.
Publicado: (2024)
por: Yuan, Yixiao, et al.
Publicado: (2024)
1st Place Solution to the 1st SkatingVerse Challenge
por: Sun, Tao, et al.
Publicado: (2024)
por: Sun, Tao, et al.
Publicado: (2024)
Second Place Solution of WSDM2023 Toloka Visual Question Answering Challenge
por: Wu, Xiangyu, et al.
Publicado: (2024)
por: Wu, Xiangyu, et al.
Publicado: (2024)
1st Place Solution for 5th LSVOS Challenge: Referring Video Object Segmentation
por: Luo, Zhuoyan, et al.
Publicado: (2024)
por: Luo, Zhuoyan, et al.
Publicado: (2024)
FigEx2: Visual-Conditioned Panel Detection and Captioning for Scientific Compound Figures
por: Song, Jifeng, et al.
Publicado: (2026)
por: Song, Jifeng, et al.
Publicado: (2026)
The Solution for Language-Enhanced Image New Category Discovery
por: Xu, Haonan, et al.
Publicado: (2024)
por: Xu, Haonan, et al.
Publicado: (2024)
X-Restormer++: 1st Place Solution for the UG2+ CVPR 2026 All-Weather Restoration Challenge
por: Pan, Youwei, et al.
Publicado: (2026)
por: Pan, Youwei, et al.
Publicado: (2026)
The 1st Solution for MOSEv1 Challenge on LSVOS 2025: CGFSeg
por: Li, Tingmin, et al.
Publicado: (2025)
por: Li, Tingmin, et al.
Publicado: (2025)
PhyT2V: LLM-Guided Iterative Self-Refinement for Physics-Grounded Text-to-Video Generation
por: Xue, Qiyao, et al.
Publicado: (2024)
por: Xue, Qiyao, et al.
Publicado: (2024)
1st Place Solution of Multiview Egocentric Hand Tracking Challenge ECCV2024
por: Zou, Minqiang, et al.
Publicado: (2024)
por: Zou, Minqiang, et al.
Publicado: (2024)
DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning
por: Wei, Yuancheng, et al.
Publicado: (2026)
por: Wei, Yuancheng, et al.
Publicado: (2026)
Solution for OOD-CV Workshop SSB Challenge 2024 (Open-Set Recognition Track)
por: Feng, Mingxu, et al.
Publicado: (2024)
por: Feng, Mingxu, et al.
Publicado: (2024)
The Solution for the CVPR 2023 1st foundation model challenge-Track2
por: Xu, Haonan, et al.
Publicado: (2024)
por: Xu, Haonan, et al.
Publicado: (2024)
Enhancing Scientific Figure Captioning Through Cross-modal Learning
por: Rojas, Mateo Alejandro, et al.
Publicado: (2024)
por: Rojas, Mateo Alejandro, et al.
Publicado: (2024)
STSeg-Complex Video Object Segmentation: The 1st Solution for 4th PVUW MOSE Challenge
por: Song, Kehuan, et al.
Publicado: (2025)
por: Song, Kehuan, et al.
Publicado: (2025)
The Solution for the GAIIC2024 RGB-TIR object detection Challenge
por: Wu, Xiangyu, et al.
Publicado: (2024)
por: Wu, Xiangyu, et al.
Publicado: (2024)
AutoFigure-Edit: Generating Editable Scientific Illustration
por: Lin, Zhen, et al.
Publicado: (2026)
por: Lin, Zhen, et al.
Publicado: (2026)
The Solution for Temporal Action Localisation Task of Perception Test Challenge 2024
por: Han, Yinan, et al.
Publicado: (2024)
por: Han, Yinan, et al.
Publicado: (2024)
Exploring Diverse In-Context Configurations for Image Captioning
por: Yang, Xu, et al.
Publicado: (2023)
por: Yang, Xu, et al.
Publicado: (2023)
Discriminative Spatial-Semantic VOS Solution: 1st Place Solution for 6th LSVOS
por: Miao, Deshui, et al.
Publicado: (2024)
por: Miao, Deshui, et al.
Publicado: (2024)
LaMP-Cap: Personalized Figure Caption Generation With Multimodal Figure Profiles
por: Ng, Ho Yin 'Sam', et al.
Publicado: (2025)
por: Ng, Ho Yin 'Sam', et al.
Publicado: (2025)
The 1st Solution for 7th LSVOS RVOS Track: SaSaSa2VA
por: Niu, Quanzhu, et al.
Publicado: (2025)
por: Niu, Quanzhu, et al.
Publicado: (2025)
Five Years of SciCap: What We Learned and Future Directions for Scientific Figure Captioning
por: Huang, Ting-Hao 'Kenneth', et al.
Publicado: (2025)
por: Huang, Ting-Hao 'Kenneth', et al.
Publicado: (2025)
ProGait: A Multi-Purpose Video Dataset and Benchmark for Transfemoral Prosthesis Users
por: Yin, Xiangyu, et al.
Publicado: (2025)
por: Yin, Xiangyu, et al.
Publicado: (2025)
EVC-MF: End-to-end Video Captioning Network with Multi-scale Features
por: Niu, Tian-Zi, et al.
Publicado: (2024)
por: Niu, Tian-Zi, et al.
Publicado: (2024)
Task adaptation of Vision-Language-Action model: 1st Place Solution for the 2025 BEHAVIOR Challenge
por: Larchenko, Ilia, et al.
Publicado: (2025)
por: Larchenko, Ilia, et al.
Publicado: (2025)
CaptionFormer: Unified Segmentation, Tracking, and Captioning for Spatio-Temporal Objects
por: Fiastre, Gabriel, et al.
Publicado: (2025)
por: Fiastre, Gabriel, et al.
Publicado: (2025)
SoccerNet 2023 Challenges Results
por: Cioppa, Anthony, et al.
Publicado: (2023)
por: Cioppa, Anthony, et al.
Publicado: (2023)
Technical Report for Soccernet 2023 -- Dense Video Captioning
por: Ruan, Zheng, et al.
Publicado: (2024)
por: Ruan, Zheng, et al.
Publicado: (2024)
UNINEXT-Cutie: The 1st Solution for LSVOS Challenge RVOS Track
por: Fang, Hao, et al.
Publicado: (2024)
por: Fang, Hao, et al.
Publicado: (2024)
Semi-Supervised Image Captioning Considering Wasserstein Graph Matching
por: Yang, Yang
Publicado: (2024)
por: Yang, Yang
Publicado: (2024)
Ejemplares similares
-
The Solution for the ICCV 2023 Perception Test Challenge 2023 -- Task 6 -- Grounded videoQA
por: Zhang, Hailiang, et al.
Publicado: (2024) -
The Solution for Temporal Sound Localisation Task of ICCV 1st Perception Test Challenge 2023
por: Huang, Yurui, et al.
Publicado: (2024) -
The Solution for the CVPR2024 NICE Image Captioning Challenge
por: Huang, Longfei, et al.
Publicado: (2024) -
Solution for Point Tracking Task of ICCV 1st Perception Test Challenge 2023
por: Pan, Hongpeng, et al.
Publicado: (2024) -
1st Place Solution for ICCV 2023 OmniObject3D Challenge: Sparse-View Reconstruction
por: Du, Hang, et al.
Publicado: (2024)