RubiCap: Rubric-Guided Reinforcement Learning for Dense Image Captioning
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Tzu-Heng, Salekin, Sirajul, Movellan, Javier, Sala, Frederic, Bilkhu, Manjot |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating Sample Utility for Efficient Data Selection by Mimicking Model Weights
di: Huang, Tzu-Heng, et al.
Pubblicazione: (2025)
di: Huang, Tzu-Heng, et al.
Pubblicazione: (2025)
MixAtlas: Uncertainty-aware Data Mixture Optimization for Multimodal LLM Midtraining
di: Wen, Bingbing, et al.
Pubblicazione: (2026)
di: Wen, Bingbing, et al.
Pubblicazione: (2026)
CapRL: Stimulating Dense Image Caption Capabilities via Reinforcement Learning
di: Xing, Long, et al.
Pubblicazione: (2025)
di: Xing, Long, et al.
Pubblicazione: (2025)
ChartCap: Mitigating Hallucination of Dense Chart Captioning
di: Lim, Junyoung, et al.
Pubblicazione: (2025)
di: Lim, Junyoung, et al.
Pubblicazione: (2025)
Skin Cancer Images Classification using Transfer Learning Techniques
di: Islam, Md Sirajul, et al.
Pubblicazione: (2024)
di: Islam, Md Sirajul, et al.
Pubblicazione: (2024)
XMeCap: Meme Caption Generation with Sub-Image Adaptability
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning
di: Wei, Yuancheng, et al.
Pubblicazione: (2026)
di: Wei, Yuancheng, et al.
Pubblicazione: (2026)
Reinforcement Learning with Robust Rubric Rewards
di: Yu, Ya-Qi, et al.
Pubblicazione: (2026)
di: Yu, Ya-Qi, et al.
Pubblicazione: (2026)
CCCaption: Dual-Reward Reinforcement Learning for Complete and Correct Image Captioning
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
di: Tang, Zhijiang, et al.
Pubblicazione: (2026)
AGIC: Attention-Guided Image Captioning to Improve Caption Relevance
di: Teja, L. D. M. S. Sai, et al.
Pubblicazione: (2025)
di: Teja, L. D. M. S. Sai, et al.
Pubblicazione: (2025)
BalCapRL: A Balanced Framework for RL-Based MLLM Image Captioning
di: Ye, Shaokai, et al.
Pubblicazione: (2026)
di: Ye, Shaokai, et al.
Pubblicazione: (2026)
Inserting Faces inside Captions: Image Captioning with Attention Guided Merging
di: Tevissen, Yannis, et al.
Pubblicazione: (2024)
di: Tevissen, Yannis, et al.
Pubblicazione: (2024)
Enhancing Image Caption Generation Using Reinforcement Learning with Human Feedback
di: L, Adarsh N, et al.
Pubblicazione: (2024)
di: L, Adarsh N, et al.
Pubblicazione: (2024)
DualCap: Enhancing Lightweight Image Captioning via Dual Retrieval with Similar Scenes Visual Prompts
di: Li, Binbin, et al.
Pubblicazione: (2025)
di: Li, Binbin, et al.
Pubblicazione: (2025)
SAIL: Similarity-Aware Guidance and Inter-Caption Augmentation-based Learning for Weakly-Supervised Dense Video Captioning
di: Kim, Ye-Chan, et al.
Pubblicazione: (2026)
di: Kim, Ye-Chan, et al.
Pubblicazione: (2026)
TOD3Cap: Towards 3D Dense Captioning in Outdoor Scenes
di: Jin, Bu, et al.
Pubblicazione: (2024)
di: Jin, Bu, et al.
Pubblicazione: (2024)
CodecCap: High-Fidelity Codec-Inspired Residual Modeling for Dense Video Captioning
di: Lin, Zihan, et al.
Pubblicazione: (2026)
di: Lin, Zihan, et al.
Pubblicazione: (2026)
InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption
di: Fan, Tiehan, et al.
Pubblicazione: (2024)
di: Fan, Tiehan, et al.
Pubblicazione: (2024)
Dense Video Captioning using Graph-based Sentence Summarization
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
Sam-Guided Enhanced Fine-Grained Encoding with Mixed Semantic Learning for Medical Image Captioning
di: Zhang, Zhenyu, et al.
Pubblicazione: (2023)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2023)
CapGeo: A Caption-Assisted Approach to Geometric Reasoning
di: Li, Yuying, et al.
Pubblicazione: (2025)
di: Li, Yuying, et al.
Pubblicazione: (2025)
QG-CoC: Question-Guided Chain-of-Captions for Large Multimodal Models
di: Kao, Kuei-Chun, et al.
Pubblicazione: (2025)
di: Kao, Kuei-Chun, et al.
Pubblicazione: (2025)
LaMP-Cap: Personalized Figure Caption Generation With Multimodal Figure Profiles
di: Ng, Ho Yin 'Sam', et al.
Pubblicazione: (2025)
di: Ng, Ho Yin 'Sam', et al.
Pubblicazione: (2025)
Exploring Annotation-free Image Captioning with Retrieval-augmented Pseudo Sentence Generation
di: Li, Zhiyuan, et al.
Pubblicazione: (2023)
di: Li, Zhiyuan, et al.
Pubblicazione: (2023)
BLIP3-KALE: Knowledge Augmented Large-Scale Dense Captions
di: Awadalla, Anas, et al.
Pubblicazione: (2024)
di: Awadalla, Anas, et al.
Pubblicazione: (2024)
Distinctive Image Captioning: Leveraging Ground Truth Captions in CLIP Guided Reinforcement Learning
di: Chaffin, Antoine, et al.
Pubblicazione: (2024)
di: Chaffin, Antoine, et al.
Pubblicazione: (2024)
SuperCap: Multi-resolution Superpixel-based Image Captioning
di: Senior, Henry, et al.
Pubblicazione: (2025)
di: Senior, Henry, et al.
Pubblicazione: (2025)
MeaCap: Memory-Augmented Zero-shot Image Captioning
di: Zeng, Zequn, et al.
Pubblicazione: (2024)
di: Zeng, Zequn, et al.
Pubblicazione: (2024)
CaptionFool: Universal Image Captioning Model Attacks
di: Parekh, Swapnil
Pubblicazione: (2026)
di: Parekh, Swapnil
Pubblicazione: (2026)
CompCap: Improving Multimodal Large Language Models with Composite Captions
di: Chen, Xiaohui, et al.
Pubblicazione: (2024)
di: Chen, Xiaohui, et al.
Pubblicazione: (2024)
PaveCap: The First Multimodal Framework for Comprehensive Pavement Condition Assessment with Dense Captioning and PCI Estimation
di: Kyem, Blessing Agyei, et al.
Pubblicazione: (2024)
di: Kyem, Blessing Agyei, et al.
Pubblicazione: (2024)
Retrieval-Guided Generation for Safer Histopathology Image Captioning
di: Hoq, Md. Enamul, et al.
Pubblicazione: (2026)
di: Hoq, Md. Enamul, et al.
Pubblicazione: (2026)
Do Large Multimodal Models Solve Caption Generation for Scientific Figures? Lessons Learned from SciCap Challenge 2023
di: Hsu, Ting-Yao E., et al.
Pubblicazione: (2025)
di: Hsu, Ting-Yao E., et al.
Pubblicazione: (2025)
SC-Captioner: Improving Image Captioning with Self-Correction by Reinforcement Learning
di: Zhang, Lin, et al.
Pubblicazione: (2025)
di: Zhang, Lin, et al.
Pubblicazione: (2025)
Uterine Ultrasound Image Captioning Using Deep Learning Techniques
di: Boulesnane, Abdennour, et al.
Pubblicazione: (2024)
di: Boulesnane, Abdennour, et al.
Pubblicazione: (2024)
Multimodal Data Curation via Object Detection and Filter Ensembles
di: Huang, Tzu-Heng, et al.
Pubblicazione: (2024)
di: Huang, Tzu-Heng, et al.
Pubblicazione: (2024)
Accurate and Fast Compressed Video Captioning
di: Shen, Yaojie, et al.
Pubblicazione: (2023)
di: Shen, Yaojie, et al.
Pubblicazione: (2023)
Pix2Cap-COCO: Advancing Visual Comprehension via Pixel-Level Captioning
di: You, Zuyao, et al.
Pubblicazione: (2025)
di: You, Zuyao, et al.
Pubblicazione: (2025)
Show, Tell and Summarize: Dense Video Captioning Using Visual Cue Aided Sentence Summarization
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwang, et al.
Pubblicazione: (2025)
Five Years of SciCap: What We Learned and Future Directions for Scientific Figure Captioning
di: Huang, Ting-Hao 'Kenneth', et al.
Pubblicazione: (2025)
di: Huang, Ting-Hao 'Kenneth', et al.
Pubblicazione: (2025)
Documenti analoghi
-
Evaluating Sample Utility for Efficient Data Selection by Mimicking Model Weights
di: Huang, Tzu-Heng, et al.
Pubblicazione: (2025) -
MixAtlas: Uncertainty-aware Data Mixture Optimization for Multimodal LLM Midtraining
di: Wen, Bingbing, et al.
Pubblicazione: (2026) -
CapRL: Stimulating Dense Image Caption Capabilities via Reinforcement Learning
di: Xing, Long, et al.
Pubblicazione: (2025) -
ChartCap: Mitigating Hallucination of Dense Chart Captioning
di: Lim, Junyoung, et al.
Pubblicazione: (2025) -
Skin Cancer Images Classification using Transfer Learning Techniques
di: Islam, Md Sirajul, et al.
Pubblicazione: (2024)