SuperCap: Multi-resolution Superpixel-based Image Captioning
Fuente:
arXiv
Salvato in:
| Autori principali: | Senior, Henry, Rossi, Luca, Slabaugh, Gregory, Yuan, Shanxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Graph Neural Networks in Vision-Language Image Understanding: A Survey
di: Senior, Henry, et al.
Pubblicazione: (2023)
di: Senior, Henry, et al.
Pubblicazione: (2023)
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
di: Yang, Xiaohang, et al.
Pubblicazione: (2025)
di: Yang, Xiaohang, et al.
Pubblicazione: (2025)
Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
di: Fu, Qifan, et al.
Pubblicazione: (2024)
di: Fu, Qifan, et al.
Pubblicazione: (2024)
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
di: Fu, Qifan, et al.
Pubblicazione: (2025)
di: Fu, Qifan, et al.
Pubblicazione: (2025)
HandSCS: Structural Coordinate Space for Animatable Hand Gaussian Splatting
di: Dong, Yilan, et al.
Pubblicazione: (2025)
di: Dong, Yilan, et al.
Pubblicazione: (2025)
SuperSVG: Superpixel-based Scalable Vector Graphics Synthesis
di: Hu, Teng, et al.
Pubblicazione: (2024)
di: Hu, Teng, et al.
Pubblicazione: (2024)
DanceChat: Large Language Model-Guided Music-to-Dance Generation
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
CapS-Adapter: Caption-based MultiModal Adapter in Zero-Shot Classification
di: Wang, Qijie, et al.
Pubblicazione: (2024)
di: Wang, Qijie, et al.
Pubblicazione: (2024)
CAMS: Convolution and Attention-Free Mamba-based Cardiac Image Segmentation
di: Khan, Abbas, et al.
Pubblicazione: (2024)
di: Khan, Abbas, et al.
Pubblicazione: (2024)
MeaCap: Memory-Augmented Zero-shot Image Captioning
di: Zeng, Zequn, et al.
Pubblicazione: (2024)
di: Zeng, Zequn, et al.
Pubblicazione: (2024)
SnapCap: Efficient Snapshot Compressive Video Captioning
di: Sun, Jianqiao, et al.
Pubblicazione: (2024)
di: Sun, Jianqiao, et al.
Pubblicazione: (2024)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
di: Gaintseva, Tatiana, et al.
Pubblicazione: (2024)
MOAB: Multi-Modal Outer Arithmetic Block For Fusion Of Histopathological Images And Genetic Data For Brain Tumor Grading
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
Superpixel-based Color Transfer
di: Giraud, Rémi, et al.
Pubblicazione: (2019)
di: Giraud, Rémi, et al.
Pubblicazione: (2019)
SuperPatchMatch: an Algorithm for Robust Correspondences using Superpixel Patches
di: Giraud, Rémi, et al.
Pubblicazione: (2019)
di: Giraud, Rémi, et al.
Pubblicazione: (2019)
SP-MoMamba: Superpixel-driven Mixture of State Space Experts for Efficient Image Super-Resolution
di: Zou, Wenbin, et al.
Pubblicazione: (2026)
di: Zou, Wenbin, et al.
Pubblicazione: (2026)
FOAA: Flattened Outer Arithmetic Attention For Multimodal Tumor Classification
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
di: Alwazzan, Omnia, et al.
Pubblicazione: (2024)
ControlCap: Controllable Region-level Captioning
di: Zhao, Yuzhong, et al.
Pubblicazione: (2024)
di: Zhao, Yuzhong, et al.
Pubblicazione: (2024)
CapArena: Benchmarking and Analyzing Detailed Image Captioning in the LLM Era
di: Cheng, Kanzhi, et al.
Pubblicazione: (2025)
di: Cheng, Kanzhi, et al.
Pubblicazione: (2025)
Superpixel Integrated Grids for Fast Image Segmentation
di: Roberts, Jack, et al.
Pubblicazione: (2025)
di: Roberts, Jack, et al.
Pubblicazione: (2025)
SuperCL: Superpixel Guided Contrastive Learning for Medical Image Segmentation Pre-training
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
di: Zeng, Shuang, et al.
Pubblicazione: (2025)
ReCap: Event-Aware Image Captioning with Article Retrieval and Semantic Gaussian Normalization
di: Nguyen, Thinh-Phuc, et al.
Pubblicazione: (2025)
di: Nguyen, Thinh-Phuc, et al.
Pubblicazione: (2025)
XMeCap: Meme Caption Generation with Sub-Image Adaptability
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Generalized Shortest Path-based Superpixels for 3D Spherical Image Segmentation
di: Giraud, Rémi, et al.
Pubblicazione: (2025)
di: Giraud, Rémi, et al.
Pubblicazione: (2025)
Multi-view Cardiac Image Segmentation via Trans-Dimensional Priors
di: Khan, Abbas, et al.
Pubblicazione: (2024)
di: Khan, Abbas, et al.
Pubblicazione: (2024)
Deep Spherical Superpixels
di: Giraud, Rémi, et al.
Pubblicazione: (2024)
di: Giraud, Rémi, et al.
Pubblicazione: (2024)
IF-VidCap: Can Video Caption Models Follow Instructions?
di: Li, Shihao, et al.
Pubblicazione: (2025)
di: Li, Shihao, et al.
Pubblicazione: (2025)
Video ReCap: Recursive Captioning of Hour-Long Videos
di: Islam, Md Mohaiminul, et al.
Pubblicazione: (2024)
di: Islam, Md Mohaiminul, et al.
Pubblicazione: (2024)
UnMA-CapSumT: Unified and Multi-Head Attention-driven Caption Summarization Transformer
di: Sharma, Dhruv, et al.
Pubblicazione: (2024)
di: Sharma, Dhruv, et al.
Pubblicazione: (2024)
ScaleCap: Inference-Time Scalable Image Captioning via Dual-Modality Debiasing
di: Xing, Long, et al.
Pubblicazione: (2025)
di: Xing, Long, et al.
Pubblicazione: (2025)
XFMamba: Cross-Fusion Mamba for Multi-View Medical Image Classification
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zheng, Xiaoyu, et al.
Pubblicazione: (2025)
Sentinel2Cap: A Human-Annotated Benchmark Dataset for Multimodal Remote Sensing Image Captioning
di: Tosato, Lucrezia, et al.
Pubblicazione: (2026)
di: Tosato, Lucrezia, et al.
Pubblicazione: (2026)
Do Superpixel Segmentation Methods Influence Deforestation Image Classification?
di: Resende, Hugo, et al.
Pubblicazione: (2025)
di: Resende, Hugo, et al.
Pubblicazione: (2025)
Superpixel-informed Implicit Neural Representation for Multi-Dimensional Data
di: Li, Jiayi, et al.
Pubblicazione: (2024)
di: Li, Jiayi, et al.
Pubblicazione: (2024)
Multi-Scale Superpatch Matching using Dual Superpixel Descriptors
di: Giraud, Rémi, et al.
Pubblicazione: (2020)
di: Giraud, Rémi, et al.
Pubblicazione: (2020)
FingerCap: Fine-grained Finger-level Hand Motion Captioning
di: Shen, Xin, et al.
Pubblicazione: (2025)
di: Shen, Xin, et al.
Pubblicazione: (2025)
VoCap: Video Object Captioning and Segmentation from Any Prompt
di: Uijlings, Jasper, et al.
Pubblicazione: (2025)
di: Uijlings, Jasper, et al.
Pubblicazione: (2025)
Texture-Aware Superpixel Segmentation
di: Giraud, Remi, et al.
Pubblicazione: (2019)
di: Giraud, Remi, et al.
Pubblicazione: (2019)
Leveraging Activations for Superpixel Explanations
di: Boubekki, Ahcène, et al.
Pubblicazione: (2024)
di: Boubekki, Ahcène, et al.
Pubblicazione: (2024)
OwlCap: Harmonizing Motion-Detail for Video Captioning via HMD-270K and Caption Set Equivalence Reward
di: Zhong, Chunlin, et al.
Pubblicazione: (2025)
di: Zhong, Chunlin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Graph Neural Networks in Vision-Language Image Understanding: A Survey
di: Senior, Henry, et al.
Pubblicazione: (2023) -
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
di: Yang, Xiaohang, et al.
Pubblicazione: (2025) -
Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
di: Fu, Qifan, et al.
Pubblicazione: (2024) -
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
di: Fu, Qifan, et al.
Pubblicazione: (2025) -
HandSCS: Structural Coordinate Space for Animatable Hand Gaussian Splatting
di: Dong, Yilan, et al.
Pubblicazione: (2025)