RISE: Enhancing VLM Image Annotation with Self-Supervised Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Suhang, Hu, Wei, Su, Yuhang, Zhang, Fan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reassessing the Role of Supervised Fine-Tuning: An Empirical Study in VLM Reasoning
di: Yu, Yongcan, et al.
Pubblicazione: (2025)
di: Yu, Yongcan, et al.
Pubblicazione: (2025)
V-Zero: Self-Improving Multimodal Reasoning with Zero Annotation
di: Wang, Han, et al.
Pubblicazione: (2026)
di: Wang, Han, et al.
Pubblicazione: (2026)
VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
di: Xu, Yi, et al.
Pubblicazione: (2024)
di: Xu, Yi, et al.
Pubblicazione: (2024)
Image Clustering Algorithm Based on Self-Supervised Pretrained Models and Latent Feature Distribution Optimization
di: Zhu, Qiuyu, et al.
Pubblicazione: (2024)
di: Zhu, Qiuyu, et al.
Pubblicazione: (2024)
Metis-RISE: RL Incentivizes and SFT Enhances Multimodal Reasoning Model Learning
di: Qiu, Haibo, et al.
Pubblicazione: (2025)
di: Qiu, Haibo, et al.
Pubblicazione: (2025)
SaFeR-VLM: Toward Safety-aware Fine-grained Reasoning in Multimodal Models
di: Yi, Huahui, et al.
Pubblicazione: (2025)
di: Yi, Huahui, et al.
Pubblicazione: (2025)
Self-Tuning Self-Supervised Image Anomaly Detection
di: Yoo, Jaemin, et al.
Pubblicazione: (2023)
di: Yoo, Jaemin, et al.
Pubblicazione: (2023)
Leveraging Semi-Supervised Learning to Enhance Data Mining for Image Classification under Limited Labeled Data
di: Shen, Aoran, et al.
Pubblicazione: (2024)
di: Shen, Aoran, et al.
Pubblicazione: (2024)
PSPU: Enhanced Positive and Unlabeled Learning by Leveraging Pseudo Supervision
di: Wang, Chengjie, et al.
Pubblicazione: (2024)
di: Wang, Chengjie, et al.
Pubblicazione: (2024)
Weakly Supervised Pixel-Level Annotation with Visual Interpretability
di: Nasir, Basma, et al.
Pubblicazione: (2025)
di: Nasir, Basma, et al.
Pubblicazione: (2025)
TESPEC: Temporally-Enhanced Self-Supervised Pretraining for Event Cameras
di: Mohammadi, Mohammad, et al.
Pubblicazione: (2025)
di: Mohammadi, Mohammad, et al.
Pubblicazione: (2025)
Self-Supervised Uncertainty Estimation For Super-Resolution of Satellite Images
di: Zheng, Zhe, et al.
Pubblicazione: (2026)
di: Zheng, Zhe, et al.
Pubblicazione: (2026)
Self-Improving VLM Judges Without Human Annotations
di: Lin, Inna Wanyin, et al.
Pubblicazione: (2025)
di: Lin, Inna Wanyin, et al.
Pubblicazione: (2025)
DocVLM: Make Your VLM an Efficient Reader
di: Nacson, Mor Shpigel, et al.
Pubblicazione: (2024)
di: Nacson, Mor Shpigel, et al.
Pubblicazione: (2024)
A Lightweight Medical Image Classification Framework via Self-Supervised Contrastive Learning and Quantum-Enhanced Feature Modeling
di: Xia, Jingsong, et al.
Pubblicazione: (2026)
di: Xia, Jingsong, et al.
Pubblicazione: (2026)
Enhancing Generalization of Depth Estimation Foundation Model via Weakly-Supervised Adaptation with Regularization
di: Huang, Yan, et al.
Pubblicazione: (2025)
di: Huang, Yan, et al.
Pubblicazione: (2025)
SASSL: Enhancing Self-Supervised Learning via Neural Style Transfer
di: Rojas-Gomez, Renan A., et al.
Pubblicazione: (2023)
di: Rojas-Gomez, Renan A., et al.
Pubblicazione: (2023)
VLM-Pruner: Buffering for Spatial Sparsity in an Efficient VLM Centrifugal Token Pruning Paradigm
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
di: Wu, Zhenkai, et al.
Pubblicazione: (2025)
Selective Masking based Self-Supervised Learning for Image Semantic Segmentation
di: Wang, Yuemin, et al.
Pubblicazione: (2025)
di: Wang, Yuemin, et al.
Pubblicazione: (2025)
SelfFed: Self-Supervised Federated Learning for Data Heterogeneity and Label Scarcity in Medical Images
di: Khowaja, Sunder Ali, et al.
Pubblicazione: (2023)
di: Khowaja, Sunder Ali, et al.
Pubblicazione: (2023)
ChemVLM: Exploring the Power of Multimodal Large Language Models in Chemistry Area
di: Li, Junxian, et al.
Pubblicazione: (2024)
di: Li, Junxian, et al.
Pubblicazione: (2024)
Enhancing Semi-Supervised Multi-View Graph Convolutional Networks via Supervised Contrastive Learning and Self-Training
di: Xiao, Huaiyuan, et al.
Pubblicazione: (2025)
di: Xiao, Huaiyuan, et al.
Pubblicazione: (2025)
Enhancing Cardiovascular Disease Prediction through Multi-Modal Self-Supervised Learning
di: Girlanda, Francesco, et al.
Pubblicazione: (2024)
di: Girlanda, Francesco, et al.
Pubblicazione: (2024)
DeepVAT: A Self-Supervised Technique for Cluster Assessment in Image Datasets
di: Mazumder, Alokendu, et al.
Pubblicazione: (2023)
di: Mazumder, Alokendu, et al.
Pubblicazione: (2023)
GraphVLM: Benchmarking Vision Language Models for Multimodal Graph Learning
di: Liu, Jiajin, et al.
Pubblicazione: (2026)
di: Liu, Jiajin, et al.
Pubblicazione: (2026)
Low-Data Supervised Adaptation Outperforms Prompting for Cloud Segmentation Under Domain Shift
di: Kethavath, Harshith, et al.
Pubblicazione: (2026)
di: Kethavath, Harshith, et al.
Pubblicazione: (2026)
Solving Semi-Supervised Few-Shot Learning from an Auto-Annotation Perspective
di: Liu, Tian, et al.
Pubblicazione: (2025)
di: Liu, Tian, et al.
Pubblicazione: (2025)
CrIBo: Self-Supervised Learning via Cross-Image Object-Level Bootstrapping
di: Lebailly, Tim, et al.
Pubblicazione: (2023)
di: Lebailly, Tim, et al.
Pubblicazione: (2023)
DINOv2 based Self Supervised Learning For Few Shot Medical Image Segmentation
di: Ayzenberg, Lev, et al.
Pubblicazione: (2024)
di: Ayzenberg, Lev, et al.
Pubblicazione: (2024)
Mediffusion: Joint Diffusion for Self-Explainable Semi-Supervised Classification and Medical Image Generation
di: Kaleta, Joanna, et al.
Pubblicazione: (2024)
di: Kaleta, Joanna, et al.
Pubblicazione: (2024)
PolMERLIN: Self-Supervised Polarimetric Complex SAR Image Despeckling with Masked Networks
di: Kato, Shunya, et al.
Pubblicazione: (2024)
di: Kato, Shunya, et al.
Pubblicazione: (2024)
Variational Self-Supervised Learning
di: Yavuz, Mehmet Can, et al.
Pubblicazione: (2025)
di: Yavuz, Mehmet Can, et al.
Pubblicazione: (2025)
Self-Supervised Siamese Autoencoders
di: Baier, Friederike, et al.
Pubblicazione: (2023)
di: Baier, Friederike, et al.
Pubblicazione: (2023)
S4: Self-Supervised Sensing Across the Spectrum
di: Shenoy, Jayanth, et al.
Pubblicazione: (2024)
di: Shenoy, Jayanth, et al.
Pubblicazione: (2024)
Large VLM-based Stylized Sports Captioning
di: Dhar, Sauptik, et al.
Pubblicazione: (2025)
di: Dhar, Sauptik, et al.
Pubblicazione: (2025)
BiSeg-SAM: Weakly-Supervised Post-Processing Framework for Boosting Binary Segmentation in Segment Anything Models
di: Su, Encheng, et al.
Pubblicazione: (2025)
di: Su, Encheng, et al.
Pubblicazione: (2025)
Learning Topological Representations for Deep Image Understanding
di: Hu, Xiaoling
Pubblicazione: (2024)
di: Hu, Xiaoling
Pubblicazione: (2024)
Applications and Effect Evaluation of Generative Adversarial Networks in Semi-Supervised Learning
di: Hu, Jiyu, et al.
Pubblicazione: (2025)
di: Hu, Jiyu, et al.
Pubblicazione: (2025)
Integration of Self-Supervised BYOL in Semi-Supervised Medical Image Recognition
di: Feng, Hao, et al.
Pubblicazione: (2024)
di: Feng, Hao, et al.
Pubblicazione: (2024)
Hyperspectral Anomaly Detection with Self-Supervised Anomaly Prior
di: Liu, Yidan, et al.
Pubblicazione: (2024)
di: Liu, Yidan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Reassessing the Role of Supervised Fine-Tuning: An Empirical Study in VLM Reasoning
di: Yu, Yongcan, et al.
Pubblicazione: (2025) -
V-Zero: Self-Improving Multimodal Reasoning with Zero Annotation
di: Wang, Han, et al.
Pubblicazione: (2026) -
VLM-AD: End-to-End Autonomous Driving through Vision-Language Model Supervision
di: Xu, Yi, et al.
Pubblicazione: (2024) -
Image Clustering Algorithm Based on Self-Supervised Pretrained Models and Latent Feature Distribution Optimization
di: Zhu, Qiuyu, et al.
Pubblicazione: (2024) -
Metis-RISE: RL Incentivizes and SFT Enhances Multimodal Reasoning Model Learning
di: Qiu, Haibo, et al.
Pubblicazione: (2025)