IO Transformer: Evaluating SwinV2-Based Reward Models for Computer Vision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Meyer, Maxwell, Spruyt, Jack |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BEN: Using Confidence-Guided Matting for Dichotomous Image Segmentation
par: Meyer, Maxwell, et autres
Publié: (2025)
par: Meyer, Maxwell, et autres
Publié: (2025)
RSwinV2-MD: An Enhanced Residual SwinV2 Transformer for Monkeypox Detection from Skin Images
par: Iqbal, Rashid, et autres
Publié: (2026)
par: Iqbal, Rashid, et autres
Publié: (2026)
SparseSwin: Swin Transformer with Sparse Transformer Block
par: Pinasthika, Krisna, et autres
Publié: (2023)
par: Pinasthika, Krisna, et autres
Publié: (2023)
Brain Hematoma Marker Recognition Using Multitask Learning: SwinTransformer and Swin-Unet
par: Hirata, Kodai, et autres
Publié: (2025)
par: Hirata, Kodai, et autres
Publié: (2025)
Video Quality Assessment Based on Swin TransformerV2 and Coarse to Fine Strategy
par: Yu, Zihao, et autres
Publié: (2024)
par: Yu, Zihao, et autres
Publié: (2024)
DualSwinFusionSeg: Multimodal Martian Landslide Segmentation via Dual Swin Transformer with Multi-Scale Fusion and UNet++
par: Kabir, Shahriar, et autres
Publié: (2026)
par: Kabir, Shahriar, et autres
Publié: (2026)
Self-Supervised Modality-Agnostic Pre-Training of Swin Transformers
par: Talasila, Abhiroop, et autres
Publié: (2024)
par: Talasila, Abhiroop, et autres
Publié: (2024)
DIAR: Deep Image Alignment and Reconstruction using Swin Transformers
par: Kwiatkowski, Monika, et autres
Publié: (2023)
par: Kwiatkowski, Monika, et autres
Publié: (2023)
StrideNET: Swin Transformer for Terrain Recognition with Dynamic Roughness Extraction
par: Shelare, Maitreya, et autres
Publié: (2024)
par: Shelare, Maitreya, et autres
Publié: (2024)
Do VLMs Need Vision Transformers? Evaluating State Space Models as Vision Encoders
par: Kuo, Shang-Jui Ray, et autres
Publié: (2026)
par: Kuo, Shang-Jui Ray, et autres
Publié: (2026)
Parallel Swin Transformer-Enhanced 3D MRI-to-CT Synthesis for MRI-Only Radiotherapy Planning
par: Dorjsembe, Zolnamar, et autres
Publié: (2026)
par: Dorjsembe, Zolnamar, et autres
Publié: (2026)
Residual-SwinCA-Net: A Channel-Aware Integrated Residual CNN-Swin Transformer for Malignant Lesion Segmentation in BUSI
par: Naz, Saeeda, et autres
Publié: (2025)
par: Naz, Saeeda, et autres
Publié: (2025)
A Fully Automated Pipeline Using Swin Transformers for Deep Learning-Based Blood Segmentation on Head CT Scans After Aneurysmal Subarachnoid Hemorrhage
par: Garcia, Sergio Garcia, et autres
Publié: (2023)
par: Garcia, Sergio Garcia, et autres
Publié: (2023)
Frozen Vision Transformers for Dense Prediction on Small Datasets: A Case Study in Arrow Localization
par: Shepherd, Maxwell
Publié: (2026)
par: Shepherd, Maxwell
Publié: (2026)
Calibrated Self-Rewarding Vision Language Models
par: Zhou, Yiyang, et autres
Publié: (2024)
par: Zhou, Yiyang, et autres
Publié: (2024)
Benchmarking the Attribution Quality of Vision Models
par: Hesse, Robin, et autres
Publié: (2024)
par: Hesse, Robin, et autres
Publié: (2024)
TLDR: Token-Level Detective Reward Model for Large Vision Language Models
par: Fu, Deqing, et autres
Publié: (2024)
par: Fu, Deqing, et autres
Publié: (2024)
Swin fMRI Transformer Predicts Early Neurodevelopmental Outcomes from Neonatal fMRI
par: Styll, Patrick, et autres
Publié: (2024)
par: Styll, Patrick, et autres
Publié: (2024)
SoliReward: Mitigating Susceptibility to Reward Hacking and Annotation Noise in Video Generation Reward Models
par: Lian, Jiesong, et autres
Publié: (2025)
par: Lian, Jiesong, et autres
Publié: (2025)
Automated Assessment of Residual Plots with Computer Vision Models
par: Li, Weihao, et autres
Publié: (2024)
par: Li, Weihao, et autres
Publié: (2024)
Evaluating Object-Centric Models beyond Object Discovery
par: Singh, Krishnakant, et autres
Publié: (2026)
par: Singh, Krishnakant, et autres
Publié: (2026)
Voxel-Level Brain States Prediction Using Swin Transformer
par: Sun, Yifei, et autres
Publié: (2025)
par: Sun, Yifei, et autres
Publié: (2025)
Deep Learning for Melt Pool Depth Contour Prediction From Surface Thermal Images via Vision Transformers
par: Ogoke, Francis, et autres
Publié: (2024)
par: Ogoke, Francis, et autres
Publié: (2024)
Towards Improved Cervical Cancer Screening: Vision Transformer-Based Classification and Interpretability
par: Nguyen, Khoa Tuan, et autres
Publié: (2025)
par: Nguyen, Khoa Tuan, et autres
Publié: (2025)
Native Segmentation Vision Transformers
par: Brasó, Guillem, et autres
Publié: (2025)
par: Brasó, Guillem, et autres
Publié: (2025)
KamonBench: A Grammar-Based Dataset for Evaluating Compositional Factor Recovery in Vision-Language Models
par: Sproat, Richard, et autres
Publié: (2026)
par: Sproat, Richard, et autres
Publié: (2026)
WSVD: Weighted Low-Rank Approximation for Fast and Efficient Execution of Low-Precision Vision-Language Models
par: Wang, Haiyu, et autres
Publié: (2026)
par: Wang, Haiyu, et autres
Publié: (2026)
Enhancing Parameter-Efficient Fine-Tuning of Vision Transformers through Frequency-Based Adaptation
par: Ly, Son Thai, et autres
Publié: (2024)
par: Ly, Son Thai, et autres
Publié: (2024)
PerFormer: A Permutation Based Vision Transformer for Remaining Useful Life Prediction
par: Fan, Zhengyang, et autres
Publié: (2025)
par: Fan, Zhengyang, et autres
Publié: (2025)
Iwin Transformer: Hierarchical Vision Transformer using Interleaved Windows
par: Huo, Simin, et autres
Publié: (2025)
par: Huo, Simin, et autres
Publié: (2025)
TwoHead-SwinFPN: A Unified DL Architecture for Synthetic Manipulation, Detection and Localization in Identity Documents
par: Naseeb, Chan, et autres
Publié: (2026)
par: Naseeb, Chan, et autres
Publié: (2026)
Slicing Vision Transformer for Flexible Inference
par: Zhang, Yitian, et autres
Publié: (2024)
par: Zhang, Yitian, et autres
Publié: (2024)
Rotary Position Embedding for Vision Transformer
par: Heo, Byeongho, et autres
Publié: (2024)
par: Heo, Byeongho, et autres
Publié: (2024)
RAViT: Resolution-Adaptive Vision Transformer
par: Guidez, Martial, et autres
Publié: (2026)
par: Guidez, Martial, et autres
Publié: (2026)
Decorrelation Speeds Up Vision Transformers
par: Carrigg, Kieran, et autres
Publié: (2025)
par: Carrigg, Kieran, et autres
Publié: (2025)
Activation Reward Models for Few-Shot Model Alignment
par: Chai, Tianning, et autres
Publié: (2025)
par: Chai, Tianning, et autres
Publié: (2025)
Training a Computer Vision Model for Commercial Bakeries with Primarily Synthetic Images
par: Schmitt, Thomas H., et autres
Publié: (2024)
par: Schmitt, Thomas H., et autres
Publié: (2024)
SKINOPATHY AI: Smartphone-Based Ophthalmic Screening and Longitudinal Tracking Using Lightweight Computer Vision
par: Kalaycioglu, S., et autres
Publié: (2026)
par: Kalaycioglu, S., et autres
Publié: (2026)
Discrete Cosine Transform Based Decorrelated Attention for Vision Transformers
par: Pan, Hongyi, et autres
Publié: (2024)
par: Pan, Hongyi, et autres
Publié: (2024)
An Efficient Approach to Detecting Lung Nodules Using Swin Transformer
par: Shakuri, Saeed, et autres
Publié: (2025)
par: Shakuri, Saeed, et autres
Publié: (2025)
Documents similaires
-
BEN: Using Confidence-Guided Matting for Dichotomous Image Segmentation
par: Meyer, Maxwell, et autres
Publié: (2025) -
RSwinV2-MD: An Enhanced Residual SwinV2 Transformer for Monkeypox Detection from Skin Images
par: Iqbal, Rashid, et autres
Publié: (2026) -
SparseSwin: Swin Transformer with Sparse Transformer Block
par: Pinasthika, Krisna, et autres
Publié: (2023) -
Brain Hematoma Marker Recognition Using Multitask Learning: SwinTransformer and Swin-Unet
par: Hirata, Kodai, et autres
Publié: (2025) -
Video Quality Assessment Based on Swin TransformerV2 and Coarse to Fine Strategy
par: Yu, Zihao, et autres
Publié: (2024)