Hierarchical Image Tokenization for Multi-Scale Image Super Resolution
Fuente:
arXiv
Saved in:
| Main Authors: | Hadji, Isma, Sanchez, Enrique, Bulat, Adrian, Martinez, Brais, Tzimiropoulos, Georgios |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-scale Image Super Resolution with a Single Auto-Regressive Model
by: Sanchez, Enrique, et al.
Published: (2025)
by: Sanchez, Enrique, et al.
Published: (2025)
You Only Need One Step: Fast Super-Resolution with Stable Diffusion via Scale Distillation
by: Noroozi, Mehdi, et al.
Published: (2024)
by: Noroozi, Mehdi, et al.
Published: (2024)
FAM Diffusion: Frequency and Attention Modulation for High-Resolution Image Generation with Stable Diffusion
by: Yang, Haosen, et al.
Published: (2024)
by: Yang, Haosen, et al.
Published: (2024)
Restore, Assess, Repeat: A Unified Framework for Iterative Image Restoration
by: Chen, I-Hsiang, et al.
Published: (2026)
by: Chen, I-Hsiang, et al.
Published: (2026)
Edge-SD-SR: Low Latency and Parameter Efficient On-device Super-Resolution with Stable Diffusion via Bidirectional Conditioning
by: Noroozi, Mehdi, et al.
Published: (2024)
by: Noroozi, Mehdi, et al.
Published: (2024)
CLIP-DPO: Vision-Language Models as a Source of Preference for Fixing Hallucinations in LVLMs
by: Ouali, Yassine, et al.
Published: (2024)
by: Ouali, Yassine, et al.
Published: (2024)
Knowledge Distillation Meets Open-Set Semi-Supervised Learning
by: Yang, Jing, et al.
Published: (2022)
by: Yang, Jing, et al.
Published: (2022)
Aligned Unsupervised Pretraining of Object Detectors with Self-training
by: Metaxas, Ioannis Maniadis, et al.
Published: (2023)
by: Metaxas, Ioannis Maniadis, et al.
Published: (2023)
More Images, More Problems? A Controlled Analysis of VLM Failure Modes
by: Das, Anurag, et al.
Published: (2026)
by: Das, Anurag, et al.
Published: (2026)
Fwd2Bot: LVLM Visual Token Compression with Double Forward Bottleneck
by: Bulat, Adrian, et al.
Published: (2025)
by: Bulat, Adrian, et al.
Published: (2025)
FFF: Fixing Flawed Foundations in contrastive pre-training results in very strong Vision-Language models
by: Bulat, Adrian, et al.
Published: (2024)
by: Bulat, Adrian, et al.
Published: (2024)
VladVA: Discriminative Fine-tuning of LVLMs
by: Ouali, Yassine, et al.
Published: (2024)
by: Ouali, Yassine, et al.
Published: (2024)
Vision-Free Retrieval: Rethinking Multimodal Search with Textual Scene Descriptions
by: Ntinou, Ioanna, et al.
Published: (2025)
by: Ntinou, Ioanna, et al.
Published: (2025)
Multiscale Vision Transformers meet Bipartite Matching for efficient single-stage Action Localization
by: Ntinou, Ioanna, et al.
Published: (2023)
by: Ntinou, Ioanna, et al.
Published: (2023)
MeMSVD: Long-Range Temporal Structure Capturing Using Incremental SVD
by: Ntinou, Ioanna, et al.
Published: (2024)
by: Ntinou, Ioanna, et al.
Published: (2024)
VISion On Request: Enhanced VLLM efficiency with sparse, dynamically selected, vision-language interactions
by: Bulat, Adrian, et al.
Published: (2026)
by: Bulat, Adrian, et al.
Published: (2026)
Implicit Grid Convolution for Multi-Scale Image Super-Resolution
by: Lee, Dongheon, et al.
Published: (2024)
by: Lee, Dongheon, et al.
Published: (2024)
Hi-Mamba: Hierarchical Mamba for Efficient Image Super-Resolution
by: Qiao, Junbo, et al.
Published: (2024)
by: Qiao, Junbo, et al.
Published: (2024)
HiT-SR: Hierarchical Transformer for Efficient Image Super-Resolution
by: Zhang, Xiang, et al.
Published: (2024)
by: Zhang, Xiang, et al.
Published: (2024)
Efficient Image Super-Resolution with Multi-Scale Spatial Adaptive Attention Networks
by: Rao, Sushi, et al.
Published: (2026)
by: Rao, Sushi, et al.
Published: (2026)
CATANet: Efficient Content-Aware Token Aggregation for Lightweight Image Super-Resolution
by: Liu, Xin, et al.
Published: (2025)
by: Liu, Xin, et al.
Published: (2025)
HiTokSR: A Coarse-to-Fine Tokenizer with Hierarchical Codebooks for High-Fidelity Real-World Image Super-Resolution
by: Li, Mingxi
Published: (2026)
by: Li, Mingxi
Published: (2026)
SuperF: Neural Implicit Fields for Multi-Image Super-Resolution
by: Jyhne, Sander Riisøen, et al.
Published: (2025)
by: Jyhne, Sander Riisøen, et al.
Published: (2025)
FourierSR: A Fourier Token-based Plugin for Efficient Image Super-Resolution
by: Li, Wenjie, et al.
Published: (2025)
by: Li, Wenjie, et al.
Published: (2025)
CLIPCleaner: Cleaning Noisy Labels with CLIP
by: Feng, Chen, et al.
Published: (2024)
by: Feng, Chen, et al.
Published: (2024)
CASISR: Circular Arbitrary-Scale Image Super-Resolution
by: Li, Honggui, et al.
Published: (2026)
by: Li, Honggui, et al.
Published: (2026)
Burst Image Super-Resolution with Mamba
by: Unal, Ozan, et al.
Published: (2025)
by: Unal, Ozan, et al.
Published: (2025)
Balancing Efficiency and Quality: MoEISR for Arbitrary-Scale Image Super-Resolution
by: Oh, Young Jae, et al.
Published: (2023)
by: Oh, Young Jae, et al.
Published: (2023)
Task-Aware Dynamic Transformer for Efficient Arbitrary-Scale Image Super-Resolution
by: Xu, Tianyi, et al.
Published: (2024)
by: Xu, Tianyi, et al.
Published: (2024)
Iterative Inference-time Scaling with Adaptive Frequency Steering for Image Super-Resolution
by: Zhang, Hexin, et al.
Published: (2025)
by: Zhang, Hexin, et al.
Published: (2025)
Enhanced Self-Supervised Multi-Image Super-Resolution for Camera Array Images
by: Chen, Yating, et al.
Published: (2026)
by: Chen, Yating, et al.
Published: (2026)
Efficient Unsupervised Visual Representation Learning with Explicit Cluster Balancing
by: Metaxas, Ioannis Maniadis, et al.
Published: (2024)
by: Metaxas, Ioannis Maniadis, et al.
Published: (2024)
Likelihood-Separable Diffusion Inference for Multi-Image MRI Super-Resolution
by: Remedios, Samuel W., et al.
Published: (2026)
by: Remedios, Samuel W., et al.
Published: (2026)
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution
by: Li, Simiao, et al.
Published: (2024)
by: Li, Simiao, et al.
Published: (2024)
MAT: Multi-Range Attention Transformer for Efficient Image Super-Resolution
by: Xie, Chengxing, et al.
Published: (2024)
by: Xie, Chengxing, et al.
Published: (2024)
HMANet: Hybrid Multi-Axis Aggregation Network for Image Super-Resolution
by: Chu, Shu-Chuan, et al.
Published: (2024)
by: Chu, Shu-Chuan, et al.
Published: (2024)
Hierarchical Similarity Learning for Aliasing Suppression Image Super-Resolution
by: Liu, Yuqing, et al.
Published: (2022)
by: Liu, Yuqing, et al.
Published: (2022)
A Cosine Network for Image Super-Resolution
by: Tian, Chunwei, et al.
Published: (2026)
by: Tian, Chunwei, et al.
Published: (2026)
Image Super-Resolution with Text Prompt Diffusion
by: Chen, Zheng, et al.
Published: (2023)
by: Chen, Zheng, et al.
Published: (2023)
Activating Wider Areas in Image Super-Resolution
by: Cheng, Cheng, et al.
Published: (2024)
by: Cheng, Cheng, et al.
Published: (2024)
Similar Items
-
Multi-scale Image Super Resolution with a Single Auto-Regressive Model
by: Sanchez, Enrique, et al.
Published: (2025) -
You Only Need One Step: Fast Super-Resolution with Stable Diffusion via Scale Distillation
by: Noroozi, Mehdi, et al.
Published: (2024) -
FAM Diffusion: Frequency and Attention Modulation for High-Resolution Image Generation with Stable Diffusion
by: Yang, Haosen, et al.
Published: (2024) -
Restore, Assess, Repeat: A Unified Framework for Iterative Image Restoration
by: Chen, I-Hsiang, et al.
Published: (2026) -
Edge-SD-SR: Low Latency and Parameter Efficient On-device Super-Resolution with Stable Diffusion via Bidirectional Conditioning
by: Noroozi, Mehdi, et al.
Published: (2024)