Cascaded Multi-Scale Attention for Enhanced Multi-Scale Feature Extraction and Interaction with Low-Resolution Images
Fuente:
arXiv
Saved in:
| Main Authors: | Lu, Xiangyong, Suganuma, Masanori, Okatani, Takayuki |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
An Improved Method for Personalizing Diffusion Models
by: Zeng, Yan, et al.
Published: (2024)
by: Zeng, Yan, et al.
Published: (2024)
Open-vocabulary vs. Closed-set: Best Practice for Few-shot Object Detection Considering Text Describability
by: Hosoya, Yusuke, et al.
Published: (2024)
by: Hosoya, Yusuke, et al.
Published: (2024)
Rethinking Annotation for Object Detection: Is Annotating Small-size Instances Worth Its Cost?
by: Hosoya, Yusuke, et al.
Published: (2024)
by: Hosoya, Yusuke, et al.
Published: (2024)
RefVSR++: Exploiting Reference Inputs for Reference-based Video Super-resolution
by: Zou, Han, et al.
Published: (2023)
by: Zou, Han, et al.
Published: (2023)
Rethinking Open-Set Object Detection: Issues, a New Formulation, and Taxonomy
by: Hosoya, Yusuke, et al.
Published: (2022)
by: Hosoya, Yusuke, et al.
Published: (2022)
Rethinking Unsupervised Domain Adaptation for Semantic Segmentation
by: Wang, Zhijie, et al.
Published: (2022)
by: Wang, Zhijie, et al.
Published: (2022)
MS-DPPs: Multi-Source Determinantal Point Processes for Contextual Diversity Refinement of Composite Attributes in Text to Image Retrieval
by: Sogi, Naoya, et al.
Published: (2025)
by: Sogi, Naoya, et al.
Published: (2025)
Exploring the Potential of Multi-Modal AI for Driving Hazard Prediction
by: Charoenpitaks, Korawat, et al.
Published: (2023)
by: Charoenpitaks, Korawat, et al.
Published: (2023)
TB-Bench: Training and Testing Multi-Modal AI for Understanding Spatio-Temporal Traffic Behaviors from Dashcam Images/Videos
by: Charoenpitaks, Korawat, et al.
Published: (2025)
by: Charoenpitaks, Korawat, et al.
Published: (2025)
LAMS-Edit: Latent and Attention Mixing with Schedulers for Improved Content Preservation in Diffusion-Based Image and Style Editing
by: Fu, Wingwa, et al.
Published: (2026)
by: Fu, Wingwa, et al.
Published: (2026)
RP-SLAM: Real-time Photorealistic SLAM with Efficient 3D Gaussian Splatting
by: Bai, Lizhi, et al.
Published: (2024)
by: Bai, Lizhi, et al.
Published: (2024)
Efficient Image Super-Resolution with Multi-Scale Spatial Adaptive Attention Networks
by: Rao, Sushi, et al.
Published: (2026)
by: Rao, Sushi, et al.
Published: (2026)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
by: Tang, Hao, et al.
Published: (2025)
by: Tang, Hao, et al.
Published: (2025)
Hierarchical Image Tokenization for Multi-Scale Image Super Resolution
by: Hadji, Isma, et al.
Published: (2026)
by: Hadji, Isma, et al.
Published: (2026)
Multi-Scale Diffusion: Enhancing Spatial Layout in High-Resolution Panoramic Image Generation
by: Zhang, Xiaoyu, et al.
Published: (2024)
by: Zhang, Xiaoyu, et al.
Published: (2024)
Implicit Grid Convolution for Multi-Scale Image Super-Resolution
by: Lee, Dongheon, et al.
Published: (2024)
by: Lee, Dongheon, et al.
Published: (2024)
EfficientViT: Multi-Scale Linear Attention for High-Resolution Dense Prediction
by: Cai, Han, et al.
Published: (2022)
by: Cai, Han, et al.
Published: (2022)
Towards Satellite Image Road Graph Extraction: A Global-Scale Dataset and A Novel Method
by: Yin, Pan, et al.
Published: (2024)
by: Yin, Pan, et al.
Published: (2024)
Attention-Guided Multi-scale Interaction Network for Face Super-Resolution
by: Wan, Xujie, et al.
Published: (2024)
by: Wan, Xujie, et al.
Published: (2024)
Cross-Layer Feature Self-Attention Module for Multi-Scale Object Detection
by: Xie, Dingzhou, et al.
Published: (2025)
by: Xie, Dingzhou, et al.
Published: (2025)
Multi-Scale Denoising in the Feature Space for Low-Light Instance Segmentation
by: Lin, Joanne, et al.
Published: (2024)
by: Lin, Joanne, et al.
Published: (2024)
Small Object Detection Model with Spatial Laplacian Pyramid Attention and Multi-Scale Features Enhancement in Aerial Images
by: Ji, Zhangjian, et al.
Published: (2026)
by: Ji, Zhangjian, et al.
Published: (2026)
Optimized Unet with Attention Mechanism for Multi-Scale Semantic Segmentation
by: Li, Xuan, et al.
Published: (2025)
by: Li, Xuan, et al.
Published: (2025)
Self-Cascaded Diffusion Models for Arbitrary-Scale Image Super-Resolution
by: Bang, Junseo, et al.
Published: (2025)
by: Bang, Junseo, et al.
Published: (2025)
Multi-Scale Implicit Transformer with Re-parameterize for Arbitrary-Scale Super-Resolution
by: Zhu, Jinchen, et al.
Published: (2024)
by: Zhu, Jinchen, et al.
Published: (2024)
AMMUNet: Multi-Scale Attention Map Merging for Remote Sensing Image Segmentation
by: Yang, Yang, et al.
Published: (2024)
by: Yang, Yang, et al.
Published: (2024)
Enhancing Multi-Image Understanding through Delimiter Token Scaling
by: Lee, Minyoung, et al.
Published: (2026)
by: Lee, Minyoung, et al.
Published: (2026)
Local-Global Attention: An Adaptive Mechanism for Multi-Scale Feature Integration
by: Shao, Yifan
Published: (2024)
by: Shao, Yifan
Published: (2024)
DMAGaze: Gaze Estimation Based on Feature Disentanglement and Multi-Scale Attention
by: Chen, Haohan, et al.
Published: (2025)
by: Chen, Haohan, et al.
Published: (2025)
RMAFF-PSN: A Residual Multi-Scale Attention Feature Fusion Photometric Stereo Network
by: Luo, Kai, et al.
Published: (2024)
by: Luo, Kai, et al.
Published: (2024)
Improving Cross-view Object Geo-localization: A Dual Attention Approach with Cross-view Interaction and Multi-Scale Spatial Features
by: Zhu, Xingtao Ling Yingying
Published: (2025)
by: Zhu, Xingtao Ling Yingying
Published: (2025)
Scale Equalization for Multi-Level Feature Fusion
by: Kim, Bum Jun, et al.
Published: (2024)
by: Kim, Bum Jun, et al.
Published: (2024)
PINN-EMFNet: PINN-based and Enhanced Multi-Scale Feature Fusion Network for Breast Ultrasound Images Segmentation
by: Ding, Jiajun, et al.
Published: (2024)
by: Ding, Jiajun, et al.
Published: (2024)
A Lightweight Attention-based Deep Network via Multi-Scale Feature Fusion for Multi-View Facial Expression Recognition
by: Ezati, Ali, et al.
Published: (2024)
by: Ezati, Ali, et al.
Published: (2024)
MambaCAFU: Hybrid Multi-Scale and Multi-Attention Model with Mamba-Based Fusion for Medical Image Segmentation
by: Bui, T-Mai, et al.
Published: (2025)
by: Bui, T-Mai, et al.
Published: (2025)
Rotated Multi-Scale Interaction Network for Referring Remote Sensing Image Segmentation
by: Liu, Sihan, et al.
Published: (2023)
by: Liu, Sihan, et al.
Published: (2023)
HiLM-D: Enhancing MLLMs with Multi-Scale High-Resolution Details for Autonomous Driving
by: Ding, Xinpeng, et al.
Published: (2023)
by: Ding, Xinpeng, et al.
Published: (2023)
ViSketch-GPT: Collaborative Multi-Scale Feature Extraction for Sketch Recognition and Generation
by: Federico, Giulio, et al.
Published: (2025)
by: Federico, Giulio, et al.
Published: (2025)
Enhancing Few-Shot Image Classification through Learnable Multi-Scale Embedding and Attention Mechanisms
by: Askari, Fatemeh, et al.
Published: (2024)
by: Askari, Fatemeh, et al.
Published: (2024)
Temporal Insight Enhancement: Mitigating Temporal Hallucination in Multimodal Large Language Models
by: Sun, Li, et al.
Published: (2024)
by: Sun, Li, et al.
Published: (2024)
Similar Items
-
An Improved Method for Personalizing Diffusion Models
by: Zeng, Yan, et al.
Published: (2024) -
Open-vocabulary vs. Closed-set: Best Practice for Few-shot Object Detection Considering Text Describability
by: Hosoya, Yusuke, et al.
Published: (2024) -
Rethinking Annotation for Object Detection: Is Annotating Small-size Instances Worth Its Cost?
by: Hosoya, Yusuke, et al.
Published: (2024) -
RefVSR++: Exploiting Reference Inputs for Reference-based Video Super-resolution
by: Zou, Han, et al.
Published: (2023) -
Rethinking Open-Set Object Detection: Issues, a New Formulation, and Taxonomy
by: Hosoya, Yusuke, et al.
Published: (2022)