Efficient Masked Image Compression with Position-Indexed Self-Attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dai, Chengjie, Song, Tiantian, Tang, Hui, Chen, Fangdong, Yang, Bowei, Song, Guanghua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Progressive Image Compression with Variance-aware Masking
par: Presta, Alberto, et autres
Publié: (2024)
par: Presta, Alberto, et autres
Publié: (2024)
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
par: Wu, Yecheng, et autres
Publié: (2025)
par: Wu, Yecheng, et autres
Publié: (2025)
Linear Attention Modeling for Learned Image Compression
par: Feng, Donghui, et autres
Publié: (2025)
par: Feng, Donghui, et autres
Publié: (2025)
Efficient Masked Autoencoders with Self-Consistency
par: Li, Zhaowen, et autres
Publié: (2023)
par: Li, Zhaowen, et autres
Publié: (2023)
Deep Lossless Image Compression via Masked Sampling and Coarse-to-Fine Auto-Regression
par: Li, Tiantian, et autres
Publié: (2025)
par: Li, Tiantian, et autres
Publié: (2025)
MSCViT: A Small-size ViT architecture with Multi-Scale Self-Attention Mechanism for Tiny Datasets
par: Zhang, Bowei, et autres
Publié: (2025)
par: Zhang, Bowei, et autres
Publié: (2025)
TriAttention: Efficient Long Reasoning with Trigonometric KV Compression
par: Mao, Weian, et autres
Publié: (2026)
par: Mao, Weian, et autres
Publié: (2026)
Towards Efficient Diffusion-Based Image Editing with Instant Attention Masks
par: Zou, Siyu, et autres
Publié: (2024)
par: Zou, Siyu, et autres
Publié: (2024)
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
par: Luo, Yifu, et autres
Publié: (2025)
par: Luo, Yifu, et autres
Publié: (2025)
Exploring the Coordination of Frequency and Attention in Masked Image Modeling
par: Gui, Jie, et autres
Publié: (2022)
par: Gui, Jie, et autres
Publié: (2022)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
par: Wang, Wenxuan, et autres
Publié: (2023)
par: Wang, Wenxuan, et autres
Publié: (2023)
GenCAMO: Scene-Graph Contextual Decoupling for Environment-aware and Mask-free Camouflage Image-Dense Annotation Generation
par: Chen, Chenglizhao, et autres
Publié: (2026)
par: Chen, Chenglizhao, et autres
Publié: (2026)
SIDME: Self-supervised Image Demoiréing via Masked Encoder-Decoder Reconstruction
par: Wang, Xia, et autres
Publié: (2025)
par: Wang, Xia, et autres
Publié: (2025)
Castling-ViT: Compressing Self-Attention via Switching Towards Linear-Angular Attention at Vision Transformer Inference
par: You, Haoran, et autres
Publié: (2022)
par: You, Haoran, et autres
Publié: (2022)
Meissonic: Revitalizing Masked Generative Transformers for Efficient High-Resolution Text-to-Image Synthesis
par: Bai, Jinbin, et autres
Publié: (2024)
par: Bai, Jinbin, et autres
Publié: (2024)
FairViT: Fair Vision Transformer via Adaptive Masking
par: Tian, Bowei, et autres
Publié: (2024)
par: Tian, Bowei, et autres
Publié: (2024)
Polyline Path Masked Attention for Vision Transformer
par: Zhao, Zhongchen, et autres
Publié: (2025)
par: Zhao, Zhongchen, et autres
Publié: (2025)
Extremely low-bitrate Image Compression Semantically Disentangled by LMMs from a Human Perception Perspective
par: Song, Juan, et autres
Publié: (2025)
par: Song, Juan, et autres
Publié: (2025)
Next-Frame Decoding for Ultra-Low-Bitrate Image Compression with Video Diffusion Priors
par: Chen, Yunuo, et autres
Publié: (2026)
par: Chen, Yunuo, et autres
Publié: (2026)
Timestep-Aware Block Masking for Efficient Diffusion Model Inference
par: He, Haodong, et autres
Publié: (2026)
par: He, Haodong, et autres
Publié: (2026)
MedVKAN: Efficient Feature Extraction with Mamba and KAN for Medical Image Segmentation
par: Zhu, Hancan, et autres
Publié: (2025)
par: Zhu, Hancan, et autres
Publié: (2025)
Efficient Self-supervised Vision Pretraining with Local Masked Reconstruction
par: Chen, Jun, et autres
Publié: (2022)
par: Chen, Jun, et autres
Publié: (2022)
SyncMask: Synchronized Attentional Masking for Fashion-centric Vision-Language Pretraining
par: Song, Chull Hwan, et autres
Publié: (2024)
par: Song, Chull Hwan, et autres
Publié: (2024)
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
par: Xia, Zunhui, et autres
Publié: (2025)
par: Xia, Zunhui, et autres
Publié: (2025)
AnatoMask: Enhancing Medical Image Segmentation with Reconstruction-guided Self-masking
par: Li, Yuheng, et autres
Publié: (2024)
par: Li, Yuheng, et autres
Publié: (2024)
BA-SAM: Scalable Bias-Mode Attention Mask for Segment Anything Model
par: Song, Yiran, et autres
Publié: (2024)
par: Song, Yiran, et autres
Publié: (2024)
Mask What Matters: Controllable Text-Guided Masking for Self-Supervised Medical Image Analysis
par: Wang, Ruilang, et autres
Publié: (2025)
par: Wang, Ruilang, et autres
Publié: (2025)
Compress to Focus: Efficient Coordinate Compression for Policy Optimization in Multi-Turn GUI Agents
par: Song, Yurun, et autres
Publié: (2026)
par: Song, Yurun, et autres
Publié: (2026)
EpiMask: Leveraging Epipolar Distance Based Masks in Cross-Attention for Satellite Image Matching
par: Deshmukh, Rahul, et autres
Publié: (2026)
par: Deshmukh, Rahul, et autres
Publié: (2026)
DCText: Scheduled Attention Masking for Visual Text Generation via Divide-and-Conquer Strategy
par: Song, Jaewoo, et autres
Publié: (2025)
par: Song, Jaewoo, et autres
Publié: (2025)
From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models
par: Xiao, Changming, et autres
Publié: (2023)
par: Xiao, Changming, et autres
Publié: (2023)
MMCLIP: Cross-modal Attention Masked Modelling for Medical Language-Image Pre-Training
par: Wu, Biao, et autres
Publié: (2024)
par: Wu, Biao, et autres
Publié: (2024)
PositionIC: Unified Position and Identity Consistency for Image Customization
par: Hu, Junjie, et autres
Publié: (2025)
par: Hu, Junjie, et autres
Publié: (2025)
Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models
par: Chen, Junyu, et autres
Publié: (2024)
par: Chen, Junyu, et autres
Publié: (2024)
MiM: Mask in Mask Self-Supervised Pre-Training for 3D Medical Image Analysis
par: Zhuang, Jiaxin, et autres
Publié: (2024)
par: Zhuang, Jiaxin, et autres
Publié: (2024)
GaussianImage++: Boosted Image Representation and Compression with 2D Gaussian Splatting
par: Li, Tiantian, et autres
Publié: (2025)
par: Li, Tiantian, et autres
Publié: (2025)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
par: Zhan, Zechao, et autres
Publié: (2024)
par: Zhan, Zechao, et autres
Publié: (2024)
Mitigating Mask Prior Drift and Positional Attention Collapse in Large Diffusion Vision-Language Models
par: Hong, Sujung, et autres
Publié: (2026)
par: Hong, Sujung, et autres
Publié: (2026)
Harnessing Massive Satellite Imagery with Efficient Masked Image Modeling
par: Wang, Fengxiang, et autres
Publié: (2024)
par: Wang, Fengxiang, et autres
Publié: (2024)
Segmenting and Understanding: Region-aware Semantic Attention for Fine-grained Image Quality Assessment with Large Language Models
par: Song, Chenyue, et autres
Publié: (2025)
par: Song, Chenyue, et autres
Publié: (2025)
Documents similaires
-
Efficient Progressive Image Compression with Variance-aware Masking
par: Presta, Alberto, et autres
Publié: (2024) -
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
par: Wu, Yecheng, et autres
Publié: (2025) -
Linear Attention Modeling for Learned Image Compression
par: Feng, Donghui, et autres
Publié: (2025) -
Efficient Masked Autoencoders with Self-Consistency
par: Li, Zhaowen, et autres
Publié: (2023) -
Deep Lossless Image Compression via Masked Sampling and Coarse-to-Fine Auto-Regression
par: Li, Tiantian, et autres
Publié: (2025)