GPSToken: Gaussian Parameterized Spatially-adaptive Tokenization for Image Representation and Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Zhang, Zhengqiang, Wu, Rongyuan, Sun, Lingchen, Zhang, Lei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GDPO-SR: Group Direct Preference Optimization for One-Step Generative Image Super-Resolution
by: Yi, Qiaosi, et al.
Published: (2026)
by: Yi, Qiaosi, et al.
Published: (2026)
SeeSR: Towards Semantics-Aware Real-World Image Super-Resolution
by: Wu, Rongyuan, et al.
Published: (2023)
by: Wu, Rongyuan, et al.
Published: (2023)
VOSR: A Vision-Only Generative Model for Image Super-Resolution
by: Wu, Rongyuan, et al.
Published: (2026)
by: Wu, Rongyuan, et al.
Published: (2026)
One-Step Diffusion for Detail-Rich and Temporally Consistent Video Super-Resolution
by: Sun, Yujing, et al.
Published: (2025)
by: Sun, Yujing, et al.
Published: (2025)
Self-transcendence: Is External Feature Guidance Indispensable for Accelerating Diffusion Transformer Training?
by: Sun, Lingchen, et al.
Published: (2026)
by: Sun, Lingchen, et al.
Published: (2026)
GGT-100K: Generative Ground Truth for Generalizable Real-World Image Restoration
by: Kong, Xiangtao, et al.
Published: (2026)
by: Kong, Xiangtao, et al.
Published: (2026)
Improving the Stability and Efficiency of Diffusion Models for Content Consistent Super-Resolution
by: Sun, Lingchen, et al.
Published: (2023)
by: Sun, Lingchen, et al.
Published: (2023)
DP$^2$O-SR: Direct Perceptual Preference Optimization for Real-World Image Super-Resolution
by: Wu, Rongyuan, et al.
Published: (2025)
by: Wu, Rongyuan, et al.
Published: (2025)
One-Step Effective Diffusion Network for Real-World Image Super-Resolution
by: Wu, Rongyuan, et al.
Published: (2024)
by: Wu, Rongyuan, et al.
Published: (2024)
NSARM: Next-Scale Autoregressive Modeling for Robust Real-World Image Super-Resolution
by: Kong, Xiangtao, et al.
Published: (2025)
by: Kong, Xiangtao, et al.
Published: (2025)
Fine-structure Preserved Real-world Image Super-resolution via Transfer VAE Training
by: Yi, Qiaosi, et al.
Published: (2025)
by: Yi, Qiaosi, et al.
Published: (2025)
NTIRE 2025 the 2nd Restore Any Image Model (RAIM) in the Wild Challenge
by: Liang, Jie, et al.
Published: (2025)
by: Liang, Jie, et al.
Published: (2025)
Pixel-level and Semantic-level Adjustable Super-resolution: A Dual-LoRA Approach
by: Sun, Lingchen, et al.
Published: (2024)
by: Sun, Lingchen, et al.
Published: (2024)
FreCaS: Efficient Higher-Resolution Image Generation via Frequency-aware Cascaded Sampling
by: Zhang, Zhengqiang, et al.
Published: (2024)
by: Zhang, Zhengqiang, et al.
Published: (2024)
SSL: A Self-similarity Loss for Improving Generative Image Super-resolution
by: Chen, Du, et al.
Published: (2024)
by: Chen, Du, et al.
Published: (2024)
NTIRE 2024 Restore Any Image Model (RAIM) in the Wild Challenge
by: Liang, Jie, et al.
Published: (2024)
by: Liang, Jie, et al.
Published: (2024)
AlignCVC: Aligning Cross-View Consistency for Single-Image-to-3D Generation
by: Liang, Xinyue, et al.
Published: (2025)
by: Liang, Xinyue, et al.
Published: (2025)
Generalized and Efficient 2D Gaussian Splatting for Arbitrary-scale Super-Resolution
by: Chen, Du, et al.
Published: (2025)
by: Chen, Du, et al.
Published: (2025)
Pixel-Aware Stable Diffusion for Realistic Image Super-resolution and Personalized Stylization
by: Yang, Tao, et al.
Published: (2023)
by: Yang, Tao, et al.
Published: (2023)
Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation
by: Guo, Yanjun, et al.
Published: (2026)
by: Guo, Yanjun, et al.
Published: (2026)
Spatial-Mamba: Effective Visual State Space Models via Structure-aware State Fusion
by: Xiao, Chaodong, et al.
Published: (2024)
by: Xiao, Chaodong, et al.
Published: (2024)
InstructRestore: Region-Customized Image Restoration with Human Instructions
by: Liu, Shuaizheng, et al.
Published: (2025)
by: Liu, Shuaizheng, et al.
Published: (2025)
BinaryAttention: One-Bit QK-Attention for Vision and Diffusion Transformers
by: Xiao, Chaodong, et al.
Published: (2026)
by: Xiao, Chaodong, et al.
Published: (2026)
Photo3D: Advancing Photorealistic 3D Generation through Structure-Aligned Detail Enhancement
by: Liang, Xinyue, et al.
Published: (2025)
by: Liang, Xinyue, et al.
Published: (2025)
Improved Masked Image Generation with Knowledge-Augmented Token Representations
by: Liang, Guotao, et al.
Published: (2025)
by: Liang, Guotao, et al.
Published: (2025)
Restoration Adaptation for Semantic Segmentation on Low Quality Images
by: Guan, Kai, et al.
Published: (2026)
by: Guan, Kai, et al.
Published: (2026)
Versatile Video Tokenization with Generative 2D Gaussian Splatting
by: Chen, Zhenghao, et al.
Published: (2025)
by: Chen, Zhenghao, et al.
Published: (2025)
Adversarial Diffusion Compression for Real-World Image Super-Resolution
by: Chen, Bin, et al.
Published: (2024)
by: Chen, Bin, et al.
Published: (2024)
GaussianToken: An Effective Image Tokenizer with 2D Gaussian Splatting
by: Dong, Jiajun, et al.
Published: (2025)
by: Dong, Jiajun, et al.
Published: (2025)
Progressive Rendering Distillation: Adapting Stable Diffusion for Instant Text-to-Mesh Generation without 3D Data
by: Ma, Zhiyuan, et al.
Published: (2025)
by: Ma, Zhiyuan, et al.
Published: (2025)
GaussianImage++: Boosted Image Representation and Compression with 2D Gaussian Splatting
by: Li, Tiantian, et al.
Published: (2025)
by: Li, Tiantian, et al.
Published: (2025)
TMP: Temporal Motion Propagation for Online Video Super-Resolution
by: Zhang, Zhengqiang, et al.
Published: (2023)
by: Zhang, Zhengqiang, et al.
Published: (2023)
OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens
by: Yang, Yiying, et al.
Published: (2026)
by: Yang, Yiying, et al.
Published: (2026)
A Multi-Mode Structured Light 3D Imaging System with Multi-Source Information Fusion for Underwater Pipeline Detection
by: Hu, Qinghan, et al.
Published: (2025)
by: Hu, Qinghan, et al.
Published: (2025)
ASAP-Textured Gaussians: Enhancing Textured Gaussians with Adaptive Sampling and Anisotropic Parameterization
by: Wei, Meng, et al.
Published: (2025)
by: Wei, Meng, et al.
Published: (2025)
LLaVA-SP: Enhancing Visual Representation with Visual Spatial Tokens for MLLMs
by: Lou, Haoran, et al.
Published: (2025)
by: Lou, Haoran, et al.
Published: (2025)
TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction
by: Liu, Yunfei, et al.
Published: (2025)
by: Liu, Yunfei, et al.
Published: (2025)
Layton: Latent Consistency Tokenizer for 1024-pixel Image Reconstruction and Generation by 256 Tokens
by: Xie, Qingsong, et al.
Published: (2025)
by: Xie, Qingsong, et al.
Published: (2025)
DeepStack: Deeply Stacking Visual Tokens is Surprisingly Simple and Effective for LMMs
by: Meng, Lingchen, et al.
Published: (2024)
by: Meng, Lingchen, et al.
Published: (2024)
Image Understanding Makes for A Good Tokenizer for Image Generation
by: Wang, Luting, et al.
Published: (2024)
by: Wang, Luting, et al.
Published: (2024)
Similar Items
-
GDPO-SR: Group Direct Preference Optimization for One-Step Generative Image Super-Resolution
by: Yi, Qiaosi, et al.
Published: (2026) -
SeeSR: Towards Semantics-Aware Real-World Image Super-Resolution
by: Wu, Rongyuan, et al.
Published: (2023) -
VOSR: A Vision-Only Generative Model for Image Super-Resolution
by: Wu, Rongyuan, et al.
Published: (2026) -
One-Step Diffusion for Detail-Rich and Temporally Consistent Video Super-Resolution
by: Sun, Yujing, et al.
Published: (2025) -
Self-transcendence: Is External Feature Guidance Indispensable for Accelerating Diffusion Transformer Training?
by: Sun, Lingchen, et al.
Published: (2026)