From "What" to "How": Constrained Reasoning for Autoregressive Image Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yan, Ruxue, Liu, Xubo, Guo, Wenya, Zhang, Zhengkun, Zhang, Ying, Yuan, Xiaojie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
por: Wang, Ziyi, et al.
Publicado: (2025)
por: Wang, Ziyi, et al.
Publicado: (2025)
Image Quality Assessment: From Human to Machine Preference
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
Generative Preprocessing for Image Compression with Pre-trained Diffusion Models
por: Guo, Mengxi, et al.
Publicado: (2025)
por: Guo, Mengxi, et al.
Publicado: (2025)
T2IW: Joint Text to Image & Watermark Generation
por: Liu, An-An, et al.
Publicado: (2023)
por: Liu, An-An, et al.
Publicado: (2023)
Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
por: Ye, Kai, et al.
Publicado: (2025)
por: Ye, Kai, et al.
Publicado: (2025)
Toward Scalable Image Feature Compression: A Content-Adaptive and Diffusion-Based Approach
por: Guo, Sha, et al.
Publicado: (2024)
por: Guo, Sha, et al.
Publicado: (2024)
SANR: Scene-Aware Neural Representation for Light Field Image Compression with Rate-Distortion Optimization
por: Zhang, Gai, et al.
Publicado: (2025)
por: Zhang, Gai, et al.
Publicado: (2025)
CI-ICM: Channel Importance-driven Learned Image Coding for Machines
por: Zhang, Yun, et al.
Publicado: (2026)
por: Zhang, Yun, et al.
Publicado: (2026)
Exploiting Frequency Correlation for Hyperspectral Image Reconstruction
por: Yan, Muge, et al.
Publicado: (2024)
por: Yan, Muge, et al.
Publicado: (2024)
Learned Image Compression with Hierarchical Progressive Context Modeling
por: Li, Yuqi, et al.
Publicado: (2025)
por: Li, Yuqi, et al.
Publicado: (2025)
Off-the-shelf Vision Models Benefit Image Manipulation Localization
por: Zhang, Zhengxuan, et al.
Publicado: (2026)
por: Zhang, Zhengxuan, et al.
Publicado: (2026)
EditMGT: Unleashing Potentials of Masked Generative Transformers in Image Editing
por: Chow, Wei, et al.
Publicado: (2025)
por: Chow, Wei, et al.
Publicado: (2025)
Once-for-All: Controllable Generative Image Compression with Dynamic Granularity Adaptation
por: Li, Anqi, et al.
Publicado: (2024)
por: Li, Anqi, et al.
Publicado: (2024)
End-to-End RGB-IR Joint Image Compression With Channel-wise Cross-modality Entropy Model
por: Wang, Haofeng, et al.
Publicado: (2025)
por: Wang, Haofeng, et al.
Publicado: (2025)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
por: Li, Chunyi, et al.
Publicado: (2024)
por: Li, Chunyi, et al.
Publicado: (2024)
LeRF: Learning Resampling Function for Adaptive and Efficient Image Interpolation
por: Li, Jiacheng, et al.
Publicado: (2024)
por: Li, Jiacheng, et al.
Publicado: (2024)
Hyperspectral Image Fusion with Spectral-Band and Fusion-Scale Agnosticism
por: Liang, Yu-Jie, et al.
Publicado: (2026)
por: Liang, Yu-Jie, et al.
Publicado: (2026)
Automated Retinal Image Analysis and Medical Report Generation through Deep Learning
por: Huang, Jia-Hong
Publicado: (2024)
por: Huang, Jia-Hong
Publicado: (2024)
EchoSR: Efficient Context Harnessing for Lightweight Image Super-Resolution
por: Zhao, Hanli, et al.
Publicado: (2026)
por: Zhao, Hanli, et al.
Publicado: (2026)
MORE: Multi-Organ Medical Image REconstruction Dataset
por: Wu, Shaokai, et al.
Publicado: (2025)
por: Wu, Shaokai, et al.
Publicado: (2025)
Towards Efficient SDRTV-to-HDRTV by Learning from Image Formation
por: Chen, Xiangyu, et al.
Publicado: (2023)
por: Chen, Xiangyu, et al.
Publicado: (2023)
Audio-Visual Quality Assessment for User Generated Content: Database and Method
por: Cao, Yuqin, et al.
Publicado: (2023)
por: Cao, Yuqin, et al.
Publicado: (2023)
CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
por: Wang, Hang, et al.
Publicado: (2026)
por: Wang, Hang, et al.
Publicado: (2026)
Inter-LPCM: Learning-based Inter-Frame Predictive Coding for LiDAR Point Cloud Compression
por: Sun, Chang, et al.
Publicado: (2026)
por: Sun, Chang, et al.
Publicado: (2026)
GaussianImage: 1000 FPS Image Representation and Compression by 2D Gaussian Splatting
por: Zhang, Xinjie, et al.
Publicado: (2024)
por: Zhang, Xinjie, et al.
Publicado: (2024)
Fine-grained Image Quality Assessment for Perceptual Image Restoration
por: Sheng, Xiangfei, et al.
Publicado: (2025)
por: Sheng, Xiangfei, et al.
Publicado: (2025)
Releasing the Parameter Latency of Neural Representation for High-Efficiency Video Compression
por: Zhang, Gai, et al.
Publicado: (2024)
por: Zhang, Gai, et al.
Publicado: (2024)
Modeling Beyond MOS: Quality Assessment Models Must Integrate Context, Reasoning, and Multimodality
por: Kerkouri, Mohamed Amine, et al.
Publicado: (2025)
por: Kerkouri, Mohamed Amine, et al.
Publicado: (2025)
Perceptual Quality Optimization of Image Super-Resolution
por: Zhou, Wei, et al.
Publicado: (2026)
por: Zhou, Wei, et al.
Publicado: (2026)
SatFusion: A Unified Framework for Enhancing Remote Sensing Images via Multi-Frame and Multi-Source Images Fusion
por: Tong, Yufei, et al.
Publicado: (2025)
por: Tong, Yufei, et al.
Publicado: (2025)
Perceptual Depth Quality Assessment of Stereoscopic Omnidirectional Images
por: Zhou, Wei, et al.
Publicado: (2024)
por: Zhou, Wei, et al.
Publicado: (2024)
Transferable Learned Image Compression-Resistant Adversarial Perturbations
por: Sui, Yang, et al.
Publicado: (2024)
por: Sui, Yang, et al.
Publicado: (2024)
Channel-wise Feature Decorrelation for Enhanced Learned Image Compression
por: Pakdaman, Farhad, et al.
Publicado: (2024)
por: Pakdaman, Farhad, et al.
Publicado: (2024)
LFACon: Introducing Anglewise Attention to No-Reference Quality Assessment in Light Field Space
por: Qu, Qiang, et al.
Publicado: (2023)
por: Qu, Qiang, et al.
Publicado: (2023)
Dynamic Kernel-Based Adaptive Spatial Aggregation for Learned Image Compression
por: Wang, Huairui, et al.
Publicado: (2023)
por: Wang, Huairui, et al.
Publicado: (2023)
Enhancing Learned Image Compression via Cross Window-based Attention
por: Mudgal, Priyanka, et al.
Publicado: (2024)
por: Mudgal, Priyanka, et al.
Publicado: (2024)
Enhanced Dermatology Image Quality Assessment via Cross-Domain Training
por: Montilla, Ignacio Hernández, et al.
Publicado: (2025)
por: Montilla, Ignacio Hernández, et al.
Publicado: (2025)
Ultrasound-QBench: Can LLMs Aid in Quality Assessment of Ultrasound Imaging?
por: Miao, Hongyi, et al.
Publicado: (2025)
por: Miao, Hongyi, et al.
Publicado: (2025)
ReCon-GS: Continuum-Preserved Gaussian Streaming for Fast and Compact Reconstruction of Dynamic Scenes
por: Fu, Jiaye, et al.
Publicado: (2025)
por: Fu, Jiaye, et al.
Publicado: (2025)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
por: Sun, Wei, et al.
Publicado: (2024)
por: Sun, Wei, et al.
Publicado: (2024)
Ejemplares similares
-
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
por: Wang, Ziyi, et al.
Publicado: (2025) -
Image Quality Assessment: From Human to Machine Preference
por: Li, Chunyi, et al.
Publicado: (2025) -
Generative Preprocessing for Image Compression with Pre-trained Diffusion Models
por: Guo, Mengxi, et al.
Publicado: (2025) -
T2IW: Joint Text to Image & Watermark Generation
por: Liu, An-An, et al.
Publicado: (2023) -
Understanding What Is Not Said:Referring Remote Sensing Image Segmentation with Scarce Expressions
por: Ye, Kai, et al.
Publicado: (2025)