UniPercept: Towards Unified Perceptual-Level Image Understanding across Aesthetics, Quality, Structure, and Texture
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Shuo, Li, Jiayang, Li, Xiaohui, Pu, Yuandong, Zhu, Kaiwen, Gao, Yuanting, Luo, Siqi, Xin, Yi, Qin, Qi, Zhou, Yu, Chen, Xiangyu, Zhang, Wenlong, Fu, Bin, Qiao, Yu, Liu, Yihao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring Scalable Unified Modeling for General Low-Level Vision
di: Chen, Xiangyu, et al.
Pubblicazione: (2025)
di: Chen, Xiangyu, et al.
Pubblicazione: (2025)
ArtiMuse: Fine-Grained Image Aesthetics Assessment with Joint Scoring and Expert-Level Understanding
di: Cao, Shuo, et al.
Pubblicazione: (2025)
di: Cao, Shuo, et al.
Pubblicazione: (2025)
Lumina-OmniLV: A Unified Multimodal Framework for General Low-Level Vision
di: Pu, Yuandong, et al.
Pubblicazione: (2025)
di: Pu, Yuandong, et al.
Pubblicazione: (2025)
Toward Generalizable Deblurring: Leveraging Massive Blur Priors with Linear Attention for Real-World Scenarios
di: Gao, Yuanting, et al.
Pubblicazione: (2026)
di: Gao, Yuanting, et al.
Pubblicazione: (2026)
Learning A Low-Level Vision Generalist via Visual Task Prompt
di: Chen, Xiangyu, et al.
Pubblicazione: (2024)
di: Chen, Xiangyu, et al.
Pubblicazione: (2024)
Accelerating Masked Image Generation by Learning Latent Controlled Dynamics
di: Zhu, Kaiwen, et al.
Pubblicazione: (2026)
di: Zhu, Kaiwen, et al.
Pubblicazione: (2026)
StableI2I: Spotting Unintended Changes in Image-to-Image Transition
di: Li, Jiayang, et al.
Pubblicazione: (2026)
di: Li, Jiayang, et al.
Pubblicazione: (2026)
A Comparative Study of Image Restoration Networks for General Backbone Network Design
di: Chen, Xiangyu, et al.
Pubblicazione: (2023)
di: Chen, Xiangyu, et al.
Pubblicazione: (2023)
DualX-VSR: Dual Axial Spatial$\times$Temporal Transformer for Real-World Video Super-Resolution without Motion Compensation
di: Cao, Shuo, et al.
Pubblicazione: (2025)
di: Cao, Shuo, et al.
Pubblicazione: (2025)
LinearSR: Unlocking Linear Attention for Stable and Efficient Image Super-Resolution
di: Li, Xiaohui, et al.
Pubblicazione: (2025)
di: Li, Xiaohui, et al.
Pubblicazione: (2025)
PICABench: How Far Are We from Physically Realistic Image Editing?
di: Pu, Yuandong, et al.
Pubblicazione: (2025)
di: Pu, Yuandong, et al.
Pubblicazione: (2025)
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
UniFork: Exploring Modality Alignment for Unified Multimodal Understanding and Generation
di: Li, Teng, et al.
Pubblicazione: (2025)
di: Li, Teng, et al.
Pubblicazione: (2025)
GRIDS: Grouped Multiple-Degradation Restoration with Image Degradation Similarity
di: Cao, Shuo, et al.
Pubblicazione: (2024)
di: Cao, Shuo, et al.
Pubblicazione: (2024)
UniFashion: A Unified Vision-Language Model for Multimodal Fashion Retrieval and Generation
di: Zhao, Xiangyu, et al.
Pubblicazione: (2024)
di: Zhao, Xiangyu, et al.
Pubblicazione: (2024)
Omni-Weather: A Unified Multimodal Model for Weather Radar Understanding and Generation
di: Zhou, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhou, Zhiwang, et al.
Pubblicazione: (2025)
SynWeather: Weather Observation Data Synthesis across Multiple Regions and Variables via a General Diffusion Transformer
di: Xu, Kaiyi, et al.
Pubblicazione: (2025)
di: Xu, Kaiyi, et al.
Pubblicazione: (2025)
SEAL: A Framework for Systematic Evaluation of Real-World Super-Resolution
di: Zhang, Wenlong, et al.
Pubblicazione: (2023)
di: Zhang, Wenlong, et al.
Pubblicazione: (2023)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
di: Li, Kunchang, et al.
Pubblicazione: (2022)
di: Li, Kunchang, et al.
Pubblicazione: (2022)
UniAlignment: Semantic Alignment for Unified Image Generation, Understanding, Manipulation and Perception
di: Song, Xinyang, et al.
Pubblicazione: (2025)
di: Song, Xinyang, et al.
Pubblicazione: (2025)
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
di: Li, Yongkang, et al.
Pubblicazione: (2026)
di: Li, Yongkang, et al.
Pubblicazione: (2026)
DiffVSR: Revealing an Effective Recipe for Taming Robust Video Super-Resolution Against Complex Degradations
di: Li, Xiaohui, et al.
Pubblicazione: (2025)
di: Li, Xiaohui, et al.
Pubblicazione: (2025)
UniSTD: Towards Unified Spatio-Temporal Learning across Diverse Disciplines
di: Tang, Chen, et al.
Pubblicazione: (2025)
di: Tang, Chen, et al.
Pubblicazione: (2025)
UniOcc: A Unified Benchmark for Occupancy Forecasting and Prediction in Autonomous Driving
di: Wang, Yuping, et al.
Pubblicazione: (2025)
di: Wang, Yuping, et al.
Pubblicazione: (2025)
Uni-RS: A Spatially Faithful Unified Understanding and Generation Model for Remote Sensing
di: Zhang, Weiyu, et al.
Pubblicazione: (2026)
di: Zhang, Weiyu, et al.
Pubblicazione: (2026)
UniRestore: Unified Perceptual and Task-Oriented Image Restoration Model Using Diffusion Prior
di: Chen, I-Hsiang, et al.
Pubblicazione: (2025)
di: Chen, I-Hsiang, et al.
Pubblicazione: (2025)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
di: Li, Yi, et al.
Pubblicazione: (2025)
di: Li, Yi, et al.
Pubblicazione: (2025)
UniViTAR: Unified Vision Transformer with Native Resolution
di: Qiao, Limeng, et al.
Pubblicazione: (2025)
di: Qiao, Limeng, et al.
Pubblicazione: (2025)
A Preliminary Exploration Towards General Image Restoration
di: Kong, Xiangtao, et al.
Pubblicazione: (2024)
di: Kong, Xiangtao, et al.
Pubblicazione: (2024)
UniVision: A Unified Framework for Vision-Centric 3D Perception
di: Hong, Yu, et al.
Pubblicazione: (2024)
di: Hong, Yu, et al.
Pubblicazione: (2024)
UniHead: Unifying Multi-Perception for Detection Heads
di: Zhou, Hantao, et al.
Pubblicazione: (2023)
di: Zhou, Hantao, et al.
Pubblicazione: (2023)
Unifying Image Processing as Visual Prompting Question Answering
di: Liu, Yihao, et al.
Pubblicazione: (2023)
di: Liu, Yihao, et al.
Pubblicazione: (2023)
Uni-Sign: Toward Unified Sign Language Understanding at Scale
di: Li, Zecheng, et al.
Pubblicazione: (2025)
di: Li, Zecheng, et al.
Pubblicazione: (2025)
UniECG: Understanding and Generating ECG in One Unified Model
di: Jin, Jiarui, et al.
Pubblicazione: (2025)
di: Jin, Jiarui, et al.
Pubblicazione: (2025)
UniPixel: Unified Object Referring and Segmentation for Pixel-Level Visual Reasoning
di: Liu, Ye, et al.
Pubblicazione: (2025)
di: Liu, Ye, et al.
Pubblicazione: (2025)
UniTok: A Unified Tokenizer for Visual Generation and Understanding
di: Ma, Chuofan, et al.
Pubblicazione: (2025)
di: Ma, Chuofan, et al.
Pubblicazione: (2025)
UniShield: An Adaptive Multi-Agent Framework for Unified Forgery Image Detection and Localization
di: Huang, Qing, et al.
Pubblicazione: (2025)
di: Huang, Qing, et al.
Pubblicazione: (2025)
Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator
di: Qin, Luozheng, et al.
Pubblicazione: (2026)
di: Qin, Luozheng, et al.
Pubblicazione: (2026)
Textural-Perceptual Joint Learning for No-Reference Super-Resolution Image Quality Assessment
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
di: Liu, Yuqing, et al.
Pubblicazione: (2022)
UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries
di: Zhu, Yijie, et al.
Pubblicazione: (2025)
di: Zhu, Yijie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Exploring Scalable Unified Modeling for General Low-Level Vision
di: Chen, Xiangyu, et al.
Pubblicazione: (2025) -
ArtiMuse: Fine-Grained Image Aesthetics Assessment with Joint Scoring and Expert-Level Understanding
di: Cao, Shuo, et al.
Pubblicazione: (2025) -
Lumina-OmniLV: A Unified Multimodal Framework for General Low-Level Vision
di: Pu, Yuandong, et al.
Pubblicazione: (2025) -
Toward Generalizable Deblurring: Leveraging Massive Blur Priors with Linear Attention for Real-World Scenarios
di: Gao, Yuanting, et al.
Pubblicazione: (2026) -
Learning A Low-Level Vision Generalist via Visual Task Prompt
di: Chen, Xiangyu, et al.
Pubblicazione: (2024)