HumanAesExpert: Advancing a Multi-Modality Foundation Model for Human Image Aesthetic Assessment
Fuente:
arXiv
Salvato in:
| Autori principali: | Liao, Zhichao, Liu, Xiaokun, Qin, Wenyu, Li, Qingyu, Wang, Qiulin, Wan, Pengfei, Zhang, Di, Zeng, Long, Feng, Pingfa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
di: Huang, Yipo, et al.
Pubblicazione: (2024)
di: Huang, Yipo, et al.
Pubblicazione: (2024)
SPF-Portrait: Towards Pure Text-to-Portrait Customization with Semantic Pollution-Free Fine-Tuning
di: Xian, Xiaole, et al.
Pubblicazione: (2025)
di: Xian, Xiaole, et al.
Pubblicazione: (2025)
AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
di: Huang, Yipo, et al.
Pubblicazione: (2024)
di: Huang, Yipo, et al.
Pubblicazione: (2024)
AesRM: Improving Video Aesthetics with Expert-Level Feedback
di: Han, Yujin, et al.
Pubblicazione: (2026)
di: Han, Yujin, et al.
Pubblicazione: (2026)
UNIAA: A Unified Multi-modal Image Aesthetic Assessment Baseline and Benchmark
di: Zhou, Zhaokun, et al.
Pubblicazione: (2024)
di: Zhou, Zhaokun, et al.
Pubblicazione: (2024)
SDGraph: Multi-Level Sketch Representation Learning by Sparse-Dense Graph Architecture
di: Cheng, Xi, et al.
Pubblicazione: (2025)
di: Cheng, Xi, et al.
Pubblicazione: (2025)
Aes3D: Aesthetic Assessment in 3D Gaussian Splatting
di: Xu, Chuanzhi, et al.
Pubblicazione: (2026)
di: Xu, Chuanzhi, et al.
Pubblicazione: (2026)
AesBiasBench: Evaluating Bias and Alignment in Multimodal Language Models for Personalized Image Aesthetic Assessment
di: Li, Kun, et al.
Pubblicazione: (2025)
di: Li, Kun, et al.
Pubblicazione: (2025)
AesCrop: Aesthetic-driven Cropping Guided by Composition
di: Wong, Yen-Hong, et al.
Pubblicazione: (2025)
di: Wong, Yen-Hong, et al.
Pubblicazione: (2025)
Constraint-Aware Feature Learning for Parametric Point Cloud
di: Cheng, Xi, et al.
Pubblicazione: (2024)
di: Cheng, Xi, et al.
Pubblicazione: (2024)
Freehand Sketch Generation from Mechanical Components
di: Liao, Zhichao, et al.
Pubblicazione: (2024)
di: Liao, Zhichao, et al.
Pubblicazione: (2024)
AesTest: Measuring Aesthetic Intelligence from Perception to Production
di: Wang, Guolong, et al.
Pubblicazione: (2025)
di: Wang, Guolong, et al.
Pubblicazione: (2025)
AccelAes: Accelerating Diffusion Transformers for Training-Free Aesthetic-Enhanced Image Generation
di: Yin, Xuanhua, et al.
Pubblicazione: (2026)
di: Yin, Xuanhua, et al.
Pubblicazione: (2026)
FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive Diffusion
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)
AesRec: A Dataset for Aesthetics-Aligned Clothing Outfit Recommendation
di: Ye, Wenxin, et al.
Pubblicazione: (2026)
di: Ye, Wenxin, et al.
Pubblicazione: (2026)
AesFA: An Aesthetic Feature-Aware Arbitrary Neural Style Transfer
di: Kwon, Joonwoo, et al.
Pubblicazione: (2023)
di: Kwon, Joonwoo, et al.
Pubblicazione: (2023)
MPE-TTS: Customized Emotion Zero-Shot Text-To-Speech Using Multi-Modal Prompt
di: Wu, Zhichao, et al.
Pubblicazione: (2025)
di: Wu, Zhichao, et al.
Pubblicazione: (2025)
Analytic Score Optimization for Multi Dimension Video Quality Assessment
di: Lin, Boda, et al.
Pubblicazione: (2026)
di: Lin, Boda, et al.
Pubblicazione: (2026)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
di: Li, Yunhao, et al.
Pubblicazione: (2026)
di: Li, Yunhao, et al.
Pubblicazione: (2026)
Fine-grained Image Aesthetic Assessment: Learning Discriminative Scores from Relative Ranks
di: Yang, Zhichao, et al.
Pubblicazione: (2026)
di: Yang, Zhichao, et al.
Pubblicazione: (2026)
MM-Diff: High-Fidelity Image Personalization via Multi-Modal Condition Integration
di: Wei, Zhichao, et al.
Pubblicazione: (2024)
di: Wei, Zhichao, et al.
Pubblicazione: (2024)
AssemPlanner: A Multi-Agent Based Task Planning Framework for Flexible Assembly System
di: Zhang, Chenhao, et al.
Pubblicazione: (2026)
di: Zhang, Chenhao, et al.
Pubblicazione: (2026)
FullDiT: Multi-Task Video Generative Foundation Model with Full Attention
di: Ju, Xuan, et al.
Pubblicazione: (2025)
di: Ju, Xuan, et al.
Pubblicazione: (2025)
Improving Video Generation with Human Feedback
di: Liu, Jie, et al.
Pubblicazione: (2025)
di: Liu, Jie, et al.
Pubblicazione: (2025)
VidEmo: Affective-Tree Reasoning for Emotion-Centric Video Foundation Models
di: Zhang, Zhicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2025)
UniCustom: Unified Visual Conditioning for Multi-Reference Image Generation
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
A Modality-agnostic Multi-task Foundation Model for Human Brain Imaging
di: Liu, Peirong, et al.
Pubblicazione: (2025)
di: Liu, Peirong, et al.
Pubblicazione: (2025)
Bridging Cognitive Gap: Hierarchical Description Learning for Artistic Image Aesthetics Assessment
di: Liu, Henglin, et al.
Pubblicazione: (2025)
di: Liu, Henglin, et al.
Pubblicazione: (2025)
RingMoE: Mixture-of-Modality-Experts Multi-Modal Foundation Models for Universal Remote Sensing Image Interpretation
di: Bi, Hanbo, et al.
Pubblicazione: (2025)
di: Bi, Hanbo, et al.
Pubblicazione: (2025)
Multi-modal Learnable Queries for Image Aesthetics Assessment
di: Xiong, Zhiwei, et al.
Pubblicazione: (2024)
di: Xiong, Zhiwei, et al.
Pubblicazione: (2024)
Embodied intelligent industrial robotics: Framework and techniques
di: Zhang, Chaoran, et al.
Pubblicazione: (2025)
di: Zhang, Chaoran, et al.
Pubblicazione: (2025)
ArtiMuse: Fine-Grained Image Aesthetics Assessment with Joint Scoring and Expert-Level Understanding
di: Cao, Shuo, et al.
Pubblicazione: (2025)
di: Cao, Shuo, et al.
Pubblicazione: (2025)
AI Outperforms Humans in Personalized Image Aesthetics Assessment via LLM-Based Interviews and Semantic Feature Extraction
di: Abe, Yoshia, et al.
Pubblicazione: (2026)
di: Abe, Yoshia, et al.
Pubblicazione: (2026)
Fine-grained Image Quality Assessment for Perceptual Image Restoration
di: Sheng, Xiangfei, et al.
Pubblicazione: (2025)
di: Sheng, Xiangfei, et al.
Pubblicazione: (2025)
Image Aesthetics Assessment using Multi Channel Convolutional Neural Networks
di: Doshi, Nishi, et al.
Pubblicazione: (2019)
di: Doshi, Nishi, et al.
Pubblicazione: (2019)
UNIV: Unified Foundation Model for Infrared and Visible Modalities
di: Mao, Fangyuan, et al.
Pubblicazione: (2025)
di: Mao, Fangyuan, et al.
Pubblicazione: (2025)
TestAgent: An Adaptive and Intelligent Expert for Human Assessment
di: Yu, Junhao, et al.
Pubblicazione: (2025)
di: Yu, Junhao, et al.
Pubblicazione: (2025)
Language-Guided Visual Perception Disentanglement for Image Quality Assessment and Conditional Image Generation
di: Yang, Zhichao, et al.
Pubblicazione: (2025)
di: Yang, Zhichao, et al.
Pubblicazione: (2025)
AesFormer: Transform Everyday Photos into Beautiful Memories
di: Du, Tianxiang, et al.
Pubblicazione: (2026)
di: Du, Tianxiang, et al.
Pubblicazione: (2026)
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
di: Sheng, Xiangfei, et al.
Pubblicazione: (2025)
di: Sheng, Xiangfei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AesExpert: Towards Multi-modality Foundation Model for Image Aesthetics Perception
di: Huang, Yipo, et al.
Pubblicazione: (2024) -
SPF-Portrait: Towards Pure Text-to-Portrait Customization with Semantic Pollution-Free Fine-Tuning
di: Xian, Xiaole, et al.
Pubblicazione: (2025) -
AesBench: An Expert Benchmark for Multimodal Large Language Models on Image Aesthetics Perception
di: Huang, Yipo, et al.
Pubblicazione: (2024) -
AesRM: Improving Video Aesthetics with Expert-Level Feedback
di: Han, Yujin, et al.
Pubblicazione: (2026) -
UNIAA: A Unified Multi-modal Image Aesthetic Assessment Baseline and Benchmark
di: Zhou, Zhaokun, et al.
Pubblicazione: (2024)