Q-Adapt: Adapting LMM for Visual Quality Assessment with Progressive Instruction Tuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lu, Yiting, Li, Xin, Wu, Haoning, Li, Bingchen, Lin, Weisi, Chen, Zhibo |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Dual-Branch Network for Portrait Image Quality Assessment
von: Sun, Wei, et al.
Veröffentlicht: (2024)
von: Sun, Wei, et al.
Veröffentlicht: (2024)
Scaling Audio-Visual Quality Assessment Dataset via Crowdsourcing
von: Yang, Renyu, et al.
Veröffentlicht: (2026)
von: Yang, Renyu, et al.
Veröffentlicht: (2026)
G-Refine: A General Quality Refiner for Text-to-Image Generation
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
Image Quality Assessment: From Human to Machine Preference
von: Li, Chunyi, et al.
Veröffentlicht: (2025)
von: Li, Chunyi, et al.
Veröffentlicht: (2025)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
von: Wu, Haoning, et al.
Veröffentlicht: (2023)
von: Wu, Haoning, et al.
Veröffentlicht: (2023)
LMM-PCQA: Assisting Point Cloud Quality Assessment with LMM
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zicheng, et al.
Veröffentlicht: (2024)
AGAV-Rater: Adapting Large Multimodal Model for AI-Generated Audio-Visual Quality Assessment
von: Cao, Yuqin, et al.
Veröffentlicht: (2025)
von: Cao, Yuqin, et al.
Veröffentlicht: (2025)
Q-Ponder: A Unified Training Pipeline for Reasoning-based Visual Quality Assessment
von: Cai, Zhuoxuan, et al.
Veröffentlicht: (2025)
von: Cai, Zhuoxuan, et al.
Veröffentlicht: (2025)
LMM-Regularized CLIP Embeddings for Image Classification
von: Tzelepi, Maria, et al.
Veröffentlicht: (2024)
von: Tzelepi, Maria, et al.
Veröffentlicht: (2024)
AIS 2024 Challenge on Video Quality Assessment of User-Generated Content: Methods and Results
von: Conde, Marcos V., et al.
Veröffentlicht: (2024)
von: Conde, Marcos V., et al.
Veröffentlicht: (2024)
NeR-SC: Adapting Neural Video Representation to Screen Content
von: Shi, Ruohan, et al.
Veröffentlicht: (2026)
von: Shi, Ruohan, et al.
Veröffentlicht: (2026)
MSPT: A Lightweight Face Image Quality Assessment Method with Multi-stage Progressive Training
von: Xiao, Xiongwei, et al.
Veröffentlicht: (2025)
von: Xiao, Xiongwei, et al.
Veröffentlicht: (2025)
DT-UFC: Universal Large Model Feature Coding via Peaky-to-Balanced Distribution Transformation
von: Gao, Changsheng, et al.
Veröffentlicht: (2025)
von: Gao, Changsheng, et al.
Veröffentlicht: (2025)
DPC-VQA: Decoupling Quality Perception and Residual Calibration for Video Quality Assessment
von: Li, Xinyue, et al.
Veröffentlicht: (2026)
von: Li, Xinyue, et al.
Veröffentlicht: (2026)
Scaling and Masking: A New Paradigm of Data Sampling for Image and Video Quality Assessment
von: Liu, Yongxu, et al.
Veröffentlicht: (2024)
von: Liu, Yongxu, et al.
Veröffentlicht: (2024)
3DMIT: 3D Multi-modal Instruction Tuning for Scene Understanding
von: Li, Zeju, et al.
Veröffentlicht: (2024)
von: Li, Zeju, et al.
Veröffentlicht: (2024)
Visual Autoregressive Modeling for Instruction-Guided Image Editing
von: Mao, Qingyang, et al.
Veröffentlicht: (2025)
von: Mao, Qingyang, et al.
Veröffentlicht: (2025)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
von: Qu, Bowen, et al.
Veröffentlicht: (2024)
von: Qu, Bowen, et al.
Veröffentlicht: (2024)
TuningIQA: Fine-Grained Blind Image Quality Assessment for Livestreaming Camera Tuning
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)
von: Sheng, Xiangfei, et al.
Veröffentlicht: (2025)
EgoAdapt: Enhancing Robustness in Egocentric Interactive Speaker Detection Under Missing Modalities
von: Qian, Xinyuan, et al.
Veröffentlicht: (2026)
von: Qian, Xinyuan, et al.
Veröffentlicht: (2026)
UPDA: Unsupervised Progressive Domain Adaptation for No-Reference Point Cloud Quality Assessment
von: Xie, Bingxu, et al.
Veröffentlicht: (2026)
von: Xie, Bingxu, et al.
Veröffentlicht: (2026)
Generative Frame Sampler for Long Video Understanding
von: Yao, Linli, et al.
Veröffentlicht: (2025)
von: Yao, Linli, et al.
Veröffentlicht: (2025)
R-Bench: Are your Large Multimodal Model Robust to Real-world Corruptions?
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
von: Li, Chunyi, et al.
Veröffentlicht: (2024)
AID: Adapting Image2Video Diffusion Models for Instruction-guided Video Prediction
von: Xing, Zhen, et al.
Veröffentlicht: (2024)
von: Xing, Zhen, et al.
Veröffentlicht: (2024)
Exploring Rich Subjective Quality Information for Image Quality Assessment in the Wild
von: Min, Xiongkuo, et al.
Veröffentlicht: (2024)
von: Min, Xiongkuo, et al.
Veröffentlicht: (2024)
Perceptual Visual Quality Assessment: Principles, Methods, and Future Directions
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
von: Zhou, Wei, et al.
Veröffentlicht: (2025)
PanoGen++: Domain-Adapted Text-Guided Panoramic Environment Generation for Vision-and-Language Navigation
von: Wang, Sen, et al.
Veröffentlicht: (2025)
von: Wang, Sen, et al.
Veröffentlicht: (2025)
FakeBench: Probing Explainable Fake Image Detection via Large Multimodal Models
von: Li, Yixuan, et al.
Veröffentlicht: (2024)
von: Li, Yixuan, et al.
Veröffentlicht: (2024)
Multi-source Multimodal Progressive Domain Adaption for Audio-Visual Deception Detection
von: Lin, Ronghao, et al.
Veröffentlicht: (2025)
von: Lin, Ronghao, et al.
Veröffentlicht: (2025)
Exploiting LMM-based knowledge for image classification tasks
von: Tzelepi, Maria, et al.
Veröffentlicht: (2024)
von: Tzelepi, Maria, et al.
Veröffentlicht: (2024)
Diversify, Contextualize, and Adapt: Efficient Entropy Modeling for Neural Image Codec
von: Kim, Jun-Hyuk, et al.
Veröffentlicht: (2024)
von: Kim, Jun-Hyuk, et al.
Veröffentlicht: (2024)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
von: Miao, Bingchen, et al.
Veröffentlicht: (2024)
von: Miao, Bingchen, et al.
Veröffentlicht: (2024)
LossAgent: Towards Any Optimization Objectives for Image Processing with LLM Agents
von: Li, Bingchen, et al.
Veröffentlicht: (2024)
von: Li, Bingchen, et al.
Veröffentlicht: (2024)
HarmonyIQA: Pioneering Benchmark and Model for Image Harmonization Quality Assessment
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
von: Xu, Zitong, et al.
Veröffentlicht: (2025)
Study of Subjective and Objective Quality Assessment of Mobile Cloud Gaming Videos
von: Saha, Avinab, et al.
Veröffentlicht: (2023)
von: Saha, Avinab, et al.
Veröffentlicht: (2023)
Language-Guided Diffusion Model for Visual Grounding
von: Chen, Sijia, et al.
Veröffentlicht: (2023)
von: Chen, Sijia, et al.
Veröffentlicht: (2023)
Towards Explainable Partial-AIGC Image Quality Assessment
von: Qian, Jiaying, et al.
Veröffentlicht: (2025)
von: Qian, Jiaying, et al.
Veröffentlicht: (2025)
ESVQA: Perceptual Quality Assessment of Egocentric Spatial Videos
von: Zhu, Xilei, et al.
Veröffentlicht: (2024)
von: Zhu, Xilei, et al.
Veröffentlicht: (2024)
Region-Constraint In-Context Generation for Instructional Video Editing
von: Zhang, Zhongwei, et al.
Veröffentlicht: (2025)
von: Zhang, Zhongwei, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Dual-Branch Network for Portrait Image Quality Assessment
von: Sun, Wei, et al.
Veröffentlicht: (2024) -
Scaling Audio-Visual Quality Assessment Dataset via Crowdsourcing
von: Yang, Renyu, et al.
Veröffentlicht: (2026) -
G-Refine: A General Quality Refiner for Text-to-Image Generation
von: Li, Chunyi, et al.
Veröffentlicht: (2024) -
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
von: Xu, Zitong, et al.
Veröffentlicht: (2025) -
Image Quality Assessment: From Human to Machine Preference
von: Li, Chunyi, et al.
Veröffentlicht: (2025)