Cross-Modal Scene Semantic Alignment for Image Complexity Assessment
Fuente:
arXiv
Saved in:
| Main Authors: | Luo, Yuqing, Li, Yixiao, Liu, Jiang, Fu, Jun, Amirpour, Hadi, Yue, Guanghui, Zhao, Baoquan, Corcoran, Padraig, Liu, Hantao, Zhou, Wei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Perceptual Quality Optimization of Image Super-Resolution
by: Zhou, Wei, et al.
Published: (2026)
by: Zhou, Wei, et al.
Published: (2026)
CLIP-DQA: Blindly Evaluating Dehazed Images from Global and Local Perspectives Using CLIP
by: Zeng, Yirui, et al.
Published: (2025)
by: Zeng, Yirui, et al.
Published: (2025)
Perception-oriented Bidirectional Attention Network for Image Super-resolution Quality Assessment
by: Li, Yixiao, et al.
Published: (2025)
by: Li, Yixiao, et al.
Published: (2025)
A Multi-Modal Spatial Risk Framework for EV Charging Infrastructure Using Remote Sensing
by: Karakuş, Oktay, et al.
Published: (2025)
by: Karakuş, Oktay, et al.
Published: (2025)
An Analysis of the Correctness and Computational Complexity of Path Planning in Payment Channel Networks
by: Corcoran, Padraig, et al.
Published: (2025)
by: Corcoran, Padraig, et al.
Published: (2025)
Deep Bi-directional Attention Network for Image Super-Resolution Quality Assessment
by: Li, Yixiao, et al.
Published: (2024)
by: Li, Yixiao, et al.
Published: (2024)
Comparison Drives Preference: Reference-Aware Modeling for AI-Generated Video Quality Assessment
by: Zou, Minghao, et al.
Published: (2026)
by: Zou, Minghao, et al.
Published: (2026)
Vision-Language Consistency Guided Multi-modal Prompt Learning for Blind AI Generated Image Quality Assessment
by: Fu, Jun, et al.
Published: (2024)
by: Fu, Jun, et al.
Published: (2024)
A Lightweight Ensemble-Based Face Image Quality Assessment Method with Correlation-Aware Loss
by: Hamidi, MohammadAli, et al.
Published: (2025)
by: Hamidi, MohammadAli, et al.
Published: (2025)
Geometry-Aware Cross Modal Alignment for Light Field-LiDAR Semantic Segmentation
by: Luo, Jie, et al.
Published: (2025)
by: Luo, Jie, et al.
Published: (2025)
Unifying Visual and Semantic Feature Spaces with Diffusion Models for Enhanced Cross-Modal Alignment
by: Zheng, Yuze, et al.
Published: (2024)
by: Zheng, Yuze, et al.
Published: (2024)
Dynamic Cross-Modal Alignment for Robust Semantic Location Prediction
by: Jing, Liu, et al.
Published: (2024)
by: Jing, Liu, et al.
Published: (2024)
Improving the Efficiency of VVC using Partitioning of Reference Frames
by: Qureshi, Kamran, et al.
Published: (2025)
by: Qureshi, Kamran, et al.
Published: (2025)
Multi-resolution Encoding for HTTP Adaptive Streaming using VVenC
by: Qureshi, Kamran, et al.
Published: (2025)
by: Qureshi, Kamran, et al.
Published: (2025)
VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering
by: Meng, Yiran, et al.
Published: (2025)
by: Meng, Yiran, et al.
Published: (2025)
Semi-MedRef: Semi-Supervised Medical Referring Image Segmentation with Cross-Modal Alignment
by: Li, Yuchen, et al.
Published: (2026)
by: Li, Yuchen, et al.
Published: (2026)
VQualA 2025 Challenge on Image Super-Resolution Generated Content Quality Assessment: Methods and Results
by: Li, Yixiao, et al.
Published: (2025)
by: Li, Yixiao, et al.
Published: (2025)
AlignGen: Boosting Personalized Image Generation with Cross-Modality Prior Alignment
by: Lin, Yiheng, et al.
Published: (2025)
by: Lin, Yiheng, et al.
Published: (2025)
Greedy and randomized heuristics for optimization of k-domination models in digraphs and road networks
by: Dijkstra, Lukas, et al.
Published: (2024)
by: Dijkstra, Lukas, et al.
Published: (2024)
CrossOver: 3D Scene Cross-Modal Alignment
by: Sarkar, Sayan Deb, et al.
Published: (2025)
by: Sarkar, Sayan Deb, et al.
Published: (2025)
Is there a relationship between Mean Opinion Score (MOS) and Just Noticeable Difference (JND)?
by: Zhu, Jingwen, et al.
Published: (2026)
by: Zhu, Jingwen, et al.
Published: (2026)
Perceptual Visual Quality Assessment: Principles, Methods, and Future Directions
by: Zhou, Wei, et al.
Published: (2025)
by: Zhou, Wei, et al.
Published: (2025)
Cross Modal Fine-Grained Alignment via Granularity-Aware and Region-Uncertain Modeling
by: Liu, Jiale, et al.
Published: (2025)
by: Liu, Jiale, et al.
Published: (2025)
EWMBench: Evaluating Scene, Motion, and Semantic Quality in Embodied World Models
by: Yue, Hu, et al.
Published: (2025)
by: Yue, Hu, et al.
Published: (2025)
ODVista: An Omnidirectional Video Dataset for super-resolution and Quality Enhancement Tasks
by: Telili, Ahmed, et al.
Published: (2024)
by: Telili, Ahmed, et al.
Published: (2024)
Weakly Supervised Cross-Modal Learning for 4D Radar Scene Flow Estimation
by: Fu, Jingyun, et al.
Published: (2026)
by: Fu, Jingyun, et al.
Published: (2026)
Depth-Guided Metric-Aware Temporal Consistency for Monocular Video Human Mesh Recovery
by: Cen, Jiaxin, et al.
Published: (2026)
by: Cen, Jiaxin, et al.
Published: (2026)
Hierarchical Context Transformer for Multi-level Semantic Scene Understanding
by: Hao, Luoying, et al.
Published: (2025)
by: Hao, Luoying, et al.
Published: (2025)
Adaptive Mixed-Scale Feature Fusion Network for Blind AI-Generated Image Quality Assessment
by: Zhou, Tianwei, et al.
Published: (2024)
by: Zhou, Tianwei, et al.
Published: (2024)
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
by: Jiang, Tianjiao, et al.
Published: (2025)
by: Jiang, Tianjiao, et al.
Published: (2025)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
by: Fang, Xiang, et al.
Published: (2022)
by: Fang, Xiang, et al.
Published: (2022)
EPS: Efficient Patch Sampling for Video Overfitting in Deep Super-Resolution Model Training
by: Wei, Yiying, et al.
Published: (2024)
by: Wei, Yiying, et al.
Published: (2024)
SGAligner++: Cross-Modal Language-Aided 3D Scene Graph Alignment
by: Singh, Binod, et al.
Published: (2025)
by: Singh, Binod, et al.
Published: (2025)
ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment
by: Hu, Xiwei, et al.
Published: (2024)
by: Hu, Xiwei, et al.
Published: (2024)
Real-World Scene Recovery for Scattering-Degraded Images Using Spatial and Frequency Priors
by: Liu, Yun, et al.
Published: (2025)
by: Liu, Yun, et al.
Published: (2025)
BEVPose: Unveiling Scene Semantics through Pose-Guided Multi-Modal BEV Alignment
by: Hosseinzadeh, Mehdi, et al.
Published: (2024)
by: Hosseinzadeh, Mehdi, et al.
Published: (2024)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
by: Xia, Chong, et al.
Published: (2025)
by: Xia, Chong, et al.
Published: (2025)
Interleaved Scene Graphs for Interleaved Text-and-Image Generation Assessment
by: Chen, Dongping, et al.
Published: (2024)
by: Chen, Dongping, et al.
Published: (2024)
DepthGait: Multi-Scale Cross-Level Feature Fusion of RGB-Derived Depth and Silhouette Sequences for Robust Gait Recognition
by: Li, Xinzhu, et al.
Published: (2025)
by: Li, Xinzhu, et al.
Published: (2025)
Ultrasound Report Generation with Cross-Modality Feature Alignment via Unsupervised Guidance
by: Li, Jun, et al.
Published: (2024)
by: Li, Jun, et al.
Published: (2024)
Similar Items
-
Perceptual Quality Optimization of Image Super-Resolution
by: Zhou, Wei, et al.
Published: (2026) -
CLIP-DQA: Blindly Evaluating Dehazed Images from Global and Local Perspectives Using CLIP
by: Zeng, Yirui, et al.
Published: (2025) -
Perception-oriented Bidirectional Attention Network for Image Super-resolution Quality Assessment
by: Li, Yixiao, et al.
Published: (2025) -
A Multi-Modal Spatial Risk Framework for EV Charging Infrastructure Using Remote Sensing
by: Karakuş, Oktay, et al.
Published: (2025) -
An Analysis of the Correctness and Computational Complexity of Path Planning in Payment Channel Networks
by: Corcoran, Padraig, et al.
Published: (2025)