Seeing Like a Designer Without One: A Study on Unsupervised Slide Quality Assessment via Designer Cue Augmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Inui, Tai, Oh, Steven, Kuan, Magdeline |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DesignLab: Designing Slides Through Iterative Detection and Correction
par: Yun, Jooyeol, et autres
Publié: (2025)
par: Yun, Jooyeol, et autres
Publié: (2025)
SlideCoder: Layout-aware RAG-enhanced Hierarchical Slide Generation from Design
par: Tang, Wenxin, et autres
Publié: (2025)
par: Tang, Wenxin, et autres
Publié: (2025)
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
par: Fu, Kang, et autres
Publié: (2026)
par: Fu, Kang, et autres
Publié: (2026)
Seeing Beyond 8bits: Subjective and Objective Quality Assessment of HDR-UGC Videos
par: Saini, Shreshth, et autres
Publié: (2026)
par: Saini, Shreshth, et autres
Publié: (2026)
Beyond Frequency: Seeing Subtle Cues Through the Lens of Spatial Decomposition for Fine-Grained Visual Classification
par: Xu, Qin, et autres
Publié: (2025)
par: Xu, Qin, et autres
Publié: (2025)
See Further, Think Deeper: Advancing VLM's Reasoning Ability with Low-level Visual Cues and Reflection
par: Wu, Zhiheng, et autres
Publié: (2026)
par: Wu, Zhiheng, et autres
Publié: (2026)
EReCu: Pseudo-label Evolution Fusion and Refinement with Multi-Cue Learning for Unsupervised Camouflage Detection
par: Jiang, Shuo, et autres
Publié: (2026)
par: Jiang, Shuo, et autres
Publié: (2026)
Can LLMs See Without Pixels? Benchmarking Spatial Intelligence from Textual Descriptions
par: Guo, Zhongbin, et autres
Publié: (2026)
par: Guo, Zhongbin, et autres
Publié: (2026)
See, Act, Adapt: Active Perception for Unsupervised Cross-Domain Visual Adaptation via Personalized VLM-Guided Agent
par: Tang, Tianci, et autres
Publié: (2026)
par: Tang, Tianci, et autres
Publié: (2026)
Seeing through Unclear Glass: Occlusion Removal with One Shot
par: Li, Qiang, et autres
Publié: (2025)
par: Li, Qiang, et autres
Publié: (2025)
From Local Cues to Global Percepts: Emergent Gestalt Organization in Self-Supervised Vision Models
par: Li, Tianqin, et autres
Publié: (2025)
par: Li, Tianqin, et autres
Publié: (2025)
Improving Quality Control of Whole Slide Images by Explicit Artifact Augmentation
par: Jurgas, Artur, et autres
Publié: (2024)
par: Jurgas, Artur, et autres
Publié: (2024)
Genetic Learning for Designing Sim-to-Real Data Augmentations
par: Vanherle, Bram, et autres
Publié: (2024)
par: Vanherle, Bram, et autres
Publié: (2024)
Vision Augmentation Prediction Autoencoder with Attention Design (VAPAAD)
par: Yin, Yiqiao
Publié: (2024)
par: Yin, Yiqiao
Publié: (2024)
Seeing Like Radiologists: Context- and Gaze-Guided Vision-Language Pretraining for Chest X-rays
par: Liu, Kang, et autres
Publié: (2026)
par: Liu, Kang, et autres
Publié: (2026)
Towards Visual Text Design Transfer Across Languages
par: Choi, Yejin, et autres
Publié: (2024)
par: Choi, Yejin, et autres
Publié: (2024)
Melon Fruit Detection and Quality Assessment Using Generative AI-Based Image Data Augmentation
par: Yoon, Seungri, et autres
Publié: (2024)
par: Yoon, Seungri, et autres
Publié: (2024)
Cross-IQA: Unsupervised Learning for Image Quality Assessment
par: Zhang, Zhen
Publié: (2024)
par: Zhang, Zhen
Publié: (2024)
GThinker: Towards General Multimodal Reasoning via Cue-Guided Rethinking
par: Zhan, Yufei, et autres
Publié: (2025)
par: Zhan, Yufei, et autres
Publié: (2025)
Seeing Beyond Frames: Zero-Shot Pedestrian Intention Prediction with Raw Temporal Video and Multimodal Cues
par: Zambare, Pallavi, et autres
Publié: (2025)
par: Zambare, Pallavi, et autres
Publié: (2025)
On the Reliability of Cue Conflict and Beyond
par: Kim, Pum Jun, et autres
Publié: (2026)
par: Kim, Pum Jun, et autres
Publié: (2026)
AI-Generated Lecture Slides for Improving Slide Element Detection and Retrieval
par: Maniyar, Suyash, et autres
Publié: (2025)
par: Maniyar, Suyash, et autres
Publié: (2025)
Action Quality Assessment via Hierarchical Pose-guided Multi-stage Contrastive Regression
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
OCR-Quality: A Human-Annotated Dataset for OCR Quality Assessment
par: Zhang, Yulong
Publié: (2025)
par: Zhang, Yulong
Publié: (2025)
MLLMs Know When Before Speaking: Revealing and Recovering Temporal Grounding via Attention Cues
par: Du, Dazhao, et autres
Publié: (2026)
par: Du, Dazhao, et autres
Publié: (2026)
Motion-Boundary-Driven Unsupervised Surgical Instrument Segmentation in Low-Quality Optical Flow
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
KAN See In the Dark
par: Ning, Aoxiang, et autres
Publié: (2024)
par: Ning, Aoxiang, et autres
Publié: (2024)
Scaling-up Perceptual Video Quality Assessment
par: Jia, Ziheng, et autres
Publié: (2025)
par: Jia, Ziheng, et autres
Publié: (2025)
See Without Decoding: Motion-Vector-Based Tracking in Compressed Video
par: Duché, Axel, et autres
Publié: (2026)
par: Duché, Axel, et autres
Publié: (2026)
Ice Hockey Puck Localization Using Contextual Cues
par: Salass, Liam, et autres
Publié: (2025)
par: Salass, Liam, et autres
Publié: (2025)
SlideChat: A Large Vision-Language Assistant for Whole-Slide Pathology Image Understanding
par: Chen, Ying, et autres
Publié: (2024)
par: Chen, Ying, et autres
Publié: (2024)
Script-to-Slide Grounding: Grounding Script Sentences to Slide Objects for Automatic Instructional Video Generation
par: Suzuki, Rena, et autres
Publié: (2026)
par: Suzuki, Rena, et autres
Publié: (2026)
mRAG: Elucidating the Design Space of Multi-modal Retrieval-Augmented Generation
par: Hu, Chan-Wei, et autres
Publié: (2025)
par: Hu, Chan-Wei, et autres
Publié: (2025)
Eye Sclera for Fair Face Image Quality Assessment
par: Kabbani, Wassim, et autres
Publié: (2025)
par: Kabbani, Wassim, et autres
Publié: (2025)
AI-generated Image Quality Assessment in Visual Communication
par: Tian, Yu, et autres
Publié: (2024)
par: Tian, Yu, et autres
Publié: (2024)
DesignCLIP: Multimodal Learning with CLIP for Design Patent Understanding
par: Wang, Zhu, et autres
Publié: (2025)
par: Wang, Zhu, et autres
Publié: (2025)
Investigation of Frame Differences as Motion Cues for Video Object Segmentation
par: Kawamura, Sota, et autres
Publié: (2025)
par: Kawamura, Sota, et autres
Publié: (2025)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
par: Li, Guangyao, et autres
Publié: (2024)
par: Li, Guangyao, et autres
Publié: (2024)
Designing Domain-Specific Agents via Hierarchical Task Abstraction Mechanism
par: Li, Kaiyu, et autres
Publié: (2025)
par: Li, Kaiyu, et autres
Publié: (2025)
StageDesigner: Artistic Stage Generation for Scenography via Theater Scripts
par: Gan, Zhaoxing, et autres
Publié: (2025)
par: Gan, Zhaoxing, et autres
Publié: (2025)
Documents similaires
-
DesignLab: Designing Slides Through Iterative Detection and Correction
par: Yun, Jooyeol, et autres
Publié: (2025) -
SlideCoder: Layout-aware RAG-enhanced Hierarchical Slide Generation from Design
par: Tang, Wenxin, et autres
Publié: (2025) -
Enhancing Image Quality Assessment Ability of LMMs via Retrieval-Augmented Generation
par: Fu, Kang, et autres
Publié: (2026) -
Seeing Beyond 8bits: Subjective and Objective Quality Assessment of HDR-UGC Videos
par: Saini, Shreshth, et autres
Publié: (2026) -
Beyond Frequency: Seeing Subtle Cues Through the Lens of Spatial Decomposition for Fine-Grained Visual Classification
par: Xu, Qin, et autres
Publié: (2025)