Through the PRISM: Principle-Aware, Interpretable, and Multi-Scale Evaluation of Visual Designs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gandhi, Mona, Joseph, KJ, Parthasarathy, Srinivasan, Nag, Sayan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Agentic Design Review System
par: Nag, Sayan, et autres
Publié: (2025)
par: Nag, Sayan, et autres
Publié: (2025)
AURA: A Fine-Grained Benchmark and Decomposed Metric for Audio-Visual Reasoning
par: Galougah, Siminfar Samakoush, et autres
Publié: (2025)
par: Galougah, Siminfar Samakoush, et autres
Publié: (2025)
Context-Aware Palmprint Recognition via a Relative Similarity Metric
par: Brisley, Trinnhallen, et autres
Publié: (2025)
par: Brisley, Trinnhallen, et autres
Publié: (2025)
Seeing Through the PRISM: Compound & Controllable Restoration of Scientific Images
par: Kurinchi-Vendhan, Rupa, et autres
Publié: (2026)
par: Kurinchi-Vendhan, Rupa, et autres
Publié: (2026)
MeLFusion: Synthesizing Music from Image and Language Cues using Diffusion Models
par: Chowdhury, Sanjoy, et autres
Publié: (2024)
par: Chowdhury, Sanjoy, et autres
Publié: (2024)
MAGNET: A Multi-agent Framework for Finding Audio-Visual Needles by Reasoning over Multi-Video Haystacks
par: Chowdhury, Sanjoy, et autres
Publié: (2025)
par: Chowdhury, Sanjoy, et autres
Publié: (2025)
Object-WIPER : Training-Free Object and Associated Effect Removal in Videos
par: Kushwaha, Saksham Singh, et autres
Publié: (2026)
par: Kushwaha, Saksham Singh, et autres
Publié: (2026)
PRISM: A Promptable and Robust Interactive Segmentation Model with Visual Prompts
par: Li, Hao, et autres
Publié: (2024)
par: Li, Hao, et autres
Publié: (2024)
PRISM: PRogressive dependency maxImization for Scale-invariant image Matching
par: Cai, Xudong, et autres
Publié: (2024)
par: Cai, Xudong, et autres
Publié: (2024)
AVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs
par: Chowdhury, Sanjoy, et autres
Publié: (2025)
par: Chowdhury, Sanjoy, et autres
Publié: (2025)
PRISM-Bench: A Benchmark of Puzzle-Based Visual Tasks with CoT Error Detection
par: Qian, Yusu, et autres
Publié: (2025)
par: Qian, Yusu, et autres
Publié: (2025)
SliderEdit: Continuous Image Editing with Fine-Grained Instruction Control
par: Zarei, Arman, et autres
Publié: (2025)
par: Zarei, Arman, et autres
Publié: (2025)
Localizing Knowledge in Diffusion Transformers
par: Zarei, Arman, et autres
Publié: (2025)
par: Zarei, Arman, et autres
Publié: (2025)
DEL: Dense Event Localization for Multi-modal Audio-Visual Understanding
par: Ahmadian, Mona, et autres
Publié: (2025)
par: Ahmadian, Mona, et autres
Publié: (2025)
TIDE: Training Locally Interpretable Domain Generalization Models Enables Test-time Correction
par: Agarwal, Aishwarya, et autres
Publié: (2024)
par: Agarwal, Aishwarya, et autres
Publié: (2024)
SafaRi:Adaptive Sequence Transformer for Weakly Supervised Referring Expression Segmentation
par: Nag, Sayan, et autres
Publié: (2024)
par: Nag, Sayan, et autres
Publié: (2024)
PRISM: Prior Rectification and Uncertainty-Aware Structure Modeling for Diffusion-Based Text Image Super-Resolution
par: Xu, Zihang, et autres
Publié: (2026)
par: Xu, Zihang, et autres
Publié: (2026)
Can GPTs Evaluate Graphic Design Based on Design Principles?
par: Haraguchi, Daichi, et autres
Publié: (2024)
par: Haraguchi, Daichi, et autres
Publié: (2024)
PRISM: Color-Stratified Point Cloud Sampling
par: Lim, Hansol, et autres
Publié: (2026)
par: Lim, Hansol, et autres
Publié: (2026)
PRISM2: Unlocking Multi-Modal General Pathology AI with Clinical Dialogue
par: Vorontsov, Eugene, et autres
Publié: (2025)
par: Vorontsov, Eugene, et autres
Publié: (2025)
Automatic Discovery and Assessment of Interpretable Systematic Errors in Semantic Segmentation
par: Singh, Jaisidh, et autres
Publié: (2024)
par: Singh, Jaisidh, et autres
Publié: (2024)
BrainExplore: Large-Scale Discovery of Interpretable Visual Representations in the Human Brain
par: Wasserman, Navve, et autres
Publié: (2025)
par: Wasserman, Navve, et autres
Publié: (2025)
PRISM: Probabilistic Representation for Integrated Shape Modeling and Generation
par: Cheng, Lei, et autres
Publié: (2025)
par: Cheng, Lei, et autres
Publié: (2025)
TemporalFlowViz: Parameter-Aware Visual Analytics for Interpreting Scramjet Combustion Evolution
par: Jia, Yifei, et autres
Publié: (2025)
par: Jia, Yifei, et autres
Publié: (2025)
Towards Design Compositing
par: Mahajan, Abhinav, et autres
Publié: (2026)
par: Mahajan, Abhinav, et autres
Publié: (2026)
SSG: Scaled Spatial Guidance for Multi-Scale Visual Autoregressive Generation
par: Shin, Youngwoo, et autres
Publié: (2026)
par: Shin, Youngwoo, et autres
Publié: (2026)
PRISM: Progressive Reasoning through Iterative Slot Memory for Vision
par: Wang, Ziyu, et autres
Publié: (2026)
par: Wang, Ziyu, et autres
Publié: (2026)
PRISM: Product Retrieval In Shopping Carts using Hybrid Matching
par: Kabadayi, Arda, et autres
Publié: (2025)
par: Kabadayi, Arda, et autres
Publié: (2025)
PRISM: Progressive Rain removal with Integrated State-space Modeling
par: Xue, Pengze, et autres
Publié: (2025)
par: Xue, Pengze, et autres
Publié: (2025)
A Distributional View for Visual Mechanistic Interpretability: KL-Minimal Soft-Constraint Principle
par: Zhou, Guancheng, et autres
Publié: (2026)
par: Zhou, Guancheng, et autres
Publié: (2026)
PRISM: A Framework Harnessing Unsupervised Visual Representations and Textual Prompts for Explainable MACE Survival Prediction from Cardiac Cine MRI
par: Su, Haoyang, et autres
Publié: (2025)
par: Su, Haoyang, et autres
Publié: (2025)
Mimicking Human Visual Development for Learning Robust Image Representations
par: Raj, Ankita, et autres
Publié: (2025)
par: Raj, Ankita, et autres
Publié: (2025)
FPN-IAIA-BL: A Multi-Scale Interpretable Deep Learning Model for Classification of Mass Margins in Digital Mammography
par: Yang, Julia, et autres
Publié: (2024)
par: Yang, Julia, et autres
Publié: (2024)
Principle-Guided Supervision for Interpretable Uncertainty in Medical Image Segmentation
par: Sui, An, et autres
Publié: (2026)
par: Sui, An, et autres
Publié: (2026)
Interpretability-Aware Vision Transformer
par: Qiang, Yao, et autres
Publié: (2023)
par: Qiang, Yao, et autres
Publié: (2023)
PRISM: Streaming Human Motion Generation with Per-Joint Latent Decomposition
par: Ling, Zeyu, et autres
Publié: (2026)
par: Ling, Zeyu, et autres
Publié: (2026)
Fair and Interpretable Deepfake Detection in Videos
par: Yoshii, Akihito, et autres
Publié: (2025)
par: Yoshii, Akihito, et autres
Publié: (2025)
Multi-Step Visual Reasoning with Visual Tokens Scaling and Verification
par: Bai, Tianyi, et autres
Publié: (2025)
par: Bai, Tianyi, et autres
Publié: (2025)
FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark
par: Fang, Rongyao, et autres
Publié: (2025)
par: Fang, Rongyao, et autres
Publié: (2025)
Principles of Visual Tokens for Efficient Video Understanding
par: Hao, Xinyue, et autres
Publié: (2024)
par: Hao, Xinyue, et autres
Publié: (2024)
Documents similaires
-
Agentic Design Review System
par: Nag, Sayan, et autres
Publié: (2025) -
AURA: A Fine-Grained Benchmark and Decomposed Metric for Audio-Visual Reasoning
par: Galougah, Siminfar Samakoush, et autres
Publié: (2025) -
Context-Aware Palmprint Recognition via a Relative Similarity Metric
par: Brisley, Trinnhallen, et autres
Publié: (2025) -
Seeing Through the PRISM: Compound & Controllable Restoration of Scientific Images
par: Kurinchi-Vendhan, Rupa, et autres
Publié: (2026) -
MeLFusion: Synthesizing Music from Image and Language Cues using Diffusion Models
par: Chowdhury, Sanjoy, et autres
Publié: (2024)