AAPMT: AGI Assessment Through Prompt and Metric Transformer
Fuente:
arXiv
Salvato in:
| Autore principale: | Huang, Benhao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Defining and Extracting generalizable interaction primitives from DNNs
di: Chen, Lu, et al.
Pubblicazione: (2024)
di: Chen, Lu, et al.
Pubblicazione: (2024)
AGI Is Coming... Right After AI Learns to Play Wordle
di: Shekkizhar, Sarath, et al.
Pubblicazione: (2025)
di: Shekkizhar, Sarath, et al.
Pubblicazione: (2025)
Dual Prompting Image Restoration with Diffusion Transformers
di: Kong, Dehong, et al.
Pubblicazione: (2025)
di: Kong, Dehong, et al.
Pubblicazione: (2025)
Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments
di: Lillemark, Hansen Jin, et al.
Pubblicazione: (2026)
di: Lillemark, Hansen Jin, et al.
Pubblicazione: (2026)
MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI
di: Yao, Huanjin, et al.
Pubblicazione: (2025)
di: Yao, Huanjin, et al.
Pubblicazione: (2025)
MMMU: A Massive Multi-discipline Multimodal Understanding and Reasoning Benchmark for Expert AGI
di: Yue, Xiang, et al.
Pubblicazione: (2023)
di: Yue, Xiang, et al.
Pubblicazione: (2023)
2AFC Prompting of Large Multimodal Models for Image Quality Assessment
di: Zhu, Hanwei, et al.
Pubblicazione: (2024)
di: Zhu, Hanwei, et al.
Pubblicazione: (2024)
APEX: Assumption-free Projection-based Embedding eXamination Metric for Image Quality Assessment
di: Gallegati, Caterina, et al.
Pubblicazione: (2026)
di: Gallegati, Caterina, et al.
Pubblicazione: (2026)
Prompt-CAM: Making Vision Transformers Interpretable for Fine-Grained Analysis
di: Chowdhury, Arpita, et al.
Pubblicazione: (2025)
di: Chowdhury, Arpita, et al.
Pubblicazione: (2025)
PromptDx: Differentiable Prompt Tuning for Multimodal In-Context Alzheimer's Diagnosis
di: Zhong, Lujia, et al.
Pubblicazione: (2026)
di: Zhong, Lujia, et al.
Pubblicazione: (2026)
MedIQA: A Scalable Foundation Model for Prompt-Driven Medical Image Quality Assessment
di: Xun, Siyi, et al.
Pubblicazione: (2025)
di: Xun, Siyi, et al.
Pubblicazione: (2025)
Case-Enhanced Vision Transformer: Improving Explanations of Image Similarity with a ViT-based Similarity Metric
di: Zhao, Ziwei, et al.
Pubblicazione: (2024)
di: Zhao, Ziwei, et al.
Pubblicazione: (2024)
Generalizable Object Re-Identification via Visual In-Context Prompting
di: Huang, Zhizhong, et al.
Pubblicazione: (2025)
di: Huang, Zhizhong, et al.
Pubblicazione: (2025)
CVPT: Cross Visual Prompt Tuning
di: Huang, Lingyun, et al.
Pubblicazione: (2024)
di: Huang, Lingyun, et al.
Pubblicazione: (2024)
AI Powered Urban Green Infrastructure Assessment Through Aerial Imagery of an Industrial Township
di: Dutta, Anisha
Pubblicazione: (2025)
di: Dutta, Anisha
Pubblicazione: (2025)
MetricAnything: Scaling Metric Depth Pretraining with Noisy Heterogeneous Sources
di: Ma, Baorui, et al.
Pubblicazione: (2026)
di: Ma, Baorui, et al.
Pubblicazione: (2026)
Visual Fourier Prompt Tuning
di: Zeng, Runjia, et al.
Pubblicazione: (2024)
di: Zeng, Runjia, et al.
Pubblicazione: (2024)
Vision-Language Consistency Guided Multi-modal Prompt Learning for Blind AI Generated Image Quality Assessment
di: Fu, Jun, et al.
Pubblicazione: (2024)
di: Fu, Jun, et al.
Pubblicazione: (2024)
Long-Text-to-Image Generation via Compositional Prompt Decomposition
di: Huang, Jen-Yuan, et al.
Pubblicazione: (2026)
di: Huang, Jen-Yuan, et al.
Pubblicazione: (2026)
How Modality Shapes Perception and Reasoning: A Study of Error Propagation in ARC-AGI
di: Wen, Bo, et al.
Pubblicazione: (2025)
di: Wen, Bo, et al.
Pubblicazione: (2025)
Human-Centric Video Anomaly Detection Through Spatio-Temporal Pose Tokenization and Transformer
di: Noghre, Ghazal Alinezhad, et al.
Pubblicazione: (2024)
di: Noghre, Ghazal Alinezhad, et al.
Pubblicazione: (2024)
Spatio-Temporal Context Prompting for Zero-Shot Action Detection
di: Huang, Wei-Jhe, et al.
Pubblicazione: (2024)
di: Huang, Wei-Jhe, et al.
Pubblicazione: (2024)
Who Evaluates the Evaluations? Objectively Scoring Text-to-Image Prompt Coherence Metrics with T2IScoreScore (TS2)
di: Saxon, Michael, et al.
Pubblicazione: (2024)
di: Saxon, Michael, et al.
Pubblicazione: (2024)
Large language models for artificial general intelligence (AGI): A survey of foundational principles and approaches
di: Mumuni, Alhassan, et al.
Pubblicazione: (2025)
di: Mumuni, Alhassan, et al.
Pubblicazione: (2025)
Layer-Wise Feature Metric of Semantic-Pixel Matching for Few-Shot Learning
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
The Fabrication of Reality and Fantasy: Scene Generation with LLM-Assisted Prompt Interpretation
di: Yao, Yi, et al.
Pubblicazione: (2024)
di: Yao, Yi, et al.
Pubblicazione: (2024)
ADAPT to Robustify Prompt Tuning Vision Transformers
di: Eskandar, Masih, et al.
Pubblicazione: (2024)
di: Eskandar, Masih, et al.
Pubblicazione: (2024)
Robust Depth Enhancement via Polarization Prompt Fusion Tuning
di: Ikemura, Kei, et al.
Pubblicazione: (2024)
di: Ikemura, Kei, et al.
Pubblicazione: (2024)
PromptDresser: Improving the Quality and Controllability of Virtual Try-On via Generative Textual Prompt and Prompt-aware Mask
di: Kim, Jeongho, et al.
Pubblicazione: (2024)
di: Kim, Jeongho, et al.
Pubblicazione: (2024)
Lightweight CycleGAN Models for Cross-Modality Image Transformation and Experimental Quality Assessment in Fluorescence Microscopy
di: Soltaninezhad, Mohammad, et al.
Pubblicazione: (2025)
di: Soltaninezhad, Mohammad, et al.
Pubblicazione: (2025)
CAPT: Confusion-Aware Prompt Tuning for Reducing Vision-Language Misalignment
di: Shao, Maoyuan, et al.
Pubblicazione: (2026)
di: Shao, Maoyuan, et al.
Pubblicazione: (2026)
HCVP: Leveraging Hierarchical Contrastive Visual Prompt for Domain Generalization
di: Zhou, Guanglin, et al.
Pubblicazione: (2024)
di: Zhou, Guanglin, et al.
Pubblicazione: (2024)
DDT: Decoupled Diffusion Transformer
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
Medical Visual Prompting (MVP): A Unified Framework for Versatile and High-Quality Medical Image Segmentation
di: Chen, Yulin, et al.
Pubblicazione: (2024)
di: Chen, Yulin, et al.
Pubblicazione: (2024)
MedPromptX: Grounded Multimodal Prompting for Chest X-ray Diagnosis
di: Shaaban, Mai A., et al.
Pubblicazione: (2024)
di: Shaaban, Mai A., et al.
Pubblicazione: (2024)
DetailMaster: Can Your Text-to-Image Model Handle Long Prompts?
di: Jiao, Qirui, et al.
Pubblicazione: (2025)
di: Jiao, Qirui, et al.
Pubblicazione: (2025)
Decoupling Template Bias in CLIP: Harnessing Empty Prompts for Enhanced Few-Shot Learning
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
Dual-View Alignment Learning with Hierarchical-Prompt for Class-Imbalance Multi-Label Classification
di: Huang, Sheng, et al.
Pubblicazione: (2025)
di: Huang, Sheng, et al.
Pubblicazione: (2025)
Metric-Guided Synthesis of Class Activation Mapping
di: Luque-Cerpa, Alejandro, et al.
Pubblicazione: (2025)
di: Luque-Cerpa, Alejandro, et al.
Pubblicazione: (2025)
Rethinking Metrics and Benchmarks of Video Anomaly Detection
di: Liu, Zihao, et al.
Pubblicazione: (2025)
di: Liu, Zihao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Defining and Extracting generalizable interaction primitives from DNNs
di: Chen, Lu, et al.
Pubblicazione: (2024) -
AGI Is Coming... Right After AI Learns to Play Wordle
di: Shekkizhar, Sarath, et al.
Pubblicazione: (2025) -
Dual Prompting Image Restoration with Diffusion Transformers
di: Kong, Dehong, et al.
Pubblicazione: (2025) -
Flow Equivariant World Models: Memory for Partially Observed Dynamic Environments
di: Lillemark, Hansen Jin, et al.
Pubblicazione: (2026) -
MMReason: An Open-Ended Multi-Modal Multi-Step Reasoning Benchmark for MLLMs Toward AGI
di: Yao, Huanjin, et al.
Pubblicazione: (2025)