GenAI Arena: An Open Evaluation Platform for Generative Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Dongfu, Ku, Max, Li, Tianle, Ni, Yuansheng, Sun, Shizhuo, Fan, Rongqi, Chen, Wenhu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation
por: Ku, Max, et al.
Publicado: (2023)
por: Ku, Max, et al.
Publicado: (2023)
VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation
por: He, Xuan, et al.
Publicado: (2024)
por: He, Xuan, et al.
Publicado: (2024)
MANTIS: Interleaved Multi-Image Instruction Tuning
por: Jiang, Dongfu, et al.
Publicado: (2024)
por: Jiang, Dongfu, et al.
Publicado: (2024)
3D Arena: An Open Platform for Generative 3D Evaluation
por: Ebert, Dylan
Publicado: (2025)
por: Ebert, Dylan
Publicado: (2025)
GenAI-DrawIO-Creator: A Framework for Automated Diagram Generation
por: Yu, Jinze, et al.
Publicado: (2026)
por: Yu, Jinze, et al.
Publicado: (2026)
MEGA-Bench: Scaling Multimodal Evaluation to over 500 Real-World Tasks
por: Chen, Jiacheng, et al.
Publicado: (2024)
por: Chen, Jiacheng, et al.
Publicado: (2024)
QuickVideo: Real-Time Long Video Understanding with System Algorithm Co-Design
por: Schneider, Benjamin, et al.
Publicado: (2025)
por: Schneider, Benjamin, et al.
Publicado: (2025)
ImagenHub: Standardizing the evaluation of conditional image generation models
por: Ku, Max, et al.
Publicado: (2023)
por: Ku, Max, et al.
Publicado: (2023)
WildVision: Evaluating Vision-Language Models in the Wild with Human Preferences
por: Lu, Yujie, et al.
Publicado: (2024)
por: Lu, Yujie, et al.
Publicado: (2024)
Scaling Vision Language Models for Pharmaceutical Long Form Video Reasoning on Industrial GenAI Platform
por: Mishra, Suyash, et al.
Publicado: (2026)
por: Mishra, Suyash, et al.
Publicado: (2026)
Face Consistency Benchmark for GenAI Video
por: Podstawski, Michal, et al.
Publicado: (2025)
por: Podstawski, Michal, et al.
Publicado: (2025)
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
por: Wu, Keming, et al.
Publicado: (2025)
por: Wu, Keming, et al.
Publicado: (2025)
GenAI-Bench: Evaluating and Improving Compositional Text-to-Visual Generation
por: Li, Baiqi, et al.
Publicado: (2024)
por: Li, Baiqi, et al.
Publicado: (2024)
Enhancing weed detection performance by means of GenAI-based image augmentation
por: Modak, Sourav, et al.
Publicado: (2024)
por: Modak, Sourav, et al.
Publicado: (2024)
Are Pose Estimators Ready for the Open World? STAGE: A GenAI Toolkit for Auditing 3D Human Pose Estimators
por: Kister, Nikita, et al.
Publicado: (2024)
por: Kister, Nikita, et al.
Publicado: (2024)
AnyV2V: A Tuning-Free Framework For Any Video-to-Video Editing Tasks
por: Ku, Max, et al.
Publicado: (2024)
por: Ku, Max, et al.
Publicado: (2024)
VisPhyWorld: Probing Physical Reasoning via Code-Driven Video Reconstruction
por: Liang, Jiarong, et al.
Publicado: (2026)
por: Liang, Jiarong, et al.
Publicado: (2026)
DiffAtlas: GenAI-fying Atlas Segmentation via Image-Mask Diffusion
por: Zhang, Hantao, et al.
Publicado: (2025)
por: Zhang, Hantao, et al.
Publicado: (2025)
GenAI Mirage: The Impostor Bias and the Deepfake Detection Challenge in the Era of Artificial Illusions
por: Casu, Mirko, et al.
Publicado: (2023)
por: Casu, Mirko, et al.
Publicado: (2023)
Exploring Model Quantization in GenAI-based Image Inpainting and Detection of Arable Plants
por: Modak, Sourav, et al.
Publicado: (2025)
por: Modak, Sourav, et al.
Publicado: (2025)
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
GenAI Confessions: Black-box Membership Inference for Generative Image Models
por: Bohacek, Matyas, et al.
Publicado: (2025)
por: Bohacek, Matyas, et al.
Publicado: (2025)
GenArena: How Can We Achieve Human-Aligned Evaluation for Visual Generation Tasks?
por: Li, Ruihang, et al.
Publicado: (2026)
por: Li, Ruihang, et al.
Publicado: (2026)
Drifting Away from Truth: GenAI-Driven News Diversity Challenges LVLM-Based Misinformation Detection
por: Li, Fanxiao, et al.
Publicado: (2025)
por: Li, Fanxiao, et al.
Publicado: (2025)
GeoArena: Evaluating Open-World Geographic Reasoning in Large Vision-Language Models
por: Jia, Pengyue, et al.
Publicado: (2025)
por: Jia, Pengyue, et al.
Publicado: (2025)
GenVidBench: A 6-Million Benchmark for AI-Generated Video Detection
por: Ni, Zhenliang, et al.
Publicado: (2025)
por: Ni, Zhenliang, et al.
Publicado: (2025)
Can Large Vision-Language Models Detect Images Copyright Infringement from GenAI?
por: Xu, Qipan, et al.
Publicado: (2025)
por: Xu, Qipan, et al.
Publicado: (2025)
RTGen: Real-Time Generative Detection Transformer
por: Ruan, Chi, et al.
Publicado: (2025)
por: Ruan, Chi, et al.
Publicado: (2025)
VideoGen-Eval: Agent-based System for Video Generation Evaluation
por: Yang, Yuhang, et al.
Publicado: (2025)
por: Yang, Yuhang, et al.
Publicado: (2025)
Not All Similarities Are Created Equal: Leveraging Data-Driven Biases to Inform GenAI Copyright Disputes
por: Hacohen, Uri, et al.
Publicado: (2024)
por: Hacohen, Uri, et al.
Publicado: (2024)
GAC-KAN: An Ultra-Lightweight GNSS Interference Classifier for GenAI-Powered Consumer Edge Devices
por: Zeng, Zhihan, et al.
Publicado: (2026)
por: Zeng, Zhihan, et al.
Publicado: (2026)
DeepfakeArt Challenge: A Benchmark Dataset for Generative AI Art Forgery and Data Poisoning Detection
por: Aboutalebi, Hossein, et al.
Publicado: (2023)
por: Aboutalebi, Hossein, et al.
Publicado: (2023)
TheoremExplainAgent: Towards Video-based Multimodal Explanations for LLM Theorem Understanding
por: Ku, Max, et al.
Publicado: (2025)
por: Ku, Max, et al.
Publicado: (2025)
GenRC: Generative 3D Room Completion from Sparse Image Collections
por: Li, Ming-Feng, et al.
Publicado: (2024)
por: Li, Ming-Feng, et al.
Publicado: (2024)
Synthetic Industrial Object Detection: GenAI vs. Feature-Based Methods
por: Araya-Martinez, Jose Moises, et al.
Publicado: (2025)
por: Araya-Martinez, Jose Moises, et al.
Publicado: (2025)
Gen-AI Police Sketches with Stable Diffusion
por: Fidalgo, Nicholas, et al.
Publicado: (2025)
por: Fidalgo, Nicholas, et al.
Publicado: (2025)
Gen-Searcher: Reinforcing Agentic Search for Image Generation
por: Feng, Kaituo, et al.
Publicado: (2026)
por: Feng, Kaituo, et al.
Publicado: (2026)
Mitigating GenAI-powered Evidence Pollution for Out-of-Context Multimodal Misinformation Detection
por: Yan, Zehong, et al.
Publicado: (2025)
por: Yan, Zehong, et al.
Publicado: (2025)
VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models
por: Zhang, Borong, et al.
Publicado: (2025)
por: Zhang, Borong, et al.
Publicado: (2025)
WorldArena 2.0: Extending Embodied World Model Benchmarking on Modality, Functionality and Platform
por: Shang, Yu, et al.
Publicado: (2026)
por: Shang, Yu, et al.
Publicado: (2026)
Ejemplares similares
-
VIEScore: Towards Explainable Metrics for Conditional Image Synthesis Evaluation
por: Ku, Max, et al.
Publicado: (2023) -
VideoScore: Building Automatic Metrics to Simulate Fine-grained Human Feedback for Video Generation
por: He, Xuan, et al.
Publicado: (2024) -
MANTIS: Interleaved Multi-Image Instruction Tuning
por: Jiang, Dongfu, et al.
Publicado: (2024) -
3D Arena: An Open Platform for Generative 3D Evaluation
por: Ebert, Dylan
Publicado: (2025) -
GenAI-DrawIO-Creator: A Framework for Automated Diagram Generation
por: Yu, Jinze, et al.
Publicado: (2026)