SridBench: Benchmark of Scientific Research Illustration Drawing of Image Generation Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Chang, Yifan, Feng, Yukang, Sun, Jianwen, Ai, Jiaxin, Li, Chuanhao, Zhou, S. Kevin, Zhang, Kaipeng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Pixels to Paths: A Multi-Agent Framework for Editable Scientific Illustration
por: Sun, Jianwen, et al.
Publicado: (2025)
por: Sun, Jianwen, et al.
Publicado: (2025)
IA-T2I: Internet-Augmented Text-to-Image Generation
por: Li, Chuanhao, et al.
Publicado: (2025)
por: Li, Chuanhao, et al.
Publicado: (2025)
A High-Quality Dataset and Reliable Evaluation for Interleaved Image-Text Generation
por: Feng, Yukang, et al.
Publicado: (2025)
por: Feng, Yukang, et al.
Publicado: (2025)
ARMOR: Empowering Multimodal Understanding Model with Interleaved Multimodal Generation Capability
por: Sun, Jianwen, et al.
Publicado: (2025)
por: Sun, Jianwen, et al.
Publicado: (2025)
MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
por: Zhou, Pengfei, et al.
Publicado: (2025)
por: Zhou, Pengfei, et al.
Publicado: (2025)
ProJudge: A Multi-Modal Multi-Discipline Benchmark and Instruction-Tuning Dataset for MLLM-based Process Judges
por: Ai, Jiaxin, et al.
Publicado: (2025)
por: Ai, Jiaxin, et al.
Publicado: (2025)
SciDraw-6K: A Multilingual Scientific Illustration Dataset Generated by Google Gemini
por: Chen, Davie
Publicado: (2026)
por: Chen, Davie
Publicado: (2026)
Closing the Expression Gap in LLM Instructions via Socratic Questioning
por: Sun, Jianwen, et al.
Publicado: (2025)
por: Sun, Jianwen, et al.
Publicado: (2025)
WorldMark: A Unified Benchmark Suite for Interactive Video World Models
por: Xu, Xiaojie, et al.
Publicado: (2026)
por: Xu, Xiaojie, et al.
Publicado: (2026)
ProSoftArena: Benchmarking Hierarchical Capabilities of Multimodal Agents in Professional Software Environments
por: Ai, Jiaxin, et al.
Publicado: (2025)
por: Ai, Jiaxin, et al.
Publicado: (2025)
PhyBench: A Physical Commonsense Benchmark for Evaluating Text-to-Image Models
por: Meng, Fanqing, et al.
Publicado: (2024)
por: Meng, Fanqing, et al.
Publicado: (2024)
SVBench: Evaluation of Video Generation Models on Social Reasoning
por: Peng, Wenshuo, et al.
Publicado: (2025)
por: Peng, Wenshuo, et al.
Publicado: (2025)
OverLayBench: A Benchmark for Layout-to-Image Generation with Dense Overlaps
por: Li, Bingnan, et al.
Publicado: (2025)
por: Li, Bingnan, et al.
Publicado: (2025)
AutoFigure-Edit: Generating Editable Scientific Illustration
por: Lin, Zhen, et al.
Publicado: (2026)
por: Lin, Zhen, et al.
Publicado: (2026)
TIR-Bench: A Comprehensive Benchmark for Agentic Thinking-with-Images Reasoning
por: Li, Ming, et al.
Publicado: (2025)
por: Li, Ming, et al.
Publicado: (2025)
AutoFigure: Generating and Refining Publication-Ready Scientific Illustrations
por: Zhu, Minjun, et al.
Publicado: (2026)
por: Zhu, Minjun, et al.
Publicado: (2026)
PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models
por: Xu, Zhaopan, et al.
Publicado: (2025)
por: Xu, Zhaopan, et al.
Publicado: (2025)
Sekai: A Video Dataset towards World Exploration
por: Li, Zhen, et al.
Publicado: (2025)
por: Li, Zhen, et al.
Publicado: (2025)
OpenING: A Comprehensive Benchmark for Judging Open-ended Interleaved Image-Text Generation
por: Zhou, Pengfei, et al.
Publicado: (2024)
por: Zhou, Pengfei, et al.
Publicado: (2024)
MICON-Bench: Benchmarking and Enhancing Multi-Image Context Image Generation in Unified Multimodal Models
por: Wu, Mingrui, et al.
Publicado: (2026)
por: Wu, Mingrui, et al.
Publicado: (2026)
TransMed: Large Language Models Enhance Vision Transformer for Biomedical Image Classification
por: Zheng, Kaipeng, et al.
Publicado: (2023)
por: Zheng, Kaipeng, et al.
Publicado: (2023)
IP-Bench: Benchmark for Image Protection Methods in Image-to-Video Generation Scenarios
por: Li, Xiaofeng, et al.
Publicado: (2026)
por: Li, Xiaofeng, et al.
Publicado: (2026)
MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
por: Xu, Zhaopan, et al.
Publicado: (2025)
por: Xu, Zhaopan, et al.
Publicado: (2025)
R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation
por: Chen, Kaijie, et al.
Publicado: (2025)
por: Chen, Kaijie, et al.
Publicado: (2025)
BioBench: A Blueprint to Move Beyond ImageNet for Scientific ML Benchmarks
por: Stevens, Samuel
Publicado: (2025)
por: Stevens, Samuel
Publicado: (2025)
VTEdit-Bench: A Comprehensive Benchmark for Multi-Reference Image Editing Models in Virtual Try-On
por: Liang, Xiaoye, et al.
Publicado: (2026)
por: Liang, Xiaoye, et al.
Publicado: (2026)
LaGen: Towards Autoregressive LiDAR Scene Generation
por: Zhou, Sizhuo, et al.
Publicado: (2025)
por: Zhou, Sizhuo, et al.
Publicado: (2025)
WildWorld: A Large-Scale Dataset for Dynamic World Modeling with Actions and Explicit State toward Generative ARPG
por: Li, Zhen, et al.
Publicado: (2026)
por: Li, Zhen, et al.
Publicado: (2026)
OCRGenBench: A Comprehensive Benchmark for Evaluating OCR Generative Capabilities
por: Zhang, Peirong, et al.
Publicado: (2025)
por: Zhang, Peirong, et al.
Publicado: (2025)
Code-in-the-Loop Forensics: Agentic Tool Use for Image Forgery Detection
por: Zhang, Fanrui, et al.
Publicado: (2025)
por: Zhang, Fanrui, et al.
Publicado: (2025)
Yume-1.5: A Text-Controlled Interactive World Generation Model
por: Mao, Xiaofeng, et al.
Publicado: (2025)
por: Mao, Xiaofeng, et al.
Publicado: (2025)
World Craft: Agentic Framework to Create Visualizable Worlds via Text
por: Sun, Jianwen, et al.
Publicado: (2026)
por: Sun, Jianwen, et al.
Publicado: (2026)
T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation
por: Sun, Kaiyue, et al.
Publicado: (2025)
por: Sun, Kaiyue, et al.
Publicado: (2025)
GIR-Bench: Versatile Benchmark for Generating Images with Reasoning
por: Li, Hongxiang, et al.
Publicado: (2025)
por: Li, Hongxiang, et al.
Publicado: (2025)
UI2V-Bench: An Understanding-based Image-to-video Generation Benchmark
por: Zhang, Ailing, et al.
Publicado: (2025)
por: Zhang, Ailing, et al.
Publicado: (2025)
FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model
por: Cao, Yukang, et al.
Publicado: (2025)
por: Cao, Yukang, et al.
Publicado: (2025)
Draw ALL Your Imagine: A Holistic Benchmark and Agent Framework for Complex Instruction-based Image Generation
por: Zhou, Yucheng, et al.
Publicado: (2025)
por: Zhou, Yucheng, et al.
Publicado: (2025)
Benchmarking Scientific Understanding and Reasoning for Video Generation using VideoScience-Bench
por: Hu, Lanxiang, et al.
Publicado: (2025)
por: Hu, Lanxiang, et al.
Publicado: (2025)
HighlightBench: Benchmarking Markup-Driven Table Reasoning in Scientific Documents
por: Wang, Lexin, et al.
Publicado: (2026)
por: Wang, Lexin, et al.
Publicado: (2026)
GenColorBench: A Color Evaluation Benchmark for Text-to-Image Generation Models
por: Butt, Muhammad Atif, et al.
Publicado: (2025)
por: Butt, Muhammad Atif, et al.
Publicado: (2025)
Ejemplares similares
-
From Pixels to Paths: A Multi-Agent Framework for Editable Scientific Illustration
por: Sun, Jianwen, et al.
Publicado: (2025) -
IA-T2I: Internet-Augmented Text-to-Image Generation
por: Li, Chuanhao, et al.
Publicado: (2025) -
A High-Quality Dataset and Reliable Evaluation for Interleaved Image-Text Generation
por: Feng, Yukang, et al.
Publicado: (2025) -
ARMOR: Empowering Multimodal Understanding Model with Interleaved Multimodal Generation Capability
por: Sun, Jianwen, et al.
Publicado: (2025) -
MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
por: Zhou, Pengfei, et al.
Publicado: (2025)