Envisioning Beyond the Pixels: Benchmarking Reasoning-Informed Visual Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Xiangyu, Zhang, Peiyuan, Tang, Kexian, Zhu, Xiaorong, Li, Hao, Chai, Wenhao, Zhang, Zicheng, Xia, Renqiu, Zhai, Guangtao, Yan, Junchi, Yang, Hua, Yang, Xue, Duan, Haodong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GOBench: Benchmarking Geometric Optics Generation and Understanding of MLLMs
di: Zhu, Xiaorong, et al.
Pubblicazione: (2025)
di: Zhu, Xiaorong, et al.
Pubblicazione: (2025)
GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
Redundancy Principles for MLLMs Benchmarks
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
Beyond Theorem Proving: Formulation, Framework and Benchmark for Formal Problem-Solving
di: Liu, Qi, et al.
Pubblicazione: (2025)
di: Liu, Qi, et al.
Pubblicazione: (2025)
LM Fight Arena: Benchmarking Large Multimodal Models via Game Competition
di: Zheng, Yushuo, et al.
Pubblicazione: (2025)
di: Zheng, Yushuo, et al.
Pubblicazione: (2025)
MM-HELIX: Boosting Multimodal Long-Chain Reflective Reasoning with Holistic Platform and Adaptive Hybrid Policy Optimization
di: Zhao, Xiangyu, et al.
Pubblicazione: (2025)
di: Zhao, Xiangyu, et al.
Pubblicazione: (2025)
Affordance Benchmark for MLLMs
di: Wang, Junying, et al.
Pubblicazione: (2025)
di: Wang, Junying, et al.
Pubblicazione: (2025)
Trust Your Critic: Robust Reward Modeling and Reinforcement Learning for Faithful Image Editing and Generation
di: Zhao, Xiangyu, et al.
Pubblicazione: (2026)
di: Zhao, Xiangyu, et al.
Pubblicazione: (2026)
Market-Bench: Benchmarking Large Language Models on Economic and Trade Competition
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
ReasonEdit: Towards Interpretable Image Editing Evaluation via Reinforcement Learning
di: Chen, Honghua, et al.
Pubblicazione: (2026)
di: Chen, Honghua, et al.
Pubblicazione: (2026)
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
Q-Bench+: A Benchmark for Multi-modal Foundation Models on Low-level Vision from Single Images to Pairs
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zicheng, et al.
Pubblicazione: (2024)
MedOmni-45°: A Safety-Performance Benchmark for Reasoning-Oriented LLMs in Medicine
di: Ji, Kaiyuan, et al.
Pubblicazione: (2025)
di: Ji, Kaiyuan, et al.
Pubblicazione: (2025)
Information Density Principle for MLLM Benchmarks
di: Li, Chunyi, et al.
Pubblicazione: (2025)
di: Li, Chunyi, et al.
Pubblicazione: (2025)
OmniAlign-V: Towards Enhanced Alignment of MLLMs with Human Preference
di: Zhao, Xiangyu, et al.
Pubblicazione: (2025)
di: Zhao, Xiangyu, et al.
Pubblicazione: (2025)
IllusionBench+: A Large-scale and Comprehensive Benchmark for Visual Illusion Understanding in Vision-Language Models
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
di: Zhang, Yiming, et al.
Pubblicazione: (2025)
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
di: Liao, Ning, et al.
Pubblicazione: (2023)
di: Liao, Ning, et al.
Pubblicazione: (2023)
I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
VideoAesBench: Benchmarking the Video Aesthetics Perception Capabilities of Large Multimodal Models
di: Li, Yunhao, et al.
Pubblicazione: (2026)
di: Li, Yunhao, et al.
Pubblicazione: (2026)
Milestones over Outcome: Unlocking Geometric Reasoning with Sub-Goal Verifiable Reward
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
Q-Bench-Portrait: Benchmarking Multimodal Large Language Models on Portrait Image Quality Perception
di: Wu, Sijing, et al.
Pubblicazione: (2026)
di: Wu, Sijing, et al.
Pubblicazione: (2026)
ChartX & ChartVLM: A Versatile Benchmark and Foundation Model for Complicated Chart Reasoning
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
di: Xia, Renqiu, et al.
Pubblicazione: (2024)
GeoX-Bench: Benchmarking Cross-View Geo-Localization and Pose Estimation Capabilities of Large Multimodal Models
di: Zheng, Yushuo, et al.
Pubblicazione: (2025)
di: Zheng, Yushuo, et al.
Pubblicazione: (2025)
Human-Centric Evaluation for Foundation Models
di: Guo, Yijin, et al.
Pubblicazione: (2025)
di: Guo, Yijin, et al.
Pubblicazione: (2025)
DHQA-4D: Perceptual Quality Assessment of Dynamic 4D Digital Human
di: Li, Yunhao, et al.
Pubblicazione: (2025)
di: Li, Yunhao, et al.
Pubblicazione: (2025)
HazeCLIP: Towards Language Guided Real-World Image Dehazing
di: Wang, Ruiyi, et al.
Pubblicazione: (2024)
di: Wang, Ruiyi, et al.
Pubblicazione: (2024)
LMM4Edit: Benchmarking and Evaluating Multimodal Image Editing with LMMs
di: Xu, Zitong, et al.
Pubblicazione: (2025)
di: Xu, Zitong, et al.
Pubblicazione: (2025)
LOVE: Benchmarking and Evaluating Text-to-Video Generation and Video-to-Text Interpretation
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
Beyond Words and Pixels: A Benchmark for Implicit World Knowledge Reasoning in Generative Models
di: Han, Tianyang, et al.
Pubblicazione: (2025)
di: Han, Tianyang, et al.
Pubblicazione: (2025)
Teaching LMMs for Image Quality Scoring and Interpreting
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
di: Zhang, Zicheng, et al.
Pubblicazione: (2025)
GeoR-Bench: Evaluating Geoscience Visual Reasoning
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
di: Zheng, Yushuo, et al.
Pubblicazione: (2026)
Beyond Generation: Unlocking Universal Editing via Self-Supervised Fine-Tuning
di: Chen, Harold Haodong, et al.
Pubblicazione: (2024)
di: Chen, Harold Haodong, et al.
Pubblicazione: (2024)
LEGO-Puzzles: How Good Are MLLMs at Multi-Step Spatial Reasoning?
di: Tang, Kexian, et al.
Pubblicazione: (2025)
di: Tang, Kexian, et al.
Pubblicazione: (2025)
Multi-Dimensional Quality Assessment for Text-to-3D Assets: Dataset and Model
di: Fu, Kang, et al.
Pubblicazione: (2025)
di: Fu, Kang, et al.
Pubblicazione: (2025)
DFBench: Benchmarking Deepfake Image Detection Capability of Large Multimodal Models
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
di: Wang, Jiarui, et al.
Pubblicazione: (2025)
Towards Explainable Partial-AIGC Image Quality Assessment
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror
di: Guo, Shengyu, et al.
Pubblicazione: (2026)
di: Guo, Shengyu, et al.
Pubblicazione: (2026)
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
di: Ye, Hancheng, et al.
Pubblicazione: (2024)
Learning Adaptive and Temporally Causal Video Tokenization in a 1D Latent Space
di: Li, Yan, et al.
Pubblicazione: (2025)
di: Li, Yan, et al.
Pubblicazione: (2025)
TinyLlama: An Open-Source Small Language Model
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
GOBench: Benchmarking Geometric Optics Generation and Understanding of MLLMs
di: Zhu, Xiaorong, et al.
Pubblicazione: (2025) -
GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
di: Liu, Mingxin, et al.
Pubblicazione: (2026) -
Redundancy Principles for MLLMs Benchmarks
di: Zhang, Zicheng, et al.
Pubblicazione: (2025) -
Beyond Theorem Proving: Formulation, Framework and Benchmark for Formal Problem-Solving
di: Liu, Qi, et al.
Pubblicazione: (2025) -
LM Fight Arena: Benchmarking Large Multimodal Models via Game Competition
di: Zheng, Yushuo, et al.
Pubblicazione: (2025)