BizGenEval: A Systematic Benchmark for Commercial Visual Content Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yan, Zeng, Zezi, Zhou, Ziwei, Gao, Xin, Tian, Muzhao, Yang, Yifan, Cheng, Mingxi, Dai, Qi, Yang, Yuqing, Qiu, Lili, Wang, Zhendong, Yang, Zhengyuan, Yang, Xue, Wang, Lijuan, Li, Ji, Luo, Chong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MM-WebAgent: A Hierarchical Multimodal Web Agent for Webpage Generation
par: Li, Yan, et autres
Publié: (2026)
par: Li, Yan, et autres
Publié: (2026)
AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation
par: Zhou, Ziwei, et autres
Publié: (2026)
par: Zhou, Ziwei, et autres
Publié: (2026)
ReasonGen-R1: CoT for Autoregressive Image generation models through SFT and RL
par: Zhang, Yu, et autres
Publié: (2025)
par: Zhang, Yu, et autres
Publié: (2025)
ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning
par: Liao, Jiaqi, et autres
Publié: (2025)
par: Liao, Jiaqi, et autres
Publié: (2025)
Diagnostic Benchmark and Iterative Inpainting for Layout-Guided Image Generation
par: Cho, Jaemin, et autres
Publié: (2023)
par: Cho, Jaemin, et autres
Publié: (2023)
From Raw Experience to Skill Consumption: A Systematic Study of Model-Generated Agent Skills
par: Huang, Zisu, et autres
Publié: (2026)
par: Huang, Zisu, et autres
Publié: (2026)
CONSTRUCTA: Automating Commercial Construction Schedules in Fabrication Facilities with Large Language Models
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
Beyond Words: Advancing Long-Text Image Generation via Multimodal Autoregressive Models
par: Wang, Alex Jinpeng, et autres
Publié: (2025)
par: Wang, Alex Jinpeng, et autres
Publié: (2025)
Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark
par: Hao, Yunzhuo, et autres
Publié: (2025)
par: Hao, Yunzhuo, et autres
Publié: (2025)
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models
par: Zhou, Ziqin, et autres
Publié: (2025)
par: Zhou, Ziqin, et autres
Publié: (2025)
BizGen: Advancing Article-level Visual Text Rendering for Infographics Generation
par: Peng, Yuyang, et autres
Publié: (2025)
par: Peng, Yuyang, et autres
Publié: (2025)
Expressive and Generalizable Low-rank Adaptation for Large Models via Slow Cascaded Learning
par: Li, Siwei, et autres
Publié: (2024)
par: Li, Siwei, et autres
Publié: (2024)
Region-Adaptive Sampling for Diffusion Transformers
par: Liu, Ziming, et autres
Publié: (2025)
par: Liu, Ziming, et autres
Publié: (2025)
BizInfo
Publié: (2018)
Publié: (2018)
GenXD: Generating Any 3D and 4D Scenes
par: Zhao, Yuyang, et autres
Publié: (2024)
par: Zhao, Yuyang, et autres
Publié: (2024)
SkillOpt: Executive Strategy for Self-Evolving Agent Skills
par: Yang, Yifan, et autres
Publié: (2026)
par: Yang, Yifan, et autres
Publié: (2026)
VisEval: A Benchmark for Data Visualization in the Era of Large Language Models
par: Chen, Nan, et autres
Publié: (2024)
par: Chen, Nan, et autres
Publié: (2024)
BizCompass: Benchmarking the Reasoning Capabilities of LLMs in Business Knowledge and Applications
par: Hao, Jianing, et autres
Publié: (2026)
par: Hao, Jianing, et autres
Publié: (2026)
Conditional Text-to-Image Generation with Reference Guidance
par: Kim, Taewook, et autres
Publié: (2024)
par: Kim, Taewook, et autres
Publié: (2024)
VoLUT: Efficient Volumetric streaming enhanced by LUT-based super-resolution
par: Wang, Chendong, et autres
Publié: (2025)
par: Wang, Chendong, et autres
Publié: (2025)
AVA: Towards Agentic Video Analytics with Vision Language Models
par: Yan, Yuxuan, et autres
Publié: (2025)
par: Yan, Yuxuan, et autres
Publié: (2025)
BizBench: A Quantitative Reasoning Benchmark for Business and Finance
par: Koncel-Kedziorski, Rik, et autres
Publié: (2023)
par: Koncel-Kedziorski, Rik, et autres
Publié: (2023)
Tuning Timestep-Distilled Diffusion Model Using Pairwise Sample Optimization
par: Miao, Zichen, et autres
Publié: (2024)
par: Miao, Zichen, et autres
Publié: (2024)
Entity6K: A Large Open-Domain Evaluation Dataset for Real-World Entity Recognition
par: Qiu, Jielin, et autres
Publié: (2024)
par: Qiu, Jielin, et autres
Publié: (2024)
What makes Reasoning Models Different? Follow the Reasoning Leader for Efficient Decoding
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Bring Metric Functions into Diffusion Models
par: An, Jie, et autres
Publié: (2024)
par: An, Jie, et autres
Publié: (2024)
LLM2CLIP: Powerful Language Model Unlocks Richer Cross-Modality Representation
par: Huang, Weiquan, et autres
Publié: (2024)
par: Huang, Weiquan, et autres
Publié: (2024)
VideoGen-Eval: Agent-based System for Video Generation Evaluation
par: Yang, Yuhang, et autres
Publié: (2025)
par: Yang, Yuhang, et autres
Publié: (2025)
InfiCoEvalChain: A Blockchain-Based Decentralized Framework for Collaborative LLM Evaluation
par: Yang, Yifan, et autres
Publié: (2026)
par: Yang, Yifan, et autres
Publié: (2026)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
par: He, Zhiyuan, et autres
Publié: (2024)
par: He, Zhiyuan, et autres
Publié: (2024)
BizFinBench.v2: A Unified Dual-Mode Bilingual Benchmark for Expert-Level Financial Capability Alignment
par: Guo, Xin, et autres
Publié: (2026)
par: Guo, Xin, et autres
Publié: (2026)
VideoGUI: A Benchmark for GUI Automation from Instructional Videos
par: Lin, Kevin Qinghong, et autres
Publié: (2024)
par: Lin, Kevin Qinghong, et autres
Publié: (2024)
Unified Medical Image Pre-training in Language-Guided Common Semantic Space
par: He, Xiaoxuan, et autres
Publié: (2023)
par: He, Xiaoxuan, et autres
Publié: (2023)
MTraining: Distributed Dynamic Sparse Attention for Efficient Ultra-Long Context Training
par: Li, Wenxuan, et autres
Publié: (2025)
par: Li, Wenxuan, et autres
Publié: (2025)
LiVOS: Light Video Object Segmentation with Gated Linear Matching
par: Liu, Qin, et autres
Publié: (2024)
par: Liu, Qin, et autres
Publié: (2024)
TreeEval: Benchmark-Free Evaluation of Large Language Models through Tree Planning
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Video-in-the-Loop: Span-Grounded Long Video QA with Interleaved Reasoning
par: Wang, Chendong, et autres
Publié: (2025)
par: Wang, Chendong, et autres
Publié: (2025)
Retrieval Augmented Generation (RAG) and Beyond: A Comprehensive Survey on How to Make your LLMs use External Data More Wisely
par: Zhao, Siyun, et autres
Publié: (2024)
par: Zhao, Siyun, et autres
Publié: (2024)
CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X
par: Zheng, Qinkai, et autres
Publié: (2023)
par: Zheng, Qinkai, et autres
Publié: (2023)
MM-Vet v2: A Challenging Benchmark to Evaluate Large Multimodal Models for Integrated Capabilities
par: Yu, Weihao, et autres
Publié: (2024)
par: Yu, Weihao, et autres
Publié: (2024)
Documents similaires
-
MM-WebAgent: A Hierarchical Multimodal Web Agent for Webpage Generation
par: Li, Yan, et autres
Publié: (2026) -
AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation
par: Zhou, Ziwei, et autres
Publié: (2026) -
ReasonGen-R1: CoT for Autoregressive Image generation models through SFT and RL
par: Zhang, Yu, et autres
Publié: (2025) -
ImageGen-CoT: Enhancing Text-to-Image In-context Learning with Chain-of-Thought Reasoning
par: Liao, Jiaqi, et autres
Publié: (2025) -
Diagnostic Benchmark and Iterative Inpainting for Layout-Guided Image Generation
par: Cho, Jaemin, et autres
Publié: (2023)