ComfyBench: Benchmarking LLM-based Agents in ComfyUI for Autonomously Designing Collaborative AI Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xue, Xiangyuan, Lu, Zeyu, Huang, Di, Wang, Zidong, Ouyang, Wanli, Bai, Lei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ComfySearch: Autonomous Exploration and Reasoning for ComfyUI Workflows
par: Su, Jinwei, et autres
Publié: (2026)
par: Su, Jinwei, et autres
Publié: (2026)
ComfyUI-Copilot: An Intelligent Assistant for Automated Workflow Development
par: Xu, Zhenran, et autres
Publié: (2025)
par: Xu, Zhenran, et autres
Publié: (2025)
ComfyUI-R1: Exploring Reasoning Models for Workflow Generation
par: Xu, Zhenran, et autres
Publié: (2025)
par: Xu, Zhenran, et autres
Publié: (2025)
ComfyGPT: A Self-Optimizing Multi-Agent System for Comprehensive ComfyUI Workflow Generation
par: Huang, Oucheng, et autres
Publié: (2025)
par: Huang, Oucheng, et autres
Publié: (2025)
Ep. 20: Architectural AI: Precision with ControlNet & ComfyUI
par: Rosehill, Daniel, et autres
Publié: (2025)
par: Rosehill, Daniel, et autres
Publié: (2025)
Explainability-in-Action: Enabling Expressive Manipulation and Tacit Understanding by Bending Diffusion Models in ComfyUI
par: Abuzuraiq, Ahmed M., et autres
Publié: (2025)
par: Abuzuraiq, Ahmed M., et autres
Publié: (2025)
ComfyGI: Automatic Improvement of Image Generation Workflows
par: Sobania, Dominik, et autres
Publié: (2024)
par: Sobania, Dominik, et autres
Publié: (2024)
ComfyGen: Prompt-Adaptive Workflows for Text-to-Image Generation
par: Gal, Rinon, et autres
Publié: (2024)
par: Gal, Rinon, et autres
Publié: (2024)
PredBench: Benchmarking Spatio-Temporal Prediction across Diverse Disciplines
par: Wang, ZiDong, et autres
Publié: (2024)
par: Wang, ZiDong, et autres
Publié: (2024)
ComfyMind: Toward General-Purpose Generation via Tree-Based Planning and Reactive Feedback
par: Guo, Litao, et autres
Publié: (2025)
par: Guo, Litao, et autres
Publié: (2025)
FiT: Flexible Vision Transformer for Diffusion Model
par: Lu, Zeyu, et autres
Publié: (2024)
par: Lu, Zeyu, et autres
Publié: (2024)
StraTA: Incentivizing Agentic Reinforcement Learning with Strategic Trajectory Abstraction
par: Xue, Xiangyuan, et autres
Publié: (2026)
par: Xue, Xiangyuan, et autres
Publié: (2026)
Diffusion Models Need Visual Priors for Image Generation
par: Yue, Xiaoyu, et autres
Publié: (2024)
par: Yue, Xiaoyu, et autres
Publié: (2024)
CoMAS: Co-Evolving Multi-Agent Systems via Interaction Rewards
par: Xue, Xiangyuan, et autres
Publié: (2025)
par: Xue, Xiangyuan, et autres
Publié: (2025)
UI-Bench: A Benchmark for Evaluating Design Capabilities of AI Text-to-App Tools
par: Jung, Sam, et autres
Publié: (2025)
par: Jung, Sam, et autres
Publié: (2025)
Native-Resolution Image Synthesis
par: Wang, Zidong, et autres
Publié: (2025)
par: Wang, Zidong, et autres
Publié: (2025)
UI2V-Bench: An Understanding-based Image-to-video Generation Benchmark
par: Zhang, Ailing, et autres
Publié: (2025)
par: Zhang, Ailing, et autres
Publié: (2025)
A Scalable Multi-LLM Collaboration System with Retrieval-based Selection and Exploration-Exploitation-Driven Enhancement
par: Tang, Shengji, et autres
Publié: (2025)
par: Tang, Shengji, et autres
Publié: (2025)
ISD-Agent-Bench: A Comprehensive Benchmark for Evaluating LLM-based Instructional Design Agents
par: Jeon, YoungHoon, et autres
Publié: (2026)
par: Jeon, YoungHoon, et autres
Publié: (2026)
Transition Models: Rethinking the Generative Learning Objective
par: Wang, Zidong, et autres
Publié: (2025)
par: Wang, Zidong, et autres
Publié: (2025)
Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
par: Deng, Shihan, et autres
Publié: (2024)
par: Deng, Shihan, et autres
Publié: (2024)
Understand Before You Generate: Self-Guided Training for Autoregressive Image Generation
par: Yue, Xiaoyu, et autres
Publié: (2025)
par: Yue, Xiaoyu, et autres
Publié: (2025)
MultiAgentBench: Evaluating the Collaboration and Competition of LLM agents
par: Zhu, Kunlun, et autres
Publié: (2025)
par: Zhu, Kunlun, et autres
Publié: (2025)
FlowBench: Revisiting and Benchmarking Workflow-Guided Planning for LLM-based Agents
par: Xiao, Ruixuan, et autres
Publié: (2024)
par: Xiao, Ruixuan, et autres
Publié: (2024)
On AI-Inspired UI-Design
par: Wei, Jialiang, et autres
Publié: (2024)
par: Wei, Jialiang, et autres
Publié: (2024)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
par: Tan, Haoran, et autres
Publié: (2025)
par: Tan, Haoran, et autres
Publié: (2025)
ClickAgent: Enhancing UI Location Capabilities of Autonomous Agents
par: Hoscilowicz, Jakub, et autres
Publié: (2024)
par: Hoscilowicz, Jakub, et autres
Publié: (2024)
FocusUI: Efficient UI Grounding via Position-Preserving Visual Token Selection
par: Ouyang, Mingyu, et autres
Publié: (2026)
par: Ouyang, Mingyu, et autres
Publié: (2026)
BenchGuard: Who Guards the Benchmarks? Automated Auditing of LLM Agent Benchmarks
par: Tu, Xinming, et autres
Publié: (2026)
par: Tu, Xinming, et autres
Publié: (2026)
How to Steer Your Multi-Agent System: Human-LLM Collaborative Planning
par: He, Zeyu, et autres
Publié: (2026)
par: He, Zeyu, et autres
Publié: (2026)
ShowUI: One Vision-Language-Action Model for GUI Visual Agent
par: Lin, Kevin Qinghong, et autres
Publié: (2024)
par: Lin, Kevin Qinghong, et autres
Publié: (2024)
ASIC-Agent: An Autonomous Multi-Agent System for ASIC Design with Benchmark Evaluation
par: Allam, Ahmed, et autres
Publié: (2025)
par: Allam, Ahmed, et autres
Publié: (2025)
TelcoAgent-Bench: A Multilingual Benchmark for Telecom AI Agents
par: Bariah, Lina, et autres
Publié: (2026)
par: Bariah, Lina, et autres
Publié: (2026)
AgentLens: Visual Analysis for Agent Behaviors in LLM-based Autonomous Systems
par: Lu, Jiaying, et autres
Publié: (2024)
par: Lu, Jiaying, et autres
Publié: (2024)
Editable Scene Simulation for Autonomous Driving via Collaborative LLM-Agents
par: Wei, Yuxi, et autres
Publié: (2024)
par: Wei, Yuxi, et autres
Publié: (2024)
ResearchBench: Benchmarking LLMs in Scientific Discovery via Inspiration-Based Task Decomposition
par: Liu, Yujie, et autres
Publié: (2025)
par: Liu, Yujie, et autres
Publié: (2025)
ShoppingBench: A Real-World Intent-Grounded Shopping Benchmark for LLM-based Agents
par: Wang, Jiangyuan, et autres
Publié: (2025)
par: Wang, Jiangyuan, et autres
Publié: (2025)
SpecifyUI: Supporting Iterative UI Design Intent Expression through Structured Specifications and Generative AI
par: Chen, Yunnong, et autres
Publié: (2025)
par: Chen, Yunnong, et autres
Publié: (2025)
CompBench: Benchmarking Complex Instruction-guided Image Editing
par: Jia, Bohan, et autres
Publié: (2025)
par: Jia, Bohan, et autres
Publié: (2025)
UI-Evol: Automatic Knowledge Evolving for Computer Use Agents
par: Zhang, Ziyun, et autres
Publié: (2025)
par: Zhang, Ziyun, et autres
Publié: (2025)
Documents similaires
-
ComfySearch: Autonomous Exploration and Reasoning for ComfyUI Workflows
par: Su, Jinwei, et autres
Publié: (2026) -
ComfyUI-Copilot: An Intelligent Assistant for Automated Workflow Development
par: Xu, Zhenran, et autres
Publié: (2025) -
ComfyUI-R1: Exploring Reasoning Models for Workflow Generation
par: Xu, Zhenran, et autres
Publié: (2025) -
ComfyGPT: A Self-Optimizing Multi-Agent System for Comprehensive ComfyUI Workflow Generation
par: Huang, Oucheng, et autres
Publié: (2025) -
Ep. 20: Architectural AI: Precision with ControlNet & ComfyUI
par: Rosehill, Daniel, et autres
Publié: (2025)