DECKBench: Benchmarking Multi-Agent Frameworks for Academic Slide Generation and Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Jang, Daesik, Heisler, Morgan Lindsay, Xing, Linzi, Li, Yifei, Wang, Edward, Xiong, Ying, Zhang, Yong, Fan, Zhenan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
morgan-heisler/DeckBench: v1.0.0 — DECKBench Initial Release (KDD 2026)
di: dsjang2, et al.
Pubblicazione: (2026)
di: dsjang2, et al.
Pubblicazione: (2026)
SemAug: Semantically Meaningful Image Augmentations for Object Detection Through Language Grounding
di: Heisler, Morgan, et al.
Pubblicazione: (2022)
di: Heisler, Morgan, et al.
Pubblicazione: (2022)
Enhancing Learned Knowledge in LoRA Adapters Through Efficient Contrastive Decoding on Ascend NPUs
di: Heisler, Morgan Lindsay, et al.
Pubblicazione: (2025)
di: Heisler, Morgan Lindsay, et al.
Pubblicazione: (2025)
Efficiently Serving Large Multimodal Models Using EPD Disaggregation
di: Singh, Gursimran, et al.
Pubblicazione: (2024)
di: Singh, Gursimran, et al.
Pubblicazione: (2024)
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
SkeletonAgent: An Agentic Interaction Framework for Skeleton-based Action Recognition
di: Liu, Hongda, et al.
Pubblicazione: (2025)
di: Liu, Hongda, et al.
Pubblicazione: (2025)
3D Gaussian Editing with A Single Image
di: Luo, Guan, et al.
Pubblicazione: (2024)
di: Luo, Guan, et al.
Pubblicazione: (2024)
A Lightweight Model-Driven 4D Radar Framework for Pervasive Human Detection in Harsh Conditions
di: Liu, Zhenan, et al.
Pubblicazione: (2026)
di: Liu, Zhenan, et al.
Pubblicazione: (2026)
ScaleEdit-12M: Scaling Open-Source Image Editing Data Generation via Multi-Agent Framework
di: Chen, Guanzhou, et al.
Pubblicazione: (2026)
di: Chen, Guanzhou, et al.
Pubblicazione: (2026)
Dual Frequency Branch Framework with Reconstructed Sliding Windows Attention for AI-Generated Image Detection
di: Yan, Jiazhen, et al.
Pubblicazione: (2025)
di: Yan, Jiazhen, et al.
Pubblicazione: (2025)
CAMEO: A Conditional and Quality-Aware Multi-Agent Image Editing Orchestrator
di: Pu, Yuhan, et al.
Pubblicazione: (2026)
di: Pu, Yuhan, et al.
Pubblicazione: (2026)
Talk2Image: A Multi-Agent System for Multi-Turn Image Generation and Editing
di: Ma, Shichao, et al.
Pubblicazione: (2025)
di: Ma, Shichao, et al.
Pubblicazione: (2025)
Sketch2Human: Deep Human Generation with Disentangled Geometry and Appearance Control
di: Qu, Linzi, et al.
Pubblicazione: (2024)
di: Qu, Linzi, et al.
Pubblicazione: (2024)
MIRAGE: Benchmarking and Aligning Multi-Instance Image Editing
di: Liu, Ziqian, et al.
Pubblicazione: (2026)
di: Liu, Ziqian, et al.
Pubblicazione: (2026)
MMNavAgent: Multi-Magnification WSI Navigation Agent for Clinically Consistent Whole-Slide Analysis
di: Xu, Zhengyang, et al.
Pubblicazione: (2026)
di: Xu, Zhengyang, et al.
Pubblicazione: (2026)
UTDesign: A Unified Framework for Stylized Text Editing and Generation in Graphic Design Images
di: Zhao, Yiming, et al.
Pubblicazione: (2025)
di: Zhao, Yiming, et al.
Pubblicazione: (2025)
PPTArena: A Benchmark for Agentic PowerPoint Editing
di: Ofengenden, Michael, et al.
Pubblicazione: (2025)
di: Ofengenden, Michael, et al.
Pubblicazione: (2025)
PresentBench: A Fine-Grained Rubric-Based Benchmark for Slide Generation
di: Chen, Xin-Sheng, et al.
Pubblicazione: (2026)
di: Chen, Xin-Sheng, et al.
Pubblicazione: (2026)
ReAgent-V: A Reward-Driven Multi-Agent Framework for Video Understanding
di: Zhou, Yiyang, et al.
Pubblicazione: (2025)
di: Zhou, Yiyang, et al.
Pubblicazione: (2025)
Generalizable Whole Slide Image Classification with Fine-Grained Visual-Semantic Interaction
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Follow-Your-MultiPose: Tuning-Free Multi-Character Text-to-Video Generation via Pose Guidance
di: Zhang, Beiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Beiyuan, et al.
Pubblicazione: (2024)
Multi-turn Consistent Image Editing
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
Aurora: Unified Video Editing with a Tool-Using Agent
di: Yu, Yongsheng, et al.
Pubblicazione: (2026)
di: Yu, Yongsheng, et al.
Pubblicazione: (2026)
Exploiting Low-Dimensional Manifold of Features for Few-Shot Whole Slide Image Classification
di: Xiong, Conghao, et al.
Pubblicazione: (2025)
di: Xiong, Conghao, et al.
Pubblicazione: (2025)
MotionMERGE: A Multi-granular Framework for Human Motion Editing, Reasoning, Generation, and Explanation
di: Wu, Bizhu, et al.
Pubblicazione: (2026)
di: Wu, Bizhu, et al.
Pubblicazione: (2026)
Learning in ImaginationLand: Omnidirectional Policies through 3D Generative Models (OP-Gen)
di: Ren, Yifei, et al.
Pubblicazione: (2025)
di: Ren, Yifei, et al.
Pubblicazione: (2025)
SVGenius: Benchmarking LLMs in SVG Understanding, Editing and Generation
di: Chen, Siqi, et al.
Pubblicazione: (2025)
di: Chen, Siqi, et al.
Pubblicazione: (2025)
Lego-Edit: A General Image Editing Framework with Model-Level Bricks and MLLM Builder
di: Jia, Qifei, et al.
Pubblicazione: (2025)
di: Jia, Qifei, et al.
Pubblicazione: (2025)
EdiVal-Agent: An Object-Centric Framework for Automated, Fine-Grained Evaluation of Multi-Turn Editing
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
Agent4FaceForgery: Multi-Agent LLM Framework for Realistic Face Forgery Detection
di: Lai, Yingxin, et al.
Pubblicazione: (2025)
di: Lai, Yingxin, et al.
Pubblicazione: (2025)
Imperceptible Protection against Style Imitation from Diffusion Models
di: Ahn, Namhyuk, et al.
Pubblicazione: (2024)
di: Ahn, Namhyuk, et al.
Pubblicazione: (2024)
Nearly Zero-Cost Protection Against Mimicry by Personalized Diffusion Models
di: Ahn, Namhyuk, et al.
Pubblicazione: (2024)
di: Ahn, Namhyuk, et al.
Pubblicazione: (2024)
Step1X-Edit: A Practical Framework for General Image Editing
di: Liu, Shiyu, et al.
Pubblicazione: (2025)
di: Liu, Shiyu, et al.
Pubblicazione: (2025)
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
di: Chen, Yinan, et al.
Pubblicazione: (2025)
di: Chen, Yinan, et al.
Pubblicazione: (2025)
High-Fidelity GAN Inversion for Image Attribute Editing
di: Wang, Tengfei, et al.
Pubblicazione: (2021)
di: Wang, Tengfei, et al.
Pubblicazione: (2021)
coDrawAgents: A Multi-Agent Dialogue Framework for Compositional Image Generation
di: Li, Chunhan, et al.
Pubblicazione: (2026)
di: Li, Chunhan, et al.
Pubblicazione: (2026)
GenArtist: Multimodal LLM as an Agent for Unified Image Generation and Editing
di: Wang, Zhenyu, et al.
Pubblicazione: (2024)
di: Wang, Zhenyu, et al.
Pubblicazione: (2024)
PosBridge: Multi-View Positional Embedding Transplant for Identity-Aware Image Editing
di: Xiong, Peilin, et al.
Pubblicazione: (2025)
di: Xiong, Peilin, et al.
Pubblicazione: (2025)
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
di: Zhao, Haoyu, et al.
Pubblicazione: (2023)
di: Zhao, Haoyu, et al.
Pubblicazione: (2023)
Documenti analoghi
-
morgan-heisler/DeckBench: v1.0.0 — DECKBench Initial Release (KDD 2026)
di: dsjang2, et al.
Pubblicazione: (2026) -
SemAug: Semantically Meaningful Image Augmentations for Object Detection Through Language Grounding
di: Heisler, Morgan, et al.
Pubblicazione: (2022) -
Enhancing Learned Knowledge in LoRA Adapters Through Efficient Contrastive Decoding on Ascend NPUs
di: Heisler, Morgan Lindsay, et al.
Pubblicazione: (2025) -
Efficiently Serving Large Multimodal Models Using EPD Disaggregation
di: Singh, Gursimran, et al.
Pubblicazione: (2024) -
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)