StitchCUDA: An Automated Multi-Agents End-to-End GPU Programing Framework with Rubric-based Agentic Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Shiyang, Zhang, Zijian, Chen, Winson, Luo, Yuebo, Hong, Mingyi, Ding, Caiwen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CudaForge: An Agent Framework with Hardware Feedback for CUDA Kernel Optimization
di: Zhang, Zijian, et al.
Pubblicazione: (2025)
di: Zhang, Zijian, et al.
Pubblicazione: (2025)
FilmAgent: A Multi-Agent Framework for End-to-End Film Automation in Virtual 3D Spaces
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
di: Xu, Zhenran, et al.
Pubblicazione: (2025)
Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems
di: Yu, Ye, et al.
Pubblicazione: (2026)
di: Yu, Ye, et al.
Pubblicazione: (2026)
Agentic Automation of BT-RADS Scoring: End-to-End Multi-Agent System for Standardized Brain Tumor Follow-up Assessment
di: Jabal, Mohamed Sobhi, et al.
Pubblicazione: (2026)
di: Jabal, Mohamed Sobhi, et al.
Pubblicazione: (2026)
MLZero: A Multi-Agent System for End-to-end Machine Learning Automation
di: Fang, Haoyang, et al.
Pubblicazione: (2025)
di: Fang, Haoyang, et al.
Pubblicazione: (2025)
MACM: Utilizing a Multi-Agent System for Condition Mining in Solving Complex Mathematical Problems
di: Lei, Bin, et al.
Pubblicazione: (2024)
di: Lei, Bin, et al.
Pubblicazione: (2024)
CUDAHercules: Benchmarking Hardware-Aware Expert-level CUDA Optimization for LLMs
di: Li, Shiyang, et al.
Pubblicazione: (2026)
di: Li, Shiyang, et al.
Pubblicazione: (2026)
WebTestBench: Evaluating Computer-Use Agents towards End-to-End Automated Web Testing
di: Kong, Fanheng, et al.
Pubblicazione: (2026)
di: Kong, Fanheng, et al.
Pubblicazione: (2026)
Doctorina MedBench: End-to-End Evaluation of Agent-Based Medical AI
di: Kozlova, Anna, et al.
Pubblicazione: (2026)
di: Kozlova, Anna, et al.
Pubblicazione: (2026)
City-LEO: Toward Transparent City Management Using LLM with End-to-End Optimization
di: Jiao, Zihao, et al.
Pubblicazione: (2024)
di: Jiao, Zihao, et al.
Pubblicazione: (2024)
DDO: Dual-Decision Optimization for LLM-Based Medical Consultation via Multi-Agent Collaboration
di: Jia, Zhihao, et al.
Pubblicazione: (2025)
di: Jia, Zhihao, et al.
Pubblicazione: (2025)
Which Agent Causes Task Failures and When? On Automated Failure Attribution of LLM Multi-Agent Systems
di: Zhang, Shaokun, et al.
Pubblicazione: (2025)
di: Zhang, Shaokun, et al.
Pubblicazione: (2025)
RPA-Check: A Multi-Stage Automated Framework for Evaluating Dynamic LLM-based Role-Playing Agents
di: Rosati, Riccardo, et al.
Pubblicazione: (2026)
di: Rosati, Riccardo, et al.
Pubblicazione: (2026)
CUDABeaver: Benchmarking LLM-Based Automated CUDA Debugging
di: Li, Shiyang, et al.
Pubblicazione: (2026)
di: Li, Shiyang, et al.
Pubblicazione: (2026)
LingxiDiagBench: A Multi-Agent Framework for Benchmarking LLMs in Chinese Psychiatric Consultation and Diagnosis
di: Xu, Shihao, et al.
Pubblicazione: (2026)
di: Xu, Shihao, et al.
Pubblicazione: (2026)
SPASM: Stable Persona-driven Agent Simulation for Multi-turn Dialogue Generation
di: Luo, Han, et al.
Pubblicazione: (2026)
di: Luo, Han, et al.
Pubblicazione: (2026)
AgentNet: Decentralized Evolutionary Coordination for LLM-based Multi-Agent Systems
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
Multi Agent based Medical Assistant for Edge Devices
di: Gawade, Sakharam, et al.
Pubblicazione: (2025)
di: Gawade, Sakharam, et al.
Pubblicazione: (2025)
MedPriv-Bench: Benchmarking the Privacy-Utility Trade-off of Large Language Models in Medical Open-End Question Answering
di: Guan, Shaowei, et al.
Pubblicazione: (2026)
di: Guan, Shaowei, et al.
Pubblicazione: (2026)
GEMA-Score: Granular Explainable Multi-Agent Scoring Framework for Radiology Report Evaluation
di: Zhang, Zhenxuan, et al.
Pubblicazione: (2025)
di: Zhang, Zhenxuan, et al.
Pubblicazione: (2025)
SkillMAS: Skill Co-Evolution with LLM-based Multi-Agent System
di: Pan, Shuai, et al.
Pubblicazione: (2026)
di: Pan, Shuai, et al.
Pubblicazione: (2026)
MAS-GPT: Training LLMs to Build LLM-based Multi-Agent Systems
di: Ye, Rui, et al.
Pubblicazione: (2025)
di: Ye, Rui, et al.
Pubblicazione: (2025)
CAF-I: A Collaborative Multi-Agent Framework for Enhanced Irony Detection with Large Language Models
di: Liu, Ziqi., et al.
Pubblicazione: (2025)
di: Liu, Ziqi., et al.
Pubblicazione: (2025)
DeepMEL: A Multi-Agent Collaboration Framework for Multimodal Entity Linking
di: Wang, Fang, et al.
Pubblicazione: (2025)
di: Wang, Fang, et al.
Pubblicazione: (2025)
The Subtle Art of Defection: Understanding Uncooperative Behaviors in LLM based Multi-Agent Systems
di: Kulshreshtha, Devang, et al.
Pubblicazione: (2025)
di: Kulshreshtha, Devang, et al.
Pubblicazione: (2025)
Preventing Rogue Agents Improves Multi-Agent Collaboration
di: Barbi, Ohav, et al.
Pubblicazione: (2025)
di: Barbi, Ohav, et al.
Pubblicazione: (2025)
AMANDA: Agentic Medical Knowledge Augmentation for Data-Efficient Medical Visual Question Answering
di: Wang, Ziqing, et al.
Pubblicazione: (2025)
di: Wang, Ziqing, et al.
Pubblicazione: (2025)
Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning
di: Yan, Sikuan, et al.
Pubblicazione: (2025)
di: Yan, Sikuan, et al.
Pubblicazione: (2025)
AI Urban Scientist: Multi-Agent Collaborative Automation for Urban Research
di: Xia, Tong, et al.
Pubblicazione: (2025)
di: Xia, Tong, et al.
Pubblicazione: (2025)
A Survey on LLM-based Multi-Agent System: Recent Advances and New Frontiers in Application
di: Chen, Shuaihang, et al.
Pubblicazione: (2024)
di: Chen, Shuaihang, et al.
Pubblicazione: (2024)
The Social Cost of Intelligence: Emergence, Propagation, and Amplification of Stereotypical Bias in Multi-Agent Systems
di: Nguyen, Thi-Nhung, et al.
Pubblicazione: (2025)
di: Nguyen, Thi-Nhung, et al.
Pubblicazione: (2025)
Specialists or Generalists? Multi-Agent and Single-Agent LLMs for Essay Grading
di: Idowu, Jamiu Adekunle, et al.
Pubblicazione: (2026)
di: Idowu, Jamiu Adekunle, et al.
Pubblicazione: (2026)
LinguistAgent: A Reflective Multi-Model Platform for Automated Linguistic Annotation
di: Li, Bingru
Pubblicazione: (2026)
di: Li, Bingru
Pubblicazione: (2026)
MAATS: A Multi-Agent Automated Translation System Based on MQM Evaluation
di: Wang, George, et al.
Pubblicazione: (2025)
di: Wang, George, et al.
Pubblicazione: (2025)
AutoMedic: An Automated Evaluation Framework for Clinical Conversational Agents with Medical Dataset Grounding
di: Oh, Gyutaek, et al.
Pubblicazione: (2025)
di: Oh, Gyutaek, et al.
Pubblicazione: (2025)
Agents that Matter: Optimizing Multi-Agent LLMs via Removal-Based Attribution
di: Lu, Mingyu, et al.
Pubblicazione: (2026)
di: Lu, Mingyu, et al.
Pubblicazione: (2026)
Single-Agent LLMs Outperform Multi-Agent Systems on Multi-Hop Reasoning Under Equal Thinking Token Budgets
di: Tran, Dat, et al.
Pubblicazione: (2026)
di: Tran, Dat, et al.
Pubblicazione: (2026)
OptiML: An End-to-End Framework for Program Synthesis and CUDA Kernel Optimization
di: Bhattacharjee, Arijit, et al.
Pubblicazione: (2026)
di: Bhattacharjee, Arijit, et al.
Pubblicazione: (2026)
Adaptive Graph Pruning for Multi-Agent Communication
di: Li, Boyi, et al.
Pubblicazione: (2025)
di: Li, Boyi, et al.
Pubblicazione: (2025)
Multi-User Large Language Model Agents
di: Yang, Shu, et al.
Pubblicazione: (2026)
di: Yang, Shu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
CudaForge: An Agent Framework with Hardware Feedback for CUDA Kernel Optimization
di: Zhang, Zijian, et al.
Pubblicazione: (2025) -
FilmAgent: A Multi-Agent Framework for End-to-End Film Automation in Virtual 3D Spaces
di: Xu, Zhenran, et al.
Pubblicazione: (2025) -
Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems
di: Yu, Ye, et al.
Pubblicazione: (2026) -
Agentic Automation of BT-RADS Scoring: End-to-End Multi-Agent System for Standardized Brain Tumor Follow-up Assessment
di: Jabal, Mohamed Sobhi, et al.
Pubblicazione: (2026) -
MLZero: A Multi-Agent System for End-to-end Machine Learning Automation
di: Fang, Haoyang, et al.
Pubblicazione: (2025)