HiRAS: A Hierarchical Multi-Agent Framework for Paper-to-Code Generation and Execution
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hong, Hanhua, LI, Yizhi, Chen, Jiaoyan, Ananiadou, Sophia, Li, Xiaoli, Kim, Jung-jae, Lin, Chenghua |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Overview of the NLPCC 2025 Shared Task: Gender Bias Mitigation Challenge
par: Li, Yizhi, et autres
Publié: (2025)
par: Li, Yizhi, et autres
Publié: (2025)
RAS: Reflection-Augmented Scaling with In-Context Learning for Executable Cypher Query Generation
par: Jung, Minseok, et autres
Publié: (2026)
par: Jung, Minseok, et autres
Publié: (2026)
Beyond One-Size-Fits-All: Inversion Learning for Highly Effective NLG Evaluation Prompts
par: Hong, Hanhua, et autres
Publié: (2025)
par: Hong, Hanhua, et autres
Publié: (2025)
HiMATE: A Hierarchical Multi-Agent Framework for Machine Translation Evaluation
par: Zhang, Shijie, et autres
Publié: (2025)
par: Zhang, Shijie, et autres
Publié: (2025)
Disentangled VAD Representations via a Variational Framework for Political Stance Detection
par: Xu, Beiyu, et autres
Publié: (2025)
par: Xu, Beiyu, et autres
Publié: (2025)
CoinMath: Harnessing the Power of Coding Instruction for Math LLMs
par: Wei, Chengwei, et autres
Publié: (2024)
par: Wei, Chengwei, et autres
Publié: (2024)
Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models
par: Yu, Zeping, et autres
Publié: (2025)
par: Yu, Zeping, et autres
Publié: (2025)
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
par: Yu, Zeping, et autres
Publié: (2024)
par: Yu, Zeping, et autres
Publié: (2024)
Understanding Multimodal LLMs: the Mechanistic Interpretability of Llava in Visual Question Answering
par: Yu, Zeping, et autres
Publié: (2024)
par: Yu, Zeping, et autres
Publié: (2024)
Understanding and Mitigating Gender Bias in LLMs via Interpretable Neuron Editing
par: Yu, Zeping, et autres
Publié: (2025)
par: Yu, Zeping, et autres
Publié: (2025)
Locate-then-Merge: Neuron-Level Parameter Fusion for Mitigating Catastrophic Forgetting in Multimodal LLMs
par: Yu, Zeping, et autres
Publié: (2025)
par: Yu, Zeping, et autres
Publié: (2025)
HiKE: Hierarchical Evaluation Framework for Korean-English Code-Switching Speech Recognition
par: Paik, Gio, et autres
Publié: (2025)
par: Paik, Gio, et autres
Publié: (2025)
Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems
par: Wei, Chengwei, et autres
Publié: (2025)
par: Wei, Chengwei, et autres
Publié: (2025)
How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning
par: Yu, Zeping, et autres
Publié: (2024)
par: Yu, Zeping, et autres
Publié: (2024)
Neuron-Level Knowledge Attribution in Large Language Models
par: Yu, Zeping, et autres
Publié: (2023)
par: Yu, Zeping, et autres
Publié: (2023)
Overview of the NLPCC 2024 Shared Task on Chinese Metaphor Generation
par: Qu, Xingwei, et autres
Publié: (2024)
par: Qu, Xingwei, et autres
Publié: (2024)
HiRA: A Hierarchical Reasoning Framework for Decoupled Planning and Execution in Deep Search
par: Jin, Jiajie, et autres
Publié: (2025)
par: Jin, Jiajie, et autres
Publié: (2025)
Rumor Detection by Multi-task Suffix Learning based on Time-series Dual Sentiments
par: Liu, Zhiwei, et autres
Publié: (2025)
par: Liu, Zhiwei, et autres
Publié: (2025)
DITING: A Multi-Agent Evaluation Framework for Benchmarking Web Novel Translation
par: Zhang, Enze, et autres
Publié: (2025)
par: Zhang, Enze, et autres
Publié: (2025)
THCM-CAL: Temporal-Hierarchical Causal Modelling with Conformal Calibration for Clinical Risk Prediction
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
Factual consistency evaluation of summarization in the Era of large language models
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
The Lay Person's Guide to Biomedicine: Orchestrating Large Language Models
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
From n-gram to Attention: How Model Architectures Learn and Propagate Bias in Language Modeling
par: Kabir, Mohsinul, et autres
Publié: (2025)
par: Kabir, Mohsinul, et autres
Publié: (2025)
Revisiting Self-Play Preference Optimization: On the Role of Prompt Difficulty
par: Xiao, Yao, et autres
Publié: (2025)
par: Xiao, Yao, et autres
Publié: (2025)
HiMAP-Travel: Hierarchical Multi-Agent Planning for Long-Horizon Constrained Travel
par: Bui, The Viet, et autres
Publié: (2026)
par: Bui, The Viet, et autres
Publié: (2026)
NOMAD: A Multi-Agent LLM System for UML Class Diagram Generation from Natural Language Requirements
par: Giannouris, Polydoros, et autres
Publié: (2025)
par: Giannouris, Polydoros, et autres
Publié: (2025)
Break the Checkbox: Challenging Closed-Style Evaluations of Cultural Alignment in LLMs
par: Kabir, Mohsinul, et autres
Publié: (2025)
par: Kabir, Mohsinul, et autres
Publié: (2025)
HiCaM: A Hierarchical-Causal Modification Framework for Long-Form Text Modification
par: Shi, Yuntao, et autres
Publié: (2025)
par: Shi, Yuntao, et autres
Publié: (2025)
A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compression
par: Ren, Jincheng, et autres
Publié: (2026)
par: Ren, Jincheng, et autres
Publié: (2026)
Are Large Language Models True Healthcare Jacks-of-All-Trades? Benchmarking Across Health Professions Beyond Physician Exams
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
ConspEmoLLM-v2: A robust and stable model to detect sentiment-transformed conspiracy theories
par: Liu, Zhiwei, et autres
Publié: (2025)
par: Liu, Zhiwei, et autres
Publié: (2025)
Natural Language Generation
par: van Miltenburg, Emiel, et autres
Publié: (2025)
par: van Miltenburg, Emiel, et autres
Publié: (2025)
ReproHum #0087-01: Human Evaluation Reproduction Report for Generating Fact Checking Explanations
par: Loakman, Tyler, et autres
Publié: (2024)
par: Loakman, Tyler, et autres
Publié: (2024)
SynGraph: A Dynamic Graph-LLM Synthesis Framework for Sparse Streaming User Sentiment Modeling
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
Executing as You Generate: Hiding Execution Latency in LLM Code Generation
par: Sun, Zhensu, et autres
Publié: (2026)
par: Sun, Zhensu, et autres
Publié: (2026)
InfoDensity: Rewarding Information-Dense Traces for Efficient Reasoning
par: Wei, Chengwei, et autres
Publié: (2026)
par: Wei, Chengwei, et autres
Publié: (2026)
Decomposing and Revising What Language Models Generate
par: Yan, Zhichao, et autres
Publié: (2025)
par: Yan, Zhichao, et autres
Publié: (2025)
Document Reconstruction Unlocks Scalable Long-Context RLVR
par: Xiao, Yao, et autres
Publié: (2026)
par: Xiao, Yao, et autres
Publié: (2026)
MemAdapter: Fast Alignment across Agent Memory Paradigms via Generative Subgraph Retrieval
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
Code Execution as Grounded Supervision for LLM Reasoning
par: Jung, Dongwon, et autres
Publié: (2025)
par: Jung, Dongwon, et autres
Publié: (2025)
Documents similaires
-
Overview of the NLPCC 2025 Shared Task: Gender Bias Mitigation Challenge
par: Li, Yizhi, et autres
Publié: (2025) -
RAS: Reflection-Augmented Scaling with In-Context Learning for Executable Cypher Query Generation
par: Jung, Minseok, et autres
Publié: (2026) -
Beyond One-Size-Fits-All: Inversion Learning for Highly Effective NLG Evaluation Prompts
par: Hong, Hanhua, et autres
Publié: (2025) -
HiMATE: A Hierarchical Multi-Agent Framework for Machine Translation Evaluation
par: Zhang, Shijie, et autres
Publié: (2025) -
Disentangled VAD Representations via a Variational Framework for Political Stance Detection
par: Xu, Beiyu, et autres
Publié: (2025)