Enregistré dans:
| Auteurs principaux: | Yang, Wei, Li, Shixuan, Ping, Heng, Zhang, Peiyu, Bogdan, Paul, Thomason, Jesse |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.09341 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VeriMoA: A Mixture-of-Agents Framework for Spec-to-HDL Generation
par: Ping, Heng, et autres
Publié: (2025)
par: Ping, Heng, et autres
Publié: (2025)
Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
par: Yang, Wei, et autres
Publié: (2025)
par: Yang, Wei, et autres
Publié: (2025)
COEVO: Co-Evolutionary Framework for Joint Functional Correctness and PPA Optimization in LLM-Based RTL Generation
par: Ping, Heng, et autres
Publié: (2026)
par: Ping, Heng, et autres
Publié: (2026)
POET: Power-Oriented Evolutionary Tuning for LLM-Based RTL PPA Optimization
par: Ping, Heng, et autres
Publié: (2026)
par: Ping, Heng, et autres
Publié: (2026)
HDLCoRe: A Training-Free Framework for Mitigating Hallucinations in LLM-Generated HDL
par: Ping, Heng, et autres
Publié: (2025)
par: Ping, Heng, et autres
Publié: (2025)
ClimateLLM: Efficient Weather Forecasting via Frequency-Aware Large Language Models
par: Li, Shixuan, et autres
Publié: (2025)
par: Li, Shixuan, et autres
Publié: (2025)
Learning to Deliberate: Meta-policy Collaboration for Agentic LLMs with Multi-agent Reinforcement Learning
par: Yang, Wei, et autres
Publié: (2025)
par: Yang, Wei, et autres
Publié: (2025)
Expert Personas Improve LLM Alignment but Damage Accuracy: Bootstrapping Intent-Based Persona Routing with PRISM
par: Hu, Zizhao, et autres
Publié: (2026)
par: Hu, Zizhao, et autres
Publié: (2026)
Why Do Some Inputs Break Low-Bit LLM Quantization?
par: Chang, Ting-Yun, et autres
Publié: (2025)
par: Chang, Ting-Yun, et autres
Publié: (2025)
EMS: Multi-Agent Voting via Efficient Majority-then-Stopping
par: Liu, Yiqing, et autres
Publié: (2026)
par: Liu, Yiqing, et autres
Publié: (2026)
Counterfactual Trace Auditing of LLM Agent Skills
par: Zhou, Xiaolin, et autres
Publié: (2026)
par: Zhou, Xiaolin, et autres
Publié: (2026)
Bias in the Loop: Auditing LLM-as-a-Judge for Software Engineering
par: Zhao, Zixiao, et autres
Publié: (2026)
par: Zhao, Zixiao, et autres
Publié: (2026)
Multi-modal Synthetic Data Training and Model Collapse: Insights from VLMs and Diffusion Models
par: Hu, Zizhao, et autres
Publié: (2025)
par: Hu, Zizhao, et autres
Publié: (2025)
Multi-Agent Debate for LLM Judges with Adaptive Stability Detection
par: Hu, Tianyu, et autres
Publié: (2025)
par: Hu, Tianyu, et autres
Publié: (2025)
CollabEval: Enhancing LLM-as-a-Judge via Multi-Agent Collaboration
par: Qian, Yiyue, et autres
Publié: (2026)
par: Qian, Yiyue, et autres
Publié: (2026)
Towards Security-Auditable LLM Agents: A Unified Graph Representation
par: Li, Chaofan, et autres
Publié: (2026)
par: Li, Chaofan, et autres
Publié: (2026)
SFT-then-RL Outperforms Mixed-Policy Methods for LLM Reasoning
par: Limozin, Alexis, et autres
Publié: (2026)
par: Limozin, Alexis, et autres
Publié: (2026)
M3PT: A Transformer for Multimodal, Multi-Party Social Signal Prediction with Person-aware Blockwise Attention
par: Tang, Yiming, et autres
Publié: (2025)
par: Tang, Yiming, et autres
Publié: (2025)
Vote-Tree-Planner: Optimizing Execution Order in LLM-based Task Planning Pipeline via Voting
par: Zhang, Chaoyuan, et autres
Publié: (2025)
par: Zhang, Chaoyuan, et autres
Publié: (2025)
Project Riley: Multimodal Multi-Agent LLM Collaboration with Emotional Reasoning and Voting
par: Ortigoso, Ana Rita, et autres
Publié: (2025)
par: Ortigoso, Ana Rita, et autres
Publié: (2025)
Improving LLM Reasoning with Multi-Agent Tree-of-Thought Validator Agent
par: Haji, Fatemeh, et autres
Publié: (2024)
par: Haji, Fatemeh, et autres
Publié: (2024)
Audit-LLM: Multi-Agent Collaboration for Log-based Insider Threat Detection
par: Song, Chengyu, et autres
Publié: (2024)
par: Song, Chengyu, et autres
Publié: (2024)
Neuron-based Multifractal Analysis of Neuron Interaction Dynamics in Large Models
par: Xiao, Xiongye, et autres
Publié: (2024)
par: Xiao, Xiongye, et autres
Publié: (2024)
Auto-Prompt Ensemble for LLM Judge
par: Li, Jiajie, et autres
Publié: (2025)
par: Li, Jiajie, et autres
Publié: (2025)
Adjust for Trust: Mitigating Trust-Induced Inappropriate Reliance on AI Assistance
par: Srinivasan, Tejas, et autres
Publié: (2025)
par: Srinivasan, Tejas, et autres
Publié: (2025)
Leveraging LLMs as Meta-Judges: A Multi-Agent Framework for Evaluating LLM Judgments
par: Li, Yuran, et autres
Publié: (2025)
par: Li, Yuran, et autres
Publié: (2025)
Scalable and Accurate Graph Reasoning with LLM-based Multi-Agents
par: Hu, Yuwei, et autres
Publié: (2024)
par: Hu, Yuwei, et autres
Publié: (2024)
Thought Branches: Interpreting LLM Reasoning Requires Resampling
par: Macar, Uzay, et autres
Publié: (2025)
par: Macar, Uzay, et autres
Publié: (2025)
Thought Anchors: Which LLM Reasoning Steps Matter?
par: Bogdan, Paul C., et autres
Publié: (2025)
par: Bogdan, Paul C., et autres
Publié: (2025)
Drop the Hierarchy and Roles: How Self-Organizing LLM Agents Outperform Designed Structures
par: Dochkina, Victoria
Publié: (2026)
par: Dochkina, Victoria
Publié: (2026)
Agent Audit: A Security Analysis System for LLM Agent Applications
par: Zhang, Haiyue, et autres
Publié: (2026)
par: Zhang, Haiyue, et autres
Publié: (2026)
LLM-Based SQL Generation: Prompting, Self-Refinement, and Adaptive Weighted Majority Voting
par: Yang, Yu-Jie, et autres
Publié: (2026)
par: Yang, Yu-Jie, et autres
Publié: (2026)
Evaluating Creativity and Deception in Large Language Models: A Simulation Framework for Multi-Agent Balderdash
par: Hejabi, Parsa, et autres
Publié: (2024)
par: Hejabi, Parsa, et autres
Publié: (2024)
Iterative Formalization and Planning in Partially Observable Environments
par: Gong, Liancheng, et autres
Publié: (2025)
par: Gong, Liancheng, et autres
Publié: (2025)
Ares: Adaptive Reasoning Effort Selection for Efficient LLM Agents
par: Yang, Jingbo, et autres
Publié: (2026)
par: Yang, Jingbo, et autres
Publié: (2026)
SAGE: Multi-Agent Self-Evolution for LLM Reasoning
par: Peng, Yulin, et autres
Publié: (2026)
par: Peng, Yulin, et autres
Publié: (2026)
Learning to Plan & Reason for Evaluation with Thinking-LLM-as-a-Judge
par: Saha, Swarnadeep, et autres
Publié: (2025)
par: Saha, Swarnadeep, et autres
Publié: (2025)
Time To Impeach LLM-as-a-Judge: Programs are the Future of Evaluation
par: Huang, Tzu-Heng, et autres
Publié: (2025)
par: Huang, Tzu-Heng, et autres
Publié: (2025)
Structured Personality Control and Adaptation for LLM Agents
par: Wang, Jinpeng, et autres
Publié: (2026)
par: Wang, Jinpeng, et autres
Publié: (2026)
PDDL-Mind: Large Language Models are Capable on Belief Reasoning with Reliable State Tracking
par: Zhu, Wang Bill, et autres
Publié: (2026)
par: Zhu, Wang Bill, et autres
Publié: (2026)
Documents similaires
-
VeriMoA: A Mixture-of-Agents Framework for Spec-to-HDL Generation
par: Ping, Heng, et autres
Publié: (2025) -
Maestro: Learning to Collaborate via Conditional Listwise Policy Optimization for Multi-Agent LLMs
par: Yang, Wei, et autres
Publié: (2025) -
COEVO: Co-Evolutionary Framework for Joint Functional Correctness and PPA Optimization in LLM-Based RTL Generation
par: Ping, Heng, et autres
Publié: (2026) -
POET: Power-Oriented Evolutionary Tuning for LLM-Based RTL PPA Optimization
par: Ping, Heng, et autres
Publié: (2026) -
HDLCoRe: A Training-Free Framework for Mitigating Hallucinations in LLM-Generated HDL
par: Ping, Heng, et autres
Publié: (2025)