Enregistré dans:
| Auteur principal: | Gürsun, Gonca |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2512.11421 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Trustworthy Legal AI through LLM Agents and Formal Reasoning
par: Chen, Linze, et autres
Publié: (2025)
par: Chen, Linze, et autres
Publié: (2025)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025)
par: Hu, Yuanzhe, et autres
Publié: (2025)
TrustAgent: Towards Safe and Trustworthy LLM-based Agents
par: Hua, Wenyue, et autres
Publié: (2024)
par: Hua, Wenyue, et autres
Publié: (2024)
EvoEmo: Towards Evolved Emotional Policies for Adversarial LLM Agents in Multi-Turn Price Negotiation
par: Long, Yunbo, et autres
Publié: (2025)
par: Long, Yunbo, et autres
Publié: (2025)
General Modular Harness for LLM Agents in Multi-Turn Gaming Environments
par: Zhang, Yuxuan, et autres
Publié: (2025)
par: Zhang, Yuxuan, et autres
Publié: (2025)
Evaluating Multi-Turn Bargain Skills in LLM-Based Seller Agent
par: Wang, Issue Yishu, et autres
Publié: (2025)
par: Wang, Issue Yishu, et autres
Publié: (2025)
Towards Trustworthy LLM-Based Recommendation via Rationale Integration
par: Park, Chung, et autres
Publié: (2025)
par: Park, Chung, et autres
Publié: (2025)
ProRL Agent: Rollout-as-a-Service for RL Training of Multi-Turn LLM Agents
par: Zhang, Hao, et autres
Publié: (2026)
par: Zhang, Hao, et autres
Publié: (2026)
Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents
par: Ye, Bowen, et autres
Publié: (2026)
par: Ye, Bowen, et autres
Publié: (2026)
Beyond the Strongest LLM: Multi-Turn Multi-Agent Orchestration vs. Single LLMs on Benchmarks
par: Tian, Aaron Xuxiang, et autres
Publié: (2025)
par: Tian, Aaron Xuxiang, et autres
Publié: (2025)
Evaluating LLM-based Agents for Multi-Turn Conversations: A Survey
par: Guan, Shengyue, et autres
Publié: (2025)
par: Guan, Shengyue, et autres
Publié: (2025)
RGD: Multi-LLM Based Agent Debugger via Refinement and Generation Guidance
par: Jin, Haolin, et autres
Publié: (2024)
par: Jin, Haolin, et autres
Publié: (2024)
Toward a Trustworthy Optimization Modeling Agent via Verifiable Synthetic Data Generation
par: Lima, Vinicius, et autres
Publié: (2025)
par: Lima, Vinicius, et autres
Publié: (2025)
RAGEN: Understanding Self-Evolution in LLM Agents via Multi-Turn Reinforcement Learning
par: Wang, Zihan, et autres
Publié: (2025)
par: Wang, Zihan, et autres
Publié: (2025)
Improving the Safety and Trustworthiness of Medical AI via Multi-Agent Evaluation Loops
par: Ghafoor, Zainab, et autres
Publié: (2026)
par: Ghafoor, Zainab, et autres
Publié: (2026)
Proximity-Based Multi-Turn Optimization: Practical Credit Assignment for LLM Agent Training
par: Fang, Yangyi, et autres
Publié: (2026)
par: Fang, Yangyi, et autres
Publié: (2026)
MEMO: Memory-Augmented Model Context Optimization for Robust Multi-Turn Multi-Agent LLM Games
par: Xie, Yunfei, et autres
Publié: (2026)
par: Xie, Yunfei, et autres
Publié: (2026)
MASteer: Multi-Agent Adaptive Steer Strategy for End-to-End LLM Trustworthiness Repair
par: Li, Changqing, et autres
Publié: (2025)
par: Li, Changqing, et autres
Publié: (2025)
From Helpful to Trustworthy: LLM Agents for Pair Programming
par: Ayon, Ragib Shahariar
Publié: (2026)
par: Ayon, Ragib Shahariar
Publié: (2026)
MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments
par: Yang, Xiao, et autres
Publié: (2025)
par: Yang, Xiao, et autres
Publié: (2025)
TSR: Trajectory-Search Rollouts for Multi-Turn RL of LLM Agents
par: Djuhera, Aladin, et autres
Publié: (2026)
par: Djuhera, Aladin, et autres
Publié: (2026)
Scaling up Multi-Turn Off-Policy RL and Multi-Agent Tree Search for LLM Step-Provers
par: Xin, Ran, et autres
Publié: (2025)
par: Xin, Ran, et autres
Publié: (2025)
Building Coding Agents via Entropy-Enhanced Multi-Turn Preference Optimization
par: Yu, Jiahao, et autres
Publié: (2025)
par: Yu, Jiahao, et autres
Publié: (2025)
Metacognitive Reuse: Turning Recurring LLM Reasoning Into Concise Behaviors
par: Didolkar, Aniket, et autres
Publié: (2025)
par: Didolkar, Aniket, et autres
Publié: (2025)
TrajAD: Trajectory Anomaly Detection for Trustworthy LLM Agents
par: Liu, Yibing, et autres
Publié: (2026)
par: Liu, Yibing, et autres
Publié: (2026)
Facilitating Trustworthy Human-Agent Collaboration in LLM-based Multi-Agent System oriented Software Engineering
par: Ronanki, Krishna
Publié: (2025)
par: Ronanki, Krishna
Publié: (2025)
Sentinel Agents for Secure and Trustworthy Agentic AI in Multi-Agent Systems
par: Gosmar, Diego, et autres
Publié: (2025)
par: Gosmar, Diego, et autres
Publié: (2025)
Adaptive Stopping for Multi-Turn LLM Reasoning
par: Zhou, Xiaofan, et autres
Publié: (2026)
par: Zhou, Xiaofan, et autres
Publié: (2026)
The Echo Chamber Multi-Turn LLM Jailbreak
par: Alobaid, Ahmad, et autres
Publié: (2026)
par: Alobaid, Ahmad, et autres
Publié: (2026)
Mitigating Conversational Inertia in Multi-Turn Agents
par: Wan, Yang, et autres
Publié: (2026)
par: Wan, Yang, et autres
Publié: (2026)
ECG-Agent: On-Device Tool-Calling Agent for ECG Multi-Turn Dialogue
par: Chung, Hyunseung, et autres
Publié: (2026)
par: Chung, Hyunseung, et autres
Publié: (2026)
Drift-Bench: Diagnosing Cooperative Breakdowns in LLM Agents under Input Faults via Multi-Turn Interaction
par: Bao, Han, et autres
Publié: (2026)
par: Bao, Han, et autres
Publié: (2026)
Protect: Towards Robust Guardrailing Stack for Trustworthy Enterprise LLM Systems
par: Avinash, Karthik, et autres
Publié: (2025)
par: Avinash, Karthik, et autres
Publié: (2025)
Toward Automated and Trustworthy Scientific Analysis and Visualization with LLM-Generated Code
par: Chakroborti, Apu Kumar, et autres
Publié: (2025)
par: Chakroborti, Apu Kumar, et autres
Publié: (2025)
AIVV: Neuro-Symbolic LLM Agent-Integrated Verification and Validation for Trustworthy Autonomous Systems
par: Kwon, Jiyong, et autres
Publié: (2026)
par: Kwon, Jiyong, et autres
Publié: (2026)
Co-Sight: Enhancing LLM-Based Agents via Conflict-Aware Meta-Verification and Trustworthy Reasoning with Structured Facts
par: Zhang, Hongwei, et autres
Publié: (2025)
par: Zhang, Hongwei, et autres
Publié: (2025)
Agent Drift: Quantifying Behavioral Degradation in Multi-Agent LLM Systems Over Extended Interactions
par: Rath, Abhishek
Publié: (2026)
par: Rath, Abhishek
Publié: (2026)
Trustworthy AI Psychotherapy: Multi-Agent LLM Workflow for Counseling and Explainable Mental Disorder Diagnosis
par: Ozgun, Mithat Can, et autres
Publié: (2025)
par: Ozgun, Mithat Can, et autres
Publié: (2025)
Automating Deception: Scalable Multi-Turn LLM Jailbreaks
par: Kumarappan, Adarsh, et autres
Publié: (2025)
par: Kumarappan, Adarsh, et autres
Publié: (2025)
Towards Mitigating Excessive Forgetting in LLM Unlearning via Entanglement-Guidance with Proxy Constraint
par: Liu, Zhihao, et autres
Publié: (2025)
par: Liu, Zhihao, et autres
Publié: (2025)
Documents similaires
-
Towards Trustworthy Legal AI through LLM Agents and Formal Reasoning
par: Chen, Linze, et autres
Publié: (2025) -
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025) -
TrustAgent: Towards Safe and Trustworthy LLM-based Agents
par: Hua, Wenyue, et autres
Publié: (2024) -
EvoEmo: Towards Evolved Emotional Policies for Adversarial LLM Agents in Multi-Turn Price Negotiation
par: Long, Yunbo, et autres
Publié: (2025) -
General Modular Harness for LLM Agents in Multi-Turn Gaming Environments
par: Zhang, Yuxuan, et autres
Publié: (2025)