Comparative Analysis of AI Agent Architectures for Entity Relationship Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Berijanian, Maryam, Singh, Kuldeep, Sehati, Amin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
How to Evaluate Medical AI
par: Kopanichuk, Ilia, et autres
Publié: (2025)
par: Kopanichuk, Ilia, et autres
Publié: (2025)
Comparing the Performance of LLMs in RAG-based Question-Answering: A Case Study in Computer Science Literature
par: Dayarathne, Ranul, et autres
Publié: (2025)
par: Dayarathne, Ranul, et autres
Publié: (2025)
OEMA: Ontology-Enhanced Multi-Agent Collaboration Framework for Zero-Shot Clinical Named Entity Recognition
par: Tao, Xinli, et autres
Publié: (2025)
par: Tao, Xinli, et autres
Publié: (2025)
AskSport: Web Application for Sports Question-Answering
par: Onofre, Enzo B, et autres
Publié: (2025)
par: Onofre, Enzo B, et autres
Publié: (2025)
Towards Safer Chatbots: Automated Policy Compliance Evaluation of Custom GPTs
par: Rodriguez, David, et autres
Publié: (2025)
par: Rodriguez, David, et autres
Publié: (2025)
ReTreVal: Reasoning Tree with Validation -- A Hybrid Framework for Enhanced LLM Multi-Step Reasoning
par: HS, Abhishek, et autres
Publié: (2026)
par: HS, Abhishek, et autres
Publié: (2026)
Challenges and Opportunities of NLP for HR Applications: A Discussion Paper
par: Leidner, Jochen L., et autres
Publié: (2024)
par: Leidner, Jochen L., et autres
Publié: (2024)
Evaluating Large Language Models on Historical Health Crisis Knowledge in Resource-Limited Settings: A Hybrid Multi-Metric Study
par: Hasan, Mohammed Rakibul
Publié: (2026)
par: Hasan, Mohammed Rakibul
Publié: (2026)
AI-Powered Detection of Inappropriate Language in Medical School Curricula
par: Salavati, Chiman, et autres
Publié: (2025)
par: Salavati, Chiman, et autres
Publié: (2025)
BLT: Can Large Language Models Handle Basic Legal Text?
par: Blair-Stanek, Andrew, et autres
Publié: (2023)
par: Blair-Stanek, Andrew, et autres
Publié: (2023)
Social and Ethical Risks Posed by General-Purpose LLMs for Settling Newcomers in Canada
par: Nejadgholi, Isar, et autres
Publié: (2024)
par: Nejadgholi, Isar, et autres
Publié: (2024)
Towards Conditioning Clinical Text Generation for User Control
par: Koraş, Osman Alperen, et autres
Publié: (2025)
par: Koraş, Osman Alperen, et autres
Publié: (2025)
Exploring the Structure of AI-Induced Language Change in Scientific English
par: Galpin, Riley, et autres
Publié: (2025)
par: Galpin, Riley, et autres
Publié: (2025)
EvoIdeator: Evolving Scientific Ideas through Checklist-Grounded Reinforcement Learning
par: Sauter, Andreas, et autres
Publié: (2026)
par: Sauter, Andreas, et autres
Publié: (2026)
Project Riley: Multimodal Multi-Agent LLM Collaboration with Emotional Reasoning and Voting
par: Ortigoso, Ana Rita, et autres
Publié: (2025)
par: Ortigoso, Ana Rita, et autres
Publié: (2025)
Scaling In, Not Up? Testing Thick Citation Context Analysis with GPT-5 and Fragile Prompts
par: Simons, Arno
Publié: (2026)
par: Simons, Arno
Publié: (2026)
Lossless Prompt Compression via Dictionary-Encoding and In-Context Learning: Enabling Cost-Effective LLM Analysis of Repetitive Data
par: de Campos, Andresa Rodrigues, et autres
Publié: (2026)
par: de Campos, Andresa Rodrigues, et autres
Publié: (2026)
From Instructor to Collaborator: What a 90-Participant Study Reveals about Human-Agent Collaboration in a Mobile Serious Game
par: Korre, Danai
Publié: (2026)
par: Korre, Danai
Publié: (2026)
A Llama walks into the 'Bar': Efficient Supervised Fine-Tuning for Legal Reasoning in the Multi-state Bar Exam
par: Fernandes, Rean, et autres
Publié: (2025)
par: Fernandes, Rean, et autres
Publié: (2025)
Teaching a Language Model to Speak the Language of Tools
par: Emanuilov, Simeon
Publié: (2025)
par: Emanuilov, Simeon
Publié: (2025)
Mitigating Structural Noise in Low-Resource S2TT: An Optimized Cascaded Nepali-English Pipeline with Punctuation Restoration
par: Chongbang, Tangsang, et autres
Publié: (2026)
par: Chongbang, Tangsang, et autres
Publié: (2026)
VERITAS-NLI : Validation and Extraction of Reliable Information Through Automated Scraping and Natural Language Inference
par: Shah, Arjun, et autres
Publié: (2024)
par: Shah, Arjun, et autres
Publié: (2024)
LLMs Simulate Big Five Personality Traits: Further Evidence
par: Sorokovikova, Aleksandra, et autres
Publié: (2024)
par: Sorokovikova, Aleksandra, et autres
Publié: (2024)
Deciphering Digital Detectives: Understanding LLM Behaviors and Capabilities in Multi-Agent Mystery Games
par: Wu, Dekun, et autres
Publié: (2023)
par: Wu, Dekun, et autres
Publié: (2023)
Introducing Brain-like Concepts to Embodied Hand-crafted Dialog Management System
par: Joublin, Frank, et autres
Publié: (2024)
par: Joublin, Frank, et autres
Publié: (2024)
Navigating WebAI: Training Agents to Complete Web Tasks with Large Language Models and Reinforcement Learning
par: Thil, Lucas-Andreï, et autres
Publié: (2024)
par: Thil, Lucas-Andreï, et autres
Publié: (2024)
CVE-Bench: A Benchmark for AI Agents' Ability to Exploit Real-World Web Application Vulnerabilities
par: Zhu, Yuxuan, et autres
Publié: (2025)
par: Zhu, Yuxuan, et autres
Publié: (2025)
The Need for Guardrails with Large Language Models in Medical Safety-Critical Settings: An Artificial Intelligence Application in the Pharmacovigilance Ecosystem
par: Hakim, Joe B, et autres
Publié: (2024)
par: Hakim, Joe B, et autres
Publié: (2024)
Multi-Hierarchical Feature Detection for Large Language Model Generated Text
par: Zhang, Luyan, et autres
Publié: (2025)
par: Zhang, Luyan, et autres
Publié: (2025)
Meta-Evaluation of Translation Evaluation Methods: a systematic up-to-date overview
par: Han, Lifeng, et autres
Publié: (2016)
par: Han, Lifeng, et autres
Publié: (2016)
HalluScan: A Systematic Benchmark for Detecting and Mitigating Hallucinations in Instruction-Following LLMs
par: Cherif, Ahmed
Publié: (2026)
par: Cherif, Ahmed
Publié: (2026)
An Industrial-Scale Insurance LLM Achieving Verifiable Domain Mastery and Hallucination Control without Competence Trade-offs
par: Zhu, Qian, et autres
Publié: (2026)
par: Zhu, Qian, et autres
Publié: (2026)
Scaling Laws for State Dynamics in Large Language Models
par: Li, Jacob X, et autres
Publié: (2025)
par: Li, Jacob X, et autres
Publié: (2025)
AutoTRIZ: Automating Engineering Innovation with TRIZ and Large Language Models
par: Jiang, Shuo, et autres
Publié: (2024)
par: Jiang, Shuo, et autres
Publié: (2024)
The Impact of Generative Artificial Intelligence on Ideation and the performance of Innovation Teams (Preprint)
par: Gindert, Michael, et autres
Publié: (2024)
par: Gindert, Michael, et autres
Publié: (2024)
From RAG to QA-RAG: Integrating Generative AI for Pharmaceutical Regulatory Compliance Process
par: Kim, Jaewoong, et autres
Publié: (2024)
par: Kim, Jaewoong, et autres
Publié: (2024)
PestMA: LLM-based Multi-Agent System for Informed Pest Management
par: Shi, Hongrui, et autres
Publié: (2025)
par: Shi, Hongrui, et autres
Publié: (2025)
Open-TI: Open Traffic Intelligence with Augmented Language Model
par: Da, Longchao, et autres
Publié: (2023)
par: Da, Longchao, et autres
Publié: (2023)
Automating the Deep Space Network Data Systems; A Case Study in Adaptive Anomaly Detection through Agentic AI
par: Chou, Evan J., et autres
Publié: (2025)
par: Chou, Evan J., et autres
Publié: (2025)
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
par: Hashemi, Helia, et autres
Publié: (2024)
par: Hashemi, Helia, et autres
Publié: (2024)
Documents similaires
-
How to Evaluate Medical AI
par: Kopanichuk, Ilia, et autres
Publié: (2025) -
Comparing the Performance of LLMs in RAG-based Question-Answering: A Case Study in Computer Science Literature
par: Dayarathne, Ranul, et autres
Publié: (2025) -
OEMA: Ontology-Enhanced Multi-Agent Collaboration Framework for Zero-Shot Clinical Named Entity Recognition
par: Tao, Xinli, et autres
Publié: (2025) -
AskSport: Web Application for Sports Question-Answering
par: Onofre, Enzo B, et autres
Publié: (2025) -
Towards Safer Chatbots: Automated Policy Compliance Evaluation of Custom GPTs
par: Rodriguez, David, et autres
Publié: (2025)