Towards Rationality in Language and Multimodal Agents: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Bowen, Xie, Yangxinyu, Wang, Xiaomeng, Yuan, Yuan, Hao, Zhuoqun, Bai, Xinyi, Su, Weijie J., Taylor, Camillo J., Mallick, Tanwi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners
di: Jiang, Bowen, et al.
Pubblicazione: (2024)
di: Jiang, Bowen, et al.
Pubblicazione: (2024)
GeoGrid-Bench: Can Foundation Models Understand Multimodal Gridded Geo-Spatial Data?
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
Debiasing Watermarks for Large Language Models via Maximal Coupling
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024)
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024)
Multi-Agent VQA: Exploring Multi-Agent Foundation Models in Zero-Shot Visual Question Answering
di: Jiang, Bowen, et al.
Pubblicazione: (2024)
di: Jiang, Bowen, et al.
Pubblicazione: (2024)
Comparative Evaluation of Prompting and Fine-Tuning for Applying Large Language Models to Grid-Structured Geospatial Data
di: Dhruv, Akash, et al.
Pubblicazione: (2025)
di: Dhruv, Akash, et al.
Pubblicazione: (2025)
No Test Cases, No Problem: Distillation-Driven Code Generation for Scientific Workflows
di: Raghavan, Siddeshwar, et al.
Pubblicazione: (2026)
di: Raghavan, Siddeshwar, et al.
Pubblicazione: (2026)
Who Gets the Reward, Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents
di: Yang, Chih-Hsuan, et al.
Pubblicazione: (2025)
di: Yang, Chih-Hsuan, et al.
Pubblicazione: (2025)
SCORE: Specificity, Context Utilization, Robustness, and Relevance for Reference-Free LLM Evaluation
di: Shomee, Homaira Huda, et al.
Pubblicazione: (2026)
di: Shomee, Homaira Huda, et al.
Pubblicazione: (2026)
Multimodal Multi-Agent Empowered Legal Judgment Prediction
di: Kang, Zhaolu, et al.
Pubblicazione: (2026)
di: Kang, Zhaolu, et al.
Pubblicazione: (2026)
Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems
di: Yu, Ye, et al.
Pubblicazione: (2026)
di: Yu, Ye, et al.
Pubblicazione: (2026)
ControlText: Unlocking Controllable Fonts in Multilingual Text Rendering without Font Annotations
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
Epistemic Context Learning: Building Trust the Right Way in LLM-Based Multi-Agent Systems
di: Zhou, Ruiwen, et al.
Pubblicazione: (2026)
di: Zhou, Ruiwen, et al.
Pubblicazione: (2026)
AI Agent for Education: von Neumann Multi-Agent System Framework
di: Jiang, Yuan-Hao, et al.
Pubblicazione: (2024)
di: Jiang, Yuan-Hao, et al.
Pubblicazione: (2024)
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
di: Sun, Haochen, et al.
Pubblicazione: (2025)
di: Sun, Haochen, et al.
Pubblicazione: (2025)
A RAG-Based Multi-Agent LLM System for Natural Hazard Resilience and Adaptation
di: Xie, Yangxinyu, et al.
Pubblicazione: (2025)
di: Xie, Yangxinyu, et al.
Pubblicazione: (2025)
AgentDisCo: Towards Disentanglement and Collaboration in Open-ended Deep Research Agents
di: Jin, Jiarui, et al.
Pubblicazione: (2026)
di: Jin, Jiarui, et al.
Pubblicazione: (2026)
Towards Reliable Fetal Ultrasound Interpretation with Multi-Agent Collaboration
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
di: Hu, Xiaotian, et al.
Pubblicazione: (2026)
Multi-User Large Language Model Agents
di: Yang, Shu, et al.
Pubblicazione: (2026)
di: Yang, Shu, et al.
Pubblicazione: (2026)
RoadMapper: A Multi-Agent System for Roadmap Generation of Solving Complex Research Problems
di: Liu, Jiacheng, et al.
Pubblicazione: (2026)
di: Liu, Jiacheng, et al.
Pubblicazione: (2026)
A Survey on Trustworthy LLM Agents: Threats and Countermeasures
di: Yu, Miao, et al.
Pubblicazione: (2025)
di: Yu, Miao, et al.
Pubblicazione: (2025)
How Real Is AI Tutoring? Comparing Simulated and Human Dialogues in One-on-One Instruction
di: Li, Ruijia, et al.
Pubblicazione: (2025)
di: Li, Ruijia, et al.
Pubblicazione: (2025)
Emergent Language: A Survey and Taxonomy
di: Peters, Jannik, et al.
Pubblicazione: (2024)
di: Peters, Jannik, et al.
Pubblicazione: (2024)
Agents that Matter: Optimizing Multi-Agent LLMs via Removal-Based Attribution
di: Lu, Mingyu, et al.
Pubblicazione: (2026)
di: Lu, Mingyu, et al.
Pubblicazione: (2026)
MAxPrototyper: A Multi-Agent Generation System for Interactive User Interface Prototyping
di: Yuan, Mingyue, et al.
Pubblicazione: (2024)
di: Yuan, Mingyue, et al.
Pubblicazione: (2024)
DeepMEL: A Multi-Agent Collaboration Framework for Multimodal Entity Linking
di: Wang, Fang, et al.
Pubblicazione: (2025)
di: Wang, Fang, et al.
Pubblicazione: (2025)
AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
di: Qiu, Yilun, et al.
Pubblicazione: (2026)
Large Language Model based Multi-Agents: A Survey of Progress and Challenges
di: Guo, Taicheng, et al.
Pubblicazione: (2024)
di: Guo, Taicheng, et al.
Pubblicazione: (2024)
X-MAS: Towards Building Multi-Agent Systems with Heterogeneous LLMs
di: Ye, Rui, et al.
Pubblicazione: (2025)
di: Ye, Rui, et al.
Pubblicazione: (2025)
QUACK: Questioning, Understanding, and Auditing Communicated Knowledge in Multimodal Social Deduction Agents
di: Yuan, Ye, et al.
Pubblicazione: (2026)
di: Yuan, Ye, et al.
Pubblicazione: (2026)
Towards Self-Improving Error Diagnosis in Multi-Agent Systems
di: Li, Jiazheng, et al.
Pubblicazione: (2026)
di: Li, Jiazheng, et al.
Pubblicazione: (2026)
CompeteAI: Understanding the Competition Dynamics in Large Language Model-based Agents
di: Zhao, Qinlin, et al.
Pubblicazione: (2023)
di: Zhao, Qinlin, et al.
Pubblicazione: (2023)
Rational Capability in Concurrent Games
di: Li, Yinfeng, et al.
Pubblicazione: (2025)
di: Li, Yinfeng, et al.
Pubblicazione: (2025)
Agent Primitives: Reusable Latent Building Blocks for Multi-Agent Systems
di: Jin, Haibo, et al.
Pubblicazione: (2026)
di: Jin, Haibo, et al.
Pubblicazione: (2026)
Beyond Self-Talk: A Communication-Centric Survey of LLM-Based Multi-Agent Systems
di: Yan, Bingyu, et al.
Pubblicazione: (2025)
di: Yan, Bingyu, et al.
Pubblicazione: (2025)
A Survey on LLM-based Multi-Agent System: Recent Advances and New Frontiers in Application
di: Chen, Shuaihang, et al.
Pubblicazione: (2024)
di: Chen, Shuaihang, et al.
Pubblicazione: (2024)
Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
PlotEdit: Natural Language-Driven Accessible Chart Editing in PDFs via Multimodal LLM Agents
di: Goswami, Kanika, et al.
Pubblicazione: (2025)
di: Goswami, Kanika, et al.
Pubblicazione: (2025)
Multimodal Safety Evaluation in Generative Agent Social Simulations
di: Vera, Alhim, et al.
Pubblicazione: (2025)
di: Vera, Alhim, et al.
Pubblicazione: (2025)
A Computable Game-Theoretic Framework for Multi-Agent Theory of Mind
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
di: Zhu, Fengming, et al.
Pubblicazione: (2025)
What Makes Good Collaborative Views? Contrastive Mutual Information Maximization for Multi-Agent Perception
di: Su, Wanfang, et al.
Pubblicazione: (2024)
di: Su, Wanfang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners
di: Jiang, Bowen, et al.
Pubblicazione: (2024) -
GeoGrid-Bench: Can Foundation Models Understand Multimodal Gridded Geo-Spatial Data?
di: Jiang, Bowen, et al.
Pubblicazione: (2025) -
Debiasing Watermarks for Large Language Models via Maximal Coupling
di: Xie, Yangxinyu, et al.
Pubblicazione: (2024) -
Multi-Agent VQA: Exploring Multi-Agent Foundation Models in Zero-Shot Visual Question Answering
di: Jiang, Bowen, et al.
Pubblicazione: (2024) -
Comparative Evaluation of Prompting and Fine-Tuning for Applying Large Language Models to Grid-Structured Geospatial Data
di: Dhruv, Akash, et al.
Pubblicazione: (2025)