Lumos: Let there be Language Model System Certification
Fuente:
arXiv
Saved in:
| Main Authors: | Chaudhary, Isha, Jain, Vedaant, Parhar, Prineet, Sachdeva, Kavya, Singh, Avaljot, Ranu, Sayan, Singh, Gagandeep |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Revealing Interpretable Failure Modes of VLMs
by: Chaudhary, Isha, et al.
Published: (2026)
by: Chaudhary, Isha, et al.
Published: (2026)
Certifying Knowledge Comprehension in LLMs
by: Chaudhary, Isha, et al.
Published: (2024)
by: Chaudhary, Isha, et al.
Published: (2024)
In-Context Environments Induce Evaluation-Awareness in Language Models
by: Chaudhary, Maheep
Published: (2026)
by: Chaudhary, Maheep
Published: (2026)
LLM-Guided Strategy Synthesis for Scalable Equality Saturation
by: Yin, Chenyun, et al.
Published: (2026)
by: Yin, Chenyun, et al.
Published: (2026)
SMoA: Improving Multi-agent Large Language Models with Sparse Mixture-of-Agents
by: Li, Dawei, et al.
Published: (2024)
by: Li, Dawei, et al.
Published: (2024)
TwoStep: Multi-agent Task Planning using Classical Planners and Large Language Models
by: Bai, David, et al.
Published: (2024)
by: Bai, David, et al.
Published: (2024)
Grammar Search for Multi-Agent Systems
by: Singh, Mayank, et al.
Published: (2025)
by: Singh, Mayank, et al.
Published: (2025)
Theory of Mind in Action: The Instruction Inference Task in Dynamic Human-Agent Collaboration
by: Saad, Fardin, et al.
Published: (2025)
by: Saad, Fardin, et al.
Published: (2025)
Gricean Norms as a Basis for Effective Collaboration
by: Saad, Fardin, et al.
Published: (2025)
by: Saad, Fardin, et al.
Published: (2025)
Language Modeling by Language Models
by: Cheng, Junyan, et al.
Published: (2025)
by: Cheng, Junyan, et al.
Published: (2025)
Can Proof Assistants Verify Multi-Agent Systems?
by: Mendez, Julian Alfredo, et al.
Published: (2025)
by: Mendez, Julian Alfredo, et al.
Published: (2025)
Towards Ethical Multi-Agent Systems of Large Language Models: A Mechanistic Interpretability Perspective
by: Lee, Jae Hee, et al.
Published: (2025)
by: Lee, Jae Hee, et al.
Published: (2025)
Layered Chain-of-Thought Prompting for Multi-Agent LLM Systems: A Comprehensive Approach to Explainable Large Language Models
by: Sanwal, Manish
Published: (2025)
by: Sanwal, Manish
Published: (2025)
Modeling Layered Consciousness with Multi-Agent Large Language Models
by: Kim, Sang Hun, et al.
Published: (2025)
by: Kim, Sang Hun, et al.
Published: (2025)
Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems
by: Yu, Ye, et al.
Published: (2026)
by: Yu, Ye, et al.
Published: (2026)
Quantitative Certification of Agentic Tool Selection
by: Yeon, Jehyeok, et al.
Published: (2025)
by: Yeon, Jehyeok, et al.
Published: (2025)
Building and Measuring Trust between Large Language Models
by: Buyl, Maarten, et al.
Published: (2025)
by: Buyl, Maarten, et al.
Published: (2025)
Specification Generation for Neural Networks in Systems
by: Chaudhary, Isha, et al.
Published: (2024)
by: Chaudhary, Isha, et al.
Published: (2024)
Multi-Agent Language Models: Advancing Cooperation, Coordination, and Adaptation
by: Sudhakar, Arjun Vaithilingam
Published: (2025)
by: Sudhakar, Arjun Vaithilingam
Published: (2025)
AFSPP: Agent Framework for Shaping Preference and Personality with Large Language Models
by: He, Zihong, et al.
Published: (2024)
by: He, Zihong, et al.
Published: (2024)
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
by: Sun, Haochen, et al.
Published: (2025)
by: Sun, Haochen, et al.
Published: (2025)
CulturePark: Boosting Cross-cultural Understanding in Large Language Models
by: Li, Cheng, et al.
Published: (2024)
by: Li, Cheng, et al.
Published: (2024)
LLM-as-RNN: A Recurrent Language Model for Memory Updates and Sequence Prediction
by: Lu, Yuxing, et al.
Published: (2026)
by: Lu, Yuxing, et al.
Published: (2026)
Leveraging Unstructured Text Data for Federated Instruction Tuning of Large Language Models
by: Ye, Rui, et al.
Published: (2024)
by: Ye, Rui, et al.
Published: (2024)
DebUnc: Improving Large Language Model Agent Communication With Uncertainty Metrics
by: Yoffe, Luke, et al.
Published: (2024)
by: Yoffe, Luke, et al.
Published: (2024)
Large Language Model based Multi-Agents: A Survey of Progress and Challenges
by: Guo, Taicheng, et al.
Published: (2024)
by: Guo, Taicheng, et al.
Published: (2024)
The Geometry of Dialogue: Graphing Language Models to Reveal Synergistic Teams for Multi-Agent Collaboration
by: Furuya, Kotaro, et al.
Published: (2025)
by: Furuya, Kotaro, et al.
Published: (2025)
Social Reasoning in Machines: Investigating Collective Truth-Seeking Dynamics in Large Language Model Debate
by: Pecher, Tom
Published: (2026)
by: Pecher, Tom
Published: (2026)
Agent-Centric Projection of Prompting Techniques and Implications for Synthetic Training Data for Large Language Models
by: Dhamani, Dhruv, et al.
Published: (2025)
by: Dhamani, Dhruv, et al.
Published: (2025)
MentalArena: Self-play Training of Language Models for Diagnosis and Treatment of Mental Health Disorders
by: Li, Cheng, et al.
Published: (2024)
by: Li, Cheng, et al.
Published: (2024)
Why Solving Multi-agent Path Finding with Large Language Model has not Succeeded Yet
by: Chen, Weizhe, et al.
Published: (2024)
by: Chen, Weizhe, et al.
Published: (2024)
MultiAgent Collaboration Attack: Investigating Adversarial Attacks in Large Language Model Collaborations via Debate
by: Amayuelas, Alfonso, et al.
Published: (2024)
by: Amayuelas, Alfonso, et al.
Published: (2024)
SCALE: Towards Collaborative Content Analysis in Social Science with Large Language Model Agents and Human Intervention
by: Zhao, Chengshuai, et al.
Published: (2025)
by: Zhao, Chengshuai, et al.
Published: (2025)
Finding Common Ground: Using Large Language Models to Detect Agreement in Multi-Agent Decision Conferences
by: Heller, Selina, et al.
Published: (2025)
by: Heller, Selina, et al.
Published: (2025)
GraphTeam: Facilitating Large Language Model-based Graph Analysis via Multi-Agent Collaboration
by: Li, Xin, et al.
Published: (2024)
by: Li, Xin, et al.
Published: (2024)
Enhancing Multi-Agent Consensus through Third-Party LLM Integration: Analyzing Uncertainty and Mitigating Hallucinations in Large Language Models
by: Duan, Zhihua, et al.
Published: (2024)
by: Duan, Zhihua, et al.
Published: (2024)
Iterative Graph Alignment
by: Yu, Fangyuan, et al.
Published: (2024)
by: Yu, Fangyuan, et al.
Published: (2024)
A Comprehensive Survey of Self-Evolving AI Agents: A New Paradigm Bridging Foundation Models and Lifelong Agentic Systems
by: Fang, Jinyuan, et al.
Published: (2025)
by: Fang, Jinyuan, et al.
Published: (2025)
Investigating the Potential of Large Language Model-Based Router Multi-Agent Architectures for Foundation Design Automation: A Task Classification and Expert Selection Study
by: Youwai, Sompote, et al.
Published: (2025)
by: Youwai, Sompote, et al.
Published: (2025)
CONSCIENTIA: Can LLM Agents Learn to Strategize? Emergent Deception and Trust in a Multi-Agent NYC Simulation
by: Sinha, Aarush, et al.
Published: (2026)
by: Sinha, Aarush, et al.
Published: (2026)
Similar Items
-
Revealing Interpretable Failure Modes of VLMs
by: Chaudhary, Isha, et al.
Published: (2026) -
Certifying Knowledge Comprehension in LLMs
by: Chaudhary, Isha, et al.
Published: (2024) -
In-Context Environments Induce Evaluation-Awareness in Language Models
by: Chaudhary, Maheep
Published: (2026) -
LLM-Guided Strategy Synthesis for Scalable Equality Saturation
by: Yin, Chenyun, et al.
Published: (2026) -
SMoA: Improving Multi-agent Large Language Models with Sparse Mixture-of-Agents
by: Li, Dawei, et al.
Published: (2024)