Ensembling LLM-Induced Decision Trees for Explainable and Robust Error Detection
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Mengqi, Wang, Jianwei, Liu, Qing, Xu, Xiwei, Xing, Zhenchang, Zhu, Liming, Zhang, Wenjie |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
LLM-based HSE Compliance Assessment: Benchmark, Performance, and Advancements
by: Wang, Jianwei, et al.
Published: (2025)
by: Wang, Jianwei, et al.
Published: (2025)
PrivGemo: Privacy-Preserving Dual-Tower Graph Retrieval for Empowering LLM Reasoning with Memory Augmentation
by: Tan, Xingyu, et al.
Published: (2026)
by: Tan, Xingyu, et al.
Published: (2026)
A Reference Architecture for Designing Foundation Model based Systems
by: Lu, Qinghua, et al.
Published: (2023)
by: Lu, Qinghua, et al.
Published: (2023)
A Taxonomy of Foundation Model based Systems through the Lens of Software Architecture
by: Lu, Qinghua, et al.
Published: (2023)
by: Lu, Qinghua, et al.
Published: (2023)
HydraRAG: Structured Cross-Source Enhanced Large Language Model Reasoning
by: Tan, Xingyu, et al.
Published: (2025)
by: Tan, Xingyu, et al.
Published: (2025)
MemoTime: Memory-Augmented Temporal Knowledge Graph Enhanced Large Language Model Reasoning
by: Tan, Xingyu, et al.
Published: (2025)
by: Tan, Xingyu, et al.
Published: (2025)
A Layered Architecture for Developing and Enhancing Capabilities in Large Language Model-based Software Systems
by: Zhang, Dawen, et al.
Published: (2024)
by: Zhang, Dawen, et al.
Published: (2024)
PRoH: Dynamic Planning and Reasoning over Knowledge Hypergraphs for Retrieval-Augmented Generation
by: Zai, Xiangjun, et al.
Published: (2025)
by: Zai, Xiangjun, et al.
Published: (2025)
Paths-over-Graph: Knowledge Graph Empowered Large Language Model Reasoning
by: Tan, Xingyu, et al.
Published: (2024)
by: Tan, Xingyu, et al.
Published: (2024)
From Exploration to Revelation: Detecting Dark Patterns in Mobile Apps
by: Chen, Jieshan, et al.
Published: (2024)
by: Chen, Jieshan, et al.
Published: (2024)
Right to be Forgotten in the Era of Large Language Models: Implications, Challenges, and Solutions
by: Zhang, Dawen, et al.
Published: (2023)
by: Zhang, Dawen, et al.
Published: (2023)
HyperJoin: LLM-augmented Hypergraph Link Prediction for Joinable Table Discovery
by: Liu, Shiyuan, et al.
Published: (2026)
by: Liu, Shiyuan, et al.
Published: (2026)
Detecting Errors through Ensembling Prompts (DEEP): An End-to-End LLM Framework for Detecting Factual Errors
by: Chandler, Alex, et al.
Published: (2024)
by: Chandler, Alex, et al.
Published: (2024)
Explainable Synthetic Image Detection through Diffusion Timestep Ensembling
by: Wu, Yixin, et al.
Published: (2025)
by: Wu, Yixin, et al.
Published: (2025)
Unlocking Multi-Modal Potentials for Link Prediction on Dynamic Text-Attributed Graphs
by: Xu, Yuanyuan, et al.
Published: (2025)
by: Xu, Yuanyuan, et al.
Published: (2025)
DrunkAgent: Stealthy Memory Corruption in LLM-Powered Recommender Agents
by: Yang, Shiyi, et al.
Published: (2025)
by: Yang, Shiyi, et al.
Published: (2025)
GLIDER: Grading LLM Interactions and Decisions using Explainable Ranking
by: Deshpande, Darshan, et al.
Published: (2024)
by: Deshpande, Darshan, et al.
Published: (2024)
SAGE: Scalable Automated Robustness Augmentation for LLM Knowledge Evaluation
by: Li, Xiaoyuan, et al.
Published: (2026)
by: Li, Xiaoyuan, et al.
Published: (2026)
Deployability-Centric Infrastructure-as-Code Generation: Fail, Learn, Refine, and Succeed through LLM-Empowered DevOps Simulation
by: Zhang, Tianyi, et al.
Published: (2025)
by: Zhang, Tianyi, et al.
Published: (2025)
Retrieval-Augmented Review Generation for Poisoning Recommender Systems
by: Yang, Shiyi, et al.
Published: (2025)
by: Yang, Shiyi, et al.
Published: (2025)
Evaluating LLMs at Detecting Errors in LLM Responses
by: Kamoi, Ryo, et al.
Published: (2024)
by: Kamoi, Ryo, et al.
Published: (2024)
Robust or Suggestible? Exploring Non-Clinical Induction in LLM Drug-Safety Decisions
by: Liu, Siying, et al.
Published: (2025)
by: Liu, Siying, et al.
Published: (2025)
EnsemJudge: Enhancing Reliability in Chinese LLM-Generated Text Detection through Diverse Model Ensembles
by: Wang, Zhuoshang, et al.
Published: (2026)
by: Wang, Zhuoshang, et al.
Published: (2026)
SeeAction: Towards Reverse Engineering How-What-Where of HCI Actions from Screencasts for UI Automation
by: Zhao, Dehai, et al.
Published: (2025)
by: Zhao, Dehai, et al.
Published: (2025)
StyleDecipher: Robust and Explainable Detection of LLM-Generated Texts with Stylistic Analysis
by: Li, Siyuan, et al.
Published: (2025)
by: Li, Siyuan, et al.
Published: (2025)
Multi-Perspective Evidence Synthesis and Reasoning for Unsupervised Multimodal Entity Linking
by: Zhou, Mo, et al.
Published: (2026)
by: Zhou, Mo, et al.
Published: (2026)
A Taxonomy of Architecture Options for Foundation Model-based Agents: Analysis and Decision Model
by: Zhou, Jingwen, et al.
Published: (2024)
by: Zhou, Jingwen, et al.
Published: (2024)
EXCGEC: A Benchmark for Edit-Wise Explainable Chinese Grammatical Error Correction
by: Ye, Jingheng, et al.
Published: (2024)
by: Ye, Jingheng, et al.
Published: (2024)
Bridging the Gap between Different Vocabularies for LLM Ensemble
by: Xu, Yangyifan, et al.
Published: (2024)
by: Xu, Yangyifan, et al.
Published: (2024)
On the Hidden Costs of Counterfactual Knowledge Training in LLM Unlearning
by: Ye, Xiaotian, et al.
Published: (2026)
by: Ye, Xiaotian, et al.
Published: (2026)
ErrorLLM: Modeling SQL Errors for Text-to-SQL Refinement
by: Hong, Zijin, et al.
Published: (2026)
by: Hong, Zijin, et al.
Published: (2026)
LLM-GAN: Construct Generative Adversarial Network Through Large Language Models For Explainable Fake News Detection
by: Wang, Yifeng, et al.
Published: (2024)
by: Wang, Yifeng, et al.
Published: (2024)
Knowledge-Augmented Large Language Model Agents for Explainable Financial Decision-Making
by: Zhang, Qingyuan, et al.
Published: (2025)
by: Zhang, Qingyuan, et al.
Published: (2025)
Revealing and Mitigating the Challenge of Detecting Character Knowledge Errors in LLM Role-Playing
by: Zhang, Wenyuan, et al.
Published: (2024)
by: Zhang, Wenyuan, et al.
Published: (2024)
Open Problems and a Hypothetical Path Forward in LLM Knowledge Paradigms
by: Ye, Xiaotian, et al.
Published: (2025)
by: Ye, Xiaotian, et al.
Published: (2025)
Towards Explainable Multimodal Depression Recognition for Clinical Interviews
by: Zheng, Wenjie, et al.
Published: (2025)
by: Zheng, Wenjie, et al.
Published: (2025)
Prompt-Induced Linguistic Fingerprints for LLM-Generated Fake News Detection
by: Wang, Chi, et al.
Published: (2025)
by: Wang, Chi, et al.
Published: (2025)
Harnessing Consistency for Robust Test-Time LLM Ensemble
by: Zeng, Zhichen, et al.
Published: (2025)
by: Zeng, Zhichen, et al.
Published: (2025)
Recovering Policy-Induced Errors: Benchmarking and Trajectory Synthesis for Robust GUI Agents
by: Bu, Tianpeng, et al.
Published: (2026)
by: Bu, Tianpeng, et al.
Published: (2026)
LLM-Augmented Changepoint Detection: A Framework for Ensemble Detection and Automated Explanation
by: Lukassen, Fabian, et al.
Published: (2026)
by: Lukassen, Fabian, et al.
Published: (2026)
Similar Items
-
LLM-based HSE Compliance Assessment: Benchmark, Performance, and Advancements
by: Wang, Jianwei, et al.
Published: (2025) -
PrivGemo: Privacy-Preserving Dual-Tower Graph Retrieval for Empowering LLM Reasoning with Memory Augmentation
by: Tan, Xingyu, et al.
Published: (2026) -
A Reference Architecture for Designing Foundation Model based Systems
by: Lu, Qinghua, et al.
Published: (2023) -
A Taxonomy of Foundation Model based Systems through the Lens of Software Architecture
by: Lu, Qinghua, et al.
Published: (2023) -
HydraRAG: Structured Cross-Source Enhanced Large Language Model Reasoning
by: Tan, Xingyu, et al.
Published: (2025)