DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Cui, Wendi, Zhang, Jiaxin, Li, Zhuohang, Damien, Lopez, Das, Kamalika, Malin, Bradley, Kumar, Sricharan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025)
SAC3: Reliable Hallucination Detection in Black-Box Language Models via Semantic-aware Cross-check Consistency
di: Zhang, Jiaxin, et al.
Pubblicazione: (2023)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2023)
Synthetic Knowledge Ingestion: Towards Knowledge Refinement and Injection for Enhancing Large Language Models
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024)
SEE: Strategic Exploration and Exploitation for Cohesive In-Context Prompt Optimization
di: Cui, Wendi, et al.
Pubblicazione: (2024)
di: Cui, Wendi, et al.
Pubblicazione: (2024)
A Survey of Automatic Prompt Optimization with Instruction-focused Heuristic-based Search Algorithm
di: Cui, Wendi, et al.
Pubblicazione: (2025)
di: Cui, Wendi, et al.
Pubblicazione: (2025)
SPUQ: Perturbation-Based Uncertainty Quantification for Large Language Models
di: Gao, Xiang, et al.
Pubblicazione: (2024)
di: Gao, Xiang, et al.
Pubblicazione: (2024)
Survival of the Safest: Towards Secure Prompt Optimization through Interleaved Multi-Objective Evolution
di: Sinha, Ankita, et al.
Pubblicazione: (2024)
di: Sinha, Ankita, et al.
Pubblicazione: (2024)
Do You Know What You Are Talking About? Characterizing Query-Knowledge Relevance For Reliable Retrieval Augmented Generation
di: Li, Zhuohang, et al.
Pubblicazione: (2024)
di: Li, Zhuohang, et al.
Pubblicazione: (2024)
From Passive Metric to Active Signal: The Evolving Role of Uncertainty Quantification in Large Language Models
di: Zhang, Jiaxin, et al.
Pubblicazione: (2026)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2026)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
di: Saxena, Yash, et al.
Pubblicazione: (2024)
di: Saxena, Yash, et al.
Pubblicazione: (2024)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
DCR: Divide-and-Conquer Reasoning for Multi-choice Question Answering with LLMs
di: Meng, Zijie, et al.
Pubblicazione: (2024)
di: Meng, Zijie, et al.
Pubblicazione: (2024)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
di: Jia, Boyu, et al.
Pubblicazione: (2025)
di: Jia, Boyu, et al.
Pubblicazione: (2025)
Customizing Language Model Responses with Contrastive In-Context Learning
di: Gao, Xiang, et al.
Pubblicazione: (2024)
di: Gao, Xiang, et al.
Pubblicazione: (2024)
Divide, Reweight, and Conquer: A Logit Arithmetic Approach for In-Context Learning
di: Huang, Chengsong, et al.
Pubblicazione: (2024)
di: Huang, Chengsong, et al.
Pubblicazione: (2024)
Cross-Modal Consistency in Multimodal Large Language Models
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
di: Zhang, Xiang, et al.
Pubblicazione: (2024)
SaGE: Evaluating Moral Consistency in Large Language Models
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
Calibrating Reasoning in Language Models with Internal Consistency
di: Xie, Zhihui, et al.
Pubblicazione: (2024)
di: Xie, Zhihui, et al.
Pubblicazione: (2024)
CLLMs: Consistency Large Language Models
di: Kou, Siqi, et al.
Pubblicazione: (2024)
di: Kou, Siqi, et al.
Pubblicazione: (2024)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
The Moral Consistency Pipeline: Continuous Ethical Evaluation for Large Language Models
di: Jamshidi, Saeid, et al.
Pubblicazione: (2025)
di: Jamshidi, Saeid, et al.
Pubblicazione: (2025)
Cross-Examiner: Evaluating Consistency of Large Language Model-Generated Explanations
di: Villa, Danielle, et al.
Pubblicazione: (2025)
di: Villa, Danielle, et al.
Pubblicazione: (2025)
Firm or Fickle? Evaluating Large Language Models Consistency in Sequential Interactions
di: Li, Yubo, et al.
Pubblicazione: (2025)
di: Li, Yubo, et al.
Pubblicazione: (2025)
Self-DC: When to Reason and When to Act? Self Divide-and-Conquer for Compositional Unknown Questions
di: Wang, Hongru, et al.
Pubblicazione: (2024)
di: Wang, Hongru, et al.
Pubblicazione: (2024)
Consistency of Large Reasoning Models Under Multi-Turn Attacks
di: Li, Yubo, et al.
Pubblicazione: (2026)
di: Li, Yubo, et al.
Pubblicazione: (2026)
Towards Statistical Factuality Guarantee for Large Vision-Language Models
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
Cross-Lingual Consistency: A Novel Inference Framework for Advancing Reasoning in Large Language Models
di: Yu, Zhiwei, et al.
Pubblicazione: (2025)
di: Yu, Zhiwei, et al.
Pubblicazione: (2025)
Enhancing LLM Character-Level Manipulation via Divide and Conquer
di: Xiong, Zhen, et al.
Pubblicazione: (2025)
di: Xiong, Zhen, et al.
Pubblicazione: (2025)
Nuance Matters: Probing Epistemic Consistency in Causal Reasoning
di: Cui, Shaobo, et al.
Pubblicazione: (2024)
di: Cui, Shaobo, et al.
Pubblicazione: (2024)
Are Large Language Models Consistent over Value-laden Questions?
di: Moore, Jared, et al.
Pubblicazione: (2024)
di: Moore, Jared, et al.
Pubblicazione: (2024)
Self-Training Meets Consistency: Improving LLMs' Reasoning with Consistency-Driven Rationale Evaluation
di: Lee, Jaehyeok, et al.
Pubblicazione: (2024)
di: Lee, Jaehyeok, et al.
Pubblicazione: (2024)
Counterfactual-Consistency Prompting for Relative Temporal Understanding in Large Language Models
di: Kim, Jongho, et al.
Pubblicazione: (2025)
di: Kim, Jongho, et al.
Pubblicazione: (2025)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
di: Wang, Haoran, et al.
Pubblicazione: (2026)
di: Wang, Haoran, et al.
Pubblicazione: (2026)
Multi-Perspective Consistency Enhances Confidence Estimation in Large Language Models
di: Wang, Pei, et al.
Pubblicazione: (2024)
di: Wang, Pei, et al.
Pubblicazione: (2024)
Benchmarking the Capabilities of Large Language Models in Transportation System Engineering: Accuracy, Consistency, and Reasoning Behaviors
di: Syed, Usman, et al.
Pubblicazione: (2024)
di: Syed, Usman, et al.
Pubblicazione: (2024)
Knowledge-based Consistency Testing of Large Language Models
di: Rajan, Sai Sathiesh, et al.
Pubblicazione: (2024)
di: Rajan, Sai Sathiesh, et al.
Pubblicazione: (2024)
Semantic Consistency for Assuring Reliability of Large Language Models
di: Raj, Harsh, et al.
Pubblicazione: (2023)
di: Raj, Harsh, et al.
Pubblicazione: (2023)
The Consistency Hypothesis in Uncertainty Quantification for Large Language Models
di: Xiao, Quan, et al.
Pubblicazione: (2025)
di: Xiao, Quan, et al.
Pubblicazione: (2025)
Piece of Table: A Divide-and-Conquer Approach for Selecting Subtables in Table Question Answering
di: Lee, Wonjin, et al.
Pubblicazione: (2024)
di: Lee, Wonjin, et al.
Pubblicazione: (2024)
Beyond Self-Consistency: Ensemble Reasoning Boosts Consistency and Accuracy of LLMs in Cancer Staging
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SCE: Scalable Consistency Ensembles Make Blackbox Large Language Model Generation More Reliable
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025) -
SAC3: Reliable Hallucination Detection in Black-Box Language Models via Semantic-aware Cross-check Consistency
di: Zhang, Jiaxin, et al.
Pubblicazione: (2023) -
Synthetic Knowledge Ingestion: Towards Knowledge Refinement and Injection for Enhancing Large Language Models
di: Zhang, Jiaxin, et al.
Pubblicazione: (2024) -
SEE: Strategic Exploration and Exploitation for Cohesive In-Context Prompt Optimization
di: Cui, Wendi, et al.
Pubblicazione: (2024) -
A Survey of Automatic Prompt Optimization with Instruction-focused Heuristic-based Search Algorithm
di: Cui, Wendi, et al.
Pubblicazione: (2025)