Multilingual Self-Taught Faithfulness Evaluators
Fuente:
arXiv
Salvato in:
| Autori principali: | Alfano, Carlo, Marjani, Aymen Al, Jonke, Zeno, Mantrach, Amin, Mansour, Saab, Federico, Marcello |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cross-Lingual LLM-Judge Transfer via Evaluation Decomposition
di: Sheth, Ivaxi, et al.
Pubblicazione: (2026)
di: Sheth, Ivaxi, et al.
Pubblicazione: (2026)
Self-Taught Self-Correction for Small Language Models
di: Moskvoretskii, Viktor, et al.
Pubblicazione: (2025)
di: Moskvoretskii, Viktor, et al.
Pubblicazione: (2025)
Self-Taught Optimizer (STOP): Recursively Self-Improving Code Generation
di: Zelikman, Eric, et al.
Pubblicazione: (2023)
di: Zelikman, Eric, et al.
Pubblicazione: (2023)
V-STaR: Training Verifiers for Self-Taught Reasoners
di: Hosseini, Arian, et al.
Pubblicazione: (2024)
di: Hosseini, Arian, et al.
Pubblicazione: (2024)
MEMERAG: A Multilingual End-to-End Meta-Evaluation Benchmark for Retrieval Augmented Generation
di: Blandón, María Andrea Cruz, et al.
Pubblicazione: (2025)
di: Blandón, María Andrea Cruz, et al.
Pubblicazione: (2025)
UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs
di: Sinha, Yash, et al.
Pubblicazione: (2024)
di: Sinha, Yash, et al.
Pubblicazione: (2024)
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
di: Jia, Jinghan, et al.
Pubblicazione: (2026)
di: Jia, Jinghan, et al.
Pubblicazione: (2026)
CERET: Cost-Effective Extrinsic Refinement for Text Generation
di: Cai, Jason, et al.
Pubblicazione: (2024)
di: Cai, Jason, et al.
Pubblicazione: (2024)
AdaSTaR: Adaptive Data Sampling for Training Self-Taught Reasoners
di: Koh, Woosung, et al.
Pubblicazione: (2025)
di: Koh, Woosung, et al.
Pubblicazione: (2025)
B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners
di: Zeng, Weihao, et al.
Pubblicazione: (2024)
di: Zeng, Weihao, et al.
Pubblicazione: (2024)
GLEAN: Active Generalized Category Discovery with Diverse LLM Feedback
di: Zou, Henry Peng, et al.
Pubblicazione: (2025)
di: Zou, Henry Peng, et al.
Pubblicazione: (2025)
Measuring What LLMs Think They Do: SHAP Faithfulness and Deployability on Financial Tabular Classification
di: AlMarri, Saeed, et al.
Pubblicazione: (2025)
di: AlMarri, Saeed, et al.
Pubblicazione: (2025)
HS-STaR: Hierarchical Sampling for Self-Taught Reasoners via Difficulty Estimation and Budget Reallocation
di: Xiong, Feng, et al.
Pubblicazione: (2025)
di: Xiong, Feng, et al.
Pubblicazione: (2025)
MetaFaith: Faithful Natural Language Uncertainty Expression in LLMs
di: Liu, Gabrielle Kaili-May, et al.
Pubblicazione: (2025)
di: Liu, Gabrielle Kaili-May, et al.
Pubblicazione: (2025)
Evaluating the Robustness and Accuracy of Text Watermarking Under Real-World Cross-Lingual Manipulations
di: Ghanim, Mansour Al, et al.
Pubblicazione: (2025)
di: Ghanim, Mansour Al, et al.
Pubblicazione: (2025)
Self-Taught Recognizer: Toward Unsupervised Adaptation for Speech Foundation Models
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
di: Hu, Yuchen, et al.
Pubblicazione: (2024)
Large Language Models Must Be Taught to Know What They Don't Know
di: Kapoor, Sanyam, et al.
Pubblicazione: (2024)
di: Kapoor, Sanyam, et al.
Pubblicazione: (2024)
Controlling Summarization Length Through EOS Token Weighting
di: Belligoli, Zeno, et al.
Pubblicazione: (2025)
di: Belligoli, Zeno, et al.
Pubblicazione: (2025)
Computational Linguistics Meets Libyan Dialect: A Study on Dialect Identification
di: Essgaer, Mansour, et al.
Pubblicazione: (2025)
di: Essgaer, Mansour, et al.
Pubblicazione: (2025)
Differentially Private Best-Arm Identification
di: Azize, Achraf, et al.
Pubblicazione: (2024)
di: Azize, Achraf, et al.
Pubblicazione: (2024)
Language and Planning in Robotic Navigation: A Multilingual Evaluation of State-of-the-Art Models
di: Mansour, Malak, et al.
Pubblicazione: (2025)
di: Mansour, Malak, et al.
Pubblicazione: (2025)
Self-Taught Evaluators
di: Wang, Tianlu, et al.
Pubblicazione: (2024)
di: Wang, Tianlu, et al.
Pubblicazione: (2024)
Efficient Uncertainty Estimation for LLM-based Entity Linking in Tabular Data
di: Bono, Carlo, et al.
Pubblicazione: (2025)
di: Bono, Carlo, et al.
Pubblicazione: (2025)
Mapping Faithful Reasoning in Language Models
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
di: Li, Jiazheng, et al.
Pubblicazione: (2025)
Faithfulness Measurable Masked Language Models
di: Madsen, Andreas, et al.
Pubblicazione: (2023)
di: Madsen, Andreas, et al.
Pubblicazione: (2023)
Are LLM Decisions Faithful to Verbal Confidence?
di: Wang, Jiawei, et al.
Pubblicazione: (2026)
di: Wang, Jiawei, et al.
Pubblicazione: (2026)
A Causal Lens for Evaluating Faithfulness Metrics
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
Jailbreaking LLMs with Arabic Transliteration and Arabizi
di: Ghanim, Mansour Al, et al.
Pubblicazione: (2024)
di: Ghanim, Mansour Al, et al.
Pubblicazione: (2024)
MIPIAD: Multilingual Indirect Prompt Injection Attack Defense with Qwen -- TF-IDF Hybrid and Meta-Ensemble Learning
di: Muhtadi, Al Muhit, et al.
Pubblicazione: (2026)
di: Muhtadi, Al Muhit, et al.
Pubblicazione: (2026)
A Dynamic Self-Evolving Extraction System
di: Amin-Naseri, Moin, et al.
Pubblicazione: (2026)
di: Amin-Naseri, Moin, et al.
Pubblicazione: (2026)
Faithful and Robust Local Interpretability for Textual Predictions
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2023)
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2023)
FaithLM: Towards Faithful Explanations for Large Language Models
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
Evaluating LLMs' Multilingual Capabilities for Bengali: Benchmark Creation and Performance Analysis
di: Bhowmik, Shimanto, et al.
Pubblicazione: (2025)
di: Bhowmik, Shimanto, et al.
Pubblicazione: (2025)
Selection-p: Self-Supervised Task-Agnostic Prompt Compression for Faithfulness and Transferability
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
The Map of Misbelief: Tracing Intrinsic and Extrinsic Hallucinations Through Attention Patterns
di: Hajji, Elyes, et al.
Pubblicazione: (2025)
di: Hajji, Elyes, et al.
Pubblicazione: (2025)
Faithfulness Evaluation for Decoder-only LLM Attributions with Controlled Retained Information
di: Huang, Xin, et al.
Pubblicazione: (2026)
di: Huang, Xin, et al.
Pubblicazione: (2026)
Multilingual Amnesia: On the Transferability of Unlearning in Multilingual LLMs
di: Farashah, Alireza Dehghanpour, et al.
Pubblicazione: (2026)
di: Farashah, Alireza Dehghanpour, et al.
Pubblicazione: (2026)
Breaking Language Barriers or Reinforcing Bias? A Study of Gender and Racial Disparities in Multilingual Contrastive Vision Language Models
di: Sahili, Zahraa Al, et al.
Pubblicazione: (2025)
di: Sahili, Zahraa Al, et al.
Pubblicazione: (2025)
A System for Comprehensive Assessment of RAG Frameworks
di: Rengo, Mattia, et al.
Pubblicazione: (2025)
di: Rengo, Mattia, et al.
Pubblicazione: (2025)
Multilingual Safety Alignment via Self-Distillation
di: Qin, Ruiyang, et al.
Pubblicazione: (2026)
di: Qin, Ruiyang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Cross-Lingual LLM-Judge Transfer via Evaluation Decomposition
di: Sheth, Ivaxi, et al.
Pubblicazione: (2026) -
Self-Taught Self-Correction for Small Language Models
di: Moskvoretskii, Viktor, et al.
Pubblicazione: (2025) -
Self-Taught Optimizer (STOP): Recursively Self-Improving Code Generation
di: Zelikman, Eric, et al.
Pubblicazione: (2023) -
V-STaR: Training Verifiers for Self-Taught Reasoners
di: Hosseini, Arian, et al.
Pubblicazione: (2024) -
MEMERAG: A Multilingual End-to-End Meta-Evaluation Benchmark for Retrieval Augmented Generation
di: Blandón, María Andrea Cruz, et al.
Pubblicazione: (2025)