Enregistré dans:
| Auteurs principaux: | Feng, Yu, Zhou, Ben, Lin, Weidong, Roth, Dan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2404.12494 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Conceptual and Unbiased Reasoning in Language Models
par: Zhou, Ben, et autres
Publié: (2024)
par: Zhou, Ben, et autres
Publié: (2024)
TrustLLM: Trustworthiness in Large Language Models
par: Huang, Yue, et autres
Publié: (2024)
par: Huang, Yue, et autres
Publié: (2024)
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
par: Yu, Zhuohao, et autres
Publié: (2024)
par: Yu, Zhuohao, et autres
Publié: (2024)
Self-supervised Analogical Learning using Language Models
par: Zhou, Ben, et autres
Publié: (2025)
par: Zhou, Ben, et autres
Publié: (2025)
ConSiDERS-The-Human Evaluation Framework: Rethinking Human Evaluation for Generative Large Language Models
par: Elangovan, Aparna, et autres
Publié: (2024)
par: Elangovan, Aparna, et autres
Publié: (2024)
SocREval: Large Language Models with the Socratic Method for Reference-Free Reasoning Evaluation
par: He, Hangfeng, et autres
Publié: (2023)
par: He, Hangfeng, et autres
Publié: (2023)
XTRUST: On the Multilingual Trustworthiness of Large Language Models
par: Li, Yahan, et autres
Publié: (2024)
par: Li, Yahan, et autres
Publié: (2024)
LLM4Sweat: A Trustworthy Large Language Model for Hyperhidrosis Support
par: Lin, Wenjie, et autres
Publié: (2025)
par: Lin, Wenjie, et autres
Publié: (2025)
FamiCom: Further Demystifying Prompts for Language Models with Task-Agnostic Performance Estimation
par: Li, Bangzheng, et autres
Publié: (2024)
par: Li, Bangzheng, et autres
Publié: (2024)
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
par: Wang, Yanbo, et autres
Publié: (2025)
par: Wang, Yanbo, et autres
Publié: (2025)
On Reference (In-)Determinacy in Natural Language Inference
par: Chen, Sihao, et autres
Publié: (2025)
par: Chen, Sihao, et autres
Publié: (2025)
AdaptiveLog: An Adaptive Log Analysis Framework with the Collaboration of Large and Small Language Model
par: Ma, Lipeng, et autres
Publié: (2025)
par: Ma, Lipeng, et autres
Publié: (2025)
TRUSTVIS: A Multi-Dimensional Trustworthiness Evaluation Framework for Large Language Models
par: Sun, Ruoyu, et autres
Publié: (2025)
par: Sun, Ruoyu, et autres
Publié: (2025)
Investigating Numerical Translation with Large Language Models
par: Tang, Wei, et autres
Publié: (2025)
par: Tang, Wei, et autres
Publié: (2025)
Cross-Lingual Consistency: A Novel Inference Framework for Advancing Reasoning in Large Language Models
par: Yu, Zhiwei, et autres
Publié: (2025)
par: Yu, Zhiwei, et autres
Publié: (2025)
CSV-Decode: Certifiable Sub-Vocabulary Decoding for Efficient Large Language Model Inference
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
BLINK: Multimodal Large Language Models Can See but Not Perceive
par: Fu, Xingyu, et autres
Publié: (2024)
par: Fu, Xingyu, et autres
Publié: (2024)
Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning
par: Zhang, Zongmeng, et autres
Publié: (2024)
par: Zhang, Zongmeng, et autres
Publié: (2024)
Aligning Large Language Models with Healthcare Stakeholders: A Pathway to Trustworthy AI Integration
par: Ding, Kexin, et autres
Publié: (2025)
par: Ding, Kexin, et autres
Publié: (2025)
A Comprehensive Survey on the Trustworthiness of Large Language Models in Healthcare
par: Aljohani, Manar, et autres
Publié: (2025)
par: Aljohani, Manar, et autres
Publié: (2025)
ReEval: Automatic Hallucination Evaluation for Retrieval-Augmented Large Language Models via Transferable Adversarial Attacks
par: Yu, Xiaodong, et autres
Publié: (2023)
par: Yu, Xiaodong, et autres
Publié: (2023)
SAISA: Towards Multimodal Large Language Models with Both Training and Inference Efficiency
par: Yuan, Qianhao, et autres
Publié: (2025)
par: Yuan, Qianhao, et autres
Publié: (2025)
A Systematic Study of Training-Free Methods for Trustworthy Large Language Models
par: Si, Wai Man, et autres
Publié: (2026)
par: Si, Wai Man, et autres
Publié: (2026)
ReFIne: A Framework for Trustworthy Large Reasoning Models with Reliability, Faithfulness, and Interpretability
par: Sun, Chung-En, et autres
Publié: (2025)
par: Sun, Chung-En, et autres
Publié: (2025)
Towards Trustworthy Retrieval Augmented Generation for Large Language Models: A Survey
par: Ni, Bo, et autres
Publié: (2025)
par: Ni, Bo, et autres
Publié: (2025)
FEEL: A Framework for Evaluating Emotional Support Capability with Large Language Models
par: Zhang, Huaiwen, et autres
Publié: (2024)
par: Zhang, Huaiwen, et autres
Publié: (2024)
Mapping Trustworthiness in Large Language Models: A Bibliometric Analysis Bridging Theory to Practice
par: de Cerqueira, José Siqueira, et autres
Publié: (2025)
par: de Cerqueira, José Siqueira, et autres
Publié: (2025)
EPT Benchmark: Evaluation of Persian Trustworthiness in Large Language Models
par: Mirbagheri, Mohammad Reza, et autres
Publié: (2025)
par: Mirbagheri, Mohammad Reza, et autres
Publié: (2025)
QSTN: A Modular Framework for Robust Questionnaire Inference with Large Language Models
par: Kreutner, Maximilian, et autres
Publié: (2025)
par: Kreutner, Maximilian, et autres
Publié: (2025)
BIRD: Bronze Inscription Restoration and Dating
par: Hua, Wenjie, et autres
Publié: (2025)
par: Hua, Wenjie, et autres
Publié: (2025)
FIRST: Teach A Reliable Large Language Model Through Efficient Trustworthy Distillation
par: Shum, KaShun, et autres
Publié: (2024)
par: Shum, KaShun, et autres
Publié: (2024)
TRUE: A Trustworthy Unified Explanation Framework for Large Language Model Reasoning
par: Yang, Yujiao
Publié: (2026)
par: Yang, Yujiao
Publié: (2026)
Deceptive Semantic Shortcuts on Reasoning Chains: How Far Can Models Go without Hallucination?
par: Li, Bangzheng, et autres
Publié: (2023)
par: Li, Bangzheng, et autres
Publié: (2023)
Explainability of Large Language Models: Opportunities and Challenges toward Generating Trustworthy Explanations
par: Atakishiyev, Shahin, et autres
Publié: (2025)
par: Atakishiyev, Shahin, et autres
Publié: (2025)
BiasFilter: An Inference-Time Debiasing Framework for Large Language Models
par: Cheng, Xiaoqing, et autres
Publié: (2025)
par: Cheng, Xiaoqing, et autres
Publié: (2025)
TUBench: Benchmarking Large Vision-Language Models on Trustworthiness with Unanswerable Questions
par: He, Xingwei, et autres
Publié: (2024)
par: He, Xingwei, et autres
Publié: (2024)
A Multi-Stage Validation Framework for Trustworthy Large-scale Clinical Information Extraction using Large Language Models
par: Mahbub, Maria, et autres
Publié: (2026)
par: Mahbub, Maria, et autres
Publié: (2026)
Efficient Inference for Large Language Model-based Generative Recommendation
par: Lin, Xinyu, et autres
Publié: (2024)
par: Lin, Xinyu, et autres
Publié: (2024)
Self-Steering Optimization: Autonomous Preference Optimization for Large Language Models
par: Xiang, Hao, et autres
Publié: (2024)
par: Xiang, Hao, et autres
Publié: (2024)
Interpretable Differential Diagnosis with Dual-Inference Large Language Models
par: Zhou, Shuang, et autres
Publié: (2024)
par: Zhou, Shuang, et autres
Publié: (2024)
Documents similaires
-
Conceptual and Unbiased Reasoning in Language Models
par: Zhou, Ben, et autres
Publié: (2024) -
TrustLLM: Trustworthiness in Large Language Models
par: Huang, Yue, et autres
Publié: (2024) -
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
par: Yu, Zhuohao, et autres
Publié: (2024) -
Self-supervised Analogical Learning using Language Models
par: Zhou, Ben, et autres
Publié: (2025) -
ConSiDERS-The-Human Evaluation Framework: Rethinking Human Evaluation for Generative Large Language Models
par: Elangovan, Aparna, et autres
Publié: (2024)