XTRUST: On the Multilingual Trustworthiness of Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Yahan, Wang, Yi, Chang, Yi, Wu, Yuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Large Language Model Evaluation via Matrix Nuclear-Norm
von: Li, Yahan, et al.
Veröffentlicht: (2024)
von: Li, Yahan, et al.
Veröffentlicht: (2024)
A Survey on Data Contamination for Large Language Models
von: Cheng, Yuxing, et al.
Veröffentlicht: (2025)
von: Cheng, Yuxing, et al.
Veröffentlicht: (2025)
Transfer-Prompting: Enhancing Cross-Task Adaptation in Large Language Models via Dual-Stage Prompts Optimization
von: Chang, Yupeng, et al.
Veröffentlicht: (2025)
von: Chang, Yupeng, et al.
Veröffentlicht: (2025)
AGGC: Adaptive Group Gradient Clipping for Stabilizing Large Language Model Training
von: Li, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Li, Zhiyuan, et al.
Veröffentlicht: (2026)
NLoRA: Nyström-Initiated Low-Rank Adaptation for Large Language Models
von: Guo, Chenlu, et al.
Veröffentlicht: (2025)
von: Guo, Chenlu, et al.
Veröffentlicht: (2025)
Don't Take the Premise for Granted: Evaluating the Premise Critique Ability of Large Language Models
von: Li, Jinzhe, et al.
Veröffentlicht: (2025)
von: Li, Jinzhe, et al.
Veröffentlicht: (2025)
NegativePrompt: Leveraging Psychology for Large Language Models Enhancement via Negative Emotional Stimuli
von: Wang, Xu, et al.
Veröffentlicht: (2024)
von: Wang, Xu, et al.
Veröffentlicht: (2024)
BA-LoRA: Bias-Alleviating Low-Rank Adaptation to Mitigate Catastrophic Inheritance in Large Language Models
von: Chang, Yupeng, et al.
Veröffentlicht: (2024)
von: Chang, Yupeng, et al.
Veröffentlicht: (2024)
CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare
von: Ghosh, Akash, et al.
Veröffentlicht: (2025)
von: Ghosh, Akash, et al.
Veröffentlicht: (2025)
CHBench: A Chinese Dataset for Evaluating Health in Large Language Models
von: Guo, Chenlu, et al.
Veröffentlicht: (2024)
von: Guo, Chenlu, et al.
Veröffentlicht: (2024)
THINK-Bench: Evaluating Thinking Efficiency and Chain-of-Thought Quality of Large Reasoning Models
von: Li, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Li, Zhiyuan, et al.
Veröffentlicht: (2025)
TrustLLM: Trustworthiness in Large Language Models
von: Huang, Yue, et al.
Veröffentlicht: (2024)
von: Huang, Yue, et al.
Veröffentlicht: (2024)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
von: Cheng, Bo, et al.
Veröffentlicht: (2025)
von: Cheng, Bo, et al.
Veröffentlicht: (2025)
Revisiting Anthropomorphic Reflection Markers in Large Language Model Reasoning
von: Yu, Yahan, et al.
Veröffentlicht: (2026)
von: Yu, Yahan, et al.
Veröffentlicht: (2026)
ODE: Open-Set Evaluation of Hallucinations in Multimodal Large Language Models
von: Tu, Yahan, et al.
Veröffentlicht: (2024)
von: Tu, Yahan, et al.
Veröffentlicht: (2024)
All Languages Matter: On the Multilingual Safety of Large Language Models
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
von: Wang, Wenxuan, et al.
Veröffentlicht: (2023)
Benchmarking LLM Guardrails in Handling Multilingual Toxicity
von: Yang, Yahan, et al.
Veröffentlicht: (2024)
von: Yang, Yahan, et al.
Veröffentlicht: (2024)
MrGuard: A Multilingual Reasoning Guardrail for Universal LLM Safety
von: Yang, Yahan, et al.
Veröffentlicht: (2025)
von: Yang, Yahan, et al.
Veröffentlicht: (2025)
On the Calibration of Multilingual Question Answering LLMs
von: Yang, Yahan, et al.
Veröffentlicht: (2023)
von: Yang, Yahan, et al.
Veröffentlicht: (2023)
TUBench: Benchmarking Large Vision-Language Models on Trustworthiness with Unanswerable Questions
von: He, Xingwei, et al.
Veröffentlicht: (2024)
von: He, Xingwei, et al.
Veröffentlicht: (2024)
Multilingual Large Language Models and Curse of Multilinguality
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2024)
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2024)
Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models
von: Lu, Hongyuan, et al.
Veröffentlicht: (2024)
von: Lu, Hongyuan, et al.
Veröffentlicht: (2024)
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
Orion-14B: Open-source Multilingual Large Language Models
von: Chen, Du, et al.
Veröffentlicht: (2024)
von: Chen, Du, et al.
Veröffentlicht: (2024)
MM-LLMs: Recent Advances in MultiModal Large Language Models
von: Zhang, Duzhen, et al.
Veröffentlicht: (2024)
von: Zhang, Duzhen, et al.
Veröffentlicht: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
von: Mu, Yongyu, et al.
Veröffentlicht: (2024)
A Survey on Evaluation of Large Language Models
von: Chang, Yupeng, et al.
Veröffentlicht: (2023)
von: Chang, Yupeng, et al.
Veröffentlicht: (2023)
Language Surgery in Multilingual Large Language Models
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
Towards Boosting Many-to-Many Multilingual Machine Translation with Large Language Models
von: Gao, Pengzhi, et al.
Veröffentlicht: (2024)
von: Gao, Pengzhi, et al.
Veröffentlicht: (2024)
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
von: Yu, Zhuohao, et al.
Veröffentlicht: (2024)
von: Yu, Zhuohao, et al.
Veröffentlicht: (2024)
Language Models can Evaluate Themselves via Probability Discrepancy
von: Xia, Tingyu, et al.
Veröffentlicht: (2024)
von: Xia, Tingyu, et al.
Veröffentlicht: (2024)
Towards Trustworthy Report Generation: A Deep Research Agent with Progressive Confidence Estimation and Calibration
von: Yuan, Yi, et al.
Veröffentlicht: (2026)
von: Yuan, Yi, et al.
Veröffentlicht: (2026)
A Comprehensive Survey on the Trustworthiness of Large Language Models in Healthcare
von: Aljohani, Manar, et al.
Veröffentlicht: (2025)
von: Aljohani, Manar, et al.
Veröffentlicht: (2025)
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
von: Huang, Xu, et al.
Veröffentlicht: (2025)
von: Huang, Xu, et al.
Veröffentlicht: (2025)
ChiKhaPo: A Large-Scale Multilingual Benchmark for Evaluating Lexical Comprehension and Generation in Large Language Models
von: Chang, Emily, et al.
Veröffentlicht: (2025)
von: Chang, Emily, et al.
Veröffentlicht: (2025)
When Large Language Models Meet Speech: A Survey on Integration Approaches
von: Yang, Zhengdong, et al.
Veröffentlicht: (2025)
von: Yang, Zhengdong, et al.
Veröffentlicht: (2025)
Lens: Rethinking Multilingual Enhancement for Large Language Models
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
A Systematic Study of Training-Free Methods for Trustworthy Large Language Models
von: Si, Wai Man, et al.
Veröffentlicht: (2026)
von: Si, Wai Man, et al.
Veröffentlicht: (2026)
Clickbait Detection via Large Language Models
von: Wang, Han, et al.
Veröffentlicht: (2023)
von: Wang, Han, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Large Language Model Evaluation via Matrix Nuclear-Norm
von: Li, Yahan, et al.
Veröffentlicht: (2024) -
A Survey on Data Contamination for Large Language Models
von: Cheng, Yuxing, et al.
Veröffentlicht: (2025) -
Transfer-Prompting: Enhancing Cross-Task Adaptation in Large Language Models via Dual-Stage Prompts Optimization
von: Chang, Yupeng, et al.
Veröffentlicht: (2025) -
AGGC: Adaptive Group Gradient Clipping for Stabilizing Large Language Model Training
von: Li, Zhiyuan, et al.
Veröffentlicht: (2026) -
NLoRA: Nyström-Initiated Low-Rank Adaptation for Large Language Models
von: Guo, Chenlu, et al.
Veröffentlicht: (2025)