Salvato in:
| Autore principale: | Zhang, Damin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2402.10899 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SYNTHEVAL: Hybrid Behavioral Testing of NLP Models with Synthetic CheckLists
di: Zhao, Raoyuan, et al.
Pubblicazione: (2024)
di: Zhao, Raoyuan, et al.
Pubblicazione: (2024)
Structured yet Bounded Temporal Understanding in Large Language Models
di: Zhang, Damin, et al.
Pubblicazione: (2025)
di: Zhang, Damin, et al.
Pubblicazione: (2025)
Hire Me or Not? Examining Language Model's Behavior with Occupation Attributes
di: Zhang, Damin, et al.
Pubblicazione: (2024)
di: Zhang, Damin, et al.
Pubblicazione: (2024)
Evaluating Large Language Model Capability in Vietnamese Fact-Checking Data Generation
di: To, Long Truong, et al.
Pubblicazione: (2024)
di: To, Long Truong, et al.
Pubblicazione: (2024)
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
From Performance to Purpose: A Sociotechnical Taxonomy for Evaluating Large Language Model Utility
di: Levinson, Gavin, et al.
Pubblicazione: (2026)
di: Levinson, Gavin, et al.
Pubblicazione: (2026)
FACT-AUDIT: An Adaptive Multi-Agent Framework for Dynamic Fact-Checking Evaluation of Large Language Models
di: Lin, Hongzhan, et al.
Pubblicazione: (2025)
di: Lin, Hongzhan, et al.
Pubblicazione: (2025)
A Taxonomy for Data Contamination in Large Language Models
di: Palavalli, Medha, et al.
Pubblicazione: (2024)
di: Palavalli, Medha, et al.
Pubblicazione: (2024)
Evaluating Large Language Models on Time Series Feature Understanding: A Comprehensive Taxonomy and Benchmark
di: Fons, Elizabeth, et al.
Pubblicazione: (2024)
di: Fons, Elizabeth, et al.
Pubblicazione: (2024)
LEAF: Learning and Evaluation Augmented by Fact-Checking to Improve Factualness in Large Language Models
di: Tran, Hieu, et al.
Pubblicazione: (2024)
di: Tran, Hieu, et al.
Pubblicazione: (2024)
Evaluating List Construction and Temporal Understanding capabilities of Large Language Models
di: Dumitru, Alexandru, et al.
Pubblicazione: (2025)
di: Dumitru, Alexandru, et al.
Pubblicazione: (2025)
Self-Checker: Plug-and-Play Modules for Fact-Checking with Large Language Models
di: Li, Miaoran, et al.
Pubblicazione: (2023)
di: Li, Miaoran, et al.
Pubblicazione: (2023)
Enriching Taxonomies Using Large Language Models
di: Ghamlouch, Zeinab, et al.
Pubblicazione: (2025)
di: Ghamlouch, Zeinab, et al.
Pubblicazione: (2025)
Learning to Check: Unleashing Potentials for Self-Correction in Large Language Models
di: Zhang, Che, et al.
Pubblicazione: (2024)
di: Zhang, Che, et al.
Pubblicazione: (2024)
Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers
di: Qin, Libo, et al.
Pubblicazione: (2024)
di: Qin, Libo, et al.
Pubblicazione: (2024)
Generative Large Language Models in Automated Fact-Checking: A Survey
di: Vykopal, Ivan, et al.
Pubblicazione: (2024)
di: Vykopal, Ivan, et al.
Pubblicazione: (2024)
Automated Fact-Checking of Climate Change Claims with Large Language Models
di: Leippold, Markus, et al.
Pubblicazione: (2024)
di: Leippold, Markus, et al.
Pubblicazione: (2024)
Large Language Models for Multilingual Previously Fact-Checked Claim Detection
di: Vykopal, Ivan, et al.
Pubblicazione: (2025)
di: Vykopal, Ivan, et al.
Pubblicazione: (2025)
Are Large Language Models a Good Replacement of Taxonomies?
di: Sun, Yushi, et al.
Pubblicazione: (2024)
di: Sun, Yushi, et al.
Pubblicazione: (2024)
A Taxonomy of Stereotype Content in Large Language Models
di: Nicolas, Gandalf, et al.
Pubblicazione: (2024)
di: Nicolas, Gandalf, et al.
Pubblicazione: (2024)
Glitch Tokens in Large Language Models: Categorization Taxonomy and Effective Detection
di: Li, Yuxi, et al.
Pubblicazione: (2024)
di: Li, Yuxi, et al.
Pubblicazione: (2024)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
di: Rahman, Subhey Sadi, et al.
Pubblicazione: (2025)
di: Rahman, Subhey Sadi, et al.
Pubblicazione: (2025)
FoodTaxo: Generating Food Taxonomies with Large Language Models
di: Wullschleger, Pascal, et al.
Pubblicazione: (2025)
di: Wullschleger, Pascal, et al.
Pubblicazione: (2025)
Taxonomy, Opportunities, and Challenges of Representation Engineering for Large Language Models
di: Wehner, Jan, et al.
Pubblicazione: (2025)
di: Wehner, Jan, et al.
Pubblicazione: (2025)
Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
di: Cui, Tianyu, et al.
Pubblicazione: (2024)
Rich Semantic Knowledge Enhanced Large Language Models for Few-shot Chinese Spell Checking
di: Dong, Ming, et al.
Pubblicazione: (2024)
di: Dong, Ming, et al.
Pubblicazione: (2024)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
Refining Wikidata Taxonomy using Large Language Models
di: Peng, Yiwen, et al.
Pubblicazione: (2024)
di: Peng, Yiwen, et al.
Pubblicazione: (2024)
Evaluation Revisited: A Taxonomy of Evaluation Concerns in Natural Language Processing
di: Dhar, Ruchira, et al.
Pubblicazione: (2026)
di: Dhar, Ruchira, et al.
Pubblicazione: (2026)
IPL: Leveraging Multimodal Large Language Models for Intelligent Product Listing
di: Chen, Kang, et al.
Pubblicazione: (2024)
di: Chen, Kang, et al.
Pubblicazione: (2024)
Cross-modality Information Check for Detecting Jailbreaking in Multimodal Large Language Models
di: Xu, Yue, et al.
Pubblicazione: (2024)
di: Xu, Yue, et al.
Pubblicazione: (2024)
Towards Comprehensive Stage-wise Benchmarking of Large Language Models in Fact-Checking
di: Lin, Hongzhan, et al.
Pubblicazione: (2026)
di: Lin, Hongzhan, et al.
Pubblicazione: (2026)
Chain-of-Layer: Iteratively Prompting Large Language Models for Taxonomy Induction from Limited Examples
di: Zeng, Qingkai, et al.
Pubblicazione: (2024)
di: Zeng, Qingkai, et al.
Pubblicazione: (2024)
Audio Jailbreaks in Large Audio-Language Models: Taxonomy, Attack-Defense Analysis, and Cost-Aware Evaluation
di: Feng, Bo-Han, et al.
Pubblicazione: (2026)
di: Feng, Bo-Han, et al.
Pubblicazione: (2026)
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
di: Dunlap, Lisa, et al.
Pubblicazione: (2024)
Multimodal Large Language Models to Support Real-World Fact-Checking
di: Geng, Jiahui, et al.
Pubblicazione: (2024)
di: Geng, Jiahui, et al.
Pubblicazione: (2024)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
di: Wang, Haoran, et al.
Pubblicazione: (2026)
di: Wang, Haoran, et al.
Pubblicazione: (2026)
A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open Questions
di: Huang, Lei, et al.
Pubblicazione: (2023)
di: Huang, Lei, et al.
Pubblicazione: (2023)
Tell Me Why: Explainable Public Health Fact-Checking with Large Language Models
di: Zarharan, Majid, et al.
Pubblicazione: (2024)
di: Zarharan, Majid, et al.
Pubblicazione: (2024)
ClaimCheck: Real-Time Fact-Checking with Small Language Models
di: Putta, Akshith Reddy, et al.
Pubblicazione: (2025)
di: Putta, Akshith Reddy, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SYNTHEVAL: Hybrid Behavioral Testing of NLP Models with Synthetic CheckLists
di: Zhao, Raoyuan, et al.
Pubblicazione: (2024) -
Structured yet Bounded Temporal Understanding in Large Language Models
di: Zhang, Damin, et al.
Pubblicazione: (2025) -
Hire Me or Not? Examining Language Model's Behavior with Occupation Attributes
di: Zhang, Damin, et al.
Pubblicazione: (2024) -
Evaluating Large Language Model Capability in Vietnamese Fact-Checking Data Generation
di: To, Long Truong, et al.
Pubblicazione: (2024) -
LMMs-Eval: Reality Check on the Evaluation of Large Multimodal Models
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)