Enregistré dans:
| Auteur principal: | Coronado-Blázquez, Javier |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2503.21613 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Deterministic or probabilistic? The psychology of LLMs as random number generators
par: Coronado-Blázquez, Javier
Publié: (2025)
par: Coronado-Blázquez, Javier
Publié: (2025)
A NLP Approach to "Review Bombing" in Metacritic PC Videogames User Ratings
par: Coronado-Blázquez, Javier
Publié: (2024)
par: Coronado-Blázquez, Javier
Publié: (2024)
Large Language Models and Book Summarization: Reading or Remembering, Which Is Better?
par: Fu, Tairan, et autres
Publié: (2026)
par: Fu, Tairan, et autres
Publié: (2026)
Montague semantics and modifier consistency measurement in neural language models
par: Carvalho, Danilo S., et autres
Publié: (2022)
par: Carvalho, Danilo S., et autres
Publié: (2022)
A statistically consistent measure of semantic uncertainty using Language Models
par: Liu, Yi
Publié: (2025)
par: Liu, Yi
Publié: (2025)
Zero-knowledge LLM hallucination detection and mitigation through fine-grained cross-model consistency
par: Goel, Aman, et autres
Publié: (2025)
par: Goel, Aman, et autres
Publié: (2025)
Lost in Sampling: Assessing Lexical Reachability in LLMs via the Word Coverage Score (WCS)
par: Awad, Samer, et autres
Publié: (2026)
par: Awad, Samer, et autres
Publié: (2026)
Performance of large language models in numerical vs. semantic medical knowledge: Benchmarking on evidence-based Q&As
par: Avnat, Eden, et autres
Publié: (2024)
par: Avnat, Eden, et autres
Publié: (2024)
Mass-Editing Memory with Attention in Transformers: A cross-lingual exploration of knowledge
par: Tamayo, Daniel, et autres
Publié: (2025)
par: Tamayo, Daniel, et autres
Publié: (2025)
Is Self-knowledge and Action Consistent or Not: Investigating Large Language Model's Personality
par: Ai, Yiming, et autres
Publié: (2024)
par: Ai, Yiming, et autres
Publié: (2024)
Evaluating Large Language Models with Tests of Spanish as a Foreign Language: Pass or Fail?
par: Mayor-Rocher, Marina, et autres
Publié: (2024)
par: Mayor-Rocher, Marina, et autres
Publié: (2024)
Establishing Vocabulary Tests as a Benchmark for Evaluating Large Language Models
par: Martínez, Gonzalo, et autres
Publié: (2023)
par: Martínez, Gonzalo, et autres
Publié: (2023)
Information Extraction from Electricity Invoices with General-Purpose Large Language Models
par: Gómez, Javier, et autres
Publié: (2026)
par: Gómez, Javier, et autres
Publié: (2026)
Empirical study of pretrained multilingual language models for zero-shot cross-lingual knowledge transfer in generation
par: Chirkova, Nadezhda, et autres
Publié: (2023)
par: Chirkova, Nadezhda, et autres
Publié: (2023)
Isolating authorship from content with semantic embeddings and contrastive learning
par: Huertas-Tato, Javier, et autres
Publié: (2024)
par: Huertas-Tato, Javier, et autres
Publié: (2024)
Knowledge prompt chaining for semantic modeling
par: Ding, Ning Pei, et autres
Publié: (2025)
par: Ding, Ning Pei, et autres
Publié: (2025)
Hint-enhanced In-Context Learning wakes Large Language Models up for knowledge-intensive tasks
par: Wang, Yifan, et autres
Publié: (2023)
par: Wang, Yifan, et autres
Publié: (2023)
Extracting books from production language models
par: Ahmed, Ahmed, et autres
Publié: (2026)
par: Ahmed, Ahmed, et autres
Publié: (2026)
Geo-Semantic-Parsing: AI-powered geoparsing by traversing semantic knowledge graphs
par: Nizzoli, Leonardo, et autres
Publié: (2025)
par: Nizzoli, Leonardo, et autres
Publié: (2025)
Neurosymbolic AI approach to Attribution in Large Language Models
par: Tilwani, Deepa, et autres
Publié: (2024)
par: Tilwani, Deepa, et autres
Publié: (2024)
Evaluating Large Language Models with Psychometrics
par: Li, Yuan, et autres
Publié: (2024)
par: Li, Yuan, et autres
Publié: (2024)
What is the best model? Application-driven Evaluation for Large Language Models
par: Lian, Shiguo, et autres
Publié: (2024)
par: Lian, Shiguo, et autres
Publié: (2024)
FABLES: Evaluating faithfulness and content selection in book-length summarization
par: Kim, Yekyung, et autres
Publié: (2024)
par: Kim, Yekyung, et autres
Publié: (2024)
Comprehensive Evaluation of Large Language Models for Topic Modeling
par: Doi, Tomoki, et autres
Publié: (2024)
par: Doi, Tomoki, et autres
Publié: (2024)
A dual task learning approach to fine-tune a multilingual semantic speech encoder for Spoken Language Understanding
par: Laperrière, Gaëlle, et autres
Publié: (2024)
par: Laperrière, Gaëlle, et autres
Publié: (2024)
Evaluating Large Language Models as Expert Annotators
par: Tseng, Yu-Min, et autres
Publié: (2025)
par: Tseng, Yu-Min, et autres
Publié: (2025)
Evaluating the Deductive Competence of Large Language Models
par: Seals, Spencer M., et autres
Publié: (2023)
par: Seals, Spencer M., et autres
Publié: (2023)
Evaluating Large Language Models for Material Selection
par: Grandi, Daniele, et autres
Publié: (2024)
par: Grandi, Daniele, et autres
Publié: (2024)
Evaluating Deep Unlearning in Large Language Models
par: Wu, Ruihan, et autres
Publié: (2024)
par: Wu, Ruihan, et autres
Publié: (2024)
Evaluating Gender Bias in Large Language Models
par: Döll, Michael, et autres
Publié: (2024)
par: Döll, Michael, et autres
Publié: (2024)
Mitigating the Bias of Large Language Model Evaluation
par: Zhou, Hongli, et autres
Publié: (2024)
par: Zhou, Hongli, et autres
Publié: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
par: Wang, Chenglong, et autres
Publié: (2023)
par: Wang, Chenglong, et autres
Publié: (2023)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
par: Ying, Jiahao, et autres
Publié: (2025)
par: Ying, Jiahao, et autres
Publié: (2025)
Evaluating Large Language Models for Radiology Natural Language Processing
par: Liu, Zhengliang, et autres
Publié: (2023)
par: Liu, Zhengliang, et autres
Publié: (2023)
Performance Evaluation of Tokenizers in Large Language Models for the Assamese Language
par: Tamang, Sagar, et autres
Publié: (2024)
par: Tamang, Sagar, et autres
Publié: (2024)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
par: Park, Dojun, et autres
Publié: (2024)
par: Park, Dojun, et autres
Publié: (2024)
Language Shapes Mental Health Evaluations in Large Language Models
par: Xu, Jiayi, et autres
Publié: (2026)
par: Xu, Jiayi, et autres
Publié: (2026)
A unified foundational framework for knowledge injection and evaluation of Large Language Models in Combustion Science
par: Yang, Zonglin, et autres
Publié: (2026)
par: Yang, Zonglin, et autres
Publié: (2026)
Large Language Models, scientific knowledge and factuality: A framework to streamline human expert evaluation
par: Wysocka, Magdalena, et autres
Publié: (2023)
par: Wysocka, Magdalena, et autres
Publié: (2023)
On convexity and efficiency in semantic systems
par: Imel, Nathaniel, et autres
Publié: (2026)
par: Imel, Nathaniel, et autres
Publié: (2026)
Documents similaires
-
Deterministic or probabilistic? The psychology of LLMs as random number generators
par: Coronado-Blázquez, Javier
Publié: (2025) -
A NLP Approach to "Review Bombing" in Metacritic PC Videogames User Ratings
par: Coronado-Blázquez, Javier
Publié: (2024) -
Large Language Models and Book Summarization: Reading or Remembering, Which Is Better?
par: Fu, Tairan, et autres
Publié: (2026) -
Montague semantics and modifier consistency measurement in neural language models
par: Carvalho, Danilo S., et autres
Publié: (2022) -
A statistically consistent measure of semantic uncertainty using Language Models
par: Liu, Yi
Publié: (2025)