The Prediction-Measurement Gap: Toward Meaning Representations as Scientific Instruments
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Plisiecki, Hubert |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Eradicating Social Biases in Sentiment Analysis using Semantic Blinding and Semantic Propagation Graph Neural Networks
par: Plisiecki, Hubert
Publié: (2024)
par: Plisiecki, Hubert
Publié: (2024)
Semantic Gradients Interactions in SSD: A Case Study in Racial Identity and Hate Speech
par: Ostrowicki, Felix, et autres
Publié: (2026)
par: Ostrowicki, Felix, et autres
Publié: (2026)
Predicting Emotion Intensity in Polish Political Texts: Comparing Supervised Models and Large Language Models in a Resource-Poor Language
par: Plisiecki, Hubert, et autres
Publié: (2024)
par: Plisiecki, Hubert, et autres
Publié: (2024)
Interpretable Semantic Gradients in SSD: A PCA Sweep Approach and a Case Study on AI Discourse
par: Plisiecki, Hubert, et autres
Publié: (2026)
par: Plisiecki, Hubert, et autres
Publié: (2026)
Supervised Semantic Differential for Cross-Cultural Concept Analysis: A Case Study of Human Affect
par: Sikora, Jan, et autres
Publié: (2026)
par: Sikora, Jan, et autres
Publié: (2026)
High Risk of Political Bias in Black Box Emotion Inference Models
par: Plisiecki, Hubert, et autres
Publié: (2024)
par: Plisiecki, Hubert, et autres
Publié: (2024)
The Pinocchio Dimension: Phenomenality of Experience as the Primary Axis of LLM Psychometric Differences
par: Plisiecki, Hubert, et autres
Publié: (2026)
par: Plisiecki, Hubert, et autres
Publié: (2026)
Owl-AuraID 1.0: An Intelligent System for Autonomous Scientific Instrumentation and Scientific Data Analysis
par: Deng, Han, et autres
Publié: (2026)
par: Deng, Han, et autres
Publié: (2026)
Gap-K%: Measuring Top-1 Prediction Gap for Detecting Pretraining Data
par: Kwak, Minseo, et autres
Publié: (2026)
par: Kwak, Minseo, et autres
Publié: (2026)
Encoded but Not Routed: Explaining the Table-Chart Gap in Scientific Claim Verification
par: Kumar, Sunisth, et autres
Publié: (2026)
par: Kumar, Sunisth, et autres
Publié: (2026)
Enhancing Structured Meaning Representations with Aspect Classification
par: Post, Claire Benét, et autres
Publié: (2026)
par: Post, Claire Benét, et autres
Publié: (2026)
Survey of Abstract Meaning Representation: Then, Now, Future
par: Mansouri, Behrooz
Publié: (2025)
par: Mansouri, Behrooz
Publié: (2025)
Generating Text from Uniform Meaning Representation
par: Markle, Emma, et autres
Publié: (2025)
par: Markle, Emma, et autres
Publié: (2025)
Abstract Meaning Representation for Hospital Discharge Summarization
par: Landes, Paul, et autres
Publié: (2025)
par: Landes, Paul, et autres
Publié: (2025)
Towards Measuring the Representation of Subjective Global Opinions in Language Models
par: Durmus, Esin, et autres
Publié: (2023)
par: Durmus, Esin, et autres
Publié: (2023)
Word Alignment-Based Evaluation of Uniform Meaning Representations
par: Zeman, Daniel, et autres
Publié: (2026)
par: Zeman, Daniel, et autres
Publié: (2026)
Idiom Understanding as a Tool to Measure the Dialect Gap
par: Beauchemin, David, et autres
Publié: (2025)
par: Beauchemin, David, et autres
Publié: (2025)
Towards Controlled Table-to-Text Generation with Scientific Reasoning
par: Guo, Zhixin, et autres
Publié: (2023)
par: Guo, Zhixin, et autres
Publié: (2023)
Scene Abstraction for Lexical Semantics: Structured Representations of Situated Meaning
par: Cho, Yejin, et autres
Publié: (2026)
par: Cho, Yejin, et autres
Publié: (2026)
Neural Semantic Parsing with Extremely Rich Symbolic Meaning Representations
par: Zhang, Xiao, et autres
Publié: (2024)
par: Zhang, Xiao, et autres
Publié: (2024)
SETUP: Sentence-level English-To-Uniform Meaning Representation Parser
par: Markle, Emma, et autres
Publié: (2025)
par: Markle, Emma, et autres
Publié: (2025)
Measuring and Analyzing Subjective Uncertainty in Scientific Communications
par: Sourati, Jamshid, et autres
Publié: (2025)
par: Sourati, Jamshid, et autres
Publié: (2025)
Retrieval or Representation? Reassessing Benchmark Gaps in Multilingual and Visually Rich RAG
par: Asenov, Martin, et autres
Publié: (2026)
par: Asenov, Martin, et autres
Publié: (2026)
Persian Abstract Meaning Representation: Annotation Guidelines and Gold Standard Dataset
par: Takhshid, Reza, et autres
Publié: (2022)
par: Takhshid, Reza, et autres
Publié: (2022)
Lost in Translationese? Reducing Translation Effect Using Abstract Meaning Representation
par: Wein, Shira, et autres
Publié: (2023)
par: Wein, Shira, et autres
Publié: (2023)
Measuring and Mitigating the Distributional Gap Between Real and Simulated User Behaviors
par: Mehri, Shuhaib, et autres
Publié: (2026)
par: Mehri, Shuhaib, et autres
Publié: (2026)
HUME: Measuring the Human-Model Performance Gap in Text Embedding Tasks
par: Assadi, Adnan El, et autres
Publié: (2025)
par: Assadi, Adnan El, et autres
Publié: (2025)
SQLSpace: A Representation Space for Text-to-SQL to Discover and Mitigate Robustness Gaps
par: Srikanth, Neha, et autres
Publié: (2025)
par: Srikanth, Neha, et autres
Publié: (2025)
MASSIVE Multilingual Abstract Meaning Representation: A Dataset and Baselines for Hallucination Detection
par: Regan, Michael, et autres
Publié: (2024)
par: Regan, Michael, et autres
Publié: (2024)
Exploring Zero-Shot ACSA with Unified Meaning Representation in Chain-of-Thought Prompting
par: Ventirozos, Filippos, et autres
Publié: (2025)
par: Ventirozos, Filippos, et autres
Publié: (2025)
From Measurement Instruments to Data: Leveraging Theory-Driven Synthetic Training Data for Classifying Social Constructs
par: Birkenmaier, Lukas, et autres
Publié: (2024)
par: Birkenmaier, Lukas, et autres
Publié: (2024)
Generating Hierarchical JSON Representations of Scientific Sentences Using LLMs
par: Nimmagadda, Satya Sri Rajiteswari, et autres
Publié: (2026)
par: Nimmagadda, Satya Sri Rajiteswari, et autres
Publié: (2026)
Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions
par: Park, Yoonah, et autres
Publié: (2025)
par: Park, Yoonah, et autres
Publié: (2025)
The State of Multilingual LLM Safety Research: From Measuring the Language Gap to Mitigating It
par: Yong, Zheng-Xin, et autres
Publié: (2025)
par: Yong, Zheng-Xin, et autres
Publié: (2025)
The Grounding Gap: How LLMs Anchor the Meaning of Abstract Concepts Differently from Humans
par: Chlapanis, Odysseas S., et autres
Publié: (2026)
par: Chlapanis, Odysseas S., et autres
Publié: (2026)
MeasHalu: Mitigation of Scientific Measurement Hallucinations for Large Language Models with Enhanced Reasoning
par: Huang, Ruijun, et autres
Publié: (2026)
par: Huang, Ruijun, et autres
Publié: (2026)
A Hierarchical Framework for Measuring Scientific Paper Innovation via Large Language Models
par: Tan, Hongming, et autres
Publié: (2025)
par: Tan, Hongming, et autres
Publié: (2025)
SWAN: Semantic Watermarking with Abstract Meaning Representation
par: Ye, Ziping, et autres
Publié: (2026)
par: Ye, Ziping, et autres
Publié: (2026)
AMR-RE: Abstract Meaning Representations for Retrieval-Based In-Context Learning in Relation Extraction
par: Han, Peitao, et autres
Publié: (2024)
par: Han, Peitao, et autres
Publié: (2024)
Approaching the Source of Symbol Grounding with Confluent Reductions of Abstract Meaning Representation Directed Graphs
par: Goulet, Nicolas, et autres
Publié: (2025)
par: Goulet, Nicolas, et autres
Publié: (2025)
Documents similaires
-
Eradicating Social Biases in Sentiment Analysis using Semantic Blinding and Semantic Propagation Graph Neural Networks
par: Plisiecki, Hubert
Publié: (2024) -
Semantic Gradients Interactions in SSD: A Case Study in Racial Identity and Hate Speech
par: Ostrowicki, Felix, et autres
Publié: (2026) -
Predicting Emotion Intensity in Polish Political Texts: Comparing Supervised Models and Large Language Models in a Resource-Poor Language
par: Plisiecki, Hubert, et autres
Publié: (2024) -
Interpretable Semantic Gradients in SSD: A PCA Sweep Approach and a Case Study on AI Discourse
par: Plisiecki, Hubert, et autres
Publié: (2026) -
Supervised Semantic Differential for Cross-Cultural Concept Analysis: A Case Study of Human Affect
par: Sikora, Jan, et autres
Publié: (2026)