Negation: A Pink Elephant in the Large Language Models' Room?
Fuente:
arXiv
Saved in:
| Main Authors: | Vrabcová, Tereza, Kadlčík, Marek, Sojka, Petr, Štefánik, Michal, Spiegel, Michal |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Concept-aware Data Construction Improves In-context Learning of Language Models
by: Štefánik, Michal, et al.
Published: (2024)
by: Štefánik, Michal, et al.
Published: (2024)
Self-training Language Models for Arithmetic Reasoning
by: Kadlčík, Marek, et al.
Published: (2024)
by: Kadlčík, Marek, et al.
Published: (2024)
Pre-trained Language Models Learn Remarkably Accurate Representations of Numbers
by: Kadlčík, Marek, et al.
Published: (2025)
by: Kadlčík, Marek, et al.
Published: (2025)
Can Out-of-Distribution Evaluations Uncover Reliance on Shortcuts? A Case Study in Question Answering
by: Štefánik, Michal, et al.
Published: (2025)
by: Štefánik, Michal, et al.
Published: (2025)
Think Twice: Measuring the Efficiency of Eliminating Prediction Shortcuts of Question Answering Models
by: Mikula, Lukáš, et al.
Published: (2023)
by: Mikula, Lukáš, et al.
Published: (2023)
VectorEdits: A Dataset and Benchmark for Instruction-Based Editing of Vector Graphics
by: Kuchař, Josef, et al.
Published: (2025)
by: Kuchař, Josef, et al.
Published: (2025)
Attend or Perish: Benchmarking Attention in Algorithmic Reasoning
by: Spiegel, Michal, et al.
Published: (2025)
by: Spiegel, Michal, et al.
Published: (2025)
Language Models Learn Universal Representations of Numbers and Here's Why You Should Care
by: Štefánik, Michal, et al.
Published: (2025)
by: Štefánik, Michal, et al.
Published: (2025)
Suppressing Pink Elephants with Direct Principle Feedback
by: Castricato, Louis, et al.
Published: (2024)
by: Castricato, Louis, et al.
Published: (2024)
IMGTB: A Framework for Machine-Generated Text Detection Benchmarking
by: Spiegel, Michal, et al.
Published: (2023)
by: Spiegel, Michal, et al.
Published: (2023)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
by: Pecher, Branislav, et al.
Published: (2026)
by: Pecher, Branislav, et al.
Published: (2026)
KInIT at SemEval-2024 Task 8: Fine-tuned LLMs for Multilingual Machine-Generated Text Detection
by: Spiegel, Michal, et al.
Published: (2024)
by: Spiegel, Michal, et al.
Published: (2024)
Evaluating Large Language Models in Theory of Mind Tasks
by: Kosinski, Michal
Published: (2023)
by: Kosinski, Michal
Published: (2023)
BenCzechMark : A Czech-centric Multitask and Multimetric Benchmark for Large Language Models with Duel Scoring Mechanism
by: Fajcik, Martin, et al.
Published: (2024)
by: Fajcik, Martin, et al.
Published: (2024)
The Elephant in the Room: Analyzing the Presence of Big Tech in Natural Language Processing Research
by: Abdalla, Mohamed, et al.
Published: (2023)
by: Abdalla, Mohamed, et al.
Published: (2023)
A Review of the Challenges with Massive Web-mined Corpora Used in Large Language Models Pre-Training
by: Perełkiewicz, Michał, et al.
Published: (2024)
by: Perełkiewicz, Michał, et al.
Published: (2024)
Elephant in the Room: Unveiling the Impact of Reward Model Quality in Alignment
by: Liu, Yan, et al.
Published: (2024)
by: Liu, Yan, et al.
Published: (2024)
On the Fundamental Impossibility of Hallucination Control in Large Language Models
by: Karpowicz, Michał P.
Published: (2025)
by: Karpowicz, Michał P.
Published: (2025)
Unchecked and Overlooked: Addressing the Checkbox Blind Spot in Large Language Models with CheckboxQA
by: Turski, Michał, et al.
Published: (2025)
by: Turski, Michał, et al.
Published: (2025)
The Elephant in the Coreference Room: Resolving Coreference in Full-Length French Fiction Works
by: Bourgois, Antoine, et al.
Published: (2025)
by: Bourgois, Antoine, et al.
Published: (2025)
Evaluating Cultural Adaptability of a Large Language Model via Simulation of Synthetic Personas
by: Kwok, Louis, et al.
Published: (2024)
by: Kwok, Louis, et al.
Published: (2024)
The Effectiveness of Large Language Models in Transforming Unstructured Text to Standardized Formats
by: Brach, William, et al.
Published: (2025)
by: Brach, William, et al.
Published: (2025)
GPT Czech Poet: Generation of Czech Poetic Strophes with Language Models
by: Chudoba, Michal, et al.
Published: (2024)
by: Chudoba, Michal, et al.
Published: (2024)
Long-Context Encoder Models for Polish Language Understanding
by: Dadas, Sławomir, et al.
Published: (2026)
by: Dadas, Sławomir, et al.
Published: (2026)
Accurate Legal Reasoning at Scale: Neuro-Symbolic Offloading and Structural Auditability for Robust Legal Adjudication
by: Sójka, Stanisław, et al.
Published: (2026)
by: Sójka, Stanisław, et al.
Published: (2026)
Let's Measure the Elephant in the Room: Facilitating Personalized Automated Analysis of Privacy Policies at Scale
by: Zhao, Rui, et al.
Published: (2025)
by: Zhao, Rui, et al.
Published: (2025)
Large Language Models for Multilingual Previously Fact-Checked Claim Detection
by: Vykopal, Ivan, et al.
Published: (2025)
by: Vykopal, Ivan, et al.
Published: (2025)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
by: Bordt, Sebastian, et al.
Published: (2024)
by: Bordt, Sebastian, et al.
Published: (2024)
SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
by: Perełkiewicz, Michał, et al.
Published: (2025)
by: Perełkiewicz, Michał, et al.
Published: (2025)
LLM4SFC: Sequential Function Chart Generation via Large Language Models
by: Glick, Ofek, et al.
Published: (2025)
by: Glick, Ofek, et al.
Published: (2025)
Applying Text Embedding Models for Efficient Analysis in Labeled Property Graphs
by: Podstawski, Michal
Published: (2025)
by: Podstawski, Michal
Published: (2025)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
by: Gurgurov, Daniil, et al.
Published: (2025)
by: Gurgurov, Daniil, et al.
Published: (2025)
NegativePrompt: Leveraging Psychology for Large Language Models Enhancement via Negative Emotional Stimuli
by: Wang, Xu, et al.
Published: (2024)
by: Wang, Xu, et al.
Published: (2024)
Multilingual Models for Check-Worthy Social Media Posts Detection
by: Kula, Sebastian, et al.
Published: (2024)
by: Kula, Sebastian, et al.
Published: (2024)
Elephants Never Forget: Testing Language Models for Memorization of Tabular Data
by: Bordt, Sebastian, et al.
Published: (2024)
by: Bordt, Sebastian, et al.
Published: (2024)
Large Language Models in Plant Biology
by: Lam, Hilbert Yuen In, et al.
Published: (2024)
by: Lam, Hilbert Yuen In, et al.
Published: (2024)
Think Again! The Effect of Test-Time Compute on Preferences, Opinions, and Beliefs of Large Language Models
by: Kour, George, et al.
Published: (2025)
by: Kour, George, et al.
Published: (2025)
Meta-Reasoning Improves Tool Use in Large Language Models
by: Alazraki, Lisa, et al.
Published: (2024)
by: Alazraki, Lisa, et al.
Published: (2024)
Negated String Containment is Decidable (Technical Report)
by: Havlena, Vojtěch, et al.
Published: (2025)
by: Havlena, Vojtěch, et al.
Published: (2025)
Zero-Shot Fact Verification via Natural Logic and Large Language Models
by: Strong, Marek, et al.
Published: (2024)
by: Strong, Marek, et al.
Published: (2024)
Similar Items
-
Concept-aware Data Construction Improves In-context Learning of Language Models
by: Štefánik, Michal, et al.
Published: (2024) -
Self-training Language Models for Arithmetic Reasoning
by: Kadlčík, Marek, et al.
Published: (2024) -
Pre-trained Language Models Learn Remarkably Accurate Representations of Numbers
by: Kadlčík, Marek, et al.
Published: (2025) -
Can Out-of-Distribution Evaluations Uncover Reliance on Shortcuts? A Case Study in Question Answering
by: Štefánik, Michal, et al.
Published: (2025) -
Think Twice: Measuring the Efficiency of Eliminating Prediction Shortcuts of Question Answering Models
by: Mikula, Lukáš, et al.
Published: (2023)