Meaningless is better: hashing bias-inducing words in LLM prompts improves performance in logical reasoning and statistical learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chadimová, Milena, Jurášek, Eduard, Kliegr, Tomáš |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Outputs of Large Language Models are Meaningless
par: Hattiangadi, Anandi, et autres
Publié: (2025)
par: Hattiangadi, Anandi, et autres
Publié: (2025)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
par: Yu, Ping, et autres
Publié: (2025)
par: Yu, Ping, et autres
Publié: (2025)
Fooling LLM graders into giving better grades through neural activity guided adversarial prompting
par: Yamamura, Atsushi, et autres
Publié: (2024)
par: Yamamura, Atsushi, et autres
Publié: (2024)
Is continuous CoT better suited for multi-lingual reasoning?
par: Bashir, Ali Hamza, et autres
Publié: (2026)
par: Bashir, Ali Hamza, et autres
Publié: (2026)
Language hooks: a modular framework for augmenting LLM reasoning that decouples tool usage from the model and its prompt
par: de Mijolla, Damien, et autres
Publié: (2024)
par: de Mijolla, Damien, et autres
Publié: (2024)
Traceable LLM-based validation of statements in knowledge graphs
par: Adam, Daniel, et autres
Publié: (2024)
par: Adam, Daniel, et autres
Publié: (2024)
Can LLMs perform structured graph reasoning?
par: Agrawal, Palaash, et autres
Publié: (2024)
par: Agrawal, Palaash, et autres
Publié: (2024)
A word association network methodology for evaluating implicit biases in LLMs compared to humans
par: Abramski, Katherine, et autres
Publié: (2025)
par: Abramski, Katherine, et autres
Publié: (2025)
Can formal argumentative reasoning enhance LLMs performances?
par: Castagna, Federico, et autres
Publié: (2024)
par: Castagna, Federico, et autres
Publié: (2024)
Certainty robustness: Evaluating LLM stability under self-challenging prompts
par: Saadat, Mohammadreza, et autres
Publié: (2026)
par: Saadat, Mohammadreza, et autres
Publié: (2026)
Alignment-Weighted DPO: A principled reasoning approach to improve safety alignment
par: Hu, Mengxuan, et autres
Publié: (2026)
par: Hu, Mengxuan, et autres
Publié: (2026)
Critical-Questions-of-Thought: Steering LLM reasoning with Argumentative Querying
par: Castagna, Federico, et autres
Publié: (2024)
par: Castagna, Federico, et autres
Publié: (2024)
Superhuman performance of a large language model on the reasoning tasks of a physician
par: Brodeur, Peter G., et autres
Publié: (2024)
par: Brodeur, Peter G., et autres
Publié: (2024)
LLM-based feature generation from text for interpretable machine learning
par: Balek, Vojtěch, et autres
Publié: (2024)
par: Balek, Vojtěch, et autres
Publié: (2024)
MARS: toward more efficient multi-agent collaboration for LLM reasoning
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
par: Han, Yifu, et autres
Publié: (2025)
par: Han, Yifu, et autres
Publié: (2025)
Scaling few-shot spoken word classification with generative meta-continual learning
par: Beyers, Louise, et autres
Publié: (2026)
par: Beyers, Louise, et autres
Publié: (2026)
Prompt-prompted Adaptive Structured Pruning for Efficient LLM Generation
par: Dong, Harry, et autres
Publié: (2024)
par: Dong, Harry, et autres
Publié: (2024)
DeepSeek performs better than other Large Language Models in Dental Cases
par: Zhang, Hexian, et autres
Publié: (2025)
par: Zhang, Hexian, et autres
Publié: (2025)
Auto prompting without training labels: An LLM cascade for product quality assessment in e-commerce catalogs
par: Satyadharma, Soham, et autres
Publié: (2025)
par: Satyadharma, Soham, et autres
Publié: (2025)
Retrieval-augmented reasoning with lean language models
par: Chan, Ryan Sze-Yin, et autres
Publié: (2025)
par: Chan, Ryan Sze-Yin, et autres
Publié: (2025)
Temperature-scaling surprisal estimates improve fit to human reading times -- but does it do so for the "right reasons"?
par: Liu, Tong, et autres
Publié: (2023)
par: Liu, Tong, et autres
Publié: (2023)
Does language matter for spoken word classification? A multilingual generative meta-learning approach
par: Ziki, Batsirayi Mupamhi, et autres
Publié: (2026)
par: Ziki, Batsirayi Mupamhi, et autres
Publié: (2026)
Towards better Human-Agent Alignment: Assessing Task Utility in LLM-Powered Applications
par: Arabzadeh, Negar, et autres
Publié: (2024)
par: Arabzadeh, Negar, et autres
Publié: (2024)
Cognitive bias in LLM reasoning compromises interpretation of clinical oncology notes
par: Kenaston, Matthew W., et autres
Publié: (2025)
par: Kenaston, Matthew W., et autres
Publié: (2025)
How word semantics and phonology affect handwriting of Alzheimer's patients: a machine learning based analysis
par: Cilia, Nicole Dalia, et autres
Publié: (2023)
par: Cilia, Nicole Dalia, et autres
Publié: (2023)
Child vs. machine language learning: Can the logical structure of human language unleash LLMs?
par: Sauerland, Uli, et autres
Publié: (2025)
par: Sauerland, Uli, et autres
Publié: (2025)
Multi-step retrieval and reasoning improves radiology question answering with large language models
par: Wind, Sebastian, et autres
Publié: (2025)
par: Wind, Sebastian, et autres
Publié: (2025)
Knowledge prompt chaining for semantic modeling
par: Ding, Ning Pei, et autres
Publié: (2025)
par: Ding, Ning Pei, et autres
Publié: (2025)
Fine-Grained Bias Detection in LLM: Enhancing detection mechanisms for nuanced biases
par: Mohanty, Suvendu
Publié: (2025)
par: Mohanty, Suvendu
Publié: (2025)
IoT-LLM: a framework for enhancing Large Language Model reasoning from real-world sensor data
par: An, Tuo, et autres
Publié: (2024)
par: An, Tuo, et autres
Publié: (2024)
StateAct: Enhancing LLM Base Agents via Self-prompting and State-tracking
par: Rozanov, Nikolai, et autres
Publié: (2024)
par: Rozanov, Nikolai, et autres
Publié: (2024)
Phi-4-reasoning Technical Report
par: Abdin, Marah, et autres
Publié: (2025)
par: Abdin, Marah, et autres
Publié: (2025)
MOSLIM:Align with diverse preferences in prompts through reward classification
par: Zhang, Yu, et autres
Publié: (2025)
par: Zhang, Yu, et autres
Publié: (2025)
Preference learning in shades of gray: Interpretable and bias-aware reward modeling for human preferences
par: Oprea, Simona-Vasilica, et autres
Publié: (2026)
par: Oprea, Simona-Vasilica, et autres
Publié: (2026)
Mitigating LLM biases toward spurious social contexts using direct preference optimization
par: Nam, Hyunji, et autres
Publié: (2026)
par: Nam, Hyunji, et autres
Publié: (2026)
Is your LLM trapped in a Mental Set? Investigative study on how mental sets affect the reasoning capabilities of LLMs
par: Haq, Saiful, et autres
Publié: (2025)
par: Haq, Saiful, et autres
Publié: (2025)
Explaining word embeddings with perfect fidelity: Case study in research impact prediction
par: Dvorackova, Lucie, et autres
Publié: (2024)
par: Dvorackova, Lucie, et autres
Publié: (2024)
Temporal reasoning for timeline summarisation in social media
par: Song, Jiayu, et autres
Publié: (2024)
par: Song, Jiayu, et autres
Publié: (2024)
Mis-prompt: Benchmarking Large Language Models for Proactive Error Handling
par: Zeng, Jiayi, et autres
Publié: (2025)
par: Zeng, Jiayi, et autres
Publié: (2025)
Documents similaires
-
The Outputs of Large Language Models are Meaningless
par: Hattiangadi, Anandi, et autres
Publié: (2025) -
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
par: Yu, Ping, et autres
Publié: (2025) -
Fooling LLM graders into giving better grades through neural activity guided adversarial prompting
par: Yamamura, Atsushi, et autres
Publié: (2024) -
Is continuous CoT better suited for multi-lingual reasoning?
par: Bashir, Ali Hamza, et autres
Publié: (2026) -
Language hooks: a modular framework for augmenting LLM reasoning that decouples tool usage from the model and its prompt
par: de Mijolla, Damien, et autres
Publié: (2024)