Language Models' Factuality Depends on the Language of Inquiry
Fuente:
arXiv
Salvato in:
| Autori principali: | Aggarwal, Tushar, Tanmay, Kumar, Agrawal, Ayush, Ayush, Kumar, Palangi, Hamid, Liang, Paul Pu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learn Globally, Speak Locally: Bridging the Gaps in Multilingual Reasoning
di: Hwang, Jaedong, et al.
Pubblicazione: (2025)
di: Hwang, Jaedong, et al.
Pubblicazione: (2025)
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
di: Tanmay, Kumar, et al.
Pubblicazione: (2025)
di: Tanmay, Kumar, et al.
Pubblicazione: (2025)
Revisiting Multilingual Data Mixtures in Language Model Pretraining
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
di: Foroutan, Negar, et al.
Pubblicazione: (2025)
Do Language Models Know When They're Hallucinating References?
di: Agrawal, Ayush, et al.
Pubblicazione: (2023)
di: Agrawal, Ayush, et al.
Pubblicazione: (2023)
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
di: Yuksekgonul, Mert, et al.
Pubblicazione: (2023)
di: Yuksekgonul, Mert, et al.
Pubblicazione: (2023)
Ethical Reasoning and Moral Value Alignment of LLMs Depend on the Language we Prompt them in
di: Agarwal, Utkarsh, et al.
Pubblicazione: (2024)
di: Agarwal, Utkarsh, et al.
Pubblicazione: (2024)
Why Synthetic Isn't Real Yet: A Diagnostic Framework for Contact Center Dialogue Generation
di: Devanathan, Rishikesh, et al.
Pubblicazione: (2025)
di: Devanathan, Rishikesh, et al.
Pubblicazione: (2025)
Spot the BlindSpots: Systematic Identification and Quantification of Fine-Grained LLM Biases in Contact Center Summaries
di: Mayilvaghanan, Kawin, et al.
Pubblicazione: (2025)
di: Mayilvaghanan, Kawin, et al.
Pubblicazione: (2025)
Graphing the Truth: Structured Visualizations for Automated Hallucination Detection in LLMs
di: Agrawal, Tanmay
Pubblicazione: (2025)
di: Agrawal, Tanmay
Pubblicazione: (2025)
Beyond Captioning: Task-Specific Prompting for Improved VLM Performance in Mathematical Reasoning
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
di: Singla, Pratham, et al.
Pubblicazione: (2025)
di: Singla, Pratham, et al.
Pubblicazione: (2025)
GaussMark: A Practical Approach for Structural Watermarking of Language Models
di: Block, Adam, et al.
Pubblicazione: (2025)
di: Block, Adam, et al.
Pubblicazione: (2025)
PLAN-TUNING: Post-Training Language Models to Learn Step-by-Step Planning for Complex Problem Solving
di: Parmar, Mihir, et al.
Pubblicazione: (2025)
di: Parmar, Mihir, et al.
Pubblicazione: (2025)
Question Answering on Patient Medical Records with Private Fine-Tuned LLMs
di: Kothari, Sara, et al.
Pubblicazione: (2025)
di: Kothari, Sara, et al.
Pubblicazione: (2025)
PASS: Presentation Automation for Slide Generation and Speech
di: Aggarwal, Tushar, et al.
Pubblicazione: (2025)
di: Aggarwal, Tushar, et al.
Pubblicazione: (2025)
Generating Benchmarks for Factuality Evaluation of Language Models
di: Muhlgay, Dor, et al.
Pubblicazione: (2023)
di: Muhlgay, Dor, et al.
Pubblicazione: (2023)
Factuality of Large Language Models: A Survey
di: Wang, Yuxia, et al.
Pubblicazione: (2024)
di: Wang, Yuxia, et al.
Pubblicazione: (2024)
Do Moral Judgment and Reasoning Capability of LLMs Change with Language? A Study using the Multilingual Defining Issues Test
di: Khandelwal, Aditi, et al.
Pubblicazione: (2024)
di: Khandelwal, Aditi, et al.
Pubblicazione: (2024)
Aligning Knowledge Graphs and Language Models for Factual Accuracy
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
FLAME: Factuality-Aware Alignment for Large Language Models
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
di: Lin, Sheng-Chieh, et al.
Pubblicazione: (2024)
Empowering Language Models with Active Inquiry for Deeper Understanding
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2024)
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2024)
Training Language Models via Neural Cellular Automata
di: Lee, Dan, et al.
Pubblicazione: (2026)
di: Lee, Dan, et al.
Pubblicazione: (2026)
Robustness of Large Language Models to Perturbations in Text
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
The FACTS Leaderboard: A Comprehensive Benchmark for Large Language Model Factuality
di: Cheng, Aileen, et al.
Pubblicazione: (2025)
di: Cheng, Aileen, et al.
Pubblicazione: (2025)
Language Models with Conformal Factuality Guarantees
di: Mohri, Christopher, et al.
Pubblicazione: (2024)
di: Mohri, Christopher, et al.
Pubblicazione: (2024)
Mechanistic Understanding and Mitigation of Language Model Non-Factual Hallucinations
di: Yu, Lei, et al.
Pubblicazione: (2024)
di: Yu, Lei, et al.
Pubblicazione: (2024)
Reasoning Factual Knowledge in Structured Data with Large Language Models
di: Huang, Sirui, et al.
Pubblicazione: (2024)
di: Huang, Sirui, et al.
Pubblicazione: (2024)
A Glitch in the Matrix? Locating and Detecting Language Model Grounding with Fakepedia
di: Monea, Giovanni, et al.
Pubblicazione: (2023)
di: Monea, Giovanni, et al.
Pubblicazione: (2023)
Diversity of Thought Improves Reasoning Abilities of LLMs
di: Naik, Ranjita, et al.
Pubblicazione: (2023)
di: Naik, Ranjita, et al.
Pubblicazione: (2023)
Can GPT Redefine Medical Understanding? Evaluating GPT on Biomedical Machine Reading Comprehension
di: Vatsal, Shubham, et al.
Pubblicazione: (2024)
di: Vatsal, Shubham, et al.
Pubblicazione: (2024)
LLM-Based Section Identifiers Excel on Open Source but Stumble in Real World Applications
di: Krishnamoorthy, Saranya, et al.
Pubblicazione: (2024)
di: Krishnamoorthy, Saranya, et al.
Pubblicazione: (2024)
Enhancing Adverse Drug Event Detection with Multimodal Dataset: Corpus Creation and Model Development
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
Editing Factual Knowledge and Explanatory Ability of Medical Large Language Models
di: Xu, Derong, et al.
Pubblicazione: (2024)
di: Xu, Derong, et al.
Pubblicazione: (2024)
FactAlign: Long-form Factuality Alignment of Large Language Models
di: Huang, Chao-Wei, et al.
Pubblicazione: (2024)
di: Huang, Chao-Wei, et al.
Pubblicazione: (2024)
Factuality Challenges in the Era of Large Language Models
di: Augenstein, Isabelle, et al.
Pubblicazione: (2023)
di: Augenstein, Isabelle, et al.
Pubblicazione: (2023)
Exploring Group and Symmetry Principles in Large Language Models
di: Imani, Shima, et al.
Pubblicazione: (2024)
di: Imani, Shima, et al.
Pubblicazione: (2024)
ModelCitizens: Representing Community Voices in Online Safety
di: Suvarna, Ashima, et al.
Pubblicazione: (2025)
di: Suvarna, Ashima, et al.
Pubblicazione: (2025)
Attributional Safety Failures in Large Language Models under Code-Mixed Perturbations
di: Banerjee, Somnath, et al.
Pubblicazione: (2025)
di: Banerjee, Somnath, et al.
Pubblicazione: (2025)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Learn Globally, Speak Locally: Bridging the Gaps in Multilingual Reasoning
di: Hwang, Jaedong, et al.
Pubblicazione: (2025) -
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
di: Tanmay, Kumar, et al.
Pubblicazione: (2025) -
Revisiting Multilingual Data Mixtures in Language Model Pretraining
di: Foroutan, Negar, et al.
Pubblicazione: (2025) -
Do Language Models Know When They're Hallucinating References?
di: Agrawal, Ayush, et al.
Pubblicazione: (2023) -
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
di: Yuksekgonul, Mert, et al.
Pubblicazione: (2023)