Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tamoyan, Hovhannes, Dutta, Subhabrata, Gurevych, Iryna |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM Roleplay: Simulating Human-Chatbot Interaction
par: Tamoyan, Hovhannes, et autres
Publié: (2024)
par: Tamoyan, Hovhannes, et autres
Publié: (2024)
Hierarchical Latent Structures in Data Generation Process Unify Mechanistic Phenomena across Scale
par: Rohweder, Jonas, et autres
Publié: (2026)
par: Rohweder, Jonas, et autres
Publié: (2026)
Uncertainty-Aware Decoding with Minimum Bayes Risk
par: Daheim, Nico, et autres
Publié: (2025)
par: Daheim, Nico, et autres
Publié: (2025)
SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language Models
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2024)
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2024)
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
par: Daheim, Nico, et autres
Publié: (2024)
par: Daheim, Nico, et autres
Publié: (2024)
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
par: Paul, Indraneil, et autres
Publié: (2024)
par: Paul, Indraneil, et autres
Publié: (2024)
SPARE: Single-Pass Annotation with Reference-Guided Evaluation for Automatic Process Supervision and Reward Modelling
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2025)
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2025)
Illusion or Algorithm? Investigating Memorization, Emergence, and Symbolic Processing in In-Context Learning
par: Niu, Jingcheng, et autres
Publié: (2025)
par: Niu, Jingcheng, et autres
Publié: (2025)
Model Merging by Uncertainty-Based Gradient Matching
par: Daheim, Nico, et autres
Publié: (2023)
par: Daheim, Nico, et autres
Publié: (2023)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
par: Liu, Xiaoze, et autres
Publié: (2024)
par: Liu, Xiaoze, et autres
Publié: (2024)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
par: Zhang, Jianyi, et autres
Publié: (2024)
par: Zhang, Jianyi, et autres
Publié: (2024)
Towards Automated Error Discovery: A Study in Conversational AI
par: Petrak, Dominic, et autres
Publié: (2025)
par: Petrak, Dominic, et autres
Publié: (2025)
Language Models with Conformal Factuality Guarantees
par: Mohri, Christopher, et autres
Publié: (2024)
par: Mohri, Christopher, et autres
Publié: (2024)
ORION: Teaching Language Models to Reason Efficiently in the Language of Thought
par: Tanmay, Kumar, et autres
Publié: (2025)
par: Tanmay, Kumar, et autres
Publié: (2025)
Factuality Challenges in the Era of Large Language Models
par: Augenstein, Isabelle, et autres
Publié: (2023)
par: Augenstein, Isabelle, et autres
Publié: (2023)
MathTutorBench: A Benchmark for Measuring Open-ended Pedagogical Capabilities of LLM Tutors
par: Macina, Jakub, et autres
Publié: (2025)
par: Macina, Jakub, et autres
Publié: (2025)
BARREL: Boundary-Aware Reasoning for Factual and Reliable LRMs
par: Yang, Junxiao, et autres
Publié: (2025)
par: Yang, Junxiao, et autres
Publié: (2025)
Predictable Confabulations: Factual Recall by LLMs Scales with Model Size and Topic Frequency
par: Smith, Matthew L., et autres
Publié: (2026)
par: Smith, Matthew L., et autres
Publié: (2026)
Interpreting Key Mechanisms of Factual Recall in Transformer-Based Language Models
par: Lv, Ang, et autres
Publié: (2024)
par: Lv, Ang, et autres
Publié: (2024)
Adaptive Conformal Prediction for Improving Factuality of Generations by Large Language Models
par: Rubashevskii, Aleksandr, et autres
Publié: (2026)
par: Rubashevskii, Aleksandr, et autres
Publié: (2026)
Reward Modeling for Scientific Writing Evaluation
par: Şahinuç, Furkan, et autres
Publié: (2026)
par: Şahinuç, Furkan, et autres
Publié: (2026)
Value-Aware Numerical Representations for Transformer Language Models
par: Dutulescu, Andreea, et autres
Publié: (2026)
par: Dutulescu, Andreea, et autres
Publié: (2026)
Integrative Decoding: Improve Factuality via Implicit Self-consistency
par: Cheng, Yi, et autres
Publié: (2024)
par: Cheng, Yi, et autres
Publié: (2024)
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
par: Yuksekgonul, Mert, et autres
Publié: (2023)
par: Yuksekgonul, Mert, et autres
Publié: (2023)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
par: Chuang, Yung-Sung, et autres
Publié: (2023)
par: Chuang, Yung-Sung, et autres
Publié: (2023)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
par: Rahman, Subhey Sadi, et autres
Publié: (2025)
par: Rahman, Subhey Sadi, et autres
Publié: (2025)
Mitigating Geospatial Knowledge Hallucination in Large Language Models: Benchmarking and Dynamic Factuality Aligning
par: Wang, Shengyuan, et autres
Publié: (2025)
par: Wang, Shengyuan, et autres
Publié: (2025)
Promote, Suppress, Iterate: How Language Models Answer One-to-Many Factual Queries
par: Yan, Tianyi Lorena, et autres
Publié: (2025)
par: Yan, Tianyi Lorena, et autres
Publié: (2025)
The Factuality of Large Language Models in the Legal Domain
par: Hamdani, Rajaa El, et autres
Publié: (2024)
par: Hamdani, Rajaa El, et autres
Publié: (2024)
Is Conformal Factuality for RAG-based LLMs Robust? Novel Metrics and Systematic Insights
par: Chen, Yi, et autres
Publié: (2026)
par: Chen, Yi, et autres
Publié: (2026)
Auditing Language Model Unlearning via Information Decomposition
par: Goel, Anmol, et autres
Publié: (2026)
par: Goel, Anmol, et autres
Publié: (2026)
FactTest: Factuality Testing in Large Language Models with Finite-Sample and Distribution-Free Guarantees
par: Nie, Fan, et autres
Publié: (2024)
par: Nie, Fan, et autres
Publié: (2024)
SWEA: Updating Factual Knowledge in Large Language Models via Subject Word Embedding Altering
par: Li, Xiaopeng, et autres
Publié: (2024)
par: Li, Xiaopeng, et autres
Publié: (2024)
Patches of Nonlinearity: Instruction Vectors in Large Language Models
par: Bigoulaeva, Irina, et autres
Publié: (2026)
par: Bigoulaeva, Irina, et autres
Publié: (2026)
Factual Inconsistency in Data-to-Text Generation Scales Exponentially with LLM Size: A Statistical Validation
par: Mahapatra, Joy, et autres
Publié: (2025)
par: Mahapatra, Joy, et autres
Publié: (2025)
Combee: Scaling Prompt Learning for Self-Improving Language Model Agents
par: Li, Hanchen, et autres
Publié: (2026)
par: Li, Hanchen, et autres
Publié: (2026)
Mechanistic Behavior Editing of Language Models
par: Singh, Joykirat, et autres
Publié: (2024)
par: Singh, Joykirat, et autres
Publié: (2024)
Expert Preference-based Evaluation of Automated Related Work Generation
par: Şahinuç, Furkan, et autres
Publié: (2025)
par: Şahinuç, Furkan, et autres
Publié: (2025)
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
par: Qi, Jirui, et autres
Publié: (2023)
par: Qi, Jirui, et autres
Publié: (2023)
SciCoQA: Quality Assurance for Scientific Paper--Code Alignment
par: Baumgärtner, Tim, et autres
Publié: (2026)
par: Baumgärtner, Tim, et autres
Publié: (2026)
Documents similaires
-
LLM Roleplay: Simulating Human-Chatbot Interaction
par: Tamoyan, Hovhannes, et autres
Publié: (2024) -
Hierarchical Latent Structures in Data Generation Process Unify Mechanistic Phenomena across Scale
par: Rohweder, Jonas, et autres
Publié: (2026) -
Uncertainty-Aware Decoding with Minimum Bayes Risk
par: Daheim, Nico, et autres
Publié: (2025) -
SpaRC and SpaRP: Spatial Reasoning Characterization and Path Generation for Understanding Spatial Reasoning Capability of Large Language Models
par: Rizvi, Md Imbesat Hassan, et autres
Publié: (2024) -
Stepwise Verification and Remediation of Student Reasoning Errors with Large Language Model Tutors
par: Daheim, Nico, et autres
Publié: (2024)