Temporally Consistent Factuality Probing for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Bajpai, Ashutosh, Goyal, Aaryan, Anwer, Atif, Chakraborty, Tanmoy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multilingual LLMs Inherently Reward In-Language Time-Sensitive Semantic Alignment for Low-Resource Languages
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2024)
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2024)
Temporal Referential Consistency: Do LLMs Favor Sequences Over Absolute Time References?
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2025)
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2025)
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
di: Hengle, Amey, et al.
Pubblicazione: (2024)
di: Hengle, Amey, et al.
Pubblicazione: (2024)
SpatialMath: Spatial Comprehension-Infused Symbolic Reasoning for Mathematical Problem-Solving
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2026)
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2026)
Factuality Challenges in the Era of Large Language Models
di: Augenstein, Isabelle, et al.
Pubblicazione: (2023)
di: Augenstein, Isabelle, et al.
Pubblicazione: (2023)
Factual Consistency of Multilingual Pretrained Language Models
di: Fierro, Constanza, et al.
Pubblicazione: (2022)
di: Fierro, Constanza, et al.
Pubblicazione: (2022)
Information Anxiety in Large Language Models
di: Bajpai, Prasoon, et al.
Pubblicazione: (2024)
di: Bajpai, Prasoon, et al.
Pubblicazione: (2024)
Waking Up Blind: Cold-Start Optimization of Supervision-Free Agentic Trajectories for Grounded Visual Perception
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2026)
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2026)
Focal Inferential Infusion Coupled with Tractable Density Discrimination for Implicit Hate Detection
di: Masud, Sarah, et al.
Pubblicazione: (2023)
di: Masud, Sarah, et al.
Pubblicazione: (2023)
Efficient Training of Language Models with Compact and Consistent Next Token Distributions
di: Sathe, Ashutosh, et al.
Pubblicazione: (2024)
di: Sathe, Ashutosh, et al.
Pubblicazione: (2024)
Persona-aware Generative Model for Code-mixed Language
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models
di: Wang, Yanling, et al.
Pubblicazione: (2024)
di: Wang, Yanling, et al.
Pubblicazione: (2024)
Latent Performance Profiling of Large Language Models
di: Chakraborty, Tanmoy, et al.
Pubblicazione: (2026)
di: Chakraborty, Tanmoy, et al.
Pubblicazione: (2026)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
POSIX: A Prompt Sensitivity Index For Large Language Models
di: Chatterjee, Anwoy, et al.
Pubblicazione: (2024)
di: Chatterjee, Anwoy, et al.
Pubblicazione: (2024)
Factual Knowledge in Language Models: Robustness and Anomalies under Simple Temporal Context Variations
di: Khodja, Hichem Ammar, et al.
Pubblicazione: (2025)
di: Khodja, Hichem Ammar, et al.
Pubblicazione: (2025)
Multilingual Language Models Encode Script Over Linguistic Structure
di: Verma, Aastha A K, et al.
Pubblicazione: (2026)
di: Verma, Aastha A K, et al.
Pubblicazione: (2026)
Alternate Preference Optimization for Unlearning Factual Knowledge in Large Language Models
di: Mekala, Anmol, et al.
Pubblicazione: (2024)
di: Mekala, Anmol, et al.
Pubblicazione: (2024)
Cross-Lingual Consistency of Factual Knowledge in Multilingual Language Models
di: Qi, Jirui, et al.
Pubblicazione: (2023)
di: Qi, Jirui, et al.
Pubblicazione: (2023)
Assessing Factual Music Comprehension in Large Audio Language Models
di: Lin, Daniel Chenyu, et al.
Pubblicazione: (2025)
di: Lin, Daniel Chenyu, et al.
Pubblicazione: (2025)
Zero-shot Factual Consistency Evaluation Across Domains
di: Agarwal, Raunak
Pubblicazione: (2024)
di: Agarwal, Raunak
Pubblicazione: (2024)
The Illusionist's Prompt: Exposing the Factual Vulnerabilities of Large Language Models with Linguistic Nuances
di: Wang, Yining, et al.
Pubblicazione: (2025)
di: Wang, Yining, et al.
Pubblicazione: (2025)
Conformal Language Model Reasoning with Coherent Factuality
di: Rubin-Toles, Maxon, et al.
Pubblicazione: (2025)
di: Rubin-Toles, Maxon, et al.
Pubblicazione: (2025)
Multilingual Test-Time Scaling via Initial Thought Transfer
di: Bajpai, Prasoon, et al.
Pubblicazione: (2025)
di: Bajpai, Prasoon, et al.
Pubblicazione: (2025)
How to Upscale Neural Networks with Scaling Law? A Survey and Practical Guidelines
di: Sengupta, Ayan, et al.
Pubblicazione: (2025)
di: Sengupta, Ayan, et al.
Pubblicazione: (2025)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
di: Joshi, Maithili, et al.
Pubblicazione: (2025)
di: Joshi, Maithili, et al.
Pubblicazione: (2025)
The Factuality of Large Language Models in the Legal Domain
di: Hamdani, Rajaa El, et al.
Pubblicazione: (2024)
di: Hamdani, Rajaa El, et al.
Pubblicazione: (2024)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
di: Liu, Xiaoze, et al.
Pubblicazione: (2024)
di: Liu, Xiaoze, et al.
Pubblicazione: (2024)
Unmasking Hallucinations: A Causal Graph-Attention Perspective on Factual Reliability in Large Language Models
di: kurra, Sailesh kiran, et al.
Pubblicazione: (2026)
di: kurra, Sailesh kiran, et al.
Pubblicazione: (2026)
Are Large Language Models In-Context Personalized Summarizers? Get an iCOPERNICUS Test Done!
di: Patel, Divya, et al.
Pubblicazione: (2024)
di: Patel, Divya, et al.
Pubblicazione: (2024)
Towards Statistical Factuality Guarantee for Large Vision-Language Models
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
di: Li, Zhuohang, et al.
Pubblicazione: (2025)
Reliable Chain-of-Thought via Prefix Consistency
di: Iwase, Naoto, et al.
Pubblicazione: (2026)
di: Iwase, Naoto, et al.
Pubblicazione: (2026)
Adaptive Conformal Prediction for Improving Factuality of Generations by Large Language Models
di: Rubashevskii, Aleksandr, et al.
Pubblicazione: (2026)
di: Rubashevskii, Aleksandr, et al.
Pubblicazione: (2026)
Improving Self Consistency in LLMs through Probabilistic Tokenization
di: Sathe, Ashutosh, et al.
Pubblicazione: (2024)
di: Sathe, Ashutosh, et al.
Pubblicazione: (2024)
LoLCATs: On Low-Rank Linearizing of Large Language Models
di: Zhang, Michael, et al.
Pubblicazione: (2024)
di: Zhang, Michael, et al.
Pubblicazione: (2024)
Language Models with Conformal Factuality Guarantees
di: Mohri, Christopher, et al.
Pubblicazione: (2024)
di: Mohri, Christopher, et al.
Pubblicazione: (2024)
Less is More for Improving Automatic Evaluation of Factual Consistency
di: Wang, Tong, et al.
Pubblicazione: (2024)
di: Wang, Tong, et al.
Pubblicazione: (2024)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
di: Zhang, Jianyi, et al.
Pubblicazione: (2024)
di: Zhang, Jianyi, et al.
Pubblicazione: (2024)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2023)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2023)
GenAudit: Fixing Factual Errors in Language Model Outputs with Evidence
di: Krishna, Kundan, et al.
Pubblicazione: (2024)
di: Krishna, Kundan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multilingual LLMs Inherently Reward In-Language Time-Sensitive Semantic Alignment for Low-Resource Languages
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2024) -
Temporal Referential Consistency: Do LLMs Favor Sequences Over Absolute Time References?
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2025) -
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
di: Hengle, Amey, et al.
Pubblicazione: (2024) -
SpatialMath: Spatial Comprehension-Infused Symbolic Reasoning for Mathematical Problem-Solving
di: Bajpai, Ashutosh, et al.
Pubblicazione: (2026) -
Factuality Challenges in the Era of Large Language Models
di: Augenstein, Isabelle, et al.
Pubblicazione: (2023)