Guardado en:
| Autores principales: | Chang, Tyler A., Rajagopal, Dheeraj, Bolukbasi, Tolga, Dixon, Lucas, Tenney, Ian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2410.17413 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLM Comparator: Visual Analytics for Side-by-Side Evaluation of Large Language Models
por: Kahng, Minsuk, et al.
Publicado: (2024)
por: Kahng, Minsuk, et al.
Publicado: (2024)
How Far Can We Extract Diverse Perspectives from Large Language Models?
por: Hayati, Shirley Anugrah, et al.
Publicado: (2023)
por: Hayati, Shirley Anugrah, et al.
Publicado: (2023)
Interactive Prompt Debugging with Sequence Salience
por: Tenney, Ian, et al.
Publicado: (2024)
por: Tenney, Ian, et al.
Publicado: (2024)
Steering off Course: Reliability Challenges in Steering Language Models
por: Da Silva, Patrick Queiroz, et al.
Publicado: (2025)
por: Da Silva, Patrick Queiroz, et al.
Publicado: (2025)
Unsupervised Pretraining for Fact Verification by Language Model Distillation
por: Bazaga, Adrián, et al.
Publicado: (2023)
por: Bazaga, Adrián, et al.
Publicado: (2023)
Facts in Stats: Impacts of Pretraining Diversity on Language Model Generalization
por: Behnia, Tina, et al.
Publicado: (2025)
por: Behnia, Tina, et al.
Publicado: (2025)
A Study on Hidden Layer Distillation for Large Language Model Pre-Training
por: Guigon, Maxime, et al.
Publicado: (2026)
por: Guigon, Maxime, et al.
Publicado: (2026)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
por: Yu, Huimu, et al.
Publicado: (2024)
por: Yu, Huimu, et al.
Publicado: (2024)
Competition of Mechanisms: Tracing How Language Models Handle Facts and Counterfactuals
por: Ortu, Francesco, et al.
Publicado: (2024)
por: Ortu, Francesco, et al.
Publicado: (2024)
Confidence Calibration and Rationalization for LLMs via Multi-Agent Deliberation
por: Yang, Ruixin, et al.
Publicado: (2024)
por: Yang, Ruixin, et al.
Publicado: (2024)
Tracing Facts or just Copies? A critical investigation of the Competitions of Mechanisms in Large Language Models
por: Campregher, Dante, et al.
Publicado: (2025)
por: Campregher, Dante, et al.
Publicado: (2025)
Smaller Language Models are capable of selecting Instruction-Tuning Training Data for Larger Language Models
por: Mekala, Dheeraj, et al.
Publicado: (2024)
por: Mekala, Dheeraj, et al.
Publicado: (2024)
Logical Consistency of Large Language Models in Fact-checking
por: Ghosh, Bishwamittra, et al.
Publicado: (2024)
por: Ghosh, Bishwamittra, et al.
Publicado: (2024)
Scaling Laws for Fact Memorization of Large Language Models
por: Lu, Xingyu, et al.
Publicado: (2024)
por: Lu, Xingyu, et al.
Publicado: (2024)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
por: Yang, Linyao, et al.
Publicado: (2023)
por: Yang, Linyao, et al.
Publicado: (2023)
Tracing the Roots of Facts in Multilingual Language Models: Independent, Shared, and Transferred Knowledge
por: Zhao, Xin, et al.
Publicado: (2024)
por: Zhao, Xin, et al.
Publicado: (2024)
On the Generalizability of "Competition of Mechanisms: Tracing How Language Models Handle Facts and Counterfactuals"
por: Dotsinski, Asen, et al.
Publicado: (2025)
por: Dotsinski, Asen, et al.
Publicado: (2025)
Beyond Facts: Benchmarking Distributional Reading Comprehension in Large Language Models
por: Guo, Pei-Fu, et al.
Publicado: (2026)
por: Guo, Pei-Fu, et al.
Publicado: (2026)
The Perils & Promises of Fact-checking with Large Language Models
por: Quelle, Dorian, et al.
Publicado: (2023)
por: Quelle, Dorian, et al.
Publicado: (2023)
Kongzi: A Historical Large Language Model with Fact Enhancement
por: Yang, Jiashu, et al.
Publicado: (2025)
por: Yang, Jiashu, et al.
Publicado: (2025)
How Do Large Language Models Acquire Factual Knowledge During Pretraining?
por: Chang, Hoyeon, et al.
Publicado: (2024)
por: Chang, Hoyeon, et al.
Publicado: (2024)
Scalable Fact-checking with Human-in-the-Loop
por: Yang, Jing, et al.
Publicado: (2021)
por: Yang, Jing, et al.
Publicado: (2021)
Tracing the Representation Geometry of Language Models from Pretraining to Post-training
por: Li, Melody Zixuan, et al.
Publicado: (2025)
por: Li, Melody Zixuan, et al.
Publicado: (2025)
Detecting Hallucination and Coverage Errors in Retrieval Augmented Generation for Controversial Topics
por: Chang, Tyler A., et al.
Publicado: (2024)
por: Chang, Tyler A., et al.
Publicado: (2024)
Bigram Subnetworks: Mapping to Next Tokens in Transformer Language Models
por: Chang, Tyler A., et al.
Publicado: (2025)
por: Chang, Tyler A., et al.
Publicado: (2025)
On Large Language Models' Hallucination with Regard to Known Facts
por: Jiang, Che, et al.
Publicado: (2024)
por: Jiang, Che, et al.
Publicado: (2024)
Fine-Tuned Large Language Models for Logical Translation: Reducing Hallucinations with Lang2Logic
por: Pan, Muyu, et al.
Publicado: (2025)
por: Pan, Muyu, et al.
Publicado: (2025)
MedFact: Benchmarking the Fact-Checking Capabilities of Large Language Models on Chinese Medical Texts
por: He, Jiayi, et al.
Publicado: (2025)
por: He, Jiayi, et al.
Publicado: (2025)
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
por: Chang, Shenxu, et al.
Publicado: (2025)
por: Chang, Shenxu, et al.
Publicado: (2025)
Generative Large Language Models in Automated Fact-Checking: A Survey
por: Vykopal, Ivan, et al.
Publicado: (2024)
por: Vykopal, Ivan, et al.
Publicado: (2024)
Automated Fact-Checking of Climate Change Claims with Large Language Models
por: Leippold, Markus, et al.
Publicado: (2024)
por: Leippold, Markus, et al.
Publicado: (2024)
Large Language Models for Multilingual Previously Fact-Checked Claim Detection
por: Vykopal, Ivan, et al.
Publicado: (2025)
por: Vykopal, Ivan, et al.
Publicado: (2025)
Pretraining Large Language Models with NVFP4
por: NVIDIA, et al.
Publicado: (2025)
por: NVIDIA, et al.
Publicado: (2025)
The Role of Mixed-Language Documents for Multilingual Large Language Model Pretraining
por: Shao, Jiandong, et al.
Publicado: (2026)
por: Shao, Jiandong, et al.
Publicado: (2026)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
por: Yang, Shuo, et al.
Publicado: (2025)
por: Yang, Shuo, et al.
Publicado: (2025)
Goldfish: Monolingual Language Models for 350 Languages
por: Chang, Tyler A., et al.
Publicado: (2024)
por: Chang, Tyler A., et al.
Publicado: (2024)
Fact or Guesswork? Evaluating Large Language Models' Medical Knowledge with Structured One-Hop Judgments
por: Li, Jiaxi, et al.
Publicado: (2025)
por: Li, Jiaxi, et al.
Publicado: (2025)
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
por: Hao, Yijie, et al.
Publicado: (2025)
por: Hao, Yijie, et al.
Publicado: (2025)
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
por: Feng, Jiahai, et al.
Publicado: (2024)
por: Feng, Jiahai, et al.
Publicado: (2024)
FASTTRACK: Fast and Accurate Fact Tracing for LLMs
por: Chen, Si, et al.
Publicado: (2024)
por: Chen, Si, et al.
Publicado: (2024)
Ejemplares similares
-
LLM Comparator: Visual Analytics for Side-by-Side Evaluation of Large Language Models
por: Kahng, Minsuk, et al.
Publicado: (2024) -
How Far Can We Extract Diverse Perspectives from Large Language Models?
por: Hayati, Shirley Anugrah, et al.
Publicado: (2023) -
Interactive Prompt Debugging with Sequence Salience
por: Tenney, Ian, et al.
Publicado: (2024) -
Steering off Course: Reliability Challenges in Steering Language Models
por: Da Silva, Patrick Queiroz, et al.
Publicado: (2025) -
Unsupervised Pretraining for Fact Verification by Language Model Distillation
por: Bazaga, Adrián, et al.
Publicado: (2023)