Improving Factual Accuracy of Neural Table-to-Text Output by Addressing Input Problems in ToTTo
Fuente:
arXiv
Salvato in:
| Autori principali: | Sundararajan, Barkavi, Sripada, Somayajulu, Reiter, Ehud |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Input Matters: Evaluating Input Structure's Impact on LLM Summaries of Sports Play-by-Play
di: Sundararajan, Barkavi, et al.
Pubblicazione: (2025)
di: Sundararajan, Barkavi, et al.
Pubblicazione: (2025)
Natural Language Generation
di: Reiter, Ehud
Pubblicazione: (2025)
di: Reiter, Ehud
Pubblicazione: (2025)
NLG Evaluation: Past, Present, Future
di: Reiter, Ehud
Pubblicazione: (2026)
di: Reiter, Ehud
Pubblicazione: (2026)
We Should Evaluate Real-World Impact
di: Reiter, Ehud
Pubblicazione: (2025)
di: Reiter, Ehud
Pubblicazione: (2025)
Distributional Semantics Tracing: A Framework for Explaining Hallucinations in Large Language Models
di: Bhatia, Gagan, et al.
Pubblicazione: (2025)
di: Bhatia, Gagan, et al.
Pubblicazione: (2025)
Beyond Factual Accuracy: Evaluating Coverage of Diverse Factual Information in Long-form Text Generation
di: Samarinas, Chris, et al.
Pubblicazione: (2025)
di: Samarinas, Chris, et al.
Pubblicazione: (2025)
Linguistically Communicating Uncertainty in Patient-Facing Risk Prediction Models
di: Sivaprasad, Adarsa, et al.
Pubblicazione: (2024)
di: Sivaprasad, Adarsa, et al.
Pubblicazione: (2024)
Scalability of Bayesian Network Structure Elicitation with Large Language Models: a Novel Methodology and Comparative Analysis
di: Babakov, Nikolay, et al.
Pubblicazione: (2024)
di: Babakov, Nikolay, et al.
Pubblicazione: (2024)
DiTTo-TTS: Diffusion Transformers for Scalable Text-to-Speech without Domain-Specific Factors
di: Lee, Keon, et al.
Pubblicazione: (2024)
di: Lee, Keon, et al.
Pubblicazione: (2024)
Prompting Science Report 4: Playing Pretend: Expert Personas Don't Improve Factual Accuracy
di: Basil, Savir, et al.
Pubblicazione: (2025)
di: Basil, Savir, et al.
Pubblicazione: (2025)
FS-RAG: A Frame Semantics Based Approach for Improved Factual Accuracy in Large Language Models
di: Madabushi, Harish Tayyar
Pubblicazione: (2024)
di: Madabushi, Harish Tayyar
Pubblicazione: (2024)
Textual Summarisation of Large Sets: Towards a General Approach
di: Kuptavanich, Kittipitch, et al.
Pubblicazione: (2024)
di: Kuptavanich, Kittipitch, et al.
Pubblicazione: (2024)
The Curious Case of Factuality Finetuning: Models' Internal Beliefs Can Improve Factuality
di: Newman, Benjamin, et al.
Pubblicazione: (2025)
di: Newman, Benjamin, et al.
Pubblicazione: (2025)
Aligning Knowledge Graphs and Language Models for Factual Accuracy
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
di: Nishat, Nur A Zarin, et al.
Pubblicazione: (2025)
Improving Factuality with Explicit Working Memory
di: Chen, Mingda, et al.
Pubblicazione: (2024)
di: Chen, Mingda, et al.
Pubblicazione: (2024)
Factuality on Demand: Controlling the Factuality-Informativeness Trade-off in Text Generation
di: Gong, Ziwei, et al.
Pubblicazione: (2026)
di: Gong, Ziwei, et al.
Pubblicazione: (2026)
Localizing Factual Inconsistencies in Attributable Text Generation
di: Cattan, Arie, et al.
Pubblicazione: (2024)
di: Cattan, Arie, et al.
Pubblicazione: (2024)
GenAudit: Fixing Factual Errors in Language Model Outputs with Evidence
di: Krishna, Kundan, et al.
Pubblicazione: (2024)
di: Krishna, Kundan, et al.
Pubblicazione: (2024)
MoleculeQA: A Dataset to Evaluate Factual Accuracy in Molecular Comprehension
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
Step-by-step Instructions and a Simple Tabular Output Format Improve the Dependency Parsing Accuracy of LLMs
di: Matsuda, Hiroshi, et al.
Pubblicazione: (2025)
di: Matsuda, Hiroshi, et al.
Pubblicazione: (2025)
Improving Text-to-Image Generation with Input-Side Inference-Time Scaling
di: Chen, Ruibo, et al.
Pubblicazione: (2025)
di: Chen, Ruibo, et al.
Pubblicazione: (2025)
An End-to-End System for Culturally-Attuned Driving Feedback using a Dual-Component NLG Engine
di: Thompson, Iniakpokeikiye Peter, et al.
Pubblicazione: (2025)
di: Thompson, Iniakpokeikiye Peter, et al.
Pubblicazione: (2025)
A System for Automatic English Text Expansion
di: Méndez, Silvia García, et al.
Pubblicazione: (2024)
di: Méndez, Silvia García, et al.
Pubblicazione: (2024)
Ask the experts: sourcing high-quality datasets for nutritional counselling through Human-AI collaboration
di: Balloccu, Simone, et al.
Pubblicazione: (2024)
di: Balloccu, Simone, et al.
Pubblicazione: (2024)
DecMetrics: Structured Claim Decomposition Scoring for Factually Consistent LLM Outputs
di: Huang, Minghui
Pubblicazione: (2025)
di: Huang, Minghui
Pubblicazione: (2025)
Enhancing Factual Accuracy and Citation Generation in LLMs via Multi-Stage Self-Verification
di: García, Fernando Gabriela, et al.
Pubblicazione: (2025)
di: García, Fernando Gabriela, et al.
Pubblicazione: (2025)
Beyond Factual Accuracy: Evaluating Global Reasoning Integrity in RAG Systems with LogicScore
di: Yan, Zhichao, et al.
Pubblicazione: (2026)
di: Yan, Zhichao, et al.
Pubblicazione: (2026)
ART: Attention Replacement Technique to Improve Factuality in LLMs
di: Luo, Ziqin, et al.
Pubblicazione: (2026)
di: Luo, Ziqin, et al.
Pubblicazione: (2026)
Trustworthy Reasoning: Evaluating and Enhancing Factual Accuracy in LLM Intermediate Thought Processes
di: Jiao, Rui, et al.
Pubblicazione: (2025)
di: Jiao, Rui, et al.
Pubblicazione: (2025)
Improving Model Factuality with Fine-grained Critique-based Evaluator
di: Xie, Yiqing, et al.
Pubblicazione: (2024)
di: Xie, Yiqing, et al.
Pubblicazione: (2024)
Improving the Calibration of Confidence Scores in Text Generation Using the Output Distribution's Characteristics
di: Flores, Lorenzo Jaime Yu, et al.
Pubblicazione: (2025)
di: Flores, Lorenzo Jaime Yu, et al.
Pubblicazione: (2025)
LLM-RG4: Flexible and Factual Radiology Report Generation across Diverse Input Contexts
di: Wang, Zhuhao, et al.
Pubblicazione: (2024)
di: Wang, Zhuhao, et al.
Pubblicazione: (2024)
Understanding Gated Neurons in Transformers from Their Input-Output Functionality
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
di: Gerstner, Sebastian, et al.
Pubblicazione: (2025)
Shifting Long-Context LLMs Research from Input to Output
di: Wu, Yuhao, et al.
Pubblicazione: (2025)
di: Wu, Yuhao, et al.
Pubblicazione: (2025)
Evaluating Factual Density in Multi-Source RAG: A Study in Medical AI Accuracy
di: DeMarco, Michael R.
Pubblicazione: (2026)
di: DeMarco, Michael R.
Pubblicazione: (2026)
BaRDa: A Belief and Reasoning Dataset that Separates Factual Accuracy and Reasoning Ability
di: Clark, Peter, et al.
Pubblicazione: (2023)
di: Clark, Peter, et al.
Pubblicazione: (2023)
How Can Input Reformulation Improve Tool Usage Accuracy in a Complex Dynamic Environment? A Study on $τ$-bench
di: Mishra, Venkatesh, et al.
Pubblicazione: (2025)
di: Mishra, Venkatesh, et al.
Pubblicazione: (2025)
An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)
DnDScore: Decontextualization and Decomposition for Factuality Verification in Long-Form Text Generation
di: Wanner, Miriam, et al.
Pubblicazione: (2024)
di: Wanner, Miriam, et al.
Pubblicazione: (2024)
Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models
di: Das, Souvik, et al.
Pubblicazione: (2024)
di: Das, Souvik, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Input Matters: Evaluating Input Structure's Impact on LLM Summaries of Sports Play-by-Play
di: Sundararajan, Barkavi, et al.
Pubblicazione: (2025) -
Natural Language Generation
di: Reiter, Ehud
Pubblicazione: (2025) -
NLG Evaluation: Past, Present, Future
di: Reiter, Ehud
Pubblicazione: (2026) -
We Should Evaluate Real-World Impact
di: Reiter, Ehud
Pubblicazione: (2025) -
Distributional Semantics Tracing: A Framework for Explaining Hallucinations in Large Language Models
di: Bhatia, Gagan, et al.
Pubblicazione: (2025)