ReFEree: Reference-Free and Fine-Grained Method for Evaluating Factual Consistency in Real-World Code Summarization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bae, Suyoung, Na, CheolWon, Lee, Jaehoon, Lee, Yumin, Choi, YunSeok, Lee, Jee-Hyong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Q-FAKER: Query-free Hard Black-box Attack via Controlled Generation
par: Na, CheolWon, et autres
Publié: (2025)
par: Na, CheolWon, et autres
Publié: (2025)
Remember Your Trace: Memory-Guided Long-Horizon Agentic Framework for Consistent and Hierarchical Repository-Level Code Documentation
par: Bae, Suyoung, et autres
Publié: (2026)
par: Bae, Suyoung, et autres
Publié: (2026)
DeCAP: Context-Adaptive Prompt Generation for Debiasing Zero-shot Question Answering in Large Language Models
par: Bae, Suyoung, et autres
Publié: (2025)
par: Bae, Suyoung, et autres
Publié: (2025)
SALAD: Improving Robustness and Generalization through Contrastive Learning with Structure-Aware and LLM-Driven Augmented Data
par: Bae, Suyoung, et autres
Publié: (2025)
par: Bae, Suyoung, et autres
Publié: (2025)
DCG-SQL: Enhancing In-Context Learning for Text-to-SQL with Deep Contextual Schema Link Graph
par: Lee, Jihyung, et autres
Publié: (2025)
par: Lee, Jihyung, et autres
Publié: (2025)
BanglaSummEval: Reference-Free Factual Consistency Evaluation for Bangla Summarization
par: Rafid, Ahmed, et autres
Publié: (2026)
par: Rafid, Ahmed, et autres
Publié: (2026)
mFACE: Multilingual Summarization with Factual Consistency Evaluation
par: Aharoni, Roee, et autres
Publié: (2022)
par: Aharoni, Roee, et autres
Publié: (2022)
On the Benefits of Fine-Grained Loss Truncation: A Case Study on Factuality in Summarization
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2024)
par: Flores, Lorenzo Jaime Yu, et autres
Publié: (2024)
Fine-grained and Explainable Factuality Evaluation for Multimodal Summarization
par: Zhang, Yue, et autres
Publié: (2024)
par: Zhang, Yue, et autres
Publié: (2024)
TAG: A Simple Yet Effective Temporal-Aware Approach for Zero-Shot Video Temporal Grounding
par: Lee, Jin-Seop, et autres
Publié: (2025)
par: Lee, Jin-Seop, et autres
Publié: (2025)
Unlocking Fine-Grained and Within-Utterance Speaking Style Control in Prompt-Based Text-to-Speech Models
par: Kang, Jaehoon, et autres
Publié: (2026)
par: Kang, Jaehoon, et autres
Publié: (2026)
Improving Factual Consistency of News Summarization by Contrastive Preference Optimization
par: Feng, Huawen, et autres
Publié: (2023)
par: Feng, Huawen, et autres
Publié: (2023)
SummExecEdit: A Factual Consistency Benchmark in Summarization with Executable Edits
par: Thorat, Onkar, et autres
Publié: (2024)
par: Thorat, Onkar, et autres
Publié: (2024)
Re-Ex: Revising after Explanation Reduces the Factual Errors in LLM Responses
par: Kim, Juyeon, et autres
Publié: (2024)
par: Kim, Juyeon, et autres
Publié: (2024)
Enhancing Factuality through Consensus and Consistency in Summarization Using Minimum Bayes Risk Decoding
par: Soetedjo, Riza Setiawan, et autres
Publié: (2026)
par: Soetedjo, Riza Setiawan, et autres
Publié: (2026)
UniSumEval: Towards Unified, Fine-Grained, Multi-Dimensional Summarization Evaluation for LLMs
par: Lee, Yuho, et autres
Publié: (2024)
par: Lee, Yuho, et autres
Publié: (2024)
Stress Testing Factual Consistency Metrics for Long-Document Summarization
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
par: Mujahid, Zain Muhammad, et autres
Publié: (2025)
PlainQAFact: Retrieval-augmented Factual Consistency Evaluation Metric for Biomedical Plain Language Summarization
par: You, Zhiwen, et autres
Publié: (2025)
par: You, Zhiwen, et autres
Publié: (2025)
Reasoning by Commented Code for Table Question Answering
par: Pyo, Seho, et autres
Publié: (2026)
par: Pyo, Seho, et autres
Publié: (2026)
ReGraM: Region-First Knowledge Graph Reasoning for Medical Question Answering
par: Lee, Chaerin, et autres
Publié: (2026)
par: Lee, Chaerin, et autres
Publié: (2026)
OPSD Compresses What RLVR Teaches: A Post-RL Compaction Stage for Reasoning Models
par: Kim, Jaehoon, et autres
Publié: (2026)
par: Kim, Jaehoon, et autres
Publié: (2026)
ISQA: Informative Factuality Feedback for Scientific Summarization
par: Li, Zekai, et autres
Publié: (2024)
par: Li, Zekai, et autres
Publié: (2024)
Agent-as-Judge for Factual Summarization of Long Narratives
par: Jeong, Yeonseok, et autres
Publié: (2025)
par: Jeong, Yeonseok, et autres
Publié: (2025)
SAFE-SQL: Self-Augmented In-Context Learning with Fine-grained Example Selection for Text-to-SQL
par: Lee, Jimin, et autres
Publié: (2025)
par: Lee, Jimin, et autres
Publié: (2025)
Selective Demonstration Retrieval for Improved Implicit Hate Speech Detection
par: Kim, Yumin, et autres
Publié: (2025)
par: Kim, Yumin, et autres
Publié: (2025)
Fine-Grained Self-Endorsement Improves Factuality and Reasoning
par: Wang, Ante, et autres
Publié: (2024)
par: Wang, Ante, et autres
Publié: (2024)
SciZoom: A Large-scale Benchmark for Hierarchical Scientific Summarization across the LLM Era
par: Jang, Han, et autres
Publié: (2026)
par: Jang, Han, et autres
Publié: (2026)
MoCoRP: Modeling Consistent Relations between Persona and Response for Persona-based Dialogue
par: Lee, Kyungro, et autres
Publié: (2025)
par: Lee, Kyungro, et autres
Publié: (2025)
In Their Own Words: Reasoning Traces Tailored for Small Models Make Them Better Reasoners
par: Kim, Jaehoon, et autres
Publié: (2025)
par: Kim, Jaehoon, et autres
Publié: (2025)
SDS KoPub VDR: A Benchmark Dataset for Visual Document Retrieval in Korean Public Documents
par: Lee, Jaehoon, et autres
Publié: (2025)
par: Lee, Jaehoon, et autres
Publié: (2025)
From What to Respond to When to Respond: Timely Response Generation for Open-domain Dialogue Agents
par: Jang, Seongbo, et autres
Publié: (2025)
par: Jang, Seongbo, et autres
Publié: (2025)
Entity-level Factual Adaptiveness of Fine-tuning based Abstractive Summarization Models
par: Song, Jongyoon, et autres
Publié: (2024)
par: Song, Jongyoon, et autres
Publié: (2024)
Two-step Automated Cybercrime Coded Word Detection using Multi-level Representation Learning
par: Kim, Yongyeon, et autres
Publié: (2024)
par: Kim, Yongyeon, et autres
Publié: (2024)
KoCoSa: Korean Context-aware Sarcasm Detection Dataset
par: Kim, Yumin, et autres
Publié: (2024)
par: Kim, Yumin, et autres
Publié: (2024)
OrderSum: Semantic Sentence Ordering for Extractive Summarization
par: Kwon, Taewan, et autres
Publié: (2025)
par: Kwon, Taewan, et autres
Publié: (2025)
FINEST: Improving LLM Responses to Sensitive Topics Through Fine-Grained Evaluation
par: Oh, Juhyun, et autres
Publié: (2026)
par: Oh, Juhyun, et autres
Publié: (2026)
ReFeed: Multi-dimensional Summarization Refinement with Reflective Reasoning on Feedback
par: Yun, Taewon, et autres
Publié: (2025)
par: Yun, Taewon, et autres
Publié: (2025)
FactPICO: Factuality Evaluation for Plain Language Summarization of Medical Evidence
par: Joseph, Sebastian Antony, et autres
Publié: (2024)
par: Joseph, Sebastian Antony, et autres
Publié: (2024)
FACTS&EVIDENCE: An Interactive Tool for Transparent Fine-Grained Factual Verification of Machine-Generated Text
par: Boonsanong, Varich, et autres
Publié: (2025)
par: Boonsanong, Varich, et autres
Publié: (2025)
Using Similarity to Evaluate Factual Consistency in Summaries
par: Ye, Yuxuan, et autres
Publié: (2024)
par: Ye, Yuxuan, et autres
Publié: (2024)
Documents similaires
-
Q-FAKER: Query-free Hard Black-box Attack via Controlled Generation
par: Na, CheolWon, et autres
Publié: (2025) -
Remember Your Trace: Memory-Guided Long-Horizon Agentic Framework for Consistent and Hierarchical Repository-Level Code Documentation
par: Bae, Suyoung, et autres
Publié: (2026) -
DeCAP: Context-Adaptive Prompt Generation for Debiasing Zero-shot Question Answering in Large Language Models
par: Bae, Suyoung, et autres
Publié: (2025) -
SALAD: Improving Robustness and Generalization through Contrastive Learning with Structure-Aware and LLM-Driven Augmented Data
par: Bae, Suyoung, et autres
Publié: (2025) -
DCG-SQL: Enhancing In-Context Learning for Text-to-SQL with Deep Contextual Schema Link Graph
par: Lee, Jihyung, et autres
Publié: (2025)