Strategies for Improving NL-to-FOL Translation with LLMs: Data Generation, Incremental Fine-Tuning, and Verification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Thatikonda, Ramya Keerthy, Han, Jiuzhou, Buntine, Wray, Shareghi, Ehsan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Assessing the Sensitivity and Alignment of FOL Closeness Metrics
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2025)
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2025)
Improving Symbolic Translation of Language Models for Logical Reasoning
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2026)
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2026)
Logical Reasoning with Outcome Reward Models for Test-Time Scaling
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2025)
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2025)
PiVe: Prompting with Iterative Verification Improving Graph-based Generative Capability of LLMs
par: Han, Jiuzhou, et autres
Publié: (2023)
par: Han, Jiuzhou, et autres
Publié: (2023)
VerifiAgent: a Unified Verification Agent in Language Model Reasoning
par: Han, Jiuzhou, et autres
Publié: (2025)
par: Han, Jiuzhou, et autres
Publié: (2025)
Reward Engineering for Generating Semi-structured Explanation
par: Han, Jiuzhou, et autres
Publié: (2023)
par: Han, Jiuzhou, et autres
Publié: (2023)
Uncertainty-Based Methods for Automated Process Reward Data Construction and Output Aggregation in Mathematical Reasoning
par: Han, Jiuzhou, et autres
Publié: (2025)
par: Han, Jiuzhou, et autres
Publié: (2025)
Towards Uncertainty-Aware Language Agent
par: Han, Jiuzhou, et autres
Publié: (2024)
par: Han, Jiuzhou, et autres
Publié: (2024)
A Closer Look at Logical Reasoning with LLMs: The Choice of Tool Matters
par: Lam, Long Hei Matthew, et autres
Publié: (2024)
par: Lam, Long Hei Matthew, et autres
Publié: (2024)
Evaluating LLM-based Approaches to Legal Citation Prediction: Domain-specific Pre-training, Fine-tuning, or RAG? A Benchmark and an Australian Law Case Study
par: Han, Jiuzhou, et autres
Publié: (2024)
par: Han, Jiuzhou, et autres
Publié: (2024)
A Pilot Benchmark for NL-to-FOL Translation in Planetary Exploration
par: Moore, Hayden, et autres
Publié: (2026)
par: Moore, Hayden, et autres
Publié: (2026)
Do LLMs Really Struggle at NL-FOL Translation? Revealing their Strengths via a Novel Benchmarking Strategy
par: Brunello, Andrea, et autres
Publié: (2025)
par: Brunello, Andrea, et autres
Publié: (2025)
Improving Vietnamese-English Medical Machine Translation
par: Vo, Nhu, et autres
Publié: (2024)
par: Vo, Nhu, et autres
Publié: (2024)
Multilingual LLM Prompting Strategies for Medical English-Vietnamese Machine Translation
par: Vo, Nhu, et autres
Publié: (2025)
par: Vo, Nhu, et autres
Publié: (2025)
Equipping Language Models with Tool Use Capability for Tabular Data Analysis in Finance
par: Theuma, Adrian, et autres
Publié: (2024)
par: Theuma, Adrian, et autres
Publié: (2024)
A Survey on Out-of-Distribution Evaluation of Neural NLP Models
par: Li, Xinzhe, et autres
Publié: (2023)
par: Li, Xinzhe, et autres
Publié: (2023)
Cube Bench: A Benchmark for Spatial Visual Reasoning in MLLMs
par: Anand, Dhruv, et autres
Publié: (2025)
par: Anand, Dhruv, et autres
Publié: (2025)
Can LLMs Reason in the Wild with Programs?
par: Yang, Yuan, et autres
Publié: (2024)
par: Yang, Yuan, et autres
Publié: (2024)
One STEP at a time: Language Agents are Stepwise Planners
par: Nguyen, Minh, et autres
Publié: (2024)
par: Nguyen, Minh, et autres
Publié: (2024)
Conversational SimulMT: Efficient Simultaneous Translation with Large Language Models
par: Wang, Minghan, et autres
Publié: (2024)
par: Wang, Minghan, et autres
Publié: (2024)
Simultaneous Machine Translation with Large Language Models
par: Wang, Minghan, et autres
Publié: (2023)
par: Wang, Minghan, et autres
Publié: (2023)
LLM Reading Tea Leaves: Automatically Evaluating Topic Models with Large Language Models
par: Yang, Xiaohao, et autres
Publié: (2024)
par: Yang, Xiaohao, et autres
Publié: (2024)
ReasonGraph: Visualisation of Reasoning Paths
par: Li, Zongqian, et autres
Publié: (2025)
par: Li, Zongqian, et autres
Publié: (2025)
MTEB-NL and E5-NL: Embedding Benchmark and Models for Dutch
par: Banar, Nikolay, et autres
Publié: (2025)
par: Banar, Nikolay, et autres
Publié: (2025)
SpeechDialogueFactory: Generating High-Quality Speech Dialogue Data to Accelerate Your Speech-LLM Development
par: Wang, Minghan, et autres
Publié: (2025)
par: Wang, Minghan, et autres
Publié: (2025)
Improving Translation Quality by Selecting Better Data for LLM Fine-Tuning: A Comparative Analysis
par: de Mello, Felipe Ribeiro Fujita, et autres
Publié: (2025)
par: de Mello, Felipe Ribeiro Fujita, et autres
Publié: (2025)
Towards Better Understanding of Cybercrime: The Role of Fine-Tuned LLMs in Translation
par: Valeros, Veronica, et autres
Publié: (2024)
par: Valeros, Veronica, et autres
Publié: (2024)
Unlocking Structure Measuring: Introducing PDD, an Automatic Metric for Positional Discourse Coherence
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Jigsaw Puzzles: Splitting Harmful Questions to Jailbreak Large Language Models
par: Yang, Hao, et autres
Publié: (2024)
par: Yang, Hao, et autres
Publié: (2024)
The Compressor-Retriever Architecture for Language Model OS
par: Yang, Yuan, et autres
Publié: (2024)
par: Yang, Yuan, et autres
Publié: (2024)
Discrete Diffusion Language Model for Efficient Text Summarization
par: Dat, Do Huu, et autres
Publié: (2024)
par: Dat, Do Huu, et autres
Publié: (2024)
BEIR-NL: Zero-shot Information Retrieval Benchmark for the Dutch Language
par: Banar, Nikolay, et autres
Publié: (2024)
par: Banar, Nikolay, et autres
Publié: (2024)
Towards Inference-time Scaling for Continuous Space Reasoning
par: Wang, Minghan, et autres
Publié: (2025)
par: Wang, Minghan, et autres
Publié: (2025)
Fine-Tuning LLMs for Low-Resource Dialect Translation: The Case of Lebanese
par: Yakhni, Silvana, et autres
Publié: (2025)
par: Yakhni, Silvana, et autres
Publié: (2025)
All Roads Lead to Rome: Graph-Based Confidence Estimation for Large Language Model Reasoning
par: Zhang, Caiqi, et autres
Publié: (2025)
par: Zhang, Caiqi, et autres
Publié: (2025)
FOL2NS: Generating Natural Sentences from First-Order Logic
par: Jia, Mei
Publié: (2026)
par: Jia, Mei
Publié: (2026)
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
par: Liu, Yinhong, et autres
Publié: (2024)
par: Liu, Yinhong, et autres
Publié: (2024)
Prompt, Translate, Fine-Tune, Re-Initialize, or Instruction-Tune? Adapting LLMs for In-Context Learning in Low-Resource Languages
par: Toukmaji, Christopher, et autres
Publié: (2025)
par: Toukmaji, Christopher, et autres
Publié: (2025)
Dynamic Jointly Batch Selection for Data Efficient Machine Translation Fine-Tuning
par: Ghanizadeh, Mohammad Amin, et autres
Publié: (2025)
par: Ghanizadeh, Mohammad Amin, et autres
Publié: (2025)
TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law
par: Hui, Zheng, et autres
Publié: (2025)
par: Hui, Zheng, et autres
Publié: (2025)
Documents similaires
-
Assessing the Sensitivity and Alignment of FOL Closeness Metrics
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2025) -
Improving Symbolic Translation of Language Models for Logical Reasoning
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2026) -
Logical Reasoning with Outcome Reward Models for Test-Time Scaling
par: Thatikonda, Ramya Keerthy, et autres
Publié: (2025) -
PiVe: Prompting with Iterative Verification Improving Graph-based Generative Capability of LLMs
par: Han, Jiuzhou, et autres
Publié: (2023) -
VerifiAgent: a Unified Verification Agent in Language Model Reasoning
par: Han, Jiuzhou, et autres
Publié: (2025)