FOLIO: Natural Language Reasoning with First-Order Logic
Fuente:
arXiv
Salvato in:
| Autori principali: | Han, Simeng, Schoelkopf, Hailey, Zhao, Yilun, Qi, Zhenting, Riddell, Martin, Zhou, Wenfei, Coady, James, Peng, David, Qiao, Yujie, Benson, Luke, Sun, Lucy, Wardle-Solano, Alex, Szabo, Hannah, Zubova, Ekaterina, Burtell, Matthew, Fan, Jonathan, Liu, Yixin, Wong, Brian, Sailor, Malcolm, Ni, Ansong, Nan, Linyong, Kasai, Jungo, Yu, Tao, Zhang, Rui, Fabbri, Alexander R., Kryscinski, Wojciech, Yavuz, Semih, Liu, Ye, Lin, Xi Victoria, Joty, Shafiq, Zhou, Yingbo, Xiong, Caiming, Ying, Rex, Cohan, Arman, Radev, Dragomir |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains
di: Han, Simeng, et al.
Pubblicazione: (2024)
di: Han, Simeng, et al.
Pubblicazione: (2024)
HPE:Answering Complex Questions over Text by Hybrid Question Parsing and Execution
di: Liu, Ye, et al.
Pubblicazione: (2023)
di: Liu, Ye, et al.
Pubblicazione: (2023)
Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models
di: Riddell, Martin, et al.
Pubblicazione: (2024)
di: Riddell, Martin, et al.
Pubblicazione: (2024)
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
di: Niu, Tong, et al.
Pubblicazione: (2024)
di: Niu, Tong, et al.
Pubblicazione: (2024)
A Call for Clarity in Beam Search: How It Works and When It Stops
di: Kasai, Jungo, et al.
Pubblicazione: (2022)
di: Kasai, Jungo, et al.
Pubblicazione: (2022)
CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval
di: Liu, Ye, et al.
Pubblicazione: (2024)
di: Liu, Ye, et al.
Pubblicazione: (2024)
Modeling Uncertainty and Using Post-fusion as Fallback Improves Retrieval Augmented Generation with LLMs
di: Liu, Ye, et al.
Pubblicazione: (2023)
di: Liu, Ye, et al.
Pubblicazione: (2023)
Efficiently Aligned Cross-Lingual Transfer Learning for Conversational Tasks using Prompt-Tuning
di: Tu, Lifu, et al.
Pubblicazione: (2023)
di: Tu, Lifu, et al.
Pubblicazione: (2023)
Parameter-Efficient Detoxification with Contrastive Decoding
di: Niu, Tong, et al.
Pubblicazione: (2024)
di: Niu, Tong, et al.
Pubblicazione: (2024)
Investigating Factuality in Long-Form Text Generation: The Roles of Self-Known and Self-Unknown
di: Tu, Lifu, et al.
Pubblicazione: (2024)
di: Tu, Lifu, et al.
Pubblicazione: (2024)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
di: Liu, Yixin, et al.
Pubblicazione: (2023)
di: Liu, Yixin, et al.
Pubblicazione: (2023)
Retrofitting Small Multilingual Models for Retrieval: Matching 7B Performance with 300M Parameters
di: Tu, Lifu, et al.
Pubblicazione: (2025)
di: Tu, Lifu, et al.
Pubblicazione: (2025)
RealTime QA: What's the Answer Right Now?
di: Kasai, Jungo, et al.
Pubblicazione: (2022)
di: Kasai, Jungo, et al.
Pubblicazione: (2022)
SweRank+: Multilingual, Multi-Turn Code Ranking for Software Issue Localization
di: Reddy, Revanth Gangi, et al.
Pubblicazione: (2025)
di: Reddy, Revanth Gangi, et al.
Pubblicazione: (2025)
Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models Decoding
di: Tu, Lifu, et al.
Pubblicazione: (2023)
di: Tu, Lifu, et al.
Pubblicazione: (2023)
SweRank: Software Issue Localization with Code Ranking
di: Reddy, Revanth Gangi, et al.
Pubblicazione: (2025)
di: Reddy, Revanth Gangi, et al.
Pubblicazione: (2025)
Assessing the effects of the modular approach in math learning on independent creativity of university students
di: Elena A. Zubova
Pubblicazione: (2021)
di: Elena A. Zubova
Pubblicazione: (2021)
LiteASR: Efficient Automatic Speech Recognition with Low-Rank Approximation
di: Kamahori, Keisuke, et al.
Pubblicazione: (2025)
di: Kamahori, Keisuke, et al.
Pubblicazione: (2025)
MAS-ProVe: Understanding the Process Verification of Multi-Agent Systems
di: Venkataramani, Vishal, et al.
Pubblicazione: (2026)
di: Venkataramani, Vishal, et al.
Pubblicazione: (2026)
Direct Judgement Preference Optimization
di: Wang, Peifeng, et al.
Pubblicazione: (2024)
di: Wang, Peifeng, et al.
Pubblicazione: (2024)
Evaluating Judges as Evaluators: The JETTS Benchmark of LLM-as-Judges as Test-Time Scaling Evaluators
di: Zhou, Yilun, et al.
Pubblicazione: (2025)
di: Zhou, Yilun, et al.
Pubblicazione: (2025)
On Learning to Summarize with Large Language Models as References
di: Liu, Yixin, et al.
Pubblicazione: (2023)
di: Liu, Yixin, et al.
Pubblicazione: (2023)
Self-Abstraction from Grounded Experience for Plan-Guided Policy Refinement
di: Hayashi, Hiroaki, et al.
Pubblicazione: (2025)
di: Hayashi, Hiroaki, et al.
Pubblicazione: (2025)
P‐Wave Oversensing by the Implantable Cardiac Monitor During Paroxysmal Atrioventricular Block: What Is the Mechanism?
di: Yuhei Kasai, et al.
Pubblicazione: (2024)
di: Yuhei Kasai, et al.
Pubblicazione: (2024)
Learning from Language Feedback via Variational Policy Distillation
di: Li, Yang, et al.
Pubblicazione: (2026)
di: Li, Yang, et al.
Pubblicazione: (2026)
SSR: Socratic Self-Refine for Large Language Model Reasoning
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
J4R: Learning to Judge with Equivalent Initial State Group Relative Policy Optimization
di: Xu, Austin, et al.
Pubblicazione: (2025)
di: Xu, Austin, et al.
Pubblicazione: (2025)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
di: Pang, Bo, et al.
Pubblicazione: (2025)
di: Pang, Bo, et al.
Pubblicazione: (2025)
INDICT: Code Generation with Internal Dialogues of Critiques for Both Security and Helpfulness
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
VIBEPASS: Can Vibe Coders Really Pass the Vibe Check?
di: Bansal, Srijan, et al.
Pubblicazione: (2026)
di: Bansal, Srijan, et al.
Pubblicazione: (2026)
Community programs and women's participation : the chinese experience / David Coady, Xinyi Dai, Limin Wang
di: Coady, David
Pubblicazione: (2001)
di: Coady, David
Pubblicazione: (2001)
Targeting of transfers in developing countries : review of lessons and experience / David Coady, Margaret Grosh, John Hoddinott
di: Coady, David
Pubblicazione: (2004)
di: Coady, David
Pubblicazione: (2004)
Evaluating Spatial Understanding of Large Language Models
di: Yamada, Yutaro, et al.
Pubblicazione: (2023)
di: Yamada, Yutaro, et al.
Pubblicazione: (2023)
Summarization-Based Document IDs for Generative Retrieval with Language Models
di: Li, Haoxin, et al.
Pubblicazione: (2023)
di: Li, Haoxin, et al.
Pubblicazione: (2023)
VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks
di: Jiang, Ziyan, et al.
Pubblicazione: (2024)
di: Jiang, Ziyan, et al.
Pubblicazione: (2024)
Improving LLM Reasoning through Scaling Inference Computation with Collaborative Verification
di: Liang, Zhenwen, et al.
Pubblicazione: (2024)
di: Liang, Zhenwen, et al.
Pubblicazione: (2024)
Traffic Light or Light Traffic? Investigating Phrasal Semantics in Large Language Models
di: Meng, Rui, et al.
Pubblicazione: (2024)
di: Meng, Rui, et al.
Pubblicazione: (2024)
California Research Institute on the Integration of Students with Severe Disabilities. Final Report, Years 1987-1992.
di: Sailor, Wayne, et al.
Pubblicazione: (1993)
di: Sailor, Wayne, et al.
Pubblicazione: (1993)
Cation-DNA outer sphere coordination in DNA polymorphism
di: Zubova, Elena A., et al.
Pubblicazione: (2025)
di: Zubova, Elena A., et al.
Pubblicazione: (2025)
Cross-Ratio Dynamics and the Anharmonic S3 Orbit in Universal Hyperbolic Geometry
di: Coady, John D.
Pubblicazione: (2026)
di: Coady, John D.
Pubblicazione: (2026)
Documenti analoghi
-
P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains
di: Han, Simeng, et al.
Pubblicazione: (2024) -
HPE:Answering Complex Questions over Text by Hybrid Question Parsing and Execution
di: Liu, Ye, et al.
Pubblicazione: (2023) -
Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models
di: Riddell, Martin, et al.
Pubblicazione: (2024) -
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
di: Niu, Tong, et al.
Pubblicazione: (2024) -
A Call for Clarity in Beam Search: How It Works and When It Stops
di: Kasai, Jungo, et al.
Pubblicazione: (2022)