Salvato in:
| Autori principali: | Chen, Sihao, Malaviya, Chaitanya, Fabrikant, Alex, Taitelbaum, Hagai, Schuster, Tal, Buthpitiya, Senaka, Roth, Dan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2502.05793 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Entailed Between the Lines: Incorporating Implication into NLI
di: Havaldar, Shreya, et al.
Pubblicazione: (2025)
di: Havaldar, Shreya, et al.
Pubblicazione: (2025)
ExpertQA: Expert-Curated Questions and Attributed Answers
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
What if you said that differently?: How Explanation Formats Affect Human Feedback Efficacy and User Perception
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023)
Contextualized Evaluations: Judging Language Model Responses to Underspecified Queries
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2024)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2024)
A Simple Joint Model for Improved Contextual Neural Lemmatization
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2019)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2019)
Flattery, Fluff, and Fog: Diagnosing and Mitigating Idiosyncratic Biases in Preference Models
di: Bharadwaj, Anirudh, et al.
Pubblicazione: (2025)
di: Bharadwaj, Anirudh, et al.
Pubblicazione: (2025)
ResearchQA: Evaluating Scholarly Question Answering at Scale Across 75 Fields with Survey-Mined Questions and Rubrics
di: Yifei, Li S., et al.
Pubblicazione: (2025)
di: Yifei, Li S., et al.
Pubblicazione: (2025)
LogiCoL: Logically-Informed Contrastive Learning for Set-based Dense Retrieval
di: Shen, Yanzhen, et al.
Pubblicazione: (2025)
di: Shen, Yanzhen, et al.
Pubblicazione: (2025)
Strong Priority and Determinacy in Timed CCS
di: Liquori, Luigi, et al.
Pubblicazione: (2024)
di: Liquori, Luigi, et al.
Pubblicazione: (2024)
Do Language Models' Words Refer?
di: Mandelkern, Matthew, et al.
Pubblicazione: (2023)
di: Mandelkern, Matthew, et al.
Pubblicazione: (2023)
EvalAgent: Discovering Implicit Evaluation Criteria from the Web
di: Wadhwa, Manya, et al.
Pubblicazione: (2025)
di: Wadhwa, Manya, et al.
Pubblicazione: (2025)
AssistantBench: Can Web Agents Solve Realistic and Time-Consuming Tasks?
di: Yoran, Ori, et al.
Pubblicazione: (2024)
di: Yoran, Ori, et al.
Pubblicazione: (2024)
A synthetic data approach for domain generalization of NLI models
di: Hosseini, Mohammad Javad, et al.
Pubblicazione: (2024)
di: Hosseini, Mohammad Javad, et al.
Pubblicazione: (2024)
Conceptual and Unbiased Reasoning in Language Models
di: Zhou, Ben, et al.
Pubblicazione: (2024)
di: Zhou, Ben, et al.
Pubblicazione: (2024)
Dynamic Clue Bottlenecks: Towards Interpretable-by-Design Visual Question Answering
di: Fu, Xingyu, et al.
Pubblicazione: (2023)
di: Fu, Xingyu, et al.
Pubblicazione: (2023)
Calibrating Large Language Models with Sample Consistency
di: Lyu, Qing, et al.
Pubblicazione: (2024)
di: Lyu, Qing, et al.
Pubblicazione: (2024)
SocREval: Large Language Models with the Socratic Method for Reference-Free Reasoning Evaluation
di: He, Hangfeng, et al.
Pubblicazione: (2023)
di: He, Hangfeng, et al.
Pubblicazione: (2023)
Talking Point based Ideological Discourse Analysis in News Events
di: Nakshatri, Nishanth, et al.
Pubblicazione: (2025)
di: Nakshatri, Nishanth, et al.
Pubblicazione: (2025)
BIRD: A Trustworthy Bayesian Inference Framework for Large Language Models
di: Feng, Yu, et al.
Pubblicazione: (2024)
di: Feng, Yu, et al.
Pubblicazione: (2024)
Determinacy with Priorities up to Clocks
di: Liquori, Luigi, et al.
Pubblicazione: (2026)
di: Liquori, Luigi, et al.
Pubblicazione: (2026)
Scalable and Domain-General Abstractive Proposition Segmentation
di: Hosseini, Mohammad Javad, et al.
Pubblicazione: (2024)
di: Hosseini, Mohammad Javad, et al.
Pubblicazione: (2024)
Entailment Semantics Can Be Extracted from an Ideal Language Model
di: Merrill, William, et al.
Pubblicazione: (2022)
di: Merrill, William, et al.
Pubblicazione: (2022)
DOLOMITES: Domain-Specific Long-Form Methodical Tasks
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2024)
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2024)
Arena-Independent Finite-Memory Determinacy in Stochastic Games
di: Bouyer, Patricia, et al.
Pubblicazione: (2021)
di: Bouyer, Patricia, et al.
Pubblicazione: (2021)
Block Transformer: Global-to-Local Language Modeling for Fast Inference
di: Ho, Namgyu, et al.
Pubblicazione: (2024)
di: Ho, Namgyu, et al.
Pubblicazione: (2024)
DetermLR: Augmenting LLM-based Logical Reasoning from Indeterminacy to Determinacy
di: Sun, Hongda, et al.
Pubblicazione: (2023)
di: Sun, Hongda, et al.
Pubblicazione: (2023)
Tomato, Tomahto, Tomate: Do Multilingual Language Models Understand Based on Subword-Level Semantic Concepts?
di: Zhang, Crystina, et al.
Pubblicazione: (2024)
di: Zhang, Crystina, et al.
Pubblicazione: (2024)
Know Me, Respond to Me: Benchmarking LLMs for Dynamic User Profiling and Personalized Responses at Scale
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
di: Jiang, Bowen, et al.
Pubblicazione: (2025)
Lost in Inference: Rediscovering the Role of Natural Language Inference for Large Language Models
di: Madaan, Lovish, et al.
Pubblicazione: (2024)
di: Madaan, Lovish, et al.
Pubblicazione: (2024)
Attribute First, then Generate: Locally-attributable Grounded Text Generation
di: Slobodkin, Aviv, et al.
Pubblicazione: (2024)
di: Slobodkin, Aviv, et al.
Pubblicazione: (2024)
Conformal Language Modeling
di: Quach, Victor, et al.
Pubblicazione: (2023)
di: Quach, Victor, et al.
Pubblicazione: (2023)
Reasoning is about giving reasons
di: Shah, Krunal, et al.
Pubblicazione: (2025)
di: Shah, Krunal, et al.
Pubblicazione: (2025)
Conflicts in Texts: Data, Implications and Challenges
di: Liu, Siyi, et al.
Pubblicazione: (2025)
di: Liu, Siyi, et al.
Pubblicazione: (2025)
Can LLMs Narrate Tabular Data? An Evaluation Framework for Natural Language Representations of Text-to-SQL System Outputs
di: Singh, Jyotika, et al.
Pubblicazione: (2025)
di: Singh, Jyotika, et al.
Pubblicazione: (2025)
Towards Controllable Natural Language Inference through Lexical Inference Types
di: Zhang, Yingji, et al.
Pubblicazione: (2023)
di: Zhang, Yingji, et al.
Pubblicazione: (2023)
Pushing the boundary on Natural Language Inference
di: Miralles-González, Pablo, et al.
Pubblicazione: (2025)
di: Miralles-González, Pablo, et al.
Pubblicazione: (2025)
PokeLLMon: A Human-Parity Agent for Pokemon Battles with Large Language Models
di: Hu, Sihao, et al.
Pubblicazione: (2024)
di: Hu, Sihao, et al.
Pubblicazione: (2024)
Vaccine: Perturbation-aware Alignment for Large Language Models against Harmful Fine-tuning Attack
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
A MISMATCHED Benchmark for Scientific Natural Language Inference
di: Shaik, Firoz, et al.
Pubblicazione: (2025)
di: Shaik, Firoz, et al.
Pubblicazione: (2025)
LLMs are Frequency Pattern Learners in Natural Language Inference
di: Cheng, Liang, et al.
Pubblicazione: (2025)
di: Cheng, Liang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Entailed Between the Lines: Incorporating Implication into NLI
di: Havaldar, Shreya, et al.
Pubblicazione: (2025) -
ExpertQA: Expert-Curated Questions and Attributed Answers
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023) -
What if you said that differently?: How Explanation Formats Affect Human Feedback Efficacy and User Perception
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2023) -
Contextualized Evaluations: Judging Language Model Responses to Underspecified Queries
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2024) -
A Simple Joint Model for Improved Contextual Neural Lemmatization
di: Malaviya, Chaitanya, et al.
Pubblicazione: (2019)