From Policy to Logic for Efficient and Interpretable Coverage Assessment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pokharel, Rhitabrat, Hassanzadeh, Hamid Reza, Agrawal, Ameeta |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
Cross-Lingual Activation Steering for Multilingual Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2026)
par: Pokharel, Rhitabrat, et autres
Publié: (2026)
CAPO: Confidence Aware Preference Optimization Learning for Multilingual Preferences
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
Beyond Data Quantity: Key Factors Driving Performance in Multilingual Language Models
par: Nezhad, Sina Bagheri, et autres
Publié: (2024)
par: Nezhad, Sina Bagheri, et autres
Publié: (2024)
The Impact of Model Scaling on Seen and Unseen Language Performance
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
No-Worse Context-Aware Decoding: Preventing Neutral Regression in Context-Conditioned Generation
par: Tao, Yufei, et autres
Publié: (2026)
par: Tao, Yufei, et autres
Publié: (2026)
Understanding Position Bias Effects on Fairness in Social Multi-Document Summarization
par: Olabisi, Olubusayo, et autres
Publié: (2024)
par: Olabisi, Olubusayo, et autres
Publié: (2024)
Evaluating Multilingual Long-Context Models for Retrieval and Reasoning
par: Agrawal, Ameeta, et autres
Publié: (2024)
par: Agrawal, Ameeta, et autres
Publié: (2024)
Fair Summarization: Bridging Quality and Diversity in Extractive Summaries
par: Nezhad, Sina Bagheri, et autres
Publié: (2024)
par: Nezhad, Sina Bagheri, et autres
Publié: (2024)
"Lost-in-the-Later": Framework for Quantifying Contextual Grounding in Large Language Models
par: Tao, Yufei, et autres
Publié: (2025)
par: Tao, Yufei, et autres
Publié: (2025)
Explain-then-Process: Using Grammar Prompting to Enhance Grammatical Acceptability Judgments
par: Scheinberg, Russell, et autres
Publié: (2025)
par: Scheinberg, Russell, et autres
Publié: (2025)
Correct-Detect: Balancing Performance and Ambiguity Through the Lens of Coreference Resolution in LLMs
par: Shore, Amber, et autres
Publié: (2025)
par: Shore, Amber, et autres
Publié: (2025)
Mitigation of Gender and Ethnicity Bias in AI-Generated Stories through Model Explanations
par: Dimgba, Martha O., et autres
Publié: (2025)
par: Dimgba, Martha O., et autres
Publié: (2025)
Generative Active Testing: Efficient LLM Evaluation via Proxy Task Adaptation
par: Ramakrishnan, Aashish Anantha, et autres
Publié: (2026)
par: Ramakrishnan, Aashish Anantha, et autres
Publié: (2026)
When Context Leads but Parametric Memory Follows in Large Language Models
par: Tao, Yufei, et autres
Publié: (2024)
par: Tao, Yufei, et autres
Publié: (2024)
WikiCausal: Corpus and Evaluation Framework for Causal Knowledge Graph Construction
par: Hassanzadeh, Oktie
Publié: (2024)
par: Hassanzadeh, Oktie
Publié: (2024)
Health Insurance Coverage Rule Interpretation Corpus: Law, Policy, and Medical Guidance for Health Insurance Coverage Understanding
par: Gartner, Mike
Publié: (2025)
par: Gartner, Mike
Publié: (2025)
Distilling Event Sequence Knowledge From Large Language Models
par: Wadhwa, Somin, et autres
Publié: (2024)
par: Wadhwa, Somin, et autres
Publié: (2024)
From Implicit to Explicit: Token-Efficient Logical Supervision for Mathematical Reasoning in LLMs
par: Wang, Shaojie, et autres
Publié: (2026)
par: Wang, Shaojie, et autres
Publié: (2026)
Towards Nepali-language LLMs: Efficient GPT training with a Nepali BPE tokenizer
par: Shrestha, Adarsha, et autres
Publié: (2025)
par: Shrestha, Adarsha, et autres
Publié: (2025)
Advanced Machine Learning Techniques for Social Support Detection on Social Media
par: Kolesnikova, Olga, et autres
Publié: (2025)
par: Kolesnikova, Olga, et autres
Publié: (2025)
Interpretable Multimodal Misinformation Detection with Logic Reasoning
par: Liu, Hui, et autres
Publié: (2023)
par: Liu, Hui, et autres
Publié: (2023)
From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms
par: Jiang, Zhaokun, et autres
Publié: (2025)
par: Jiang, Zhaokun, et autres
Publié: (2025)
Logic Jailbreak: Efficiently Unlocking LLM Safety Restrictions Through Formal Logical Expression
par: Peng, Jingyu, et autres
Publié: (2025)
par: Peng, Jingyu, et autres
Publié: (2025)
Language Models' Factuality Depends on the Language of Inquiry
par: Aggarwal, Tushar, et autres
Publié: (2025)
par: Aggarwal, Tushar, et autres
Publié: (2025)
Graphing the Truth: Structured Visualizations for Automated Hallucination Detection in LLMs
par: Agrawal, Tanmay
Publié: (2025)
par: Agrawal, Tanmay
Publié: (2025)
Interpreting LLM-as-a-Judge Policies via Verifiable Global Explanations
par: Gajcin, Jasmina, et autres
Publié: (2025)
par: Gajcin, Jasmina, et autres
Publié: (2025)
Bridging Legal Interpretation and Formal Logic: Faithfulness, Assumption, and the Future of AI Legal Reasoning
par: Wang, Olivia Peiyu, et autres
Publié: (2026)
par: Wang, Olivia Peiyu, et autres
Publié: (2026)
From Query to Logic: Ontology-Driven Multi-Hop Reasoning in LLMs
par: Bian, Haonan, et autres
Publié: (2025)
par: Bian, Haonan, et autres
Publié: (2025)
Coverage-based Fairness in Multi-document Summarization
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
AutoQual: An LLM Agent for Automated Discovery of Interpretable Features for Review Quality Assessment
par: Lan, Xiaochong, et autres
Publié: (2025)
par: Lan, Xiaochong, et autres
Publié: (2025)
$\forall$uto$\exists$val: Autonomous Assessment of LLMs in Formal Synthesis and Interpretation Tasks
par: Karia, Rushang, et autres
Publié: (2024)
par: Karia, Rushang, et autres
Publié: (2024)
SuperPos-Prompt: Enhancing Soft Prompt Tuning of Language Models with Superposition of Multi Token Embeddings
par: SadraeiJavaeri, MohammadAli, et autres
Publié: (2024)
par: SadraeiJavaeri, MohammadAli, et autres
Publié: (2024)
Logic Agent: Enhancing Validity with Logic Rule Invocation
par: Liu, Hanmeng, et autres
Publié: (2024)
par: Liu, Hanmeng, et autres
Publié: (2024)
From Skill Text to Skill Structure: The Scheduling-Structural-Logical Representation for Agent Skills
par: Liang, Qiliang, et autres
Publié: (2026)
par: Liang, Qiliang, et autres
Publié: (2026)
BLUEX Revisited: Enhancing Benchmark Coverage with Automatic Captioning
par: Santos, João Guilherme Alves, et autres
Publié: (2025)
par: Santos, João Guilherme Alves, et autres
Publié: (2025)
A Comparative Study of Neurosymbolic AI Approaches to Interpretable Logical Reasoning
par: Chen, Michael K.
Publié: (2025)
par: Chen, Michael K.
Publié: (2025)
A comprehensive survey of contemporary Arabic sentiment analysis: Methods, Challenges, and Future Directions
par: Shi, Zhiqiang, et autres
Publié: (2025)
par: Shi, Zhiqiang, et autres
Publié: (2025)
Enhancing Cache-Augmented Generation (CAG) with Adaptive Contextual Compression for Scalable Knowledge Integration
par: Agrawal, Rishabh, et autres
Publié: (2025)
par: Agrawal, Rishabh, et autres
Publié: (2025)
From Blind Solvers to Logical Thinkers: Benchmarking LLMs' Logical Integrity on Faulty Mathematical Problems
par: Rahman, A M Muntasir, et autres
Publié: (2024)
par: Rahman, A M Muntasir, et autres
Publié: (2024)
Documents similaires
-
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2025) -
Cross-Lingual Activation Steering for Multilingual Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2026) -
CAPO: Confidence Aware Preference Optimization Learning for Multilingual Preferences
par: Pokharel, Rhitabrat, et autres
Publié: (2025) -
Beyond Data Quantity: Key Factors Driving Performance in Multilingual Language Models
par: Nezhad, Sina Bagheri, et autres
Publié: (2024) -
The Impact of Model Scaling on Seen and Unseen Language Performance
par: Pokharel, Rhitabrat, et autres
Publié: (2025)