NSF-SciFy: Mining the NSF Awards Database for Scientific Claims
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rao, Delip, You, Weiqiu, Wong, Eric, Callison-Burch, Chris |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
What Do Claim Verification Datasets Actually Test? A Reasoning Trace Analysis
par: Rao, Delip, et autres
Publié: (2026)
par: Rao, Delip, et autres
Publié: (2026)
BibTeX Citation Hallucinations in Scientific Publishing Agents: Evaluation and Mitigation
par: Rao, Delip, et autres
Publié: (2026)
par: Rao, Delip, et autres
Publié: (2026)
Detecting and Correcting Reference Hallucinations in Commercial LLMs and Deep Research Agents
par: Rao, Delip, et autres
Publié: (2026)
par: Rao, Delip, et autres
Publié: (2026)
ThinknCheck: Grounded Claim Verification with Compact, Reasoning-Driven, and Interpretable Models
par: Rao, Delip, et autres
Publié: (2026)
par: Rao, Delip, et autres
Publié: (2026)
Autorubric: Unifying Rubric-based LLM Evaluation
par: Rao, Delip, et autres
Publié: (2026)
par: Rao, Delip, et autres
Publié: (2026)
Agreement Metrics for LLM-as-Judge Evaluation: What to Report and Why
par: Rao, Delip, et autres
Publié: (2026)
par: Rao, Delip, et autres
Publié: (2026)
When Verification Fails: How Compositionally Infeasible Claims Escape Rejection
par: Liu, Muxin, et autres
Publié: (2026)
par: Liu, Muxin, et autres
Publié: (2026)
Probabilistic Soundness Guarantees in LLM Reasoning Chains
par: You, Weiqiu, et autres
Publié: (2025)
par: You, Weiqiu, et autres
Publié: (2025)
WithdrarXiv: A Large-Scale Dataset for Retraction Study
par: Rao, Delip, et autres
Publié: (2024)
par: Rao, Delip, et autres
Publié: (2024)
Overhearing LLM Agents: A Survey, Taxonomy, and Roadmap
par: Zhu, Andrew, et autres
Publié: (2025)
par: Zhu, Andrew, et autres
Publié: (2025)
MuSciClaims: Multimodal Scientific Claim Verification
par: Lal, Yash Kumar, et autres
Publié: (2025)
par: Lal, Yash Kumar, et autres
Publié: (2025)
SciFi-Benchmark: Leveraging Science Fiction To Improve Robot Behavior
par: Sermanet, Pierre, et autres
Publié: (2025)
par: Sermanet, Pierre, et autres
Publié: (2025)
Towards Faithful Model Explanation in NLP: A Survey
par: Lyu, Qing, et autres
Publié: (2022)
par: Lyu, Qing, et autres
Publié: (2022)
Uncovering Differences in Persuasive Language in Russian versus English Wikipedia
par: Li, Bryan, et autres
Publié: (2024)
par: Li, Bryan, et autres
Publié: (2024)
This Land is {Your, My} Land: Evaluating Geopolitical Biases in Language Models
par: Li, Bryan, et autres
Publié: (2023)
par: Li, Bryan, et autres
Publié: (2023)
Low-Resource Authorship Style Transfer: Can Non-Famous Authors Be Imitated?
par: Patel, Ajay, et autres
Publié: (2022)
par: Patel, Ajay, et autres
Publié: (2022)
SciClaimEval: Cross-modal Claim Verification in Scientific Papers
par: Ho, Xanh, et autres
Publié: (2026)
par: Ho, Xanh, et autres
Publié: (2026)
FineInstructions: Scaling Synthetic Instructions to Pre-Training Scale
par: Patel, Ajay, et autres
Publié: (2026)
par: Patel, Ajay, et autres
Publié: (2026)
You Have Thirteen Hours in Which to Solve the Labyrinth: Enhancing AI Game Masters with Function Calling
par: Song, Jaewoo, et autres
Publié: (2024)
par: Song, Jaewoo, et autres
Publié: (2024)
DataDreamer: A Tool for Synthetic Data Generation and Reproducible LLM Workflows
par: Patel, Ajay, et autres
Publié: (2024)
par: Patel, Ajay, et autres
Publié: (2024)
First Steps Towards Overhearing LLM Agents: A Case Study With Dungeons & Dragons Gameplay
par: Zhu, Andrew, et autres
Publié: (2025)
par: Zhu, Andrew, et autres
Publié: (2025)
Toward Beginner-Friendly LLMs for Language Learning: Controlling Difficulty in Conversation
par: Jin, Meiqing, et autres
Publié: (2025)
par: Jin, Meiqing, et autres
Publié: (2025)
SciClaimHunt: A Large Dataset for Evidence-based Scientific Claim Verification
par: Kumar, Sujit, et autres
Publié: (2025)
par: Kumar, Sujit, et autres
Publié: (2025)
WHAT-IF: Exploring Branching Narratives by Meta-Prompting Large Language Models
par: Huang, Runsheng "Anson", et autres
Publié: (2024)
par: Huang, Runsheng "Anson", et autres
Publié: (2024)
SciVer: Evaluating Foundation Models for Multimodal Scientific Claim Verification
par: Wang, Chengye, et autres
Publié: (2025)
par: Wang, Chengye, et autres
Publié: (2025)
MiRAGeNews: Multimodal Realistic AI-Generated News Detection
par: Huang, Runsheng, et autres
Publié: (2024)
par: Huang, Runsheng, et autres
Publié: (2024)
ReDel: A Toolkit for LLM-Powered Recursive Multi-Agent Systems
par: Zhu, Andrew, et autres
Publié: (2024)
par: Zhu, Andrew, et autres
Publié: (2024)
FanOutQA: A Multi-Hop, Multi-Document Question Answering Benchmark for Large Language Models
par: Zhu, Andrew, et autres
Publié: (2024)
par: Zhu, Andrew, et autres
Publié: (2024)
Trailblazer Engineering Impact Award (NSF)
Publié: (2024)
Publié: (2024)
CALYPSO: LLMs as Dungeon Masters' Assistants
par: Zhu, Andrew, et autres
Publié: (2023)
par: Zhu, Andrew, et autres
Publié: (2023)
Machine Text Detectors are Membership Inference Attacks
par: Koike, Ryuto, et autres
Publié: (2025)
par: Koike, Ryuto, et autres
Publié: (2025)
mStyleDistance: Multilingual Style Embeddings and their Evaluation
par: Qiu, Justin, et autres
Publié: (2025)
par: Qiu, Justin, et autres
Publié: (2025)
OpenPI2.0: An Improved Dataset for Entity Tracking in Texts
par: Zhang, Li, et autres
Publié: (2023)
par: Zhang, Li, et autres
Publié: (2023)
Identifying Information Technology Research Trends through Text Mining of NSF Awards
par: Varlioglu, Said, et autres
Publié: (2025)
par: Varlioglu, Said, et autres
Publié: (2025)
From Funding to Findings (FIND): An Open Database of NSF Awards and Research Outputs
par: Smith, Kazimier, et autres
Publié: (2025)
par: Smith, Kazimier, et autres
Publié: (2025)
Cyber-Attack Technique Classification Using Two-Stage Trained Large Language Models
par: You, Weiqiu, et autres
Publié: (2024)
par: You, Weiqiu, et autres
Publié: (2024)
Archaeology Program Senior Research Awards (NSF)
Publié: (2025)
Publié: (2025)
Scientific Computing Systems (NSF)
Publié: (2024)
Publié: (2024)
Report on the NSF Workshop on Sustainable Computing for Sustainability (NSF WSCS 2024)
par: Guérin, Roch, et autres
Publié: (2024)
par: Guérin, Roch, et autres
Publié: (2024)
PDDLEGO: Iterative Planning in Textual Environments
par: Zhang, Li, et autres
Publié: (2024)
par: Zhang, Li, et autres
Publié: (2024)
Documents similaires
-
What Do Claim Verification Datasets Actually Test? A Reasoning Trace Analysis
par: Rao, Delip, et autres
Publié: (2026) -
BibTeX Citation Hallucinations in Scientific Publishing Agents: Evaluation and Mitigation
par: Rao, Delip, et autres
Publié: (2026) -
Detecting and Correcting Reference Hallucinations in Commercial LLMs and Deep Research Agents
par: Rao, Delip, et autres
Publié: (2026) -
ThinknCheck: Grounded Claim Verification with Compact, Reasoning-Driven, and Interpretable Models
par: Rao, Delip, et autres
Publié: (2026) -
Autorubric: Unifying Rubric-based LLM Evaluation
par: Rao, Delip, et autres
Publié: (2026)