Enregistré dans:
| Auteur principal: | D'Souza, Alex |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.19764 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring the Latest LLMs for Leaderboard Extraction
par: Kabongo, Salomon, et autres
Publié: (2024)
par: Kabongo, Salomon, et autres
Publié: (2024)
LLMs4OL 2024 Overview: The 1st Large Language Models for Ontology Learning Challenge
par: Giglou, Hamed Babaei, et autres
Publié: (2024)
par: Giglou, Hamed Babaei, et autres
Publié: (2024)
A FAIR and Free Prompt-based Research Assistant
par: Shamsabadi, Mahsa, et autres
Publié: (2024)
par: Shamsabadi, Mahsa, et autres
Publié: (2024)
LLMs4Synthesis: Leveraging Large Language Models for Scientific Synthesis
par: Giglou, Hamed Babaei, et autres
Publié: (2024)
par: Giglou, Hamed Babaei, et autres
Publié: (2024)
LLMs Can Plan Only If We Tell Them
par: Sel, Bilgehan, et autres
Publié: (2025)
par: Sel, Bilgehan, et autres
Publié: (2025)
Diagnosing Structural Failures in LLM-Based Evidence Extraction for Meta-Analysis
par: Tan, Zhiyin, et autres
Publié: (2026)
par: Tan, Zhiyin, et autres
Publié: (2026)
Toward Purpose-oriented Topic Model Evaluation enabled by Large Language Models
par: Tan, Zhiyin, et autres
Publié: (2025)
par: Tan, Zhiyin, et autres
Publié: (2025)
Bridging the Evaluation Gap: Leveraging Large Language Models for Topic Model Evaluation
par: Tan, Zhiyin, et autres
Publié: (2025)
par: Tan, Zhiyin, et autres
Publié: (2025)
Can We Edit LLMs for Long-Tail Biomedical Knowledge?
par: Yi, Xinhao, et autres
Publié: (2025)
par: Yi, Xinhao, et autres
Publié: (2025)
Are Stereotypes Leading LLMs' Zero-Shot Stance Detection ?
par: Dubreuil, Anthony, et autres
Publié: (2025)
par: Dubreuil, Anthony, et autres
Publié: (2025)
Mining for Species, Locations, Habitats, and Ecosystems from Scientific Papers in Invasion Biology: A Large-Scale Exploratory Study with Large Language Models
par: D'Souza, Jennifer, et autres
Publié: (2025)
par: D'Souza, Jennifer, et autres
Publié: (2025)
YESciEval: Robust LLM-as-a-Judge for Scientific Question Answering
par: D'Souza, Jennifer, et autres
Publié: (2025)
par: D'Souza, Jennifer, et autres
Publié: (2025)
Stereotype Detection in LLMs: A Multiclass, Explainable, and Benchmark-Driven Approach
par: Wu, Zekun, et autres
Publié: (2024)
par: Wu, Zekun, et autres
Publié: (2024)
From Keywords to Structured Summaries: Streamlining Scholarly Information Access
par: Shamsabadi, Mahsa, et autres
Publié: (2024)
par: Shamsabadi, Mahsa, et autres
Publié: (2024)
Evaluating Large Language Models for Structured Science Summarization in the Open Research Knowledge Graph
par: Nechakhin, Vladyslav, et autres
Publié: (2024)
par: Nechakhin, Vladyslav, et autres
Publié: (2024)
Astro-NER -- Astronomy Named Entity Recognition: Is GPT a Good Domain Expert Annotator?
par: Evans, Julia, et autres
Publié: (2024)
par: Evans, Julia, et autres
Publié: (2024)
Large Language Models as Evaluators for Scientific Synthesis
par: Evans, Julia, et autres
Publié: (2024)
par: Evans, Julia, et autres
Publié: (2024)
OntoAligner: A Comprehensive Modular and Robust Python Toolkit for Ontology Alignment
par: Giglou, Hamed Babaei, et autres
Publié: (2025)
par: Giglou, Hamed Babaei, et autres
Publié: (2025)
DeepResearch$^{\text{Eco}}$: A Recursive Agentic Workflow for Complex Scientific Question Answering in Ecology
par: D'Souza, Jennifer, et autres
Publié: (2025)
par: D'Souza, Jennifer, et autres
Publié: (2025)
StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs
par: Jeune, Pierre Le, et autres
Publié: (2026)
par: Jeune, Pierre Le, et autres
Publié: (2026)
Can We Trust LLM Detectors?
par: Sandhan, Jivnesh, et autres
Publié: (2026)
par: Sandhan, Jivnesh, et autres
Publié: (2026)
How Can We Effectively Expand the Vocabulary of LLMs with 0.01GB of Target Language Text?
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
LLMs4SchemaDiscovery: A Human-in-the-Loop Workflow for Scientific Schema Mining with Large Language Models
par: Sadruddin, Sameer, et autres
Publié: (2025)
par: Sadruddin, Sameer, et autres
Publié: (2025)
SemEval-2025 Task 5: LLMs4Subjects -- LLM-based Automated Subject Tagging for a National Technical Library's Open-Access Catalog
par: D'Souza, Jennifer, et autres
Publié: (2025)
par: D'Souza, Jennifer, et autres
Publié: (2025)
Large Language Models for Scientific Information Extraction: An Empirical Study for Virology
par: Shamsabadi, Mahsa, et autres
Publié: (2024)
par: Shamsabadi, Mahsa, et autres
Publié: (2024)
Can We Count on LLMs? The Fixed-Effect Fallacy and Claims of GPT-4 Capabilities
par: Ball, Thomas, et autres
Publié: (2024)
par: Ball, Thomas, et autres
Publié: (2024)
Mapping Clinical Doubt: Locating Linguistic Uncertainty in LLMs
par: Sridhar, Srivarshinee, et autres
Publié: (2025)
par: Sridhar, Srivarshinee, et autres
Publié: (2025)
LLMs for Relational Reasoning: How Far are We?
par: Li, Zhiming, et autres
Publié: (2024)
par: Li, Zhiming, et autres
Publié: (2024)
LLM-REVal: Can We Trust LLM Reviewers Yet?
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
Can We Verify Step by Step for Incorrect Answer Detection?
par: Xu, Xin, et autres
Publié: (2024)
par: Xu, Xin, et autres
Publié: (2024)
We Can't Understand AI Using our Existing Vocabulary
par: Hewitt, John, et autres
Publié: (2025)
par: Hewitt, John, et autres
Publié: (2025)
Responsible AI in NLP: GUS-Net Span-Level Bias Detection Dataset and Benchmark for Generalizations, Unfairness, and Stereotypes
par: Powers, Maximus, et autres
Publié: (2024)
par: Powers, Maximus, et autres
Publié: (2024)
Automatic Prompt Engineering with No Task Cues and No Tuning
par: Chowdhury, Faisal, et autres
Publié: (2026)
par: Chowdhury, Faisal, et autres
Publié: (2026)
Can we Debias Social Stereotypes in AI-Generated Images? Examining Text-to-Image Outputs and User Perceptions
par: Barve, Saharsh, et autres
Publié: (2025)
par: Barve, Saharsh, et autres
Publié: (2025)
Location Not Found: Exposing Implicit Local and Global Biases in Multilingual LLMs
par: Mor-Lan, Guy, et autres
Publié: (2026)
par: Mor-Lan, Guy, et autres
Publié: (2026)
Coordinates from Context: Using LLMs to Ground Complex Location References
par: Masis, Tessa, et autres
Publié: (2025)
par: Masis, Tessa, et autres
Publié: (2025)
Evaluation of Large Language Models: STEM education and Gender Stereotypes
par: Due, Smilla, et autres
Publié: (2024)
par: Due, Smilla, et autres
Publié: (2024)
Characterizing Stereotypical Bias from Privacy-preserving Pre-Training
par: Arnold, Stefan, et autres
Publié: (2024)
par: Arnold, Stefan, et autres
Publié: (2024)
Detecting Linguistic Indicators for Stereotype Assessment with Large Language Models
par: Görge, Rebekka, et autres
Publié: (2025)
par: Görge, Rebekka, et autres
Publié: (2025)
The production of meaning in the processing of natural language
par: Agostino, Christopher J., et autres
Publié: (2026)
par: Agostino, Christopher J., et autres
Publié: (2026)
Documents similaires
-
Exploring the Latest LLMs for Leaderboard Extraction
par: Kabongo, Salomon, et autres
Publié: (2024) -
LLMs4OL 2024 Overview: The 1st Large Language Models for Ontology Learning Challenge
par: Giglou, Hamed Babaei, et autres
Publié: (2024) -
A FAIR and Free Prompt-based Research Assistant
par: Shamsabadi, Mahsa, et autres
Publié: (2024) -
LLMs4Synthesis: Leveraging Large Language Models for Scientific Synthesis
par: Giglou, Hamed Babaei, et autres
Publié: (2024) -
LLMs Can Plan Only If We Tell Them
par: Sel, Bilgehan, et autres
Publié: (2025)