A Survey on Spoken Italian Datasets and Corpora
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Giordano, Marco, Rinaldi, Claudia |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Natural Language Processing for the Legal Domain: A Survey of Tasks, Datasets, Models, and Challenges
par: Ariai, Farid, et autres
Publié: (2024)
par: Ariai, Farid, et autres
Publié: (2024)
LLM-ReSum: A Framework for LLM Reflective Summarization through Self-Evaluation
par: Nguyen, Huyen, et autres
Publié: (2026)
par: Nguyen, Huyen, et autres
Publié: (2026)
Historical Ink: Exploring Large Language Models for Irony Detection in 19th-Century Spanish
par: Cohen, Kevin, et autres
Publié: (2025)
par: Cohen, Kevin, et autres
Publié: (2025)
DNB-AI-Project at SemEval-2025 Task 5: An LLM-Ensemble Approach for Automated Subject Indexing
par: Kluge, Lisa, et autres
Publié: (2025)
par: Kluge, Lisa, et autres
Publié: (2025)
HLM-Cite: Hybrid Language Model Workflow for Text-based Scientific Citation Prediction
par: Hao, Qianyue, et autres
Publié: (2024)
par: Hao, Qianyue, et autres
Publié: (2024)
Large Language Models for History, Philosophy, and Sociology of Science: Interpretive Uses, Methodological Challenges, and Critical Perspectives
par: Simons, Arno, et autres
Publié: (2025)
par: Simons, Arno, et autres
Publié: (2025)
The OCON model: an old but gold solution for distributable supervised classification
par: Giacomelli, Stefano, et autres
Publié: (2024)
par: Giacomelli, Stefano, et autres
Publié: (2024)
Adversarially Probing Cross-Family Sound Symbolism in 27 Languages
par: Sharma, Anika, et autres
Publié: (2025)
par: Sharma, Anika, et autres
Publié: (2025)
Agreement Between Large Language Models, Human Reviewers, and Authors in Evaluating STROBE Checklists for Observational Studies in Rheumatology
par: Bilgin, Emre, et autres
Publié: (2026)
par: Bilgin, Emre, et autres
Publié: (2026)
Citation Grounding: Detecting and Reducing LLM Citation Hallucinations via Legal Citation Graphs
par: Ovcharov, Volodymyr
Publié: (2026)
par: Ovcharov, Volodymyr
Publié: (2026)
LCA and energy efficiency in buildings: mapping more than twenty years of research
par: Asdrubali, F., et autres
Publié: (2024)
par: Asdrubali, F., et autres
Publié: (2024)
Historical Ink: 19th Century Latin American Spanish Newspaper Corpus with LLM OCR Correction
par: Manrique-Gómez, Laura, et autres
Publié: (2024)
par: Manrique-Gómez, Laura, et autres
Publié: (2024)
On Fusing ChatGPT and Ensemble Learning in Discon-tinuous Named Entity Recognition in Health Corpora
par: Chen, Tzu-Chieh, et autres
Publié: (2024)
par: Chen, Tzu-Chieh, et autres
Publié: (2024)
BLT: Can Large Language Models Handle Basic Legal Text?
par: Blair-Stanek, Andrew, et autres
Publié: (2023)
par: Blair-Stanek, Andrew, et autres
Publié: (2023)
Local Interpretations for Explainable Natural Language Processing: A Survey
par: Luo, Siwen, et autres
Publié: (2021)
par: Luo, Siwen, et autres
Publié: (2021)
Next Token Prediction Is a Dead End for Creativity
par: Olatunji, Ibukun, et autres
Publié: (2025)
par: Olatunji, Ibukun, et autres
Publié: (2025)
AI-generated podcasts: Synthetic Intimacy and Cultural Mistranslation in NotebookLM's Audio Overviews
par: Rettberg, Jill Walker
Publié: (2025)
par: Rettberg, Jill Walker
Publié: (2025)
A Lightweight Approach to Detection of AI-Generated Texts Using Stylometric Features
par: Aityan, Sergey K., et autres
Publié: (2025)
par: Aityan, Sergey K., et autres
Publié: (2025)
Igea: a Decoder-Only Language Model for Biomedical Text Generation in Italian
par: Buonocore, Tommaso Mario, et autres
Publié: (2024)
par: Buonocore, Tommaso Mario, et autres
Publié: (2024)
Do LLMs Know What They Know? Measuring Metacognitive Efficiency with Signal Detection Theory
par: Cacioli, Jon-Paul
Publié: (2026)
par: Cacioli, Jon-Paul
Publié: (2026)
Classification of descriptions and summary using multiple passes of statistical and natural language toolkits
par: Banthia, Saumya, et autres
Publié: (2020)
par: Banthia, Saumya, et autres
Publié: (2020)
Annif at SemEval-2025 Task 5: Traditional XMTC augmented by LLMs
par: Suominen, Osma, et autres
Publié: (2025)
par: Suominen, Osma, et autres
Publié: (2025)
What is Wrong with Language Models that Can Not Tell a Story?
par: Yamshchikov, Ivan P., et autres
Publié: (2022)
par: Yamshchikov, Ivan P., et autres
Publié: (2022)
Big AI is accelerating the metacrisis: What can we do?
par: Bird, Steven
Publié: (2025)
par: Bird, Steven
Publié: (2025)
OEMA: Ontology-Enhanced Multi-Agent Collaboration Framework for Zero-Shot Clinical Named Entity Recognition
par: Tao, Xinli, et autres
Publié: (2025)
par: Tao, Xinli, et autres
Publié: (2025)
LLMs Simulate Big Five Personality Traits: Further Evidence
par: Sorokovikova, Aleksandra, et autres
Publié: (2024)
par: Sorokovikova, Aleksandra, et autres
Publié: (2024)
Scaling In, Not Up? Testing Thick Citation Context Analysis with GPT-5 and Fragile Prompts
par: Simons, Arno
Publié: (2026)
par: Simons, Arno
Publié: (2026)
A Semantic Approach to Negation Detection and Word Disambiguation with Natural Language Processing
par: Okpala, Izunna, et autres
Publié: (2023)
par: Okpala, Izunna, et autres
Publié: (2023)
Narrative Fingerprints: Multi-Scale Author Identification via Novelty Curve Dynamics
par: Zimmerman, Fred, et autres
Publié: (2026)
par: Zimmerman, Fred, et autres
Publié: (2026)
Allocate Marginal Reviews to Borderline Papers Using LLM Comparative Ranking
par: Epstein, Elliot L., et autres
Publié: (2026)
par: Epstein, Elliot L., et autres
Publié: (2026)
MIMIC-SR-ICD11: A Dataset for Narrative-Based Diagnosis
par: Wu, Yuexin, et autres
Publié: (2025)
par: Wu, Yuexin, et autres
Publié: (2025)
Exploiting LLM-as-a-Judge Disposition on Free Text Legal QA via Prompt Optimization
par: Elganayni, Mohamed Hesham, et autres
Publié: (2026)
par: Elganayni, Mohamed Hesham, et autres
Publié: (2026)
When is dataset cartography ineffective? Using training dynamics does not improve robustness against Adversarial SQuAD
par: Mandal, Paul K.
Publié: (2025)
par: Mandal, Paul K.
Publié: (2025)
Subword-Based Comparative Linguistics across 242 Languages Using Wikipedia Glottosets
par: Chelombitko, Iaroslav, et autres
Publié: (2026)
par: Chelombitko, Iaroslav, et autres
Publié: (2026)
A Multi-Encoder Frozen-Decoder Approach for Fine-Tuning Large Language Models
par: Dhole, Kaustubh D.
Publié: (2025)
par: Dhole, Kaustubh D.
Publié: (2025)
A Sociolinguistic Analysis of Automatic Speech Recognition Bias in Newcastle English
par: Serditova, Dana, et autres
Publié: (2026)
par: Serditova, Dana, et autres
Publié: (2026)
3Description: An Intuitive Human-AI Collaborative 3D Modeling Approach
par: Cai, Zhuodi
Publié: (2025)
par: Cai, Zhuodi
Publié: (2025)
Applied Explainability for Large Language Models: A Comparative Study
par: Kancharla, Venkata Abhinandan
Publié: (2026)
par: Kancharla, Venkata Abhinandan
Publié: (2026)
Advancing Italian Biomedical Information Extraction with Transformers-based Models: Methodological Insights and Multicenter Practical Application
par: Crema, Claudio, et autres
Publié: (2023)
par: Crema, Claudio, et autres
Publié: (2023)
LLMs Generate Kitsch
par: Klinge, Xenia, et autres
Publié: (2026)
par: Klinge, Xenia, et autres
Publié: (2026)
Documents similaires
-
Natural Language Processing for the Legal Domain: A Survey of Tasks, Datasets, Models, and Challenges
par: Ariai, Farid, et autres
Publié: (2024) -
LLM-ReSum: A Framework for LLM Reflective Summarization through Self-Evaluation
par: Nguyen, Huyen, et autres
Publié: (2026) -
Historical Ink: Exploring Large Language Models for Irony Detection in 19th-Century Spanish
par: Cohen, Kevin, et autres
Publié: (2025) -
DNB-AI-Project at SemEval-2025 Task 5: An LLM-Ensemble Approach for Automated Subject Indexing
par: Kluge, Lisa, et autres
Publié: (2025) -
HLM-Cite: Hybrid Language Model Workflow for Text-based Scientific Citation Prediction
par: Hao, Qianyue, et autres
Publié: (2024)