ANLS* -- A Universal Document Processing Metric for Generative Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Peer, David, Schöpf, Philemon, Nebendahl, Volckmar, Rietzler, Alexander, Stabinger, Sebastian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ATA: A Neuro-Symbolic Approach to Implement Autonomous and Trustworthy Agents
por: Peer, David, et al.
Publicado: (2025)
por: Peer, David, et al.
Publicado: (2025)
Genshin: General Shield for Natural Language Processing with Large Language Models
por: Peng, Xiao, et al.
Publicado: (2024)
por: Peng, Xiao, et al.
Publicado: (2024)
A Universal Prompting Strategy for Extracting Process Model Information from Natural Language Text using Large Language Models
por: Neuberger, Julian, et al.
Publicado: (2024)
por: Neuberger, Julian, et al.
Publicado: (2024)
Follow-Up Questions Improve Documents Generated by Large Language Models
por: Tix, Bernadette J
Publicado: (2024)
por: Tix, Bernadette J
Publicado: (2024)
Evaluating Large Language Models for Real-World Engineering Tasks
por: Heesch, Rene, et al.
Publicado: (2025)
por: Heesch, Rene, et al.
Publicado: (2025)
Is this Idea Novel? An Automated Benchmark for Judgment of Research Ideas
por: Schopf, Tim, et al.
Publicado: (2026)
por: Schopf, Tim, et al.
Publicado: (2026)
The Evolving Landscape of Generative Large Language Models and Traditional Natural Language Processing in Medicine
por: Yang, Rui, et al.
Publicado: (2025)
por: Yang, Rui, et al.
Publicado: (2025)
Reward Models are Metrics in a Trench Coat
por: Gehrmann, Sebastian
Publicado: (2025)
por: Gehrmann, Sebastian
Publicado: (2025)
Full-ECE: A Metric For Token-level Calibration on Large Language Models
por: Liu, Han, et al.
Publicado: (2024)
por: Liu, Han, et al.
Publicado: (2024)
WRDScore: New Metric for Evaluation of Natural Language Generation Models
por: Mussabayev, Ravil
Publicado: (2024)
por: Mussabayev, Ravil
Publicado: (2024)
Large Language Model for Table Processing: A Survey
por: Lu, Weizheng, et al.
Publicado: (2024)
por: Lu, Weizheng, et al.
Publicado: (2024)
Beyond Metrics: A Critical Analysis of the Variability in Large Language Model Evaluation Frameworks
por: Pimentel, Marco AF, et al.
Publicado: (2024)
por: Pimentel, Marco AF, et al.
Publicado: (2024)
On the Use of Large Language Models to Generate Capability Ontologies
por: da Silva, Luis Miguel Vieira, et al.
Publicado: (2024)
por: da Silva, Luis Miguel Vieira, et al.
Publicado: (2024)
Memorizing Documents with Guidance in Large Language Models
por: Park, Bumjin, et al.
Publicado: (2024)
por: Park, Bumjin, et al.
Publicado: (2024)
Large Language Models for Extrapolative Modeling of Manufacturing Processes
por: Khanghah, Kiarash Naghavi, et al.
Publicado: (2025)
por: Khanghah, Kiarash Naghavi, et al.
Publicado: (2025)
Document Intelligence in the Era of Large Language Models: A Survey
por: Wang, Weishi, et al.
Publicado: (2025)
por: Wang, Weishi, et al.
Publicado: (2025)
The Effectiveness of Style Vectors for Steering Large Language Models: A Human Evaluation
por: Diallo, Diaoulé, et al.
Publicado: (2026)
por: Diallo, Diaoulé, et al.
Publicado: (2026)
GlórIA -- A Generative and Open Large Language Model for Portuguese
por: Lopes, Ricardo, et al.
Publicado: (2024)
por: Lopes, Ricardo, et al.
Publicado: (2024)
Do Large Language Models Mirror Cognitive Language Processing?
por: Ren, Yuqi, et al.
Publicado: (2024)
por: Ren, Yuqi, et al.
Publicado: (2024)
Towards Universal Semantics With Large Language Models
por: Baartmans, Raymond, et al.
Publicado: (2025)
por: Baartmans, Raymond, et al.
Publicado: (2025)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
por: Zheng, Congmin, et al.
Publicado: (2025)
por: Zheng, Congmin, et al.
Publicado: (2025)
Knowledge Graph Fusion with Large Language Models for Accurate, Explainable Manufacturing Process Planning
por: Hoang, Danny, et al.
Publicado: (2025)
por: Hoang, Danny, et al.
Publicado: (2025)
Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
por: Qiu, Ziliang, et al.
Publicado: (2025)
por: Qiu, Ziliang, et al.
Publicado: (2025)
Scope Ambiguities in Large Language Models
por: Kamath, Gaurav, et al.
Publicado: (2024)
por: Kamath, Gaurav, et al.
Publicado: (2024)
Discourse Graph Guided Document Translation with Large Language Models
por: Pham, Viet-Thanh, et al.
Publicado: (2025)
por: Pham, Viet-Thanh, et al.
Publicado: (2025)
DSGram: Dynamic Weighting Sub-Metrics for Grammatical Error Correction in the Era of Large Language Models
por: Xie, Jinxiang, et al.
Publicado: (2024)
por: Xie, Jinxiang, et al.
Publicado: (2024)
The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models
por: Siegel, Noah Y., et al.
Publicado: (2024)
por: Siegel, Noah Y., et al.
Publicado: (2024)
Quantized Large Language Models in Biomedical Natural Language Processing: Evaluation and Recommendation
por: Zhan, Zaifu, et al.
Publicado: (2025)
por: Zhan, Zaifu, et al.
Publicado: (2025)
Generative Monoculture in Large Language Models
por: Wu, Fan, et al.
Publicado: (2024)
por: Wu, Fan, et al.
Publicado: (2024)
Integrating Cognitive Processing Signals into Language Models: A Review of Advances, Applications and Future Directions
por: Lopez-Cardona, Angela, et al.
Publicado: (2025)
por: Lopez-Cardona, Angela, et al.
Publicado: (2025)
Exploring Large Language Models and Hierarchical Frameworks for Classification of Large Unstructured Legal Documents
por: Prasad, Nishchal, et al.
Publicado: (2024)
por: Prasad, Nishchal, et al.
Publicado: (2024)
Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer
por: Kahana, Adar, et al.
Publicado: (2024)
por: Kahana, Adar, et al.
Publicado: (2024)
AutoRE: Document-Level Relation Extraction with Large Language Models
por: Xue, Lilong, et al.
Publicado: (2024)
por: Xue, Lilong, et al.
Publicado: (2024)
Efficient Fine-Tuning of Large Language Models for Automated Medical Documentation
por: Leong, Hui Yi, et al.
Publicado: (2024)
por: Leong, Hui Yi, et al.
Publicado: (2024)
Enhancing Legal Document Retrieval: A Multi-Phase Approach with Large Language Models
por: Nguyen, Hai-Long, et al.
Publicado: (2024)
por: Nguyen, Hai-Long, et al.
Publicado: (2024)
BioInstruct: Instruction Tuning of Large Language Models for Biomedical Natural Language Processing
por: Tran, Hieu, et al.
Publicado: (2023)
por: Tran, Hieu, et al.
Publicado: (2023)
Explainable Biomedical Hypothesis Generation via Retrieval Augmented Generation enabled Large Language Models
por: Pelletier, Alexander R., et al.
Publicado: (2024)
por: Pelletier, Alexander R., et al.
Publicado: (2024)
Knowledge Bases in Support of Large Language Models for Processing Web News
por: Zhang, Yihe, et al.
Publicado: (2024)
por: Zhang, Yihe, et al.
Publicado: (2024)
Bridging Domain Knowledge and Process Discovery Using Large Language Models
por: Norouzifar, Ali, et al.
Publicado: (2024)
por: Norouzifar, Ali, et al.
Publicado: (2024)
Disjoint Processing Mechanisms of Hierarchical and Linear Grammars in Large Language Models
por: Sankaranarayanan, Aruna, et al.
Publicado: (2025)
por: Sankaranarayanan, Aruna, et al.
Publicado: (2025)
Ejemplares similares
-
ATA: A Neuro-Symbolic Approach to Implement Autonomous and Trustworthy Agents
por: Peer, David, et al.
Publicado: (2025) -
Genshin: General Shield for Natural Language Processing with Large Language Models
por: Peng, Xiao, et al.
Publicado: (2024) -
A Universal Prompting Strategy for Extracting Process Model Information from Natural Language Text using Large Language Models
por: Neuberger, Julian, et al.
Publicado: (2024) -
Follow-Up Questions Improve Documents Generated by Large Language Models
por: Tix, Bernadette J
Publicado: (2024) -
Evaluating Large Language Models for Real-World Engineering Tasks
por: Heesch, Rene, et al.
Publicado: (2025)