Large Language Models in the Task of Automatic Validation of Text Classifier Predictions
Fuente:
arXiv
Guardado en:
| Autores principales: | Tsymbalov, Aleksandr, Khovrichev, Mikhail |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
por: Fadeeva, Ekaterina, et al.
Publicado: (2024)
por: Fadeeva, Ekaterina, et al.
Publicado: (2024)
Adaptive Conformal Prediction for Improving Factuality of Generations by Large Language Models
por: Rubashevskii, Aleksandr, et al.
Publicado: (2026)
por: Rubashevskii, Aleksandr, et al.
Publicado: (2026)
Detecting Hallucinations in SpeechLLMs at Inference Time Using Attention Maps
por: Waldendorf, Jonas, et al.
Publicado: (2026)
por: Waldendorf, Jonas, et al.
Publicado: (2026)
Binary Classifier Optimization for Large Language Model Alignment
por: Jung, Seungjae, et al.
Publicado: (2024)
por: Jung, Seungjae, et al.
Publicado: (2024)
Evaluating Large Language Models for Health-Related Text Classification Tasks with Public Social Media Data
por: Guo, Yuting, et al.
Publicado: (2024)
por: Guo, Yuting, et al.
Publicado: (2024)
MedVAL: Toward Expert-Level Medical Text Validation with Language Models
por: Aali, Asad, et al.
Publicado: (2025)
por: Aali, Asad, et al.
Publicado: (2025)
Large Language Models Are Overparameterized Text Encoders
por: K, Thennal D, et al.
Publicado: (2024)
por: K, Thennal D, et al.
Publicado: (2024)
Foundational Autoraters: Taming Large Language Models for Better Automatic Evaluation
por: Vu, Tu, et al.
Publicado: (2024)
por: Vu, Tu, et al.
Publicado: (2024)
Large Language Models as Generalizable Policies for Embodied Tasks
por: Szot, Andrew, et al.
Publicado: (2023)
por: Szot, Andrew, et al.
Publicado: (2023)
Opir: Efficient Multi-Task Safety Classification for Toxicity, Jailbreaks, Hate Speech, and Harmful Content
por: Stepanov, Ihor, et al.
Publicado: (2026)
por: Stepanov, Ihor, et al.
Publicado: (2026)
TextGrad: Automatic "Differentiation" via Text
por: Yuksekgonul, Mert, et al.
Publicado: (2024)
por: Yuksekgonul, Mert, et al.
Publicado: (2024)
Large Language Models for Detection of Life-Threatening Texts
por: Nguyen, Thanh Thi, et al.
Publicado: (2025)
por: Nguyen, Thanh Thi, et al.
Publicado: (2025)
RePrompt: Planning by Automatic Prompt Engineering for Large Language Models Agents
por: Chen, Weizhe, et al.
Publicado: (2024)
por: Chen, Weizhe, et al.
Publicado: (2024)
ClinicRealm: Re-evaluating Large Language Models with Conventional Machine Learning for Non-Generative Clinical Prediction Tasks
por: Zhu, Yinghao, et al.
Publicado: (2024)
por: Zhu, Yinghao, et al.
Publicado: (2024)
ERBench: An Entity-Relationship based Automatically Verifiable Hallucination Benchmark for Large Language Models
por: Oh, Jio, et al.
Publicado: (2024)
por: Oh, Jio, et al.
Publicado: (2024)
Large Language Models for Travel Behavior Prediction
por: Mo, Baichuan, et al.
Publicado: (2023)
por: Mo, Baichuan, et al.
Publicado: (2023)
CPLLM: Clinical Prediction with Large Language Models
por: Shoham, Ofir Ben, et al.
Publicado: (2023)
por: Shoham, Ofir Ben, et al.
Publicado: (2023)
Collaborative Performance Prediction for Large Language Models
por: Zhang, Qiyuan, et al.
Publicado: (2024)
por: Zhang, Qiyuan, et al.
Publicado: (2024)
1024m at SMM4H 2024: Tasks 3, 5 & 6 -- Ensembles of Transformers and Large Language Models for Medical Text Classification
por: Kadiyala, Ram Mohan Rao, et al.
Publicado: (2024)
por: Kadiyala, Ram Mohan Rao, et al.
Publicado: (2024)
Large Visual-Language Models Are Also Good Classifiers: A Study of In-Context Multimodal Fake News Detection
por: Jiang, Ye, et al.
Publicado: (2024)
por: Jiang, Ye, et al.
Publicado: (2024)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
por: Feng, Jie, et al.
Publicado: (2024)
por: Feng, Jie, et al.
Publicado: (2024)
Large Language Models Can Self-Improve At Web Agent Tasks
por: Patel, Ajay, et al.
Publicado: (2024)
por: Patel, Ajay, et al.
Publicado: (2024)
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
por: Zhu, Kaijie, et al.
Publicado: (2023)
por: Zhu, Kaijie, et al.
Publicado: (2023)
Wikontic: Constructing Wikidata-Aligned, Ontology-Aware Knowledge Graphs with Large Language Models
por: Chepurova, Alla, et al.
Publicado: (2025)
por: Chepurova, Alla, et al.
Publicado: (2025)
SAC-KG: Exploiting Large Language Models as Skilled Automatic Constructors for Domain Knowledge Graphs
por: Chen, Hanzhu, et al.
Publicado: (2024)
por: Chen, Hanzhu, et al.
Publicado: (2024)
Large Language Models as Topological Structure Enhancers for Text-Attributed Graphs
por: Sun, Shengyin, et al.
Publicado: (2023)
por: Sun, Shengyin, et al.
Publicado: (2023)
Training Large Language Models to Predict Clinical Events
por: Turtel, Benjamin, et al.
Publicado: (2026)
por: Turtel, Benjamin, et al.
Publicado: (2026)
Benchmarking the Medical Understanding and Reasoning of Large Language Models in Arabic Healthcare Tasks
por: AlDahoul, Nouar, et al.
Publicado: (2025)
por: AlDahoul, Nouar, et al.
Publicado: (2025)
Ensemble Learning for Large Language Models in Text and Code Generation: A Survey
por: Ashiga, Mari, et al.
Publicado: (2025)
por: Ashiga, Mari, et al.
Publicado: (2025)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
por: Jiao, Difan, et al.
Publicado: (2023)
por: Jiao, Difan, et al.
Publicado: (2023)
Debiasing Text Safety Classifiers through a Fairness-Aware Ensemble
por: Sturman, Olivia, et al.
Publicado: (2024)
por: Sturman, Olivia, et al.
Publicado: (2024)
Autonomous Data Selection with Zero-shot Generative Classifiers for Mathematical Texts
por: Zhang, Yifan, et al.
Publicado: (2024)
por: Zhang, Yifan, et al.
Publicado: (2024)
Towards LLM-guided Causal Explainability for Black-box Text Classifiers
por: Bhattacharjee, Amrita, et al.
Publicado: (2023)
por: Bhattacharjee, Amrita, et al.
Publicado: (2023)
Exploring the Trade-off Between Model Performance and Explanation Plausibility of Text Classifiers Using Human Rationales
por: Resck, Lucas E., et al.
Publicado: (2024)
por: Resck, Lucas E., et al.
Publicado: (2024)
Explingo: Explaining AI Predictions using Large Language Models
por: Zytek, Alexandra, et al.
Publicado: (2024)
por: Zytek, Alexandra, et al.
Publicado: (2024)
A Law of Next-Token Prediction in Large Language Models
por: He, Hangfeng, et al.
Publicado: (2024)
por: He, Hangfeng, et al.
Publicado: (2024)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
por: Zhou, Chenxi, et al.
Publicado: (2025)
por: Zhou, Chenxi, et al.
Publicado: (2025)
Multilingual Prompt Engineering in Large Language Models: A Survey Across NLP Tasks
por: Vatsal, Shubham, et al.
Publicado: (2025)
por: Vatsal, Shubham, et al.
Publicado: (2025)
Evaluating Computational Accuracy of Large Language Models in Numerical Reasoning Tasks for Healthcare Applications
por: Malghan, Arjun R.
Publicado: (2025)
por: Malghan, Arjun R.
Publicado: (2025)
TharuChat: Bootstrapping Large Language Models for a Low-Resource Language via Synthetic Data and Human Validation
por: Panth, Prajwal, et al.
Publicado: (2026)
por: Panth, Prajwal, et al.
Publicado: (2026)
Ejemplares similares
-
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
por: Fadeeva, Ekaterina, et al.
Publicado: (2024) -
Adaptive Conformal Prediction for Improving Factuality of Generations by Large Language Models
por: Rubashevskii, Aleksandr, et al.
Publicado: (2026) -
Detecting Hallucinations in SpeechLLMs at Inference Time Using Attention Maps
por: Waldendorf, Jonas, et al.
Publicado: (2026) -
Binary Classifier Optimization for Large Language Model Alignment
por: Jung, Seungjae, et al.
Publicado: (2024) -
Evaluating Large Language Models for Health-Related Text Classification Tasks with Public Social Media Data
por: Guo, Yuting, et al.
Publicado: (2024)