The Battle of LLMs: A Comparative Study in Conversational QA Tasks
Fuente:
arXiv
Guardado en:
| Autores principales: | Rangapur, Aryan, Rangapur, Aman |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Macroscale fracture surface segmentation via semi-supervised learning considering the structural similarity
por: Rosenberger, Johannes, et al.
Publicado: (2024)
por: Rosenberger, Johannes, et al.
Publicado: (2024)
Satellite-Surface-Area Machine-Learning Models for Reservoir Storage Estimation: Regime-Sensitive Evaluation and Operational Deployment at Loskop Dam, South Africa
por: Retief, Hugo, et al.
Publicado: (2025)
por: Retief, Hugo, et al.
Publicado: (2025)
Joint Modeling of Longitudinal Measurements and Time-to-event Outcomes Using BUGS
por: Baghfalaki, Taban, et al.
Publicado: (2024)
por: Baghfalaki, Taban, et al.
Publicado: (2024)
It Is Time To Steer: A Scalable Framework for Analysis-driven Attack Graph Generation
por: Palma, Alessandro, et al.
Publicado: (2023)
por: Palma, Alessandro, et al.
Publicado: (2023)
iRoCo: Intuitive Robot Control From Anywhere Using a Smartwatch
por: Weigend, Fabian C, et al.
Publicado: (2024)
por: Weigend, Fabian C, et al.
Publicado: (2024)
Anytime, Anywhere: Human Arm Pose from Smartwatch Data for Ubiquitous Robot Control and Teleoperation
por: Weigend, Fabian C, et al.
Publicado: (2023)
por: Weigend, Fabian C, et al.
Publicado: (2023)
Racism in the Machine: Visualization Ethics in Digital Humanities Projects
por: Hepworth, K. J., et al.
Publicado: (2024)
por: Hepworth, K. J., et al.
Publicado: (2024)
Gophy: Novel Proof-of-Useful-Work blockchain architecture for High Energy Physics
por: Hoffmann, Felix, et al.
Publicado: (2024)
por: Hoffmann, Felix, et al.
Publicado: (2024)
Post-Digital Humanities: Computation and Cultural Critique in the Arts and Humanities
por: Berry, David M.
Publicado: (2024)
por: Berry, David M.
Publicado: (2024)
Efficient Construction of Large Search Spaces for Auto-Tuning
por: Willemsen, Floris-Jan, et al.
Publicado: (2025)
por: Willemsen, Floris-Jan, et al.
Publicado: (2025)
Identifying Chemicals Through Dimensionality Reduction
por: Anand, Emile, et al.
Publicado: (2022)
por: Anand, Emile, et al.
Publicado: (2022)
WhaleVis: Visualizing the History of Commercial Whaling
por: Patil, Ameya, et al.
Publicado: (2023)
por: Patil, Ameya, et al.
Publicado: (2023)
Fin-Fact: A Benchmark Dataset for Multimodal Financial Fact Checking and Explanation Generation
por: Rangapur, Aman, et al.
Publicado: (2023)
por: Rangapur, Aman, et al.
Publicado: (2023)
Faked Speech Detection with Zero Prior Knowledge
por: Ajmi, Sahar Al, et al.
Publicado: (2022)
por: Ajmi, Sahar Al, et al.
Publicado: (2022)
Robot Metabolism: Towards machines that can grow by consuming other machines
por: Wyder, Philippe Martin, et al.
Publicado: (2024)
por: Wyder, Philippe Martin, et al.
Publicado: (2024)
Semantic Delta: An Interpretable Signal Differentiating Human and LLMs Dialogue
por: Scantamburlo, Riccardo, et al.
Publicado: (2026)
por: Scantamburlo, Riccardo, et al.
Publicado: (2026)
Parameter optimization comparison in QAOA using Stochastic Hill Climbing with Random Re-starts and Local Search with entangled and non-entangled mixing operators
por: Sarmina, Brian García, et al.
Publicado: (2024)
por: Sarmina, Brian García, et al.
Publicado: (2024)
EBBS: An Ensemble with Bi-Level Beam Search for Zero-Shot Machine Translation
por: Wen, Yuqiao, et al.
Publicado: (2024)
por: Wen, Yuqiao, et al.
Publicado: (2024)
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
por: Wen, Yuqiao, et al.
Publicado: (2025)
por: Wen, Yuqiao, et al.
Publicado: (2025)
Leveraging Synthetic Data for Question Answering with Multilingual LLMs in the Agricultural Domain
por: Kaur, Rishemjit, et al.
Publicado: (2025)
por: Kaur, Rishemjit, et al.
Publicado: (2025)
Key Algorithms for Keyphrase Generation: Instruction-Based LLMs for Russian Scientific Keyphrases
por: Glazkova, Anna, et al.
Publicado: (2024)
por: Glazkova, Anna, et al.
Publicado: (2024)
RFOX (Rotated-Field Oscillatory eXchange) quantum algorithm: Towards Parameter-Free Quantum Optimizers
por: Sarmina, Brian García, et al.
Publicado: (2026)
por: Sarmina, Brian García, et al.
Publicado: (2026)
Exploring Entanglement and Parameter Sensitivity in QAOA through Quantum Fisher Information
por: Sarmina, Brian García, et al.
Publicado: (2025)
por: Sarmina, Brian García, et al.
Publicado: (2025)
IGA-ODIL: Optimizing DIscretre robust Loss with Isogeometric Analysis to solve forward and inverse problems faster using machine learning tools
por: Paszyński, Maciej, et al.
Publicado: (2026)
por: Paszyński, Maciej, et al.
Publicado: (2026)
Exploring Prime Number Classification: Achieving High Recall Rate and Rapid Convergence with Sparse Encoding
por: Lee, Serin, et al.
Publicado: (2024)
por: Lee, Serin, et al.
Publicado: (2024)
APP: Accelerated Path Patching with Task-Specific Pruning
por: Andersen, Frauke, et al.
Publicado: (2025)
por: Andersen, Frauke, et al.
Publicado: (2025)
Comparing the Performance of LLMs in RAG-based Question-Answering: A Case Study in Computer Science Literature
por: Dayarathne, Ranul, et al.
Publicado: (2025)
por: Dayarathne, Ranul, et al.
Publicado: (2025)
From Guessing to Asking: An Approach to Resolving the Persona Knowledge Gap in LLMs during Multi-Turn Conversations
por: Baskar, Sarvesh, et al.
Publicado: (2025)
por: Baskar, Sarvesh, et al.
Publicado: (2025)
Collocation-based Robust Variational Physics-Informed Neural Networks (CRVPINN)
por: Łoś, Marcin, et al.
Publicado: (2024)
por: Łoś, Marcin, et al.
Publicado: (2024)
Python library supporting Discrete Variational Formulations and training solutions with Collocation-based Robust Variational Physics Informed Neural Networks (DVF-CRVPINN)
por: Służalec, Tomasz, et al.
Publicado: (2026)
por: Służalec, Tomasz, et al.
Publicado: (2026)
Exploring Fine-tuned Generative Models for Keyphrase Selection: A Case Study for Russian
por: Glazkova, Anna, et al.
Publicado: (2024)
por: Glazkova, Anna, et al.
Publicado: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
por: Saji, Alan, et al.
Publicado: (2025)
por: Saji, Alan, et al.
Publicado: (2025)
Efficient Toxicity Detection in Gaming Chats: A Comparative Study of Embeddings, Fine-Tuned Transformers and LLMs
por: Tereshchenko, Yehor, et al.
Publicado: (2025)
por: Tereshchenko, Yehor, et al.
Publicado: (2025)
BHRAM-IL: A Benchmark for Hallucination Recognition and Assessment in Multiple Indian Languages
por: Terdalkar, Hrishikesh, et al.
Publicado: (2025)
por: Terdalkar, Hrishikesh, et al.
Publicado: (2025)
ImmigrationQA: A Source-Grounded Dataset and Small-Model Adaptation for U.S. Immigration Law
por: Shportun, Nazarii
Publicado: (2026)
por: Shportun, Nazarii
Publicado: (2026)
Opinion Mining on Offshore Wind Energy for Environmental Engineering
por: Bittencourt, Isabele, et al.
Publicado: (2024)
por: Bittencourt, Isabele, et al.
Publicado: (2024)
A Review of the Applications of Deep Learning-Based Emergent Communication
por: Boldt, Brendon, et al.
Publicado: (2024)
por: Boldt, Brendon, et al.
Publicado: (2024)
Old Habits Die Hard: How Conversational History Geometrically Traps LLMs
por: Simhi, Adi, et al.
Publicado: (2026)
por: Simhi, Adi, et al.
Publicado: (2026)
What Makes a Good AI Review? Concern-Level Diagnostics for AI Peer Review
por: Jin, Ming
Publicado: (2026)
por: Jin, Ming
Publicado: (2026)
Benchmarking the Performance of Pre-trained LLMs across Urdu NLP Tasks
por: Tahir, Munief Hassan, et al.
Publicado: (2024)
por: Tahir, Munief Hassan, et al.
Publicado: (2024)
Ejemplares similares
-
Macroscale fracture surface segmentation via semi-supervised learning considering the structural similarity
por: Rosenberger, Johannes, et al.
Publicado: (2024) -
Satellite-Surface-Area Machine-Learning Models for Reservoir Storage Estimation: Regime-Sensitive Evaluation and Operational Deployment at Loskop Dam, South Africa
por: Retief, Hugo, et al.
Publicado: (2025) -
Joint Modeling of Longitudinal Measurements and Time-to-event Outcomes Using BUGS
por: Baghfalaki, Taban, et al.
Publicado: (2024) -
It Is Time To Steer: A Scalable Framework for Analysis-driven Attack Graph Generation
por: Palma, Alessandro, et al.
Publicado: (2023) -
iRoCo: Intuitive Robot Control From Anywhere Using a Smartwatch
por: Weigend, Fabian C, et al.
Publicado: (2024)