LLMs as On-demand Customizable Service
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sarkar, Souvika, Babar, Mohammad Fakhruddin, Hasan, Monowar, Karmaker, Shubhra Kanti |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Processing Natural Language on Embedded Devices: How Well Do Transformer Models Perform?
par: Sarkar, Souvika, et autres
Publié: (2023)
par: Sarkar, Souvika, et autres
Publié: (2023)
Pitfalls of Evaluating Language Models with Open Benchmarks
par: Hasan, Md. Najib, et autres
Publié: (2025)
par: Hasan, Md. Najib, et autres
Publié: (2025)
Are LLMs Ready to Replace Bangla Annotators?
par: Hasan, Md. Najib, et autres
Publié: (2026)
par: Hasan, Md. Najib, et autres
Publié: (2026)
Benchmarking LLMs on the Semantic Overlap Summarization Task
par: Salvador, John, et autres
Publié: (2024)
par: Salvador, John, et autres
Publié: (2024)
Zero-Shot Multi-Label Classification of Bangla Documents: Large Decoders Vs. Classic Encoders
par: Sarkar, Souvika, et autres
Publié: (2025)
par: Sarkar, Souvika, et autres
Publié: (2025)
FaNS: a Facet-based Narrative Similarity Metric
par: Akter, Mousumi, et autres
Publié: (2023)
par: Akter, Mousumi, et autres
Publié: (2023)
Retrieval Challenges in Low-Resource Public Service Information: A Case Study on Food Pantry Access
par: Hasan, Touseef, et autres
Publié: (2026)
par: Hasan, Touseef, et autres
Publié: (2026)
Investigating Timing-Based Information Leakage in Data Flow-Driven Real-Time Systems
par: Babar, Mohammad Fakhruddin, et autres
Publié: (2025)
par: Babar, Mohammad Fakhruddin, et autres
Publié: (2025)
Instructional Goal-Aligned Question Generation for Student Evaluation in Virtual Lab Settings: How Closely Do LLMs Actually Align?
par: Knipper, R. Alexander, et autres
Publié: (2025)
par: Knipper, R. Alexander, et autres
Publié: (2025)
SNNLP: Energy-Efficient Natural Language Processing Using Spiking Neural Networks
par: Knipper, R. Alexander, et autres
Publié: (2024)
par: Knipper, R. Alexander, et autres
Publié: (2024)
LLMs as Meta-Reviewers' Assistants: A Case Study
par: Hossain, Eftekhar, et autres
Publié: (2024)
par: Hossain, Eftekhar, et autres
Publié: (2024)
From Next-Token to Mathematics: The Learning Dynamics of Mathematical Reasoning in Language Models
par: Mishra, Shubhra, et autres
Publié: (2024)
par: Mishra, Shubhra, et autres
Publié: (2024)
CurLL: A Developmental Framework to Evaluate Continual Learning in Language Models
par: Kalyan, Pavan, et autres
Publié: (2025)
par: Kalyan, Pavan, et autres
Publié: (2025)
AgentSpec: Customizable Runtime Enforcement for Safe and Reliable LLM Agents
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
LLM for Comparative Narrative Analysis
par: Kampen, Leo, et autres
Publié: (2025)
par: Kampen, Leo, et autres
Publié: (2025)
Teaching and Evaluating LLMs to Reason About Polymer Design Related Tasks
par: Mohanty, Dikshya, et autres
Publié: (2026)
par: Mohanty, Dikshya, et autres
Publié: (2026)
Revisiting Word Embeddings in the LLM Era
par: Mahajan, Yash, et autres
Publié: (2024)
par: Mahajan, Yash, et autres
Publié: (2024)
BanglaQuAD: A Bengali Open-domain Question Answering Dataset
par: Rony, Md Rashad Al Hasan, et autres
Publié: (2024)
par: Rony, Md Rashad Al Hasan, et autres
Publié: (2024)
FinTradeBench: A Financial Reasoning Benchmark for LLMs
par: Agrawal, Yogesh, et autres
Publié: (2026)
par: Agrawal, Yogesh, et autres
Publié: (2026)
Investigating Annotator Bias in Large Language Models for Hate Speech Detection
par: Das, Amit, et autres
Publié: (2024)
par: Das, Amit, et autres
Publié: (2024)
Towards Smarter Hiring: Are Zero-Shot and Few-Shot Pre-trained LLMs Ready for HR Spoken Interview Transcript Analysis?
par: Maity, Subhankar, et autres
Publié: (2025)
par: Maity, Subhankar, et autres
Publié: (2025)
Halluverse-M^3: A multitask multilingual benchmark for hallucination in LLMs
par: Abdaljalil, Samir, et autres
Publié: (2026)
par: Abdaljalil, Samir, et autres
Publié: (2026)
An Evaluation Benchmark for Autoformalization in Lean4
par: Gulati, Aryan, et autres
Publié: (2024)
par: Gulati, Aryan, et autres
Publié: (2024)
SINdex: Semantic INconsistency Index for Hallucination Detection in LLMs
par: Abdaljalil, Samir, et autres
Publié: (2025)
par: Abdaljalil, Samir, et autres
Publié: (2025)
Binder: Hierarchical Concept Representation through Order Embedding of Binary Vectors
par: Gyurek, Croix, et autres
Publié: (2024)
par: Gyurek, Croix, et autres
Publié: (2024)
Evaluating Multilingual and Code-Switched Alignment in LLMs via Synthetic Natural Language Inference
par: Abdaljalil, Samir, et autres
Publié: (2025)
par: Abdaljalil, Samir, et autres
Publié: (2025)
Fine-Tuning LLMs for Reliable Medical Question-Answering Services
par: Anaissi, Ali, et autres
Publié: (2024)
par: Anaissi, Ali, et autres
Publié: (2024)
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
par: Kim, Eunsu, et autres
Publié: (2025)
par: Kim, Eunsu, et autres
Publié: (2025)
LLMs on a Budget? Say HOLA
par: Siddiqui, Zohaib Hasan, et autres
Publié: (2025)
par: Siddiqui, Zohaib Hasan, et autres
Publié: (2025)
Munsit at NADI 2025 Shared Task 2: Pushing the Boundaries of Multidialectal Arabic ASR with Weakly Supervised Pretraining and Continual Supervised Fine-tuning
par: Salhab, Mahmoud, et autres
Publié: (2025)
par: Salhab, Mahmoud, et autres
Publié: (2025)
CHOPS: CHat with custOmer Profile Systems for Customer Service with LLMs
par: Shi, Jingzhe, et autres
Publié: (2024)
par: Shi, Jingzhe, et autres
Publié: (2024)
Auxiliary task demands mask the capabilities of smaller language models
par: Hu, Jennifer, et autres
Publié: (2024)
par: Hu, Jennifer, et autres
Publié: (2024)
Beyond Specialization: Benchmarking LLMs for Transliteration of Indian Languages
par: Azam, Gulfarogh, et autres
Publié: (2025)
par: Azam, Gulfarogh, et autres
Publié: (2025)
HAL: Inducing Human-likeness in LLMs with Alignment
par: Hasan, Masum, et autres
Publié: (2026)
par: Hasan, Masum, et autres
Publié: (2026)
CareLab at #SMM4H-HeaRD 2025: Insomnia Detection and Food Safety Event Extraction with Domain-Aware Transformers
par: Liang, Zihan, et autres
Publié: (2025)
par: Liang, Zihan, et autres
Publié: (2025)
Evaluating the Evaluator: Measuring LLMs' Adherence to Task Evaluation Instructions
par: Murugadoss, Bhuvanashree, et autres
Publié: (2024)
par: Murugadoss, Bhuvanashree, et autres
Publié: (2024)
From Fallback to Frontline: When Can LLMs be Superior Annotators of Human Perspectives?
par: Amin, Hasan, et autres
Publié: (2026)
par: Amin, Hasan, et autres
Publié: (2026)
PRISM: Agentic Retrieval with LLMs for Multi-Hop Question Answering
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2025)
par: Nahid, Md Mahadi Hasan, et autres
Publié: (2025)
BanglaLlama: LLaMA for Bangla Language
par: Zehady, Abdullah Khan, et autres
Publié: (2024)
par: Zehady, Abdullah Khan, et autres
Publié: (2024)
Graph of Attacks: Improved Black-Box and Interpretable Jailbreaks for LLMs
par: Akbar-Tajari, Mohammad, et autres
Publié: (2025)
par: Akbar-Tajari, Mohammad, et autres
Publié: (2025)
Documents similaires
-
Processing Natural Language on Embedded Devices: How Well Do Transformer Models Perform?
par: Sarkar, Souvika, et autres
Publié: (2023) -
Pitfalls of Evaluating Language Models with Open Benchmarks
par: Hasan, Md. Najib, et autres
Publié: (2025) -
Are LLMs Ready to Replace Bangla Annotators?
par: Hasan, Md. Najib, et autres
Publié: (2026) -
Benchmarking LLMs on the Semantic Overlap Summarization Task
par: Salvador, John, et autres
Publié: (2024) -
Zero-Shot Multi-Label Classification of Bangla Documents: Large Decoders Vs. Classic Encoders
par: Sarkar, Souvika, et autres
Publié: (2025)