TeleMath: A Benchmark for Large Language Models in Telecom Mathematical Problem Solving
Fuente:
arXiv
Saved in:
| Main Authors: | Colle, Vincenzo, Sana, Mohamed, Piovesan, Nicola, De Domenico, Antonio, Ayed, Fadhel, Debbah, Merouane |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TeleTables: A Benchmark for Large Language Models in Telecom Table Interpretation
by: Ezzakri, Anas, et al.
Published: (2025)
by: Ezzakri, Anas, et al.
Published: (2025)
Telecom Language Models: Must They Be Large?
by: Piovesan, Nicola, et al.
Published: (2024)
by: Piovesan, Nicola, et al.
Published: (2024)
Large Language Models for Telecom: Forthcoming Impact on the Industry
by: Maatouk, Ali, et al.
Published: (2023)
by: Maatouk, Ali, et al.
Published: (2023)
Reasoning Language Models for Root Cause Analysis in 5G Wireless Networks
by: Sana, Mohamed, et al.
Published: (2025)
by: Sana, Mohamed, et al.
Published: (2025)
Hermes: A Large Language Model Framework on the Journey to Autonomous Networks
by: Ayed, Fadhel, et al.
Published: (2024)
by: Ayed, Fadhel, et al.
Published: (2024)
HPO: Hysteretic Policy Optimization for Stable and Efficient Training under Sparse-Reward Regime
by: Sana, Mohamed, et al.
Published: (2026)
by: Sana, Mohamed, et al.
Published: (2026)
KVCompose: Efficient Structured KV Cache Compression with Composite Tokens
by: Akulov, Dmitry, et al.
Published: (2025)
by: Akulov, Dmitry, et al.
Published: (2025)
WirelessMathBench: A Mathematical Modeling Benchmark for LLMs in Wireless Communications
by: Li, Xin, et al.
Published: (2025)
by: Li, Xin, et al.
Published: (2025)
Telco-oRAG: Optimizing Retrieval-augmented Generation for Telecom Queries via Hybrid Retrieval and Neural Routing
by: Bornea, Andrei-Laurentiu, et al.
Published: (2025)
by: Bornea, Andrei-Laurentiu, et al.
Published: (2025)
Telco-RAG: Navigating the Challenges of Retrieval-Augmented Language Models for Telecommunications
by: Bornea, Andrei-Laurentiu, et al.
Published: (2024)
by: Bornea, Andrei-Laurentiu, et al.
Published: (2024)
Data-driven Energy Efficiency Modelling in Large-scale Networks: An Expert Knowledge and ML-based Approach
by: López-Pérez, David, et al.
Published: (2023)
by: López-Pérez, David, et al.
Published: (2023)
Linguistic Intelligence in Large Language Models for Telecommunications
by: Ahmed, Tasnim, et al.
Published: (2024)
by: Ahmed, Tasnim, et al.
Published: (2024)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
by: Fang, Meng, et al.
Published: (2024)
by: Fang, Meng, et al.
Published: (2024)
TelcoAgent-Bench: A Multilingual Benchmark for Telecom AI Agents
by: Bariah, Lina, et al.
Published: (2026)
by: Bariah, Lina, et al.
Published: (2026)
Goal-Oriented Time-Series Forecasting: Foundation Framework Design
by: Fechete, Luca-Andrei, et al.
Published: (2025)
by: Fechete, Luca-Andrei, et al.
Published: (2025)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
by: Yang, Zhen, et al.
Published: (2024)
by: Yang, Zhen, et al.
Published: (2024)
MathLearner: A Large Language Model Agent Framework for Learning to Solve Mathematical Problems
by: Xie, Wenbei, et al.
Published: (2024)
by: Xie, Wenbei, et al.
Published: (2024)
Reasoning Beyond Limits: Advances and Open Problems for LLMs
by: Ferrag, Mohamed Amine, et al.
Published: (2025)
by: Ferrag, Mohamed Amine, et al.
Published: (2025)
Pay Attention to What Matters
by: Silva, Pedro Luiz, et al.
Published: (2024)
by: Silva, Pedro Luiz, et al.
Published: (2024)
MathMist: A Parallel Multilingual Benchmark Dataset for Mathematical Problem Solving and Reasoning
by: Sobhani, Mahbub E, et al.
Published: (2025)
by: Sobhani, Mahbub E, et al.
Published: (2025)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
by: Xue, Boyang, et al.
Published: (2025)
by: Xue, Boyang, et al.
Published: (2025)
BAQ: Efficient Bit Allocation Quantization for Large Language Models
by: Zhang, Chao, et al.
Published: (2025)
by: Zhang, Chao, et al.
Published: (2025)
TeleMoM: Consensus-Driven Telecom Intelligence via Mixture of Models
by: Wang, Xinquan, et al.
Published: (2025)
by: Wang, Xinquan, et al.
Published: (2025)
ChatGLM-Math: Improving Math Problem-Solving in Large Language Models with a Self-Critique Pipeline
by: Xu, Yifan, et al.
Published: (2024)
by: Xu, Yifan, et al.
Published: (2024)
TelecomGPT: A Framework to Build Telecom-Specfic Large Language Models
by: Zou, Hang, et al.
Published: (2024)
by: Zou, Hang, et al.
Published: (2024)
Improving Math Problem Solving in Large Language Models Through Categorization and Strategy Tailoring
by: Akella, Amogh
Published: (2024)
by: Akella, Amogh
Published: (2024)
DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving
by: Tong, Yuxuan, et al.
Published: (2024)
by: Tong, Yuxuan, et al.
Published: (2024)
MathEDU: Feedback Generation on Problem-Solving Processes for Mathematical Learning Support
by: Hsu, Wei-Ling, et al.
Published: (2025)
by: Hsu, Wei-Ling, et al.
Published: (2025)
End-to-End Bangla AI for Solving Math Olympiad Problem Benchmark: Leveraging Large Language Model Using Integrated Approach
by: Tabib, H. M. Shadman, et al.
Published: (2025)
by: Tabib, H. M. Shadman, et al.
Published: (2025)
TeleOracle: Fine-Tuned Retrieval-Augmented Generation with Long-Context Support for Network
by: Alabbasi, Nouf, et al.
Published: (2024)
by: Alabbasi, Nouf, et al.
Published: (2024)
Benchmarking Hallucination in Large Language Models based on Unanswerable Math Word Problem
by: Sun, Yuhong, et al.
Published: (2024)
by: Sun, Yuhong, et al.
Published: (2024)
Mathify: Evaluating Large Language Models on Mathematical Problem Solving Tasks
by: Anand, Avinash, et al.
Published: (2024)
by: Anand, Avinash, et al.
Published: (2024)
MathScape: Benchmarking Multimodal Large Language Models in Real-World Mathematical Contexts
by: Liang, Hao, et al.
Published: (2024)
by: Liang, Hao, et al.
Published: (2024)
Leveraging Large Language Models for Bengali Math Word Problem Solving with Chain of Thought Reasoning
by: Paul, Bidyarthi, et al.
Published: (2025)
by: Paul, Bidyarthi, et al.
Published: (2025)
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
by: Liu, Yan, et al.
Published: (2024)
by: Liu, Yan, et al.
Published: (2024)
Solving Math Word Problems via Cooperative Reasoning induced Language Models
by: Zhu, Xinyu, et al.
Published: (2022)
by: Zhu, Xinyu, et al.
Published: (2022)
Large Language Models Struggle with Unreasonability in Math Problems
by: Ma, Jingyuan, et al.
Published: (2024)
by: Ma, Jingyuan, et al.
Published: (2024)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
by: Kao, Kuei-Chun, et al.
Published: (2024)
by: Kao, Kuei-Chun, et al.
Published: (2024)
ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models
by: Wu, Yanan, et al.
Published: (2024)
by: Wu, Yanan, et al.
Published: (2024)
Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems
by: Wei, Chengwei, et al.
Published: (2025)
by: Wei, Chengwei, et al.
Published: (2025)
Similar Items
-
TeleTables: A Benchmark for Large Language Models in Telecom Table Interpretation
by: Ezzakri, Anas, et al.
Published: (2025) -
Telecom Language Models: Must They Be Large?
by: Piovesan, Nicola, et al.
Published: (2024) -
Large Language Models for Telecom: Forthcoming Impact on the Industry
by: Maatouk, Ali, et al.
Published: (2023) -
Reasoning Language Models for Root Cause Analysis in 5G Wireless Networks
by: Sana, Mohamed, et al.
Published: (2025) -
Hermes: A Large Language Model Framework on the Journey to Autonomous Networks
by: Ayed, Fadhel, et al.
Published: (2024)