MAMUT: A Novel Framework for Modifying Mathematical Formulas for the Generation of Specialized Datasets for Language Model Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Drechsel, Jonathan, Reusch, Anja, Herbold, Steffen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GRADIEND: Feature Learning within Neural Networks Exemplified through Biases
par: Drechsel, Jonathan, et autres
Publié: (2025)
par: Drechsel, Jonathan, et autres
Publié: (2025)
The GRADIEND Python Package: An End-to-End System for Gradient-Based Feature Learning
par: Drechsel, Jonathan, et autres
Publié: (2026)
par: Drechsel, Jonathan, et autres
Publié: (2026)
A Formal Framework for Uncertainty Analysis of Text Generation with Large Language Models
par: Herbold, Steffen, et autres
Publié: (2026)
par: Herbold, Steffen, et autres
Publié: (2026)
Understanding or Memorizing? A Case Study of German Definite Articles in Language Models
par: Drechsel, Jonathan, et autres
Publié: (2026)
par: Drechsel, Jonathan, et autres
Publié: (2026)
Semantic similarity prediction is better than other semantic similarity measures
par: Herbold, Steffen
Publié: (2023)
par: Herbold, Steffen
Publié: (2023)
Large Language Models can impersonate politicians and other public figures
par: Herbold, Steffen, et autres
Publié: (2024)
par: Herbold, Steffen, et autres
Publié: (2024)
Modifying Large Language Model Post-Training for Diverse Creative Writing
par: Chung, John Joon Young, et autres
Publié: (2025)
par: Chung, John Joon Young, et autres
Publié: (2025)
RedPajama: an Open Dataset for Training Large Language Models
par: Weber, Maurice, et autres
Publié: (2024)
par: Weber, Maurice, et autres
Publié: (2024)
MathBridge: A Large Corpus Dataset for Translating Spoken Mathematical Expressions into $LaTeX$ Formulas for Improved Readability
par: Jung, Kyudan, et autres
Publié: (2024)
par: Jung, Kyudan, et autres
Publié: (2024)
SortBench: Benchmarking LLMs based on their ability to sort lists
par: Herbold, Steffen
Publié: (2025)
par: Herbold, Steffen
Publié: (2025)
CPTQuant - A Novel Mixed Precision Post-Training Quantization Techniques for Large Language Models
par: Nanda, Amitash, et autres
Publié: (2024)
par: Nanda, Amitash, et autres
Publié: (2024)
NurseLLM: The First Specialized Language Model for Nursing
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2025)
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2025)
VOYAGER: A Training Free Approach for Generating Diverse Datasets using LLMs
par: Amballa, Avinash, et autres
Publié: (2025)
par: Amballa, Avinash, et autres
Publié: (2025)
Reward-aware Preference Optimization: A Unified Mathematical Framework for Model Alignment
par: Sun, Shengyang, et autres
Publié: (2025)
par: Sun, Shengyang, et autres
Publié: (2025)
VEHME: A Vision-Language Model For Evaluating Handwritten Mathematics Expressions
par: Nguyen, Thu Phuong, et autres
Publié: (2025)
par: Nguyen, Thu Phuong, et autres
Publié: (2025)
Can A Gamer Train A Mathematical Reasoning Model?
par: Shin, Andrew
Publié: (2025)
par: Shin, Andrew
Publié: (2025)
To Softmax, or not to Softmax: that is the question when applying Active Learning for Transformer Models
par: Gonsior, Julius, et autres
Publié: (2022)
par: Gonsior, Julius, et autres
Publié: (2022)
DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models
par: Liang, Hao, et autres
Publié: (2026)
par: Liang, Hao, et autres
Publié: (2026)
Demons in the Detail: On Implementing Load Balancing Loss for Training Specialized Mixture-of-Expert Models
par: Qiu, Zihan, et autres
Publié: (2025)
par: Qiu, Zihan, et autres
Publié: (2025)
Optimal Splitting of Language Models from Mixtures to Specialized Domains
par: Seto, Skyler, et autres
Publié: (2026)
par: Seto, Skyler, et autres
Publié: (2026)
Need a Small Specialized Language Model? Plan Early!
par: Grangier, David, et autres
Publié: (2024)
par: Grangier, David, et autres
Publié: (2024)
Improve Mathematical Reasoning in Language Models by Automated Process Supervision
par: Luo, Liangchen, et autres
Publié: (2024)
par: Luo, Liangchen, et autres
Publié: (2024)
DISPO: Enhancing Training Efficiency and Stability in Reinforcement Learning for Large Language Model Mathematical Reasoning
par: Karaman, Batuhan K., et autres
Publié: (2026)
par: Karaman, Batuhan K., et autres
Publié: (2026)
Synthetic Text Generation for Training Large Language Models via Gradient Matching
par: Nguyen, Dang, et autres
Publié: (2025)
par: Nguyen, Dang, et autres
Publié: (2025)
Escaping the Mode Lottery: Multi-Response Training Improves Language Model Generalization
par: Amin, Hasan, et autres
Publié: (2026)
par: Amin, Hasan, et autres
Publié: (2026)
A Symbolic Framework for Evaluating Mathematical Reasoning and Generalisation with Transformers
par: Meadows, Jordan, et autres
Publié: (2023)
par: Meadows, Jordan, et autres
Publié: (2023)
A Multi-Level Framework for Accelerating Training Transformer Models
par: Zou, Longwei, et autres
Publié: (2024)
par: Zou, Longwei, et autres
Publié: (2024)
Small or Large? Zero-Shot or Finetuned? Guiding Language Model Choice for Specialized Applications in Healthcare
par: Gondara, Lovedeep, et autres
Publié: (2025)
par: Gondara, Lovedeep, et autres
Publié: (2025)
DiLM: Distilling Dataset into Language Model for Text-level Dataset Distillation
par: Maekawa, Aru, et autres
Publié: (2024)
par: Maekawa, Aru, et autres
Publié: (2024)
Unmasking and Improving Data Credibility: A Study with Datasets for Training Harmless Language Models
par: Zhu, Zhaowei, et autres
Publié: (2023)
par: Zhu, Zhaowei, et autres
Publié: (2023)
Training Language Models to Reason Efficiently
par: Arora, Daman, et autres
Publié: (2025)
par: Arora, Daman, et autres
Publié: (2025)
Cascade-Aware Training of Language Models
par: Wang, Congchao, et autres
Publié: (2024)
par: Wang, Congchao, et autres
Publié: (2024)
Mitigating Catastrophic Forgetting in Mathematical Reasoning Finetuning through Mixed Training
par: Reynolds, John Graham
Publié: (2025)
par: Reynolds, John Graham
Publié: (2025)
BigDocs: An Open Dataset for Training Multimodal Models on Document and Code Tasks
par: Rodriguez, Juan, et autres
Publié: (2024)
par: Rodriguez, Juan, et autres
Publié: (2024)
State Fourier Diffusion Language Model (SFDLM): A Scalable, Novel Iterative Approach to Language Modeling
par: Kiruluta, Andrew, et autres
Publié: (2025)
par: Kiruluta, Andrew, et autres
Publié: (2025)
HierRouter: Coordinated Routing of Specialized Large Language Models via Reinforcement Learning
par: Gupta, Nikunj, et autres
Publié: (2025)
par: Gupta, Nikunj, et autres
Publié: (2025)
Self-MoE: Towards Compositional Large Language Models with Self-Specialized Experts
par: Kang, Junmo, et autres
Publié: (2024)
par: Kang, Junmo, et autres
Publié: (2024)
Schoenfeld's Anatomy of Mathematical Reasoning by Language Models
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Learning Mathematical Rules with Large Language Models
par: Gorceix, Antoine, et autres
Publié: (2024)
par: Gorceix, Antoine, et autres
Publié: (2024)
A Survey on Training-free Alignment of Large Language Models
par: Pan, Birong, et autres
Publié: (2025)
par: Pan, Birong, et autres
Publié: (2025)
Documents similaires
-
GRADIEND: Feature Learning within Neural Networks Exemplified through Biases
par: Drechsel, Jonathan, et autres
Publié: (2025) -
The GRADIEND Python Package: An End-to-End System for Gradient-Based Feature Learning
par: Drechsel, Jonathan, et autres
Publié: (2026) -
A Formal Framework for Uncertainty Analysis of Text Generation with Large Language Models
par: Herbold, Steffen, et autres
Publié: (2026) -
Understanding or Memorizing? A Case Study of German Definite Articles in Language Models
par: Drechsel, Jonathan, et autres
Publié: (2026) -
Semantic similarity prediction is better than other semantic similarity measures
par: Herbold, Steffen
Publié: (2023)