OnlySportsLM: Optimizing Sports-Domain Language Models with SOTA Performance under Billion Parameters
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Zexin, Li, Chengxi, Xie, Xiangyu, Dube, Parijat |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent
di: Sun, Xingwu, et al.
Pubblicazione: (2024)
di: Sun, Xingwu, et al.
Pubblicazione: (2024)
EMTSF:Extraordinary Mixture of SOTA Models for Time Series Forecasting
di: Alharthi, Musleh, et al.
Pubblicazione: (2025)
di: Alharthi, Musleh, et al.
Pubblicazione: (2025)
Let's Play Across Cultures: A Large Multilingual, Multicultural Benchmark for Assessing Language Models' Understanding of Sports
di: Singh, Punit Kumar, et al.
Pubblicazione: (2025)
di: Singh, Punit Kumar, et al.
Pubblicazione: (2025)
Step-level Value Preference Optimization for Mathematical Reasoning
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
Large Scale Generative AI Text Applied to Sports and Music
di: Baughman, Aaron, et al.
Pubblicazione: (2024)
di: Baughman, Aaron, et al.
Pubblicazione: (2024)
BioMedLM: A 2.7B Parameter Language Model Trained On Biomedical Text
di: Bolton, Elliot, et al.
Pubblicazione: (2024)
di: Bolton, Elliot, et al.
Pubblicazione: (2024)
Tree-of-Text: A Tree-based Prompting Framework for Table-to-Text Generation in the Sports Domain
di: Chiang, Shang-Hsuan, et al.
Pubblicazione: (2026)
di: Chiang, Shang-Hsuan, et al.
Pubblicazione: (2026)
AskSport: Web Application for Sports Question-Answering
di: Onofre, Enzo B, et al.
Pubblicazione: (2025)
di: Onofre, Enzo B, et al.
Pubblicazione: (2025)
Prompt and Parameter Co-Optimization for Large Language Models
di: Bo, Xiaohe, et al.
Pubblicazione: (2025)
di: Bo, Xiaohe, et al.
Pubblicazione: (2025)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
di: Wang, Yidong, et al.
Pubblicazione: (2023)
di: Wang, Yidong, et al.
Pubblicazione: (2023)
F2LLM Technical Report: Matching SOTA Embedding Performance with 6 Million Open-Source Data
di: Zhang, Ziyin, et al.
Pubblicazione: (2025)
di: Zhang, Ziyin, et al.
Pubblicazione: (2025)
KG-BiLM: Knowledge Graph Embedding via Bidirectional Language Models
di: Chen, Zirui, et al.
Pubblicazione: (2025)
di: Chen, Zirui, et al.
Pubblicazione: (2025)
CogLM: Tracking Cognitive Development of Large Language Models
di: Wang, Xinglin, et al.
Pubblicazione: (2024)
di: Wang, Xinglin, et al.
Pubblicazione: (2024)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
ReaLM: Residual Quantization Bridging Knowledge Graph Embeddings and Large Language Models
di: Guo, Wenbin, et al.
Pubblicazione: (2025)
di: Guo, Wenbin, et al.
Pubblicazione: (2025)
Hierarchical Sparse Circuit Extraction from Billion-Parameter Language Models through Scalable Attribution Graph Decomposition
di: Uddin, Mohammed Mudassir, et al.
Pubblicazione: (2026)
di: Uddin, Mohammed Mudassir, et al.
Pubblicazione: (2026)
Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
di: Li, Haoling, et al.
Pubblicazione: (2024)
di: Li, Haoling, et al.
Pubblicazione: (2024)
BadCLM: Backdoor Attack in Clinical Language Models for Electronic Health Records
di: Lyu, Weimin, et al.
Pubblicazione: (2024)
di: Lyu, Weimin, et al.
Pubblicazione: (2024)
SportsMetrics: Blending Text and Numerical Data to Understand Information Fusion in LLMs
di: Hu, Yebowen, et al.
Pubblicazione: (2024)
di: Hu, Yebowen, et al.
Pubblicazione: (2024)
When Reasoning Meets Information Aggregation: A Case Study with Sports Narratives
di: Hu, Yebowen, et al.
Pubblicazione: (2024)
di: Hu, Yebowen, et al.
Pubblicazione: (2024)
Low-Resource Fine-Tuning for Multi-Task Structured Information Extraction with a Billion-Parameter Instruction-Tuned Model
di: Chih, Yu Cheng, et al.
Pubblicazione: (2025)
di: Chih, Yu Cheng, et al.
Pubblicazione: (2025)
FlowLM: Few-Step Language Modeling via Diffusion-to-Flow Adaptation
di: Zhang, Runzhe, et al.
Pubblicazione: (2026)
di: Zhang, Runzhe, et al.
Pubblicazione: (2026)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
di: Han, Chi, et al.
Pubblicazione: (2023)
di: Han, Chi, et al.
Pubblicazione: (2023)
MobileLLM-R1: Exploring the Limits of Sub-Billion Language Model Reasoners with Open Training Recipes
di: Zhao, Changsheng, et al.
Pubblicazione: (2025)
di: Zhao, Changsheng, et al.
Pubblicazione: (2025)
Is On-Policy Data always the Best Choice for Direct Preference Optimization-based LM Alignment?
di: Sun, Zetian, et al.
Pubblicazione: (2025)
di: Sun, Zetian, et al.
Pubblicazione: (2025)
CodecLM: Aligning Language Models with Tailored Synthetic Data
di: Wang, Zifeng, et al.
Pubblicazione: (2024)
di: Wang, Zifeng, et al.
Pubblicazione: (2024)
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
MedBioLM: Optimizing Medical and Biological QA with Fine-Tuned Large Language Models and Retrieval-Augmented Generation
di: Kim, Seonok
Pubblicazione: (2025)
di: Kim, Seonok
Pubblicazione: (2025)
Evaluating and Enhancing Large Language Models Performance in Domain-specific Medicine: Osteoarthritis Management with DocOA
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
SimLM: Can Language Models Infer Parameters of Physical Systems?
di: Memery, Sean, et al.
Pubblicazione: (2023)
di: Memery, Sean, et al.
Pubblicazione: (2023)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
di: Ali, Syed Muhammad, et al.
Pubblicazione: (2026)
di: Ali, Syed Muhammad, et al.
Pubblicazione: (2026)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning
di: Qureshi, Rameez, et al.
Pubblicazione: (2024)
di: Qureshi, Rameez, et al.
Pubblicazione: (2024)
Hey, That's My Data! Token-Only Dataset Inference in Large Language Models
di: Xiong, Chen, et al.
Pubblicazione: (2025)
di: Xiong, Chen, et al.
Pubblicazione: (2025)
Krutrim LLM: Multilingual Foundational Model for over a Billion People
di: Kallappa, Aditya, et al.
Pubblicazione: (2025)
di: Kallappa, Aditya, et al.
Pubblicazione: (2025)
Overview of the First Workshop on Language Models for Low-Resource Languages (LoResLM 2025)
di: Hettiarachchi, Hansi, et al.
Pubblicazione: (2024)
di: Hettiarachchi, Hansi, et al.
Pubblicazione: (2024)
Foundation CAN LM: A Pretrained Language Model For Automotive CAN Data
di: Esashi, Akiharu, et al.
Pubblicazione: (2026)
di: Esashi, Akiharu, et al.
Pubblicazione: (2026)
LM2: Large Memory Models
di: Kang, Jikun, et al.
Pubblicazione: (2025)
di: Kang, Jikun, et al.
Pubblicazione: (2025)
Continual Learning Using Only Large Language Model Prompting
di: Qiu, Jiabao, et al.
Pubblicazione: (2024)
di: Qiu, Jiabao, et al.
Pubblicazione: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent
di: Sun, Xingwu, et al.
Pubblicazione: (2024) -
EMTSF:Extraordinary Mixture of SOTA Models for Time Series Forecasting
di: Alharthi, Musleh, et al.
Pubblicazione: (2025) -
Let's Play Across Cultures: A Large Multilingual, Multicultural Benchmark for Assessing Language Models' Understanding of Sports
di: Singh, Punit Kumar, et al.
Pubblicazione: (2025) -
Step-level Value Preference Optimization for Mathematical Reasoning
di: Chen, Guoxin, et al.
Pubblicazione: (2024) -
Large Scale Generative AI Text Applied to Sports and Music
di: Baughman, Aaron, et al.
Pubblicazione: (2024)