Typhoon-S: Minimal Open Post-Training for Sovereign Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Pipatanakul, Kunat, Taveekitworachai, Pittawat |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Typhoon T1: An Open Thai Reasoning Model
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)
Adapting Language-Specific LLMs to a Reasoning Model in One Day via Model Merging -- An Open Recipe
por: Pipatanakul, Kunat, et al.
Publicado: (2025)
por: Pipatanakul, Kunat, et al.
Publicado: (2025)
Talk Less, Call Right: Enhancing Role-Play LLM Agents with Automatic Prompt Optimization and Role Prompting
por: Ruangtanusak, Saksorn, et al.
Publicado: (2025)
por: Ruangtanusak, Saksorn, et al.
Publicado: (2025)
Typhoon OCR: Open Vision-Language Model For Thai Document Extraction
por: Nonesung, Surapon, et al.
Publicado: (2026)
por: Nonesung, Surapon, et al.
Publicado: (2026)
Prior Prompt Engineering for Reinforcement Fine-Tuning
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)
Extending Audio Context for Long-Form Understanding in Large Audio-Language Models
por: Chaichana, Yuatyong, et al.
Publicado: (2025)
por: Chaichana, Yuatyong, et al.
Publicado: (2025)
Typhoon 2: A Family of Open Text and Multimodal Thai Large Language Models
por: Pipatanakul, Kunat, et al.
Publicado: (2024)
por: Pipatanakul, Kunat, et al.
Publicado: (2024)
Formula-One Prompting: A Composable Equation-First Prefix for Applied Mathematics
por: Nitarach, Natapong, et al.
Publicado: (2026)
por: Nitarach, Natapong, et al.
Publicado: (2026)
Typhoon ASR Real-time: FastConformer-Transducer for Thai Automatic Speech Recognition
por: Sirichotedumrong, Warit, et al.
Publicado: (2026)
por: Sirichotedumrong, Warit, et al.
Publicado: (2026)
Large Language Models are Null-Shot Learners
por: Taveekitworachai, Pittawat, et al.
Publicado: (2024)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2024)
On the Robustness of Answer Formats in Medical Reasoning Models
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)
FinCoT: Grounding Chain-of-Thought in Expert Financial Reasoning
por: Nitarach, Natapong, et al.
Publicado: (2025)
por: Nitarach, Natapong, et al.
Publicado: (2025)
Enhancing Low-Resource Language and Instruction Following Capabilities of Audio Language Models
por: Manakul, Potsawee, et al.
Publicado: (2024)
por: Manakul, Potsawee, et al.
Publicado: (2024)
Multiverse of Greatness: Generating Story Branches with LLMs
por: Taveekitworachai, Pittawat, et al.
Publicado: (2024)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2024)
ThaiSafetyBench: Assessing Language Model Safety in Thai Cultural Contexts
por: Ukarapol, Trapoom, et al.
Publicado: (2026)
por: Ukarapol, Trapoom, et al.
Publicado: (2026)
ChatGPT4PCG Competition: Character-like Level Generation for Science Birds
por: Taveekitworachai, Pittawat, et al.
Publicado: (2023)
por: Taveekitworachai, Pittawat, et al.
Publicado: (2023)
Aggressive Post-Training Compression on Extremely Large Language Models
por: Zhang, Zining, et al.
Publicado: (2024)
por: Zhang, Zining, et al.
Publicado: (2024)
EngGPT2: Sovereign, Efficient and Open Intelligence
por: Ciarfaglia, G., et al.
Publicado: (2026)
por: Ciarfaglia, G., et al.
Publicado: (2026)
Sparsity Induction for Accurate Post-Training Pruning of Large Language Models
por: Jiang, Minhao, et al.
Publicado: (2026)
por: Jiang, Minhao, et al.
Publicado: (2026)
Efficient Post-Training Refinement of Latent Reasoning in Large Language Models
por: Wang, Xinyuan, et al.
Publicado: (2025)
por: Wang, Xinyuan, et al.
Publicado: (2025)
Mangosteen: An Open Thai Corpus for Language Model Pretraining
por: Phatthiyaphaibun, Wannaphong, et al.
Publicado: (2025)
por: Phatthiyaphaibun, Wannaphong, et al.
Publicado: (2025)
Post-Training Language Models for Crosslingual Consistency
por: Liu, Tianyu, et al.
Publicado: (2026)
por: Liu, Tianyu, et al.
Publicado: (2026)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
por: van Niekerk, Carel, et al.
Publicado: (2025)
por: van Niekerk, Carel, et al.
Publicado: (2025)
Benchmarking Post-Training Quantization of Large Language Models under Microscaling Floating Point Formats
por: Zhang, Manyi, et al.
Publicado: (2026)
por: Zhang, Manyi, et al.
Publicado: (2026)
Interactions Across Blocks in Post-Training Quantization of Large Language Models
por: Shabanovi, Khasmamad, et al.
Publicado: (2024)
por: Shabanovi, Khasmamad, et al.
Publicado: (2024)
Towards a Unified View of Large Language Model Post-Training
por: Lv, Xingtai, et al.
Publicado: (2025)
por: Lv, Xingtai, et al.
Publicado: (2025)
Towards Minimal Targeted Updates of Language Models with Targeted Negative Training
por: Zhang, Lily H., et al.
Publicado: (2024)
por: Zhang, Lily H., et al.
Publicado: (2024)
Assessing Robustness to Spurious Correlations in Post-Training Language Models
por: Shuieh, Julia, et al.
Publicado: (2025)
por: Shuieh, Julia, et al.
Publicado: (2025)
Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models
por: Jiang, Haitao, et al.
Publicado: (2026)
por: Jiang, Haitao, et al.
Publicado: (2026)
SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models
por: Xiao, Guangxuan, et al.
Publicado: (2022)
por: Xiao, Guangxuan, et al.
Publicado: (2022)
A Survey on Post-training of Large Language Models
por: Tie, Guiyao, et al.
Publicado: (2025)
por: Tie, Guiyao, et al.
Publicado: (2025)
Token-Level Uncertainty-Aware Objective for Language Model Post-Training
por: Liu, Tingkai, et al.
Publicado: (2025)
por: Liu, Tingkai, et al.
Publicado: (2025)
Optimising Language Models for Downstream Tasks: A Post-Training Perspective
por: Shi, Zhengyan
Publicado: (2025)
por: Shi, Zhengyan
Publicado: (2025)
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
por: Singla, Pratham, et al.
Publicado: (2025)
por: Singla, Pratham, et al.
Publicado: (2025)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
por: Zhou, Chenxi, et al.
Publicado: (2025)
por: Zhou, Chenxi, et al.
Publicado: (2025)
APTQ: Attention-aware Post-Training Mixed-Precision Quantization for Large Language Models
por: Guan, Ziyi, et al.
Publicado: (2024)
por: Guan, Ziyi, et al.
Publicado: (2024)
Evolving Subnetwork Training for Large Language Models
por: Li, Hanqi, et al.
Publicado: (2024)
por: Li, Hanqi, et al.
Publicado: (2024)
On the Effectiveness of Incremental Training of Large Language Models
por: Li, Miles Q., et al.
Publicado: (2024)
por: Li, Miles Q., et al.
Publicado: (2024)
OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models
por: Wang, Jun, et al.
Publicado: (2024)
por: Wang, Jun, et al.
Publicado: (2024)
OpenJAI-v1.0: An Open Thai Large Language Model
por: Trakuekul, Pontakorn, et al.
Publicado: (2025)
por: Trakuekul, Pontakorn, et al.
Publicado: (2025)
Ejemplares similares
-
Typhoon T1: An Open Thai Reasoning Model
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025) -
Adapting Language-Specific LLMs to a Reasoning Model in One Day via Model Merging -- An Open Recipe
por: Pipatanakul, Kunat, et al.
Publicado: (2025) -
Talk Less, Call Right: Enhancing Role-Play LLM Agents with Automatic Prompt Optimization and Role Prompting
por: Ruangtanusak, Saksorn, et al.
Publicado: (2025) -
Typhoon OCR: Open Vision-Language Model For Thai Document Extraction
por: Nonesung, Surapon, et al.
Publicado: (2026) -
Prior Prompt Engineering for Reinforcement Fine-Tuning
por: Taveekitworachai, Pittawat, et al.
Publicado: (2025)