Cognitive Training for Language Models: Towards General Capabilities via Cross-Entropy Games
Fuente:
arXiv
Salvato in:
| Autori principali: | Hongler, Clément, Gabriel, Franck, Hartmann, Valentin, Renard, Arthur, Emil, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cross-Entropy Games and Frost Training
di: Renard, Arthur, et al.
Pubblicazione: (2026)
di: Renard, Arthur, et al.
Pubblicazione: (2026)
Cross-Entropy Games for Language Models: From Implicit Knowledge to General Capability Measures
di: Hongler, Clément, et al.
Pubblicazione: (2025)
di: Hongler, Clément, et al.
Pubblicazione: (2025)
Exploiting Edited Large Language Models as General Scientific Optimizers
di: Lv, Qitan, et al.
Pubblicazione: (2025)
di: Lv, Qitan, et al.
Pubblicazione: (2025)
Exact and heuristic methods for the discrete parallel machine scheduling location problem
di: Kramer, Raphael, et al.
Pubblicazione: (2020)
di: Kramer, Raphael, et al.
Pubblicazione: (2020)
Integrated packing, placement, scheduling, and routing of personalized production: a pharmaceutical Industry 4.0 use-case with a planar transport system
di: Korladinov, Viktor Emil, et al.
Pubblicazione: (2026)
di: Korladinov, Viktor Emil, et al.
Pubblicazione: (2026)
PySCIPOpt-ML: Embedding Trained Machine Learning Models into Mixed-Integer Programs
di: Turner, Mark, et al.
Pubblicazione: (2023)
di: Turner, Mark, et al.
Pubblicazione: (2023)
The Sharpness Disparity Principle in Transformers for Accelerating Language Model Pre-Training
di: Wang, Jinbo, et al.
Pubblicazione: (2025)
di: Wang, Jinbo, et al.
Pubblicazione: (2025)
Adaptive Stabilization Based on Machine Learning for Column Generation
di: Shen, Yunzhuang, et al.
Pubblicazione: (2024)
di: Shen, Yunzhuang, et al.
Pubblicazione: (2024)
The Mathematics of Artificial Intelligence
di: Peyré, Gabriel
Pubblicazione: (2025)
di: Peyré, Gabriel
Pubblicazione: (2025)
Through the River: Understanding the Benefit of Schedule-Free Methods for Language Model Training
di: Song, Minhak, et al.
Pubblicazione: (2025)
di: Song, Minhak, et al.
Pubblicazione: (2025)
Capabilities of Large Language Models in Control Engineering: A Benchmark Study on GPT-4, Claude 3 Opus, and Gemini 1.0 Ultra
di: Kevian, Darioush, et al.
Pubblicazione: (2024)
di: Kevian, Darioush, et al.
Pubblicazione: (2024)
Unsupervised Training of Diffusion Models for Feasible Solution Generation in Neural Combinatorial Optimization
di: Hong, Seong-Hyun, et al.
Pubblicazione: (2024)
di: Hong, Seong-Hyun, et al.
Pubblicazione: (2024)
Towards Robust Spacecraft Trajectory Optimization via Transformers
di: Takubo, Yuji, et al.
Pubblicazione: (2024)
di: Takubo, Yuji, et al.
Pubblicazione: (2024)
Training Infinitely Deep and Wide Transformers
di: Barboni, Raphaël, et al.
Pubblicazione: (2026)
di: Barboni, Raphaël, et al.
Pubblicazione: (2026)
Blending Data-Driven Priors in Dynamic Games
di: Lidard, Justin, et al.
Pubblicazione: (2024)
di: Lidard, Justin, et al.
Pubblicazione: (2024)
Using Laplace Transform To Optimize the Hallucination of Generation Models
di: Kang, Cheng, et al.
Pubblicazione: (2026)
di: Kang, Cheng, et al.
Pubblicazione: (2026)
Towards Stable Machine Learning Model Retraining via Slowly Varying Sequences
di: Bertsimas, Dimitris, et al.
Pubblicazione: (2024)
di: Bertsimas, Dimitris, et al.
Pubblicazione: (2024)
StoSignSGD: Unbiased Structural Stochasticity Fixes SignSGD for Training Large Language Models
di: Yu, Dingzhi, et al.
Pubblicazione: (2026)
di: Yu, Dingzhi, et al.
Pubblicazione: (2026)
Infinite-Horizon Reach-Avoid Zero-Sum Games via Deep Reinforcement Learning
di: Li, Jingqi, et al.
Pubblicazione: (2022)
di: Li, Jingqi, et al.
Pubblicazione: (2022)
Remarks on the Polyak-Lojasiewicz inequality and the convergence of gradient systems
di: de Oliveira, Arthur Castello B., et al.
Pubblicazione: (2025)
di: de Oliveira, Arthur Castello B., et al.
Pubblicazione: (2025)
LLM4Branch: Large Language Model for Discovering Efficient Branching Policies of Integer Programs
di: Hou, Zhinan, et al.
Pubblicazione: (2026)
di: Hou, Zhinan, et al.
Pubblicazione: (2026)
Intent-aligned Autonomous Spacecraft Guidance via Reasoning Models
di: Takubo, Yuji, et al.
Pubblicazione: (2026)
di: Takubo, Yuji, et al.
Pubblicazione: (2026)
Language-Conditioned Safe Trajectory Generation for Spacecraft Rendezvous
di: Takubo, Yuji, et al.
Pubblicazione: (2025)
di: Takubo, Yuji, et al.
Pubblicazione: (2025)
Towards a constructive framework for control theory
di: Osinenko, Pavel
Pubblicazione: (2025)
di: Osinenko, Pavel
Pubblicazione: (2025)
Approximate Model Predictive Control for Microgrid Energy Management via Imitation Learning
di: Liu, Changrui, et al.
Pubblicazione: (2025)
di: Liu, Changrui, et al.
Pubblicazione: (2025)
Large Language Model-Assisted Planning of Electric Vehicle Charging Infrastructure with Real-World Case Study
di: Zheng, Xinda, et al.
Pubblicazione: (2025)
di: Zheng, Xinda, et al.
Pubblicazione: (2025)
Who Plays First? Optimizing the Order of Play in Stackelberg Games with Many Robots
di: Hu, Haimin, et al.
Pubblicazione: (2024)
di: Hu, Haimin, et al.
Pubblicazione: (2024)
Toward Decision-Oriented Prognostics: An Integrated Estimate-Optimize Framework for Predictive Maintenance
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
di: Xie, Zhuojun, et al.
Pubblicazione: (2025)
OR-R1: Automating Modeling and Solving of Operations Research Optimization Problem via Test-Time Reinforcement Learning
di: Ding, Zezhen, et al.
Pubblicazione: (2025)
di: Ding, Zezhen, et al.
Pubblicazione: (2025)
Uncovering Symmetry Transfer in Large Language Models via Layer-Peeled Optimization
di: Du, Zhehang, et al.
Pubblicazione: (2026)
di: Du, Zhehang, et al.
Pubblicazione: (2026)
Generalizable Spacecraft Trajectory Generation via Multimodal Learning with Transformers
di: Celestini, Davide, et al.
Pubblicazione: (2024)
di: Celestini, Davide, et al.
Pubblicazione: (2024)
Examining Policy Entropy of Reinforcement Learning Agents for Personalization Tasks
di: Dereventsov, Anton, et al.
Pubblicazione: (2022)
di: Dereventsov, Anton, et al.
Pubblicazione: (2022)
Understanding Sampler Stochasticity in Training Diffusion Models for RLHF
di: Sheng, Jiayuan, et al.
Pubblicazione: (2025)
di: Sheng, Jiayuan, et al.
Pubblicazione: (2025)
Code Retrieval for MILP Instance Generation
di: Yang, Tianxing, et al.
Pubblicazione: (2025)
di: Yang, Tianxing, et al.
Pubblicazione: (2025)
Transformer-based Model Predictive Control: Trajectory Optimization via Sequence Modeling
di: Celestini, Davide, et al.
Pubblicazione: (2024)
di: Celestini, Davide, et al.
Pubblicazione: (2024)
Column Generation for the Micro-Transit Zoning Problem
di: Hu, Hins, et al.
Pubblicazione: (2026)
di: Hu, Hins, et al.
Pubblicazione: (2026)
Offline Supervised Learning V.S. Online Direct Policy Optimization: A Comparative Study and A Unified Training Paradigm for Neural Network-Based Optimal Feedback Control
di: Zhao, Yue, et al.
Pubblicazione: (2022)
di: Zhao, Yue, et al.
Pubblicazione: (2022)
From Product Hilbert Spaces to the Generalized Koopman Operator and the Nonlinear Fundamental Lemma
di: Lazar, Mircea
Pubblicazione: (2025)
di: Lazar, Mircea
Pubblicazione: (2025)
Safe Control and Learning Using Generalized Action Governor
di: Fang, Peiyuan, et al.
Pubblicazione: (2022)
di: Fang, Peiyuan, et al.
Pubblicazione: (2022)
Deep FlexQP: Accelerated Nonlinear Programming via Deep Unfolding
di: Oshin, Alex, et al.
Pubblicazione: (2025)
di: Oshin, Alex, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Cross-Entropy Games and Frost Training
di: Renard, Arthur, et al.
Pubblicazione: (2026) -
Cross-Entropy Games for Language Models: From Implicit Knowledge to General Capability Measures
di: Hongler, Clément, et al.
Pubblicazione: (2025) -
Exploiting Edited Large Language Models as General Scientific Optimizers
di: Lv, Qitan, et al.
Pubblicazione: (2025) -
Exact and heuristic methods for the discrete parallel machine scheduling location problem
di: Kramer, Raphael, et al.
Pubblicazione: (2020) -
Integrated packing, placement, scheduling, and routing of personalized production: a pharmaceutical Industry 4.0 use-case with a planar transport system
di: Korladinov, Viktor Emil, et al.
Pubblicazione: (2026)