Cross-Entropy Games and Frost Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Renard, Arthur, Gabriel, Franck, Hartmann, Valentin, Hongler, Clément |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cognitive Training for Language Models: Towards General Capabilities via Cross-Entropy Games
par: Hongler, Clément, et autres
Publié: (2026)
par: Hongler, Clément, et autres
Publié: (2026)
Cross-Entropy Games for Language Models: From Implicit Knowledge to General Capability Measures
par: Hongler, Clément, et autres
Publié: (2025)
par: Hongler, Clément, et autres
Publié: (2025)
Arrows of Time for Large Language Models
par: Papadopoulos, Vassilis, et autres
Publié: (2024)
par: Papadopoulos, Vassilis, et autres
Publié: (2024)
Visualizing the Structure of Lenia Parameter Space
par: Hudcová, Barbora, et autres
Publié: (2026)
par: Hudcová, Barbora, et autres
Publié: (2026)
Looking for Complexity at Phase Boundaries in Continuous Cellular Automata
par: Papadopoulos, Vassilis, et autres
Publié: (2024)
par: Papadopoulos, Vassilis, et autres
Publié: (2024)
PermaFrost-Attack: Stealth Pretraining Seeding(SPS) for planting Logic Landmines During LLM Training
par: Kumar, Harsh, et autres
Publié: (2026)
par: Kumar, Harsh, et autres
Publié: (2026)
Deduction Game Framework and Information Set Entropy Search
par: Meng, Fandi, et autres
Publié: (2024)
par: Meng, Fandi, et autres
Publié: (2024)
Federated Learning with Workload Reduction through Partial Training of Client Models and Entropy-Based Data Selection
par: Shi, Hongrui, et autres
Publié: (2024)
par: Shi, Hongrui, et autres
Publié: (2024)
Cross-Entropy Optimization for Hyperparameter Optimization in Stochastic Gradient-based Approaches to Train Deep Neural Networks
par: Li, Kevin, et autres
Publié: (2024)
par: Li, Kevin, et autres
Publié: (2024)
MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-Entropies
par: Zhang, Shiyue, et autres
Publié: (2023)
par: Zhang, Shiyue, et autres
Publié: (2023)
$α$-GAN by Rényi Cross Entropy
par: Ding, Ni, et autres
Publié: (2025)
par: Ding, Ni, et autres
Publié: (2025)
Trajectory Entropy: Modeling Game State Stability from Multimodality Trajectory Prediction
par: Zhang, Yesheng, et autres
Publié: (2025)
par: Zhang, Yesheng, et autres
Publié: (2025)
The Token Games: Evaluating Language Model Reasoning with Puzzle Duels
par: Henniger, Simon, et autres
Publié: (2026)
par: Henniger, Simon, et autres
Publié: (2026)
Deep MMD Gradient Flow without adversarial training
par: Galashov, Alexandre, et autres
Publié: (2024)
par: Galashov, Alexandre, et autres
Publié: (2024)
Understanding Prediction Discrepancies in Machine Learning Classifiers
par: Renard, Xavier, et autres
Publié: (2021)
par: Renard, Xavier, et autres
Publié: (2021)
Sparse Training of Discrete Diffusion Models for Graph Generation
par: Qin, Yiming, et autres
Publié: (2023)
par: Qin, Yiming, et autres
Publié: (2023)
Cross-Dataset Generalization For Retinal Lesions Segmentation
par: Playout, Clément, et autres
Publié: (2024)
par: Playout, Clément, et autres
Publié: (2024)
Efficient Benchmarking of AI Agents
par: Ndzomga, Franck
Publié: (2026)
par: Ndzomga, Franck
Publié: (2026)
Model-based reinforcement learning for protein backbone design
par: Renard, Frederic, et autres
Publié: (2024)
par: Renard, Frederic, et autres
Publié: (2024)
No-Regret Strategy Solving in Imperfect-Information Games via Pre-Trained Embedding
par: Fu, Yanchang, et autres
Publié: (2025)
par: Fu, Yanchang, et autres
Publié: (2025)
Label-Free Reinforcement Learning via Cross-Model Entropy
par: Gorbett, Matt, et autres
Publié: (2026)
par: Gorbett, Matt, et autres
Publié: (2026)
Online Training and Pruning of Deep Reinforcement Learning Networks
par: Guenter, Valentin Frank Ingmar, et autres
Publié: (2025)
par: Guenter, Valentin Frank Ingmar, et autres
Publié: (2025)
SimCE: Simplifying Cross-Entropy Loss for Collaborative Filtering
par: Yang, Xiaodong, et autres
Publié: (2024)
par: Yang, Xiaodong, et autres
Publié: (2024)
Rethinking Independent Cross-Entropy Loss For Graph-Structured Data
par: Miao, Rui, et autres
Publié: (2024)
par: Miao, Rui, et autres
Publié: (2024)
Rejuvenating Cross-Entropy Loss in Knowledge Distillation for Recommender Systems
par: Zhu, Zhangchi, et autres
Publié: (2025)
par: Zhu, Zhangchi, et autres
Publié: (2025)
Beyond Shapley Values: Cooperative Games for the Interpretation of Machine Learning Models
par: Idrissi, Marouane Il, et autres
Publié: (2025)
par: Idrissi, Marouane Il, et autres
Publié: (2025)
Orak: A Foundational Benchmark for Training and Evaluating LLM Agents on Diverse Video Games
par: Park, Dongmin, et autres
Publié: (2025)
par: Park, Dongmin, et autres
Publié: (2025)
Training Interactive Agent in Large FPS Game Map with Rule-enhanced Reinforcement Learning
par: Zhang, Chen, et autres
Publié: (2024)
par: Zhang, Chen, et autres
Publié: (2024)
EntroCoT: Enhancing Chain-of-Thought via Adaptive Entropy-Guided Segmentation
par: Li, Zihang, et autres
Publié: (2026)
par: Li, Zihang, et autres
Publié: (2026)
Learned Hallucination Detection in Black-Box LLMs using Token-level Entropy Production Rate
par: Moslonka, Charles, et autres
Publié: (2025)
par: Moslonka, Charles, et autres
Publié: (2025)
What Scales in Cross-Entropy Scaling Law?
par: Yan, Junxi, et autres
Publié: (2025)
par: Yan, Junxi, et autres
Publié: (2025)
Bregman Centroid Guided Cross-Entropy Method
par: Gu, Yuliang, et autres
Publié: (2025)
par: Gu, Yuliang, et autres
Publié: (2025)
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
par: Renard, Titouan, et autres
Publié: (2024)
par: Renard, Titouan, et autres
Publié: (2024)
Market-Driven Subset Selection for Budgeted Training
par: Jha, Ashish, et autres
Publié: (2025)
par: Jha, Ashish, et autres
Publié: (2025)
Entropy-Guided Data-Efficient Training for Multimodal Reasoning Reward Models
par: Yang, Shidong, et autres
Publié: (2026)
par: Yang, Shidong, et autres
Publié: (2026)
EntropyLong: Effective Long-Context Training via Predictive Uncertainty
par: Jia, Junlong, et autres
Publié: (2025)
par: Jia, Junlong, et autres
Publié: (2025)
Entropy-Driven Curriculum for Multi-Task Training in Human Mobility Prediction
par: Fang, Tianye, et autres
Publié: (2025)
par: Fang, Tianye, et autres
Publié: (2025)
Gradient Dynamics of Attention: How Cross-Entropy Sculpts Bayesian Manifolds
par: Agarwal, Naman, et autres
Publié: (2025)
par: Agarwal, Naman, et autres
Publié: (2025)
Cross-Entropy Is All You Need To Invert the Data Generating Process
par: Reizinger, Patrik, et autres
Publié: (2024)
par: Reizinger, Patrik, et autres
Publié: (2024)
How Useful Is Cross-Domain Generalization for Training LLM Monitors?
par: Martin, Sam, et autres
Publié: (2026)
par: Martin, Sam, et autres
Publié: (2026)
Documents similaires
-
Cognitive Training for Language Models: Towards General Capabilities via Cross-Entropy Games
par: Hongler, Clément, et autres
Publié: (2026) -
Cross-Entropy Games for Language Models: From Implicit Knowledge to General Capability Measures
par: Hongler, Clément, et autres
Publié: (2025) -
Arrows of Time for Large Language Models
par: Papadopoulos, Vassilis, et autres
Publié: (2024) -
Visualizing the Structure of Lenia Parameter Space
par: Hudcová, Barbora, et autres
Publié: (2026) -
Looking for Complexity at Phase Boundaries in Continuous Cellular Automata
par: Papadopoulos, Vassilis, et autres
Publié: (2024)