Simple Baselines are Competitive with Code Evolution
Fuente:
arXiv
Salvato in:
| Autori principali: | Gideoni, Yonatan, Risi, Sebastian, Gal, Yarin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Do Multilingual LLMs Think In English?
di: Schut, Lisa, et al.
Pubblicazione: (2025)
di: Schut, Lisa, et al.
Pubblicazione: (2025)
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025)
Temporal-Difference Variational Continual Learning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
In-Context Learning Learns Label Relationships but Is Not Conventional Learning
di: Kossen, Jannik, et al.
Pubblicazione: (2023)
di: Kossen, Jannik, et al.
Pubblicazione: (2023)
Kernel Language Entropy: Fine-grained Uncertainty Quantification for LLMs from Semantic Similarities
di: Nikitin, Alexander, et al.
Pubblicazione: (2024)
di: Nikitin, Alexander, et al.
Pubblicazione: (2024)
GPG: A Simple and Strong Reinforcement Learning Baseline for Model Reasoning
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
Challenges and Considerations in the Evaluation of Bayesian Causal Discovery
di: Mamaghan, Amir Mohammad Karimi, et al.
Pubblicazione: (2024)
di: Mamaghan, Amir Mohammad Karimi, et al.
Pubblicazione: (2024)
Deep Minds and Shallow Probes
di: Lee, Su Hyeong, et al.
Pubblicazione: (2026)
di: Lee, Su Hyeong, et al.
Pubblicazione: (2026)
No Mean Feat: Simple, Strong Baselines for Context Compression
di: Feldman, Yair, et al.
Pubblicazione: (2025)
di: Feldman, Yair, et al.
Pubblicazione: (2025)
MolMix: A Simple Yet Effective Baseline for Multimodal Molecular Representation Learning
di: Manolache, Andrei, et al.
Pubblicazione: (2024)
di: Manolache, Andrei, et al.
Pubblicazione: (2024)
Continuous Thought Machines
di: Darlow, Luke, et al.
Pubblicazione: (2025)
di: Darlow, Luke, et al.
Pubblicazione: (2025)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
di: Abdulhai, Marwa, et al.
Pubblicazione: (2025)
di: Abdulhai, Marwa, et al.
Pubblicazione: (2025)
Semantic Entropy Probes: Robust and Cheap Hallucination Detection in LLMs
di: Kossen, Jannik, et al.
Pubblicazione: (2024)
di: Kossen, Jannik, et al.
Pubblicazione: (2024)
Leveraging Deep Learning for Physical Model Bias of Global Air Quality Estimates
di: Doerksen, Kelsey, et al.
Pubblicazione: (2025)
di: Doerksen, Kelsey, et al.
Pubblicazione: (2025)
Uncertainty Quantification for Surface Ozone Emulators using Deep Learning
di: Doerksen, Kelsey, et al.
Pubblicazione: (2025)
di: Doerksen, Kelsey, et al.
Pubblicazione: (2025)
Hedging Is Not All You Need: A Simple Baseline for Online Learning Under Haphazard Inputs
di: Buckchash, Himanshu, et al.
Pubblicazione: (2024)
di: Buckchash, Himanshu, et al.
Pubblicazione: (2024)
SPA: A Simple but Tough-to-Beat Baseline for Knowledge Injection
di: Tang, Kexian, et al.
Pubblicazione: (2026)
di: Tang, Kexian, et al.
Pubblicazione: (2026)
Probabilistic Modeling of Latent Agentic Substructures in Deep Neural Networks
di: Lee, Su Hyeong, et al.
Pubblicazione: (2025)
di: Lee, Su Hyeong, et al.
Pubblicazione: (2025)
Reasoning Introduces New Poisoning Attacks Yet Makes Them More Complicated
di: Foerster, Hanna, et al.
Pubblicazione: (2025)
di: Foerster, Hanna, et al.
Pubblicazione: (2025)
TextCAVs: Debugging vision models using text
di: Nicolson, Angus, et al.
Pubblicazione: (2024)
di: Nicolson, Angus, et al.
Pubblicazione: (2024)
A Simple Baseline for Stable and Plastic Neural Networks
di: Künzel, Étienne, et al.
Pubblicazione: (2025)
di: Künzel, Étienne, et al.
Pubblicazione: (2025)
An Embarrassingly Simple Baseline for Imbalanced Semi-Supervised Learning
di: Chen, Hao, et al.
Pubblicazione: (2022)
di: Chen, Hao, et al.
Pubblicazione: (2022)
Iterative Deployment Improves Planning Skills in LLMs
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
di: Corrêa, Augusto B., et al.
Pubblicazione: (2025)
Non-invasive Neural Decoding in Source Reconstructed Brain Space
di: Gideoni, Yonatan, et al.
Pubblicazione: (2024)
di: Gideoni, Yonatan, et al.
Pubblicazione: (2024)
Deep Ignorance: Filtering Pretraining Data Builds Tamper-Resistant Safeguards into Open-Weight LLMs
di: O'Brien, Kyle, et al.
Pubblicazione: (2025)
di: O'Brien, Kyle, et al.
Pubblicazione: (2025)
Is there Value in Reinforcement Learning?
di: Fox, Lior, et al.
Pubblicazione: (2025)
di: Fox, Lior, et al.
Pubblicazione: (2025)
On the Expressive Power of Sparse Geometric MPNNs
di: Sverdlov, Yonatan, et al.
Pubblicazione: (2024)
di: Sverdlov, Yonatan, et al.
Pubblicazione: (2024)
A Simple, Solid, and Reproducible Baseline for Bridge Bidding AI
di: Kita, Haruka, et al.
Pubblicazione: (2024)
di: Kita, Haruka, et al.
Pubblicazione: (2024)
When Does Structure Matter in Continual Learning? Dimensionality Controls When Modularity Shapes Representational Geometry
di: Korte, Kathrin, et al.
Pubblicazione: (2026)
di: Korte, Kathrin, et al.
Pubblicazione: (2026)
More Test-Time Compute Can Hurt: Overestimation Bias in LLM Beam Search
di: Dalal, Gal, et al.
Pubblicazione: (2026)
di: Dalal, Gal, et al.
Pubblicazione: (2026)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
di: Feng, Zhili, et al.
Pubblicazione: (2025)
di: Feng, Zhili, et al.
Pubblicazione: (2025)
LayerShuffle: Enhancing Robustness in Vision Transformers by Randomizing Layer Execution Order
di: Freiberger, Matthias, et al.
Pubblicazione: (2024)
di: Freiberger, Matthias, et al.
Pubblicazione: (2024)
Competition-Aware CPC Forecasting with Near-Market Coverage
di: Frey, Sebastian, et al.
Pubblicazione: (2026)
di: Frey, Sebastian, et al.
Pubblicazione: (2026)
Pushing Toward the Simplex Vertices: A Simple Remedy for Code Collapse in Smoothed Vector Quantization
di: Morita, Takashi
Pubblicazione: (2025)
di: Morita, Takashi
Pubblicazione: (2025)
ESSAM: A Novel Competitive Evolution Strategies Approach to Reinforcement Learning for Memory Efficient LLMs Fine-Tuning
di: Sun, Zhishen, et al.
Pubblicazione: (2026)
di: Sun, Zhishen, et al.
Pubblicazione: (2026)
Improved Distribution Estimation in $\ell_\infty$
di: Cohen, Doron, et al.
Pubblicazione: (2026)
di: Cohen, Doron, et al.
Pubblicazione: (2026)
Revisiting Multi-Permutation Equivariance through the Lens of Irreducible Representations
di: Sverdlov, Yonatan, et al.
Pubblicazione: (2024)
di: Sverdlov, Yonatan, et al.
Pubblicazione: (2024)
Informative Post-Hoc Explanations Only Exist for Simple Functions
di: Günther, Eric, et al.
Pubblicazione: (2025)
di: Günther, Eric, et al.
Pubblicazione: (2025)
Integrated Influence: Data Attribution with Baseline
di: Yang, Linxiao, et al.
Pubblicazione: (2025)
di: Yang, Linxiao, et al.
Pubblicazione: (2025)
minimax: Efficient Baselines for Autocurricula in JAX
di: Jiang, Minqi, et al.
Pubblicazione: (2023)
di: Jiang, Minqi, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Do Multilingual LLMs Think In English?
di: Schut, Lisa, et al.
Pubblicazione: (2025) -
Stabilizing Policy Gradients for Sample-Efficient Reinforcement Learning in LLM Reasoning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2025) -
Temporal-Difference Variational Continual Learning
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024) -
In-Context Learning Learns Label Relationships but Is Not Conventional Learning
di: Kossen, Jannik, et al.
Pubblicazione: (2023) -
Kernel Language Entropy: Fine-grained Uncertainty Quantification for LLMs from Semantic Similarities
di: Nikitin, Alexander, et al.
Pubblicazione: (2024)