Learning Efficient Recursive Numeral Systems via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Silvi, Andrea, Thomas, Jonathan, Carlsson, Emil, Dubhashi, Devdatt, Johansson, Moa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning Approximate and Exact Numeral Systems via Reinforcement Learning
di: Carlsson, Emil, et al.
Pubblicazione: (2021)
di: Carlsson, Emil, et al.
Pubblicazione: (2021)
PACE: Procedural Abstractions for Communicating Efficiently
di: Thomas, Jonathan D., et al.
Pubblicazione: (2024)
di: Thomas, Jonathan D., et al.
Pubblicazione: (2024)
Recursive numeral systems are highly regular and easy to process
di: Prasertsom, Ponrawee, et al.
Pubblicazione: (2025)
di: Prasertsom, Ponrawee, et al.
Pubblicazione: (2025)
Evaluating the relationship between regularity and learnability in recursive numeral systems using Reinforcement Learning
di: Silvi, Andrea, et al.
Pubblicazione: (2026)
di: Silvi, Andrea, et al.
Pubblicazione: (2026)
Cultural evolution via iterated learning and communication explains efficient color naming systems
di: Carlsson, Emil, et al.
Pubblicazione: (2023)
di: Carlsson, Emil, et al.
Pubblicazione: (2023)
Active Preference Learning for Ordering Items In- and Out-of-sample
di: Bergström, Herman, et al.
Pubblicazione: (2024)
di: Bergström, Herman, et al.
Pubblicazione: (2024)
Pure Exploration in Bandits with Linear Constraints
di: Carlsson, Emil, et al.
Pubblicazione: (2023)
di: Carlsson, Emil, et al.
Pubblicazione: (2023)
Variational Quantum Optimization with Continuous Bandits
di: Wanner, Marc, et al.
Pubblicazione: (2025)
di: Wanner, Marc, et al.
Pubblicazione: (2025)
Learning Contextual Runtime Monitors for Safe AI-Based Autonomy
di: Luque-Cerpa, Alejandro, et al.
Pubblicazione: (2026)
di: Luque-Cerpa, Alejandro, et al.
Pubblicazione: (2026)
Reasoning in Transformers -- Mitigating Spurious Correlations and Reasoning Shortcuts
di: Enström, Daniel, et al.
Pubblicazione: (2024)
di: Enström, Daniel, et al.
Pubblicazione: (2024)
Fact Recall, Heuristics or Pure Guesswork? Precise Interpretations of Language Models for Fact Completion
di: Saynova, Denitsa, et al.
Pubblicazione: (2024)
di: Saynova, Denitsa, et al.
Pubblicazione: (2024)
Predicting Ground State Properties: Constant Sample Complexity and Deep Learning Algorithms
di: Wanner, Marc, et al.
Pubblicazione: (2024)
di: Wanner, Marc, et al.
Pubblicazione: (2024)
Benchmarking Debiasing Methods for LLM-based Parameter Estimates
di: de Pieuchon, Nicolas Audinet, et al.
Pubblicazione: (2025)
di: de Pieuchon, Nicolas Audinet, et al.
Pubblicazione: (2025)
Identifying Non-Replicable Social Science Studies with Language Models
di: Saynova, Denitsa, et al.
Pubblicazione: (2025)
di: Saynova, Denitsa, et al.
Pubblicazione: (2025)
Efficient Medical VIE via Reinforcement Learning
di: Liu, Lijun, et al.
Pubblicazione: (2025)
di: Liu, Lijun, et al.
Pubblicazione: (2025)
Can Large Language Models (or Humans) Disentangle Text?
di: de Pieuchon, Nicolas Audinet, et al.
Pubblicazione: (2024)
di: de Pieuchon, Nicolas Audinet, et al.
Pubblicazione: (2024)
Parameter-Efficient Quality Estimation via Frozen Recursive Models
di: Abubacar, Umar, et al.
Pubblicazione: (2026)
di: Abubacar, Umar, et al.
Pubblicazione: (2026)
Twitch: Learning Abstractions for Equational Theorem Proving
di: Axelrod, Guy, et al.
Pubblicazione: (2026)
di: Axelrod, Guy, et al.
Pubblicazione: (2026)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
Specify What? Enhancing Neural Specification Synthesis by Symbolic Methods
di: Granberry, George, et al.
Pubblicazione: (2024)
di: Granberry, George, et al.
Pubblicazione: (2024)
Mixture-of-Recursions: Learning Dynamic Recursive Depths for Adaptive Token-Level Computation
di: Bae, Sangmin, et al.
Pubblicazione: (2025)
di: Bae, Sangmin, et al.
Pubblicazione: (2025)
Can Large Language Models Invent Algorithms to Improve Themselves?: Algorithm Discovery for Recursive Self-Improvement through Reinforcement Learning
di: Ishibashi, Yoichi, et al.
Pubblicazione: (2024)
di: Ishibashi, Yoichi, et al.
Pubblicazione: (2024)
MetaRuleGPT: Recursive Numerical Reasoning of Language Models Trained with Simple Rules
di: Chen, Kejie, et al.
Pubblicazione: (2024)
di: Chen, Kejie, et al.
Pubblicazione: (2024)
Concise Reasoning via Reinforcement Learning
di: Fatemi, Mehdi, et al.
Pubblicazione: (2025)
di: Fatemi, Mehdi, et al.
Pubblicazione: (2025)
Efficient and Transferable Agentic Knowledge Graph RAG via Reinforcement Learning
di: Lin, Junhong, et al.
Pubblicazione: (2025)
di: Lin, Junhong, et al.
Pubblicazione: (2025)
Mem-α: Learning Memory Construction via Reinforcement Learning
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
Transformer-Based Models Are Not Yet Perfect At Learning to Emulate Structural Recursion
di: Zhang, Dylan, et al.
Pubblicazione: (2024)
di: Zhang, Dylan, et al.
Pubblicazione: (2024)
Enhancing Study-Level Inference from Clinical Trial Papers via Reinforcement Learning-Based Numeric Reasoning
di: Pronesti, Massimiliano, et al.
Pubblicazione: (2025)
di: Pronesti, Massimiliano, et al.
Pubblicazione: (2025)
FlashHead: Efficient Drop-In Replacement for the Classification Head in Language Model Inference
di: Tranheden, Wilhelm, et al.
Pubblicazione: (2026)
di: Tranheden, Wilhelm, et al.
Pubblicazione: (2026)
Minority-Aware Satisfaction Estimation in Dialogue Systems via Preference-Adaptive Reinforcement Learning
di: Fu, Yahui, et al.
Pubblicazione: (2025)
di: Fu, Yahui, et al.
Pubblicazione: (2025)
Hybrid Latent Reasoning via Reinforcement Learning
di: Yue, Zhenrui, et al.
Pubblicazione: (2025)
di: Yue, Zhenrui, et al.
Pubblicazione: (2025)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
AgentGL: Towards Agentic Graph Learning with LLMs via Reinforcement Learning
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
Learning to Extract Rational Evidence via Reinforcement Learning for Retrieval-Augmented Generation
di: Zhao, Xinping, et al.
Pubblicazione: (2025)
di: Zhao, Xinping, et al.
Pubblicazione: (2025)
Demonstration Selection for In-Context Learning via Reinforcement Learning
di: Wang, Xubin, et al.
Pubblicazione: (2024)
di: Wang, Xubin, et al.
Pubblicazione: (2024)
Acquisition of Recursive Possessives and Recursive Locatives in Mandarin
di: Fu, Chenxi, et al.
Pubblicazione: (2024)
di: Fu, Chenxi, et al.
Pubblicazione: (2024)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
Preference Distillation via Value based Reinforcement Learning
di: Kwon, Minchan, et al.
Pubblicazione: (2025)
di: Kwon, Minchan, et al.
Pubblicazione: (2025)
REBEL: Reinforcement Learning via Regressing Relative Rewards
di: Gao, Zhaolin, et al.
Pubblicazione: (2024)
di: Gao, Zhaolin, et al.
Pubblicazione: (2024)
Efficient Preference-based Reinforcement Learning via Aligned Experience Estimation
di: Bai, Fengshuo, et al.
Pubblicazione: (2024)
di: Bai, Fengshuo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Learning Approximate and Exact Numeral Systems via Reinforcement Learning
di: Carlsson, Emil, et al.
Pubblicazione: (2021) -
PACE: Procedural Abstractions for Communicating Efficiently
di: Thomas, Jonathan D., et al.
Pubblicazione: (2024) -
Recursive numeral systems are highly regular and easy to process
di: Prasertsom, Ponrawee, et al.
Pubblicazione: (2025) -
Evaluating the relationship between regularity and learnability in recursive numeral systems using Reinforcement Learning
di: Silvi, Andrea, et al.
Pubblicazione: (2026) -
Cultural evolution via iterated learning and communication explains efficient color naming systems
di: Carlsson, Emil, et al.
Pubblicazione: (2023)