Learning Approximate and Exact Numeral Systems via Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Carlsson, Emil, Dubhashi, Devdatt, Johansson, Fredrik D. |
|---|---|
| Format: | Preprint |
| Published: |
2021
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning Efficient Recursive Numeral Systems via Reinforcement Learning
by: Silvi, Andrea, et al.
Published: (2024)
by: Silvi, Andrea, et al.
Published: (2024)
Cultural evolution via iterated learning and communication explains efficient color naming systems
by: Carlsson, Emil, et al.
Published: (2023)
by: Carlsson, Emil, et al.
Published: (2023)
Evaluating the relationship between regularity and learnability in recursive numeral systems using Reinforcement Learning
by: Silvi, Andrea, et al.
Published: (2026)
by: Silvi, Andrea, et al.
Published: (2026)
Active Preference Learning for Ordering Items In- and Out-of-sample
by: Bergström, Herman, et al.
Published: (2024)
by: Bergström, Herman, et al.
Published: (2024)
Pure Exploration in Bandits with Linear Constraints
by: Carlsson, Emil, et al.
Published: (2023)
by: Carlsson, Emil, et al.
Published: (2023)
Learning Contextual Runtime Monitors for Safe AI-Based Autonomy
by: Luque-Cerpa, Alejandro, et al.
Published: (2026)
by: Luque-Cerpa, Alejandro, et al.
Published: (2026)
PACE: Procedural Abstractions for Communicating Efficiently
by: Thomas, Jonathan D., et al.
Published: (2024)
by: Thomas, Jonathan D., et al.
Published: (2024)
Recursive numeral systems are highly regular and easy to process
by: Prasertsom, Ponrawee, et al.
Published: (2025)
by: Prasertsom, Ponrawee, et al.
Published: (2025)
The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation
by: Carlsson, Fredrik, et al.
Published: (2024)
by: Carlsson, Fredrik, et al.
Published: (2024)
Variational Quantum Optimization with Continuous Bandits
by: Wanner, Marc, et al.
Published: (2025)
by: Wanner, Marc, et al.
Published: (2025)
Enhancing Study-Level Inference from Clinical Trial Papers via Reinforcement Learning-Based Numeric Reasoning
by: Pronesti, Massimiliano, et al.
Published: (2025)
by: Pronesti, Massimiliano, et al.
Published: (2025)
Demonstration Selection for In-Context Learning via Reinforcement Learning
by: Wang, Xubin, et al.
Published: (2024)
by: Wang, Xubin, et al.
Published: (2024)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
by: Chen, Mingyang, et al.
Published: (2025)
by: Chen, Mingyang, et al.
Published: (2025)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
by: Wang, Jiaan, et al.
Published: (2025)
by: Wang, Jiaan, et al.
Published: (2025)
Multi-Dimensional Optimization for Text Summarization via Reinforcement Learning
by: Ryu, Sangwon, et al.
Published: (2024)
by: Ryu, Sangwon, et al.
Published: (2024)
R3-RAG: Learning Step-by-Step Reasoning and Retrieval for LLMs via Reinforcement Learning
by: Li, Yuan, et al.
Published: (2025)
by: Li, Yuan, et al.
Published: (2025)
CRINN: Contrastive Reinforcement Learning for Approximate Nearest Neighbor Search
by: Li, Xiaoya, et al.
Published: (2025)
by: Li, Xiaoya, et al.
Published: (2025)
Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning
by: Chen, Yiqun, et al.
Published: (2026)
by: Chen, Yiqun, et al.
Published: (2026)
Unleashing Embodied Task Planning Ability in LLMs via Reinforcement Learning
by: Fei, Zhaoye, et al.
Published: (2025)
by: Fei, Zhaoye, et al.
Published: (2025)
Sparks of Tabular Reasoning via Text2SQL Reinforcement Learning
by: Stoisser, Josefa Lia, et al.
Published: (2025)
by: Stoisser, Josefa Lia, et al.
Published: (2025)
DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning
by: Huang, Haoyu, et al.
Published: (2026)
by: Huang, Haoyu, et al.
Published: (2026)
Scaling Medical Reasoning Verification via Tool-Integrated Reinforcement Learning
by: Zhang, Hang, et al.
Published: (2026)
by: Zhang, Hang, et al.
Published: (2026)
Efficient and Transferable Agentic Knowledge Graph RAG via Reinforcement Learning
by: Lin, Junhong, et al.
Published: (2025)
by: Lin, Junhong, et al.
Published: (2025)
Empathy Level Alignment via Reinforcement Learning for Empathetic Response Generation
by: Ma, Hui, et al.
Published: (2024)
by: Ma, Hui, et al.
Published: (2024)
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning
by: Qureshi, Rameez, et al.
Published: (2024)
by: Qureshi, Rameez, et al.
Published: (2024)
Differentiable Evolutionary Reinforcement Learning
by: Cheng, Sitao, et al.
Published: (2025)
by: Cheng, Sitao, et al.
Published: (2025)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
by: Yan, Yuchen, et al.
Published: (2026)
by: Yan, Yuchen, et al.
Published: (2026)
Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards
by: Lara, Luis, et al.
Published: (2026)
by: Lara, Luis, et al.
Published: (2026)
Improving Low-Resource Machine Translation via Round-Trip Reinforcement Learning
by: Attia, Ahmed, et al.
Published: (2026)
by: Attia, Ahmed, et al.
Published: (2026)
Towards Faithful and Controllable Personalization via Critique-Post-Edit Reinforcement Learning
by: Zhu, Chenghao, et al.
Published: (2025)
by: Zhu, Chenghao, et al.
Published: (2025)
Meta-Thinking in LLMs via Multi-Agent Reinforcement Learning: A Survey
by: Bilal, Ahsan, et al.
Published: (2025)
by: Bilal, Ahsan, et al.
Published: (2025)
Learning to Better Search with Language Models via Guided Reinforced Self-Training
by: Moon, Seungyong, et al.
Published: (2024)
by: Moon, Seungyong, et al.
Published: (2024)
REM-CTX: Automated Peer Review via Reinforcement Learning with Auxiliary Context
by: Taechoyotin, Pawin, et al.
Published: (2026)
by: Taechoyotin, Pawin, et al.
Published: (2026)
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
by: Qian, Cheng, et al.
Published: (2025)
by: Qian, Cheng, et al.
Published: (2025)
GPT-SW3: An Autoregressive Language Model for the Nordic Languages
by: Ekgren, Ariel, et al.
Published: (2023)
by: Ekgren, Ariel, et al.
Published: (2023)
PRL: Prompts from Reinforcement Learning
by: Batorski, Paweł, et al.
Published: (2025)
by: Batorski, Paweł, et al.
Published: (2025)
Discrete Prompt Compression with Reinforcement Learning
by: Jung, Hoyoun, et al.
Published: (2023)
by: Jung, Hoyoun, et al.
Published: (2023)
Approximating Human Preferences Using a Multi-Judge Learned System
by: Sprejer, Eitán, et al.
Published: (2025)
by: Sprejer, Eitán, et al.
Published: (2025)
SAKE: Structured Agentic Knowledge Extrapolation for Complex LLM Reasoning via Reinforcement Learning
by: He, Jiashu, et al.
Published: (2025)
by: He, Jiashu, et al.
Published: (2025)
Aligning Paralinguistic Understanding and Generation in Speech LLMs via Multi-Task Reinforcement Learning
by: Chen, Jingxiang, et al.
Published: (2026)
by: Chen, Jingxiang, et al.
Published: (2026)
Similar Items
-
Learning Efficient Recursive Numeral Systems via Reinforcement Learning
by: Silvi, Andrea, et al.
Published: (2024) -
Cultural evolution via iterated learning and communication explains efficient color naming systems
by: Carlsson, Emil, et al.
Published: (2023) -
Evaluating the relationship between regularity and learnability in recursive numeral systems using Reinforcement Learning
by: Silvi, Andrea, et al.
Published: (2026) -
Active Preference Learning for Ordering Items In- and Out-of-sample
by: Bergström, Herman, et al.
Published: (2024) -
Pure Exploration in Bandits with Linear Constraints
by: Carlsson, Emil, et al.
Published: (2023)