Learning to Learn from Language Feedback with Social Meta-Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cook, Jonathan, Antognini, Diego, Klissarov, Martin, Musat, Claudiu, Grefenstette, Edward |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Interactive In-Context Learning from Natural Language Feedback
par: Klissarov, Martin, et autres
Publié: (2026)
par: Klissarov, Martin, et autres
Publié: (2026)
Position: Introspective Experience from Conversational Environments as a Path to Better Learning
par: Musat, Claudiu Cristian, et autres
Publié: (2026)
par: Musat, Claudiu Cristian, et autres
Publié: (2026)
InkFM: A Foundational Model for Full-Page Online Handwritten Note Understanding
par: Fadeeva, Anastasiia, et autres
Publié: (2025)
par: Fadeeva, Anastasiia, et autres
Publié: (2025)
On the Emergence of Induction Heads for In-Context Learning
par: Musat, Tiberiu, et autres
Publié: (2025)
par: Musat, Tiberiu, et autres
Publié: (2025)
Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language Models
par: Zhou, Yue, et autres
Publié: (2024)
par: Zhou, Yue, et autres
Publié: (2024)
Interaction Dynamics as a Reward Signal for LLMs
par: Gooding, Sian, et autres
Publié: (2025)
par: Gooding, Sian, et autres
Publié: (2025)
Meta-Reflection: A Feedback-Free Reflection Learning Framework
par: Wang, Yaoke, et autres
Publié: (2024)
par: Wang, Yaoke, et autres
Publié: (2024)
Writing as a testbed for open ended agents
par: Gooding, Sian, et autres
Publié: (2025)
par: Gooding, Sian, et autres
Publié: (2025)
Text2Grad: Reinforcement Learning from Natural Language Feedback
par: Wang, Hanyang, et autres
Publié: (2025)
par: Wang, Hanyang, et autres
Publié: (2025)
Automatic Essay Scoring and Feedback Generation in Basque Language Learning
par: Azurmendi, Ekhi, et autres
Publié: (2025)
par: Azurmendi, Ekhi, et autres
Publié: (2025)
Reinforcement Learning from Compiler and Language Server Feedback
par: Zhang, Yifan, et autres
Publié: (2025)
par: Zhang, Yifan, et autres
Publié: (2025)
MaestroMotif: Skill Design from Artificial Intelligence Feedback
par: Klissarov, Martin, et autres
Publié: (2024)
par: Klissarov, Martin, et autres
Publié: (2024)
Learning to Summarize from LLM-generated Feedback
par: Song, Hwanjun, et autres
Publié: (2024)
par: Song, Hwanjun, et autres
Publié: (2024)
Bootstrapping Exploration with Group-Level Natural Language Feedback in Reinforcement Learning
par: Huang, Lei, et autres
Publié: (2026)
par: Huang, Lei, et autres
Publié: (2026)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
par: van Niekerk, Carel, et autres
Publié: (2025)
par: van Niekerk, Carel, et autres
Publié: (2025)
Meta-aware Learning in text-to-SQL Large Language Model
par: Zhang, Wenda
Publié: (2025)
par: Zhang, Wenda
Publié: (2025)
Continual Learning of Domain Knowledge from Human Feedback in Text-to-SQL
par: Cook, Thomas, et autres
Publié: (2025)
par: Cook, Thomas, et autres
Publié: (2025)
Learning Dynamics of Meta-Learning in Small Model Pretraining
par: Africa, David Demitri, et autres
Publié: (2025)
par: Africa, David Demitri, et autres
Publié: (2025)
Learning from Natural Language Feedback for Personalized Question Answering
par: Salemi, Alireza, et autres
Publié: (2025)
par: Salemi, Alireza, et autres
Publié: (2025)
MetaReflection: Learning Instructions for Language Agents using Past Reflections
par: Gupta, Priyanshu, et autres
Publié: (2024)
par: Gupta, Priyanshu, et autres
Publié: (2024)
Enhancing the Traditional Chinese Medicine Capabilities of Large Language Model through Reinforcement Learning from AI Feedback
par: Yu, Song, et autres
Publié: (2024)
par: Yu, Song, et autres
Publié: (2024)
Transfer Learning for Automated Feedback Generation on Small Datasets
par: Morris, Oscar
Publié: (2025)
par: Morris, Oscar
Publié: (2025)
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards
par: Shen, Wei, et autres
Publié: (2024)
par: Shen, Wei, et autres
Publié: (2024)
Anomaly Detection in Human Language via Meta-Learning: A Few-Shot Approach
par: Singla, Saurav, et autres
Publié: (2025)
par: Singla, Saurav, et autres
Publié: (2025)
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
par: Luo, Renjie, et autres
Publié: (2025)
par: Luo, Renjie, et autres
Publié: (2025)
Reinforcement Learning with Backtracking Feedback
par: Sel, Bilgehan, et autres
Publié: (2026)
par: Sel, Bilgehan, et autres
Publié: (2026)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
par: Chen, Andong, et autres
Publié: (2024)
par: Chen, Andong, et autres
Publié: (2024)
GoodPoint: Learning Constructive Scientific Paper Feedback from Author Responses
par: Mun, Jimin, et autres
Publié: (2026)
par: Mun, Jimin, et autres
Publié: (2026)
RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning
par: Gehring, Jonas, et autres
Publié: (2024)
par: Gehring, Jonas, et autres
Publié: (2024)
Reinforcement Learning with Token-level Feedback for Controllable Text Generation
par: Li, Wendi, et autres
Publié: (2024)
par: Li, Wendi, et autres
Publié: (2024)
Learning to Verify Summary Facts with Fine-Grained LLM Feedback
par: Oh, Jihwan, et autres
Publié: (2024)
par: Oh, Jihwan, et autres
Publié: (2024)
Learning Personalized Agents from Human Feedback
par: Liang, Kaiqu, et autres
Publié: (2026)
par: Liang, Kaiqu, et autres
Publié: (2026)
Learning to Reason from Feedback at Test-Time
par: Li, Yanyang, et autres
Publié: (2025)
par: Li, Yanyang, et autres
Publié: (2025)
FOSSIL: Harnessing Feedback on Suboptimal Samples for Data-Efficient Generalisation with Imitation Learning for Embodied Vision-and-Language Tasks
par: McCallum, Sabrina, et autres
Publié: (2025)
par: McCallum, Sabrina, et autres
Publié: (2025)
A Meta-Learning Perspective on Transformers for Causal Language Modeling
par: Wu, Xinbo, et autres
Publié: (2023)
par: Wu, Xinbo, et autres
Publié: (2023)
Meta-RTL: Reinforcement-Based Meta-Transfer Learning for Low-Resource Commonsense Reasoning
par: Fu, Yu, et autres
Publié: (2024)
par: Fu, Yu, et autres
Publié: (2024)
What's In My Human Feedback? Learning Interpretable Descriptions of Preference Data
par: Movva, Rajiv, et autres
Publié: (2025)
par: Movva, Rajiv, et autres
Publié: (2025)
Meta-Sel: Efficient Demonstration Selection for In-Context Learning via Supervised Meta-Learning
par: Wang, Xubin, et autres
Publié: (2026)
par: Wang, Xubin, et autres
Publié: (2026)
Meta In-Context Learning Makes Large Language Models Better Zero and Few-Shot Relation Extractors
par: Li, Guozheng, et autres
Publié: (2024)
par: Li, Guozheng, et autres
Publié: (2024)
Rapid Word Learning Through Meta In-Context Learning
par: Wang, Wentao, et autres
Publié: (2025)
par: Wang, Wentao, et autres
Publié: (2025)
Documents similaires
-
Improving Interactive In-Context Learning from Natural Language Feedback
par: Klissarov, Martin, et autres
Publié: (2026) -
Position: Introspective Experience from Conversational Environments as a Path to Better Learning
par: Musat, Claudiu Cristian, et autres
Publié: (2026) -
InkFM: A Foundational Model for Full-Page Online Handwritten Note Understanding
par: Fadeeva, Anastasiia, et autres
Publié: (2025) -
On the Emergence of Induction Heads for In-Context Learning
par: Musat, Tiberiu, et autres
Publié: (2025) -
Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language Models
par: Zhou, Yue, et autres
Publié: (2024)