Learning to Learn from Language Feedback with Social Meta-Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Cook, Jonathan, Antognini, Diego, Klissarov, Martin, Musat, Claudiu, Grefenstette, Edward |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Improving Interactive In-Context Learning from Natural Language Feedback
por: Klissarov, Martin, et al.
Publicado: (2026)
por: Klissarov, Martin, et al.
Publicado: (2026)
Position: Introspective Experience from Conversational Environments as a Path to Better Learning
por: Musat, Claudiu Cristian, et al.
Publicado: (2026)
por: Musat, Claudiu Cristian, et al.
Publicado: (2026)
InkFM: A Foundational Model for Full-Page Online Handwritten Note Understanding
por: Fadeeva, Anastasiia, et al.
Publicado: (2025)
por: Fadeeva, Anastasiia, et al.
Publicado: (2025)
On the Emergence of Induction Heads for In-Context Learning
por: Musat, Tiberiu, et al.
Publicado: (2025)
por: Musat, Tiberiu, et al.
Publicado: (2025)
Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language Models
por: Zhou, Yue, et al.
Publicado: (2024)
por: Zhou, Yue, et al.
Publicado: (2024)
Interaction Dynamics as a Reward Signal for LLMs
por: Gooding, Sian, et al.
Publicado: (2025)
por: Gooding, Sian, et al.
Publicado: (2025)
Meta-Reflection: A Feedback-Free Reflection Learning Framework
por: Wang, Yaoke, et al.
Publicado: (2024)
por: Wang, Yaoke, et al.
Publicado: (2024)
Writing as a testbed for open ended agents
por: Gooding, Sian, et al.
Publicado: (2025)
por: Gooding, Sian, et al.
Publicado: (2025)
Text2Grad: Reinforcement Learning from Natural Language Feedback
por: Wang, Hanyang, et al.
Publicado: (2025)
por: Wang, Hanyang, et al.
Publicado: (2025)
Automatic Essay Scoring and Feedback Generation in Basque Language Learning
por: Azurmendi, Ekhi, et al.
Publicado: (2025)
por: Azurmendi, Ekhi, et al.
Publicado: (2025)
Reinforcement Learning from Compiler and Language Server Feedback
por: Zhang, Yifan, et al.
Publicado: (2025)
por: Zhang, Yifan, et al.
Publicado: (2025)
MaestroMotif: Skill Design from Artificial Intelligence Feedback
por: Klissarov, Martin, et al.
Publicado: (2024)
por: Klissarov, Martin, et al.
Publicado: (2024)
Learning to Summarize from LLM-generated Feedback
por: Song, Hwanjun, et al.
Publicado: (2024)
por: Song, Hwanjun, et al.
Publicado: (2024)
Bootstrapping Exploration with Group-Level Natural Language Feedback in Reinforcement Learning
por: Huang, Lei, et al.
Publicado: (2026)
por: Huang, Lei, et al.
Publicado: (2026)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
por: van Niekerk, Carel, et al.
Publicado: (2025)
por: van Niekerk, Carel, et al.
Publicado: (2025)
Meta-aware Learning in text-to-SQL Large Language Model
por: Zhang, Wenda
Publicado: (2025)
por: Zhang, Wenda
Publicado: (2025)
Continual Learning of Domain Knowledge from Human Feedback in Text-to-SQL
por: Cook, Thomas, et al.
Publicado: (2025)
por: Cook, Thomas, et al.
Publicado: (2025)
Learning Dynamics of Meta-Learning in Small Model Pretraining
por: Africa, David Demitri, et al.
Publicado: (2025)
por: Africa, David Demitri, et al.
Publicado: (2025)
Learning from Natural Language Feedback for Personalized Question Answering
por: Salemi, Alireza, et al.
Publicado: (2025)
por: Salemi, Alireza, et al.
Publicado: (2025)
MetaReflection: Learning Instructions for Language Agents using Past Reflections
por: Gupta, Priyanshu, et al.
Publicado: (2024)
por: Gupta, Priyanshu, et al.
Publicado: (2024)
Enhancing the Traditional Chinese Medicine Capabilities of Large Language Model through Reinforcement Learning from AI Feedback
por: Yu, Song, et al.
Publicado: (2024)
por: Yu, Song, et al.
Publicado: (2024)
Transfer Learning for Automated Feedback Generation on Small Datasets
por: Morris, Oscar
Publicado: (2025)
por: Morris, Oscar
Publicado: (2025)
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards
por: Shen, Wei, et al.
Publicado: (2024)
por: Shen, Wei, et al.
Publicado: (2024)
Anomaly Detection in Human Language via Meta-Learning: A Few-Shot Approach
por: Singla, Saurav, et al.
Publicado: (2025)
por: Singla, Saurav, et al.
Publicado: (2025)
Language Models Can Learn from Verbal Feedback Without Scalar Rewards
por: Luo, Renjie, et al.
Publicado: (2025)
por: Luo, Renjie, et al.
Publicado: (2025)
Reinforcement Learning with Backtracking Feedback
por: Sel, Bilgehan, et al.
Publicado: (2026)
por: Sel, Bilgehan, et al.
Publicado: (2026)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
por: Chen, Andong, et al.
Publicado: (2024)
por: Chen, Andong, et al.
Publicado: (2024)
GoodPoint: Learning Constructive Scientific Paper Feedback from Author Responses
por: Mun, Jimin, et al.
Publicado: (2026)
por: Mun, Jimin, et al.
Publicado: (2026)
RLEF: Grounding Code LLMs in Execution Feedback with Reinforcement Learning
por: Gehring, Jonas, et al.
Publicado: (2024)
por: Gehring, Jonas, et al.
Publicado: (2024)
Reinforcement Learning with Token-level Feedback for Controllable Text Generation
por: Li, Wendi, et al.
Publicado: (2024)
por: Li, Wendi, et al.
Publicado: (2024)
Learning to Verify Summary Facts with Fine-Grained LLM Feedback
por: Oh, Jihwan, et al.
Publicado: (2024)
por: Oh, Jihwan, et al.
Publicado: (2024)
Learning Personalized Agents from Human Feedback
por: Liang, Kaiqu, et al.
Publicado: (2026)
por: Liang, Kaiqu, et al.
Publicado: (2026)
Learning to Reason from Feedback at Test-Time
por: Li, Yanyang, et al.
Publicado: (2025)
por: Li, Yanyang, et al.
Publicado: (2025)
FOSSIL: Harnessing Feedback on Suboptimal Samples for Data-Efficient Generalisation with Imitation Learning for Embodied Vision-and-Language Tasks
por: McCallum, Sabrina, et al.
Publicado: (2025)
por: McCallum, Sabrina, et al.
Publicado: (2025)
A Meta-Learning Perspective on Transformers for Causal Language Modeling
por: Wu, Xinbo, et al.
Publicado: (2023)
por: Wu, Xinbo, et al.
Publicado: (2023)
Meta-RTL: Reinforcement-Based Meta-Transfer Learning for Low-Resource Commonsense Reasoning
por: Fu, Yu, et al.
Publicado: (2024)
por: Fu, Yu, et al.
Publicado: (2024)
What's In My Human Feedback? Learning Interpretable Descriptions of Preference Data
por: Movva, Rajiv, et al.
Publicado: (2025)
por: Movva, Rajiv, et al.
Publicado: (2025)
Meta-Sel: Efficient Demonstration Selection for In-Context Learning via Supervised Meta-Learning
por: Wang, Xubin, et al.
Publicado: (2026)
por: Wang, Xubin, et al.
Publicado: (2026)
Meta In-Context Learning Makes Large Language Models Better Zero and Few-Shot Relation Extractors
por: Li, Guozheng, et al.
Publicado: (2024)
por: Li, Guozheng, et al.
Publicado: (2024)
Rapid Word Learning Through Meta In-Context Learning
por: Wang, Wentao, et al.
Publicado: (2025)
por: Wang, Wentao, et al.
Publicado: (2025)
Ejemplares similares
-
Improving Interactive In-Context Learning from Natural Language Feedback
por: Klissarov, Martin, et al.
Publicado: (2026) -
Position: Introspective Experience from Conversational Environments as a Path to Better Learning
por: Musat, Claudiu Cristian, et al.
Publicado: (2026) -
InkFM: A Foundational Model for Full-Page Online Handwritten Note Understanding
por: Fadeeva, Anastasiia, et al.
Publicado: (2025) -
On the Emergence of Induction Heads for In-Context Learning
por: Musat, Tiberiu, et al.
Publicado: (2025) -
Paraphrase and Solve: Exploring and Exploiting the Impact of Surface Form on Mathematical Reasoning in Large Language Models
por: Zhou, Yue, et al.
Publicado: (2024)