MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Haoyu, Zhang, Pengkun, Lu, Mingzhe, Shen, Yanzhen, Ke, Guolin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Anti-LM Decoding for Zero-shot In-context Machine Translation
por: Sia, Suzanna, et al.
Publicado: (2023)
por: Sia, Suzanna, et al.
Publicado: (2023)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
por: Zeng, Boyi, et al.
Publicado: (2025)
por: Zeng, Boyi, et al.
Publicado: (2025)
Intent-driven In-context Learning for Few-shot Dialogue State Tracking
por: Yi, Zihao, et al.
Publicado: (2024)
por: Yi, Zihao, et al.
Publicado: (2024)
In-context Continual Learning Assisted by an External Continual Learner
por: Momeni, Saleh, et al.
Publicado: (2024)
por: Momeni, Saleh, et al.
Publicado: (2024)
Masked-and-Reordered Self-Supervision for Reinforcement Learning from Verifiable Rewards
por: Wang, Zhen, et al.
Publicado: (2025)
por: Wang, Zhen, et al.
Publicado: (2025)
Many-to-English Machine Translation Tools, Data, and Pretrained Models
por: Gowda, Thamme, et al.
Publicado: (2021)
por: Gowda, Thamme, et al.
Publicado: (2021)
PulseLM: A Foundation Dataset and Benchmark for PPG-Text Learning
por: Pham, Hung Manh, et al.
Publicado: (2026)
por: Pham, Hung Manh, et al.
Publicado: (2026)
Vector-ICL: In-context Learning with Continuous Vector Representations
por: Zhuang, Yufan, et al.
Publicado: (2024)
por: Zhuang, Yufan, et al.
Publicado: (2024)
Foundation CAN LM: A Pretrained Language Model For Automotive CAN Data
por: Esashi, Akiharu, et al.
Publicado: (2026)
por: Esashi, Akiharu, et al.
Publicado: (2026)
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning
por: Qureshi, Rameez, et al.
Publicado: (2024)
por: Qureshi, Rameez, et al.
Publicado: (2024)
Demonstration Selection for In-Context Learning via Reinforcement Learning
por: Wang, Xubin, et al.
Publicado: (2024)
por: Wang, Xubin, et al.
Publicado: (2024)
Scaling, Simplification, and Adaptation: Lessons from Pretraining on Machine-Translated Text
por: Velasco, Dan John, et al.
Publicado: (2025)
por: Velasco, Dan John, et al.
Publicado: (2025)
Long-context LLMs Struggle with Long In-context Learning
por: Li, Tianle, et al.
Publicado: (2024)
por: Li, Tianle, et al.
Publicado: (2024)
A Survey on In-context Learning
por: Dong, Qingxiu, et al.
Publicado: (2022)
por: Dong, Qingxiu, et al.
Publicado: (2022)
Beyond Random Sampling: Efficient Language Model Pretraining via Curriculum Learning
por: Zhang, Yang, et al.
Publicado: (2025)
por: Zhang, Yang, et al.
Publicado: (2025)
Learning Dynamics of Meta-Learning in Small Model Pretraining
por: Africa, David Demitri, et al.
Publicado: (2025)
por: Africa, David Demitri, et al.
Publicado: (2025)
LM-Searcher: Cross-domain Neural Architecture Search with LLMs via Unified Numerical Encoding
por: Hu, Yuxuan, et al.
Publicado: (2025)
por: Hu, Yuxuan, et al.
Publicado: (2025)
SudoLM: Learning Access Control of Parametric Knowledge with Authorization Alignment
por: Liu, Qin, et al.
Publicado: (2024)
por: Liu, Qin, et al.
Publicado: (2024)
SensorLM: Learning the Language of Wearable Sensors
por: Zhang, Yuwei, et al.
Publicado: (2025)
por: Zhang, Yuwei, et al.
Publicado: (2025)
Agent-Pro: Learning to Evolve via Policy-Level Reflection and Optimization
por: Zhang, Wenqi, et al.
Publicado: (2024)
por: Zhang, Wenqi, et al.
Publicado: (2024)
Continual Learning Using Only Large Language Model Prompting
por: Qiu, Jiabao, et al.
Publicado: (2024)
por: Qiu, Jiabao, et al.
Publicado: (2024)
A Continued Pretrained LLM Approach for Automatic Medical Note Generation
por: Yuan, Dong, et al.
Publicado: (2024)
por: Yuan, Dong, et al.
Publicado: (2024)
Rethinking Invariance in In-context Learning
por: Fang, Lizhe, et al.
Publicado: (2025)
por: Fang, Lizhe, et al.
Publicado: (2025)
KaLM: Knowledge-aligned Autoregressive Language Modeling via Dual-view Knowledge Graph Contrastive Learning
por: Yu, Peng, et al.
Publicado: (2024)
por: Yu, Peng, et al.
Publicado: (2024)
Pretrained LLMs Learn Multiple Types of Uncertainty
por: Cohen, Roi, et al.
Publicado: (2025)
por: Cohen, Roi, et al.
Publicado: (2025)
TeachLM: Post-Training LLMs for Education Using Authentic Learning Data
por: Perczel, Janos, et al.
Publicado: (2025)
por: Perczel, Janos, et al.
Publicado: (2025)
Many-Shot In-Context Learning
por: Agarwal, Rishabh, et al.
Publicado: (2024)
por: Agarwal, Rishabh, et al.
Publicado: (2024)
Sample-Efficient Online Learning in LM Agents via Hindsight Trajectory Rewriting
por: Hu, Michael Y., et al.
Publicado: (2025)
por: Hu, Michael Y., et al.
Publicado: (2025)
Accelerating Large Language Model Pretraining via LFR Pedagogy: Learn, Focus, and Review
por: Prakriya, Neha, et al.
Publicado: (2024)
por: Prakriya, Neha, et al.
Publicado: (2024)
FlowLM: Few-Step Language Modeling via Diffusion-to-Flow Adaptation
por: Zhang, Runzhe, et al.
Publicado: (2026)
por: Zhang, Runzhe, et al.
Publicado: (2026)
IKnow: Instruction-Knowledge-Aware Continual Pretraining for Effective Domain Adaptation
por: Zhang, Tianyi, et al.
Publicado: (2025)
por: Zhang, Tianyi, et al.
Publicado: (2025)
In-context Pretraining: Language Modeling Beyond Document Boundaries
por: Shi, Weijia, et al.
Publicado: (2023)
por: Shi, Weijia, et al.
Publicado: (2023)
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
por: Ruan, Yangjun, et al.
Publicado: (2023)
por: Ruan, Yangjun, et al.
Publicado: (2023)
LitVISTA: A Benchmark for Narrative Orchestration in Literary Text
por: Lu, Mingzhe, et al.
Publicado: (2026)
por: Lu, Mingzhe, et al.
Publicado: (2026)
Many-Shot In-Context Learning for Molecular Inverse Design
por: Moayedpour, Saeed, et al.
Publicado: (2024)
por: Moayedpour, Saeed, et al.
Publicado: (2024)
MASS: Mathematical Data Selection via Skill Graphs for Pretraining Large Language Models
por: Li, Jiazheng, et al.
Publicado: (2025)
por: Li, Jiazheng, et al.
Publicado: (2025)
Train Once, Answer All: Many Pretraining Experiments for the Cost of One
por: Bordt, Sebastian, et al.
Publicado: (2025)
por: Bordt, Sebastian, et al.
Publicado: (2025)
EstLLM: Enhancing Estonian Capabilities in Multilingual LLMs via Continued Pretraining and Post-Training
por: Dorkin, Aleksei, et al.
Publicado: (2026)
por: Dorkin, Aleksei, et al.
Publicado: (2026)
Irony Detection, Reasoning and Understanding in Zero-shot Learning
por: Yi, Peiling, et al.
Publicado: (2025)
por: Yi, Peiling, et al.
Publicado: (2025)
ZeroDL: Zero-shot Distribution Learning for Text Clustering via Large Language Models
por: Jo, Hwiyeol, et al.
Publicado: (2024)
por: Jo, Hwiyeol, et al.
Publicado: (2024)
Ejemplares similares
-
Anti-LM Decoding for Zero-shot In-context Machine Translation
por: Sia, Suzanna, et al.
Publicado: (2023) -
PonderLM: Pretraining Language Models to Ponder in Continuous Space
por: Zeng, Boyi, et al.
Publicado: (2025) -
Intent-driven In-context Learning for Few-shot Dialogue State Tracking
por: Yi, Zihao, et al.
Publicado: (2024) -
In-context Continual Learning Assisted by an External Continual Learner
por: Momeni, Saleh, et al.
Publicado: (2024) -
Masked-and-Reordered Self-Supervision for Reinforcement Learning from Verifiable Rewards
por: Wang, Zhen, et al.
Publicado: (2025)