From Simulation to Enaction: Post-trained language models recognize and react to their own generations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | G., Asvin, Lindsey, Jack |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Post-training makes large language models less human-like
par: Binz, Marcel, et autres
Publié: (2026)
par: Binz, Marcel, et autres
Publié: (2026)
Stylometry recognizes human and LLM-generated texts in short samples
par: Przystalski, Karol, et autres
Publié: (2025)
par: Przystalski, Karol, et autres
Publié: (2025)
Lightweight reranking for language model generations
par: Jain, Siddhartha, et autres
Publié: (2023)
par: Jain, Siddhartha, et autres
Publié: (2023)
Diffusion on language model encodings for protein sequence generation
par: Meshchaninov, Viacheslav, et autres
Publié: (2024)
par: Meshchaninov, Viacheslav, et autres
Publié: (2024)
The Impact of Post-training on Data Contamination
par: Kocyigit, Muhammed Yusuf, et autres
Publié: (2026)
par: Kocyigit, Muhammed Yusuf, et autres
Publié: (2026)
Aleph-Alpha-GermanWeb: Improving German-language LLM pre-training with model-based data curation and synthetic data generation
par: Burns, Thomas F, et autres
Publié: (2025)
par: Burns, Thomas F, et autres
Publié: (2025)
Agentic reinforcement learning empowers next-generation chemical language models for molecular design and synthesis
par: Li, Hao, et autres
Publié: (2026)
par: Li, Hao, et autres
Publié: (2026)
Data filtering methods for training language models
par: Shevchenko, Egor, et autres
Publié: (2026)
par: Shevchenko, Egor, et autres
Publié: (2026)
Pre-trained knowledge elevates large language models beyond traditional chemical reaction optimizers
par: MacKnight, Robert, et autres
Publié: (2025)
par: MacKnight, Robert, et autres
Publié: (2025)
Prior-informed optimization of treatment recommendation via bandit algorithms trained on large language model-processed historical records
par: Nessari, Saman, et autres
Publié: (2025)
par: Nessari, Saman, et autres
Publié: (2025)
Towards the generation of hierarchical attack models from cybersecurity vulnerabilities using language models
par: Sowka, Kacper, et autres
Publié: (2024)
par: Sowka, Kacper, et autres
Publié: (2024)
Improving training time and GPU utilization in geo-distributed language model training
par: Palak, et autres
Publié: (2024)
par: Palak, et autres
Publié: (2024)
Aviary: training language agents on challenging scientific tasks
par: Narayanan, Siddharth, et autres
Publié: (2024)
par: Narayanan, Siddharth, et autres
Publié: (2024)
Arena Learning: Build Data Flywheel for LLMs Post-training via Simulated Chatbot Arena
par: Luo, Haipeng, et autres
Publié: (2024)
par: Luo, Haipeng, et autres
Publié: (2024)
AI-AI Bias: large language models favor communications generated by large language models
par: Laurito, Walter, et autres
Publié: (2024)
par: Laurito, Walter, et autres
Publié: (2024)
Auditing language models for hidden objectives
par: Marks, Samuel, et autres
Publié: (2025)
par: Marks, Samuel, et autres
Publié: (2025)
AutoOR: Scalably Post-training LLMs to Autoformalize Operations Research Problems
par: Motwani, Sumeet Ramesh, et autres
Publié: (2026)
par: Motwani, Sumeet Ramesh, et autres
Publié: (2026)
BoA: Attention-aware Post-training Quantization without Backpropagation
par: Kim, Junhan, et autres
Publié: (2024)
par: Kim, Junhan, et autres
Publié: (2024)
It's the humans, not the data: Geopolitical bias in LLMs originates in post-training, amplified by the language of the prompt
par: Bladon, Stuart, et autres
Publié: (2026)
par: Bladon, Stuart, et autres
Publié: (2026)
Robust training of implicit generative models for multivariate and heavy-tailed distributions with an invariant statistical loss
par: de Frutos, José Manuel, et autres
Publié: (2024)
par: de Frutos, José Manuel, et autres
Publié: (2024)
Prioritized Replay for RL Post-training
par: Fatemi, Mehdi
Publié: (2026)
par: Fatemi, Mehdi
Publié: (2026)
The promising potential of vision language models for the generation of textual weather forecasts
par: Steele, Edward C. C., et autres
Publié: (2025)
par: Steele, Edward C. C., et autres
Publié: (2025)
Beneficial Reasoning Behaviors in Agentic Search and Effective Post-training to Obtain Them
par: Jin, Jiahe, et autres
Publié: (2025)
par: Jin, Jiahe, et autres
Publié: (2025)
AdamS: Momentum Itself Can Be A Normalizer for LLM Pretraining and Post-training
par: Zhang, Huishuai, et autres
Publié: (2025)
par: Zhang, Huishuai, et autres
Publié: (2025)
Continual Quantization-Aware Pre-Training: When to transition from 16-bit to 1.58-bit pre-training for BitNet language models?
par: Nielsen, Jacob, et autres
Publié: (2025)
par: Nielsen, Jacob, et autres
Publié: (2025)
Effective internal language model training and fusion for factorized transducer model
par: Guo, Jinxi, et autres
Publié: (2024)
par: Guo, Jinxi, et autres
Publié: (2024)
What happens when generative AI models train recursively on each others' outputs?
par: Vu, Hung Anh, et autres
Publié: (2025)
par: Vu, Hung Anh, et autres
Publié: (2025)
How predictable is language model benchmark performance?
par: Owen, David
Publié: (2024)
par: Owen, David
Publié: (2024)
Alignment faking in large language models
par: Greenblatt, Ryan, et autres
Publié: (2024)
par: Greenblatt, Ryan, et autres
Publié: (2024)
Automatic Pair Construction for Contrastive Post-training
par: Xu, Canwen, et autres
Publié: (2023)
par: Xu, Canwen, et autres
Publié: (2023)
Early-stopping for Transformer model training
par: He, Jing, et autres
Publié: (2025)
par: He, Jing, et autres
Publié: (2025)
Efficiency optimization of large-scale language models based on deep learning in natural language processing tasks
par: Mei, Taiyuan, et autres
Publié: (2024)
par: Mei, Taiyuan, et autres
Publié: (2024)
Quantifying construct validity in large language model evaluations
par: Kearns, Ryan Othniel
Publié: (2026)
par: Kearns, Ryan Othniel
Publié: (2026)
Applying sparse autoencoders to unlearn knowledge in language models
par: Farrell, Eoin, et autres
Publié: (2024)
par: Farrell, Eoin, et autres
Publié: (2024)
FoldToken2: Learning compact, invariant and generative protein structure language
par: Gao, Zhangyang, et autres
Publié: (2024)
par: Gao, Zhangyang, et autres
Publié: (2024)
PBP: Post-training Backdoor Purification for Malware Classifiers
par: Nguyen, Dung Thuy, et autres
Publié: (2024)
par: Nguyen, Dung Thuy, et autres
Publié: (2024)
Post-training for Efficient Communication via Convention Formation
par: Hua, Yilun, et autres
Publié: (2025)
par: Hua, Yilun, et autres
Publié: (2025)
Efficient Post-training Quantization with FP8 Formats
par: Shen, Haihao, et autres
Publié: (2023)
par: Shen, Haihao, et autres
Publié: (2023)
Are we still able to recognize pearls? Machine-driven peer review and the risk to creativity: An explainable RAG-XAI detection framework with markers extraction
par: Văduva, Alin-Gabriel, et autres
Publié: (2026)
par: Văduva, Alin-Gabriel, et autres
Publié: (2026)
Why Pass@k Optimization Can Degrade Pass@1: Prompt Interference in LLM Post-training
par: Barakat, Anas, et autres
Publié: (2026)
par: Barakat, Anas, et autres
Publié: (2026)
Documents similaires
-
Post-training makes large language models less human-like
par: Binz, Marcel, et autres
Publié: (2026) -
Stylometry recognizes human and LLM-generated texts in short samples
par: Przystalski, Karol, et autres
Publié: (2025) -
Lightweight reranking for language model generations
par: Jain, Siddhartha, et autres
Publié: (2023) -
Diffusion on language model encodings for protein sequence generation
par: Meshchaninov, Viacheslav, et autres
Publié: (2024) -
The Impact of Post-training on Data Contamination
par: Kocyigit, Muhammed Yusuf, et autres
Publié: (2026)