Synthetic Data for any Differentiable Target
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Thrush, Tristan, Park, Sung Min, Brunborg, Herman, Bailey, Luke, Roed, Marcel, Band, Neil, Potts, Christopher, Hashimoto, Tatsunori |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Pretraining Data Using Perplexity Correlations
par: Thrush, Tristan, et autres
Publié: (2024)
par: Thrush, Tristan, et autres
Publié: (2024)
Synthetic continued pretraining
par: Yang, Zitong, et autres
Publié: (2024)
par: Yang, Zitong, et autres
Publié: (2024)
Linguistic Calibration of Long-Form Generations
par: Band, Neil, et autres
Publié: (2024)
par: Band, Neil, et autres
Publié: (2024)
Reasoning to Learn from Latent Thoughts
par: Ruan, Yangjun, et autres
Publié: (2025)
par: Ruan, Yangjun, et autres
Publié: (2025)
I am a Strange Dataset: Metalinguistic Tests for Language Models
par: Thrush, Tristan, et autres
Publié: (2024)
par: Thrush, Tristan, et autres
Publié: (2024)
Language Models with Conformal Factuality Guarantees
par: Mohri, Christopher, et autres
Publié: (2024)
par: Mohri, Christopher, et autres
Publié: (2024)
Synthetic bootstrapped pretraining
par: Yang, Zitong, et autres
Publié: (2025)
par: Yang, Zitong, et autres
Publié: (2025)
Benchmarking Distributional Alignment of Large Language Models
par: Meister, Nicole, et autres
Publié: (2024)
par: Meister, Nicole, et autres
Publié: (2024)
Nearest Neighbor Normalization Improves Multimodal Retrieval
par: Chowdhury, Neil, et autres
Publié: (2024)
par: Chowdhury, Neil, et autres
Publié: (2024)
Observational Scaling Laws and the Predictability of Language Model Performance
par: Ruan, Yangjun, et autres
Publié: (2024)
par: Ruan, Yangjun, et autres
Publié: (2024)
Decrypting Cryptic Crosswords: Semantically Complex Wordplay Puzzles as a Target for NLP
par: Rozner, Josh, et autres
Publié: (2021)
par: Rozner, Josh, et autres
Publié: (2021)
A Bitter Lesson for Data Filtering
par: Mohri, Christopher, et autres
Publié: (2026)
par: Mohri, Christopher, et autres
Publié: (2026)
Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators
par: Dubois, Yann, et autres
Publié: (2024)
par: Dubois, Yann, et autres
Publié: (2024)
Removing RLHF Protections in GPT-4 via Fine-Tuning
par: Zhan, Qiusi, et autres
Publié: (2023)
par: Zhan, Qiusi, et autres
Publié: (2023)
Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers
par: Si, Chenglei, et autres
Publié: (2024)
par: Si, Chenglei, et autres
Publié: (2024)
The Ideation-Execution Gap: Execution Outcomes of LLM-Generated versus Human Research Ideas
par: Si, Chenglei, et autres
Publié: (2025)
par: Si, Chenglei, et autres
Publié: (2025)
Agentic Adversarial QA for Improving Domain-Specific LLMs
par: Grari, Vincent, et autres
Publié: (2026)
par: Grari, Vincent, et autres
Publié: (2026)
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
par: Jiang, Mingjian, et autres
Publié: (2024)
par: Jiang, Mingjian, et autres
Publié: (2024)
Eliciting Language Model Behaviors with Investigator Agents
par: Li, Xiang Lisa, et autres
Publié: (2025)
par: Li, Xiang Lisa, et autres
Publié: (2025)
FSPO: Few-Shot Optimization of Synthetic Preferences Personalizes to Real Users
par: Singh, Anikait, et autres
Publié: (2025)
par: Singh, Anikait, et autres
Publié: (2025)
TARGA: Targeted Synthetic Data Generation for Practical Reasoning over Structured Data
par: Huang, Xiang, et autres
Publié: (2024)
par: Huang, Xiang, et autres
Publié: (2024)
Counterfactual Simulation Training for Chain-of-Thought Faithfulness
par: Hase, Peter, et autres
Publié: (2026)
par: Hase, Peter, et autres
Publié: (2026)
PILOT: Steering Synthetic Data Generation with Psychological & Linguistic Output Targeting
par: Cisar, Caitlin, et autres
Publié: (2025)
par: Cisar, Caitlin, et autres
Publié: (2025)
ChatLang-8: An LLM-Based Synthetic Data Generation Framework for Grammatical Error Correction
par: Park, Jeiyoon, et autres
Publié: (2024)
par: Park, Jeiyoon, et autres
Publié: (2024)
Towards Execution-Grounded Automated AI Research
par: Si, Chenglei, et autres
Publié: (2026)
par: Si, Chenglei, et autres
Publié: (2026)
LongCodeBench: Evaluating Coding LLMs at 1M Context Windows
par: Rando, Stefano, et autres
Publié: (2025)
par: Rando, Stefano, et autres
Publié: (2025)
Causal Interventions Reveal Shared Structure Across English Filler-Gap Constructions
par: Boguraev, Sasha, et autres
Publié: (2025)
par: Boguraev, Sasha, et autres
Publié: (2025)
s1: Simple test-time scaling
par: Muennighoff, Niklas, et autres
Publié: (2025)
par: Muennighoff, Niklas, et autres
Publié: (2025)
Retrieval Augmented Spelling Correction for E-Commerce Applications
par: Guo, Xuan, et autres
Publié: (2024)
par: Guo, Xuan, et autres
Publié: (2024)
Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together
par: Soylu, Dilara, et autres
Publié: (2024)
par: Soylu, Dilara, et autres
Publié: (2024)
Mechanistic evaluation of Transformers and state space models
par: Arora, Aryaman, et autres
Publié: (2025)
par: Arora, Aryaman, et autres
Publié: (2025)
Scaling Laws of Synthetic Data for Language Models
par: Qin, Zeyu, et autres
Publié: (2025)
par: Qin, Zeyu, et autres
Publié: (2025)
Can we Evaluate RAGs with Synthetic Data?
par: van Elburg, Jonas, et autres
Publié: (2025)
par: van Elburg, Jonas, et autres
Publié: (2025)
CircuitSynth: Reliable Synthetic Data Generation
par: Cheng, Zehua, et autres
Publié: (2026)
par: Cheng, Zehua, et autres
Publié: (2026)
OptiMUS-0.3: Using Large Language Models to Model and Solve Optimization Problems at Scale
par: AhmadiTeshnizi, Ali, et autres
Publié: (2024)
par: AhmadiTeshnizi, Ali, et autres
Publié: (2024)
LLM See, LLM Do: Guiding Data Generation to Target Non-Differentiable Objectives
par: Shimabucoro, Luísa, et autres
Publié: (2024)
par: Shimabucoro, Luísa, et autres
Publié: (2024)
What's in an embedding? Would a rose by any embedding smell as sweet?
par: Venkatasubramanian, Venkat
Publié: (2024)
par: Venkatasubramanian, Venkat
Publié: (2024)
Synthetic Data Generation & Multi-Step RL for Reasoning & Tool Use
par: Goldie, Anna, et autres
Publié: (2025)
par: Goldie, Anna, et autres
Publié: (2025)
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
par: Ruan, Yangjun, et autres
Publié: (2023)
par: Ruan, Yangjun, et autres
Publié: (2023)
AlpacaFarm: A Simulation Framework for Methods that Learn from Human Feedback
par: Dubois, Yann, et autres
Publié: (2023)
par: Dubois, Yann, et autres
Publié: (2023)
Documents similaires
-
Improving Pretraining Data Using Perplexity Correlations
par: Thrush, Tristan, et autres
Publié: (2024) -
Synthetic continued pretraining
par: Yang, Zitong, et autres
Publié: (2024) -
Linguistic Calibration of Long-Form Generations
par: Band, Neil, et autres
Publié: (2024) -
Reasoning to Learn from Latent Thoughts
par: Ruan, Yangjun, et autres
Publié: (2025) -
I am a Strange Dataset: Metalinguistic Tests for Language Models
par: Thrush, Tristan, et autres
Publié: (2024)