OpenThoughts: Data Recipes for Reasoning Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guha, Etash, Marten, Ryan, Keh, Sedrick, Raoof, Negin, Smyrnis, Georgios, Bansal, Hritik, Nezhurina, Marianna, Mercat, Jean, Vu, Trung, Sprague, Zayne, Suvarna, Ashima, Feuer, Benjamin, Chen, Liangyu, Khan, Zaid, Frankel, Eric, Grover, Sachin, Choi, Caroline, Muennighoff, Niklas, Su, Shiye, Zhao, Wanjia, Yang, John, Pimpalgaonkar, Shreyas, Sharma, Kartik, Ji, Charlie Cheng-Jie, Deng, Yichuan, Pratt, Sarah, Ramanujan, Vivek, Saad-Falcon, Jon, Li, Jeffrey, Dave, Achal, Albalak, Alon, Arora, Kushal, Wulfe, Blake, Hegde, Chinmay, Durrett, Greg, Oh, Sewoong, Bansal, Mohit, Gabriel, Saadia, Grover, Aditya, Chang, Kai-Wei, Shankar, Vaishaal, Gokaslan, Aaron, Merrill, Mike A., Hashimoto, Tatsunori, Choi, Yejin, Jitsev, Jenia, Heckel, Reinhard, Sathiamoorthy, Maheswaran, Dimakis, Alexandros G., Schmidt, Ludwig |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
par: Bansal, Hritik, et autres
Publié: (2023)
par: Bansal, Hritik, et autres
Publié: (2023)
Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
par: Cipolina-Kun, Lucia, et autres
Publié: (2025)
par: Cipolina-Kun, Lucia, et autres
Publié: (2025)
Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
par: Nezhurina, Marianna, et autres
Publié: (2024)
par: Nezhurina, Marianna, et autres
Publié: (2024)
SkillFactory: Self-Distillation For Learning Cognitive Behaviors
par: Sprague, Zayne, et autres
Publié: (2025)
par: Sprague, Zayne, et autres
Publié: (2025)
MedMax: Mixed-Modal Instruction Tuning for Training Biomedical Assistants
par: Bansal, Hritik, et autres
Publié: (2024)
par: Bansal, Hritik, et autres
Publié: (2024)
Language models scale reliably with over-training and on downstream tasks
par: Gadre, Samir Yitzhak, et autres
Publié: (2024)
par: Gadre, Samir Yitzhak, et autres
Publié: (2024)
TALC: Time-Aligned Captions for Multi-Scene Text-to-Video Generation
par: Bansal, Hritik, et autres
Publié: (2024)
par: Bansal, Hritik, et autres
Publié: (2024)
Comparing Bad Apples to Good Oranges: Aligning Large Language Models via Joint Preference Optimization
par: Bansal, Hritik, et autres
Publié: (2024)
par: Bansal, Hritik, et autres
Publié: (2024)
VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation
par: Bansal, Hritik, et autres
Publié: (2025)
par: Bansal, Hritik, et autres
Publié: (2025)
Peeking Behind Closed Doors: Risks of LLM Evaluation by Private Data Curators
par: Bansal, Hritik, et autres
Publié: (2025)
par: Bansal, Hritik, et autres
Publié: (2025)
Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets
par: Nezhurina, Marianna, et autres
Publié: (2025)
par: Nezhurina, Marianna, et autres
Publié: (2025)
Learning in Compact Spaces with Approximately Normalized Transformer
par: Franke, Jörg K. H., et autres
Publié: (2025)
par: Franke, Jörg K. H., et autres
Publié: (2025)
Linearizing Large Language Models
par: Mercat, Jean, et autres
Publié: (2024)
par: Mercat, Jean, et autres
Publié: (2024)
When To Solve, When To Verify: Compute-Optimal Problem Solving and Generative Verification for LLM Reasoning
par: Singhi, Nishad, et autres
Publié: (2025)
par: Singhi, Nishad, et autres
Publié: (2025)
Open-sci-ref-0.01: open and reproducible reference baselines for language model and dataset comparison
par: Nezhurina, Marianna, et autres
Publié: (2025)
par: Nezhurina, Marianna, et autres
Publié: (2025)
VLA Foundry: A Unified Framework for Training Vision-Language-Action Models
par: Mercat, Jean, et autres
Publié: (2026)
par: Mercat, Jean, et autres
Publié: (2026)
HoneyBee: Data Recipes for Vision-Language Reasoners
par: Bansal, Hritik, et autres
Publié: (2025)
par: Bansal, Hritik, et autres
Publié: (2025)
Scaling transformer neural networks for skillful and reliable medium-range weather forecasting
par: Nguyen, Tung, et autres
Publié: (2023)
par: Nguyen, Tung, et autres
Publié: (2023)
AudioToolAgent: An Agentic Framework for Audio-Language Models
par: Wijngaard, Gijs, et autres
Publié: (2025)
par: Wijngaard, Gijs, et autres
Publié: (2025)
DataComp-LM: In search of the next generation of training sets for language models
par: Li, Jeffrey, et autres
Publié: (2024)
par: Li, Jeffrey, et autres
Publié: (2024)
Word frequency and sentiment analysis of twitter messages during Coronavirus pandemic
par: Rajput, Nikhil Kumar, et autres
Publié: (2020)
par: Rajput, Nikhil Kumar, et autres
Publié: (2020)
LaViDa: A Large Diffusion Language Model for Multimodal Understanding
par: Li, Shufan, et autres
Publié: (2025)
par: Li, Shufan, et autres
Publié: (2025)
VideoPhy: Evaluating Physical Commonsense for Video Generation
par: Bansal, Hritik, et autres
Publié: (2024)
par: Bansal, Hritik, et autres
Publié: (2024)
ConTextual: Evaluating Context-Sensitive Text-Rich Visual Reasoning in Large Multimodal Models
par: Wadhawan, Rohan, et autres
Publié: (2024)
par: Wadhawan, Rohan, et autres
Publié: (2024)
Resolving Discrepancies in Compute-Optimal Scaling of Language Models
par: Porian, Tomer, et autres
Publié: (2024)
par: Porian, Tomer, et autres
Publié: (2024)
ryangrvr/GRUT-RAI-v1.0: GRUT-RAI v2.0 — Phase IV Canonical Build
par: Ryan Grover
Publié: (2026)
par: Ryan Grover
Publié: (2026)
ryangrvr/GRUT-RAI-v1.0: GRUT I — Final Program Archive and GRUT-RAI v1.0
par: Ryan Grover
Publié: (2026)
par: Ryan Grover
Publié: (2026)
FinRLlama: A Solution to LLM-Engineered Signals Challenge at FinRL Contest 2024
par: Grover, Arnav
Publié: (2025)
par: Grover, Arnav
Publié: (2025)
Reliability Under Randomness: An Empirical Analysis of Sparse and Dense Language Models Across Decoding Temperatures
par: Grover, Kabir
Publié: (2026)
par: Grover, Kabir
Publié: (2026)
Steel City Readers
par: Grover, Mary
Publié: (2023)
par: Grover, Mary
Publié: (2023)
Discussion of Next Generation Models for Subsequent Sports Injuries by Wu Et Al.
par: Rhythm Grover
Publié: (2025)
par: Rhythm Grover
Publié: (2025)
Manual de preparación de proyectos de abastecimiento de agua y saneamiento / Brian Grover, Nicholas Burnett, Michael McGarry
par: Grover, Brian
Publié: (1986)
par: Grover, Brian
Publié: (1986)
The Wage Stop and Restricting Benefit Income in the United Kingdom: Discretion, Wages and Hardship
par: Chris Grover
Publié: (2024)
par: Chris Grover
Publié: (2024)
ABC needs more than letterman / Ronald Grover
par: Grover, Ronald
par: Grover, Ronald
Hierarchical entanglement transitions and hidden area-law sectors in quantum many-body dynamics
par: Grover, Tarun
Publié: (2026)
par: Grover, Tarun
Publié: (2026)
CAMBIOS FISICOQUÍMICOS POR EXPOSICIÓN A LA RADIACIÓN SOLAR EN TUBÉRCULOS DE OXALIS TUBEROSA, “OCA” CULTIVADOS EN BOLIVIA
par: Grover Castañeta
Publié: (2022)
par: Grover Castañeta
Publié: (2022)
MICROPLÁSTICOS: UN CONTAMINANTE QUE CRECE EN TODAS LAS ESFERAS AMBIENTALES, SUS CARACTERÍSTICAS Y POSIBLES RIESGOS PARA LA SALUD PÚBLICA POR EXPOSICIÓN
par: Grover Castañeta
Publié: (2020)
par: Grover Castañeta
Publié: (2020)
Assessing Information Skills Instruction.
par: Grover, Robert
Publié: (1994)
par: Grover, Robert
Publié: (1994)
A Proposed Model for Diagnosing Information Needs.
par: Grover, Robert
Publié: (1993)
par: Grover, Robert
Publié: (1993)
CHARACTERIZATION OF TERPENOIDS FROM PSEUDOGNAPHALIUM GAUDICHAUDIANUM (DC) ANDERB, WIRA-WIRA BY GC/MS, ACTIVE PRINCIPLES WITH POSSIBLE USE IN COVID-19 INFECTION PREVENTION
par: Grover Castañeta
Publié: (2022)
par: Grover Castañeta
Publié: (2022)
Documents similaires
-
Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models
par: Bansal, Hritik, et autres
Publié: (2023) -
Game Reasoning Arena: A Framework and Benchmark for Assessing Reasoning Capabilities of Large Language Models via Game Play
par: Cipolina-Kun, Lucia, et autres
Publié: (2025) -
Alice in Wonderland: Simple Tasks Showing Complete Reasoning Breakdown in State-Of-the-Art Large Language Models
par: Nezhurina, Marianna, et autres
Publié: (2024) -
SkillFactory: Self-Distillation For Learning Cognitive Behaviors
par: Sprague, Zayne, et autres
Publié: (2025) -
MedMax: Mixed-Modal Instruction Tuning for Training Biomedical Assistants
par: Bansal, Hritik, et autres
Publié: (2024)