FrontierSmith: Synthesizing Open-Ended Coding Problems at Scale
Fuente:
arXiv
Guardado en:
| Autores principales: | He, Runyuan, Mang, Qiuyang, Zhou, Shang, Liu, Kaiyuan, Li, Hanchen, Mao, Huanzhi, Zhang, Qizheng, Li, Zerui, Peng, Bo, Cheng, Lufeng, Fu, Tianfu, Wang, Yichuan, Chai, Wenhao, Shang, Jingbo, Dimakis, Alex, Gonzalez, Joseph E., Cheung, Alvin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation
por: Zhou, Shang, et al.
Publicado: (2026)
por: Zhou, Shang, et al.
Publicado: (2026)
Continuum: Efficient and Robust Multi-Turn LLM Agent Scheduling with KV Cache Time-to-Live
por: Li, Hanchen, et al.
Publicado: (2025)
por: Li, Hanchen, et al.
Publicado: (2025)
PLOP: Cost-Based Placement of Semantic Operators in Hybrid Query Plans
por: Mang, Qiuyang, et al.
Publicado: (2026)
por: Mang, Qiuyang, et al.
Publicado: (2026)
FrontierCS: Evolving Challenges for Evolving Intelligence
por: Mang, Qiuyang, et al.
Publicado: (2025)
por: Mang, Qiuyang, et al.
Publicado: (2025)
Automated Discovery of Test Oracles for Database Management Systems Using LLMs
por: Mang, Qiuyang, et al.
Publicado: (2025)
por: Mang, Qiuyang, et al.
Publicado: (2025)
Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
AutoCode: LLMs as Problem Setters for Competitive Programming
por: Zhou, Shang, et al.
Publicado: (2025)
por: Zhou, Shang, et al.
Publicado: (2025)
Combee: Scaling Prompt Learning for Self-Improving Language Model Agents
por: Li, Hanchen, et al.
Publicado: (2026)
por: Li, Hanchen, et al.
Publicado: (2026)
SVG-EAR: Parameter-Free Linear Compensation for Sparse Video Generation via Error-aware Routing
por: Zhou, Xuanyi, et al.
Publicado: (2026)
por: Zhou, Xuanyi, et al.
Publicado: (2026)
Investigating Public Fine-Tuning Datasets: A Complex Review of Current Practices from a Construction Perspective
por: Ma, Runyuan, et al.
Publicado: (2024)
por: Ma, Runyuan, et al.
Publicado: (2024)
Playing Psychic: Using Thought Trees to Predict Reasoning Models Accuracy on Coding Tasks
por: Fang, Jiaxin, et al.
Publicado: (2026)
por: Fang, Jiaxin, et al.
Publicado: (2026)
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
por: Zhong, Li, et al.
Publicado: (2024)
por: Zhong, Li, et al.
Publicado: (2024)
READ: Improving Relation Extraction from an ADversarial Perspective
por: Li, Dawei, et al.
Publicado: (2024)
por: Li, Dawei, et al.
Publicado: (2024)
Incubating Text Classifiers Following User Instruction with Nothing but LLM
por: Peng, Letian, et al.
Publicado: (2024)
por: Peng, Letian, et al.
Publicado: (2024)
Quantifying and Optimizing Global Faithfulness in Persona-driven Role-playing
por: Peng, Letian, et al.
Publicado: (2024)
por: Peng, Letian, et al.
Publicado: (2024)
Codifying Character Logic in Role-Playing
por: Peng, Letian, et al.
Publicado: (2025)
por: Peng, Letian, et al.
Publicado: (2025)
Watermarks for Language Models via Probabilistic Automata
por: Wang, Yangkun, et al.
Publicado: (2025)
por: Wang, Yangkun, et al.
Publicado: (2025)
Entangled Relations: Leveraging NLI and Meta-analysis to Enhance Biomedical Relation Extraction
por: Hogan, William, et al.
Publicado: (2024)
por: Hogan, William, et al.
Publicado: (2024)
LiveCodeBench Pro: How Do Olympiad Medalists Judge LLMs in Competitive Programming?
por: Zheng, Zihan, et al.
Publicado: (2025)
por: Zheng, Zihan, et al.
Publicado: (2025)
A Hybrid Controller Design for Human-Assistive Piloting of an Underactuated Blimp
por: Meng, Wugang, et al.
Publicado: (2024)
por: Meng, Wugang, et al.
Publicado: (2024)
The Frontiers in Manufacturing Technologies Initiative and University Innovation
por: Xuan Leng, et al.
Publicado: (2024)
por: Xuan Leng, et al.
Publicado: (2024)
Shangri-La, paraíso terrenal / Liu Huanzhi y Zhang Tao
por: Liu Huanzhi
Publicado: (2008)
por: Liu Huanzhi
Publicado: (2008)
Campesinos buscan una vida modestamente acomodada / Liu Huanzhi
por: Liu Huanzhi
por: Liu Huanzhi
Finding Logic Bugs in Spatial Database Engines via Affine Equivalent Inputs
por: Deng, Wenjing, et al.
Publicado: (2024)
por: Deng, Wenjing, et al.
Publicado: (2024)
Correlation and Navigation in the Vocabulary Key Representation Space of Language Models
por: Peng, Letian, et al.
Publicado: (2024)
por: Peng, Letian, et al.
Publicado: (2024)
EvoX: Meta-Evolution for Automated Discovery
por: Liu, Shu, et al.
Publicado: (2026)
por: Liu, Shu, et al.
Publicado: (2026)
DynamiCare: A Dynamic Multi-Agent Framework for Interactive and Open-Ended Medical Decision-Making
por: Shang, Tianqi, et al.
Publicado: (2025)
por: Shang, Tianqi, et al.
Publicado: (2025)
AuroraLong: Bringing RNNs Back to Efficient Open-Ended Video Understanding
por: Xu, Weili, et al.
Publicado: (2025)
por: Xu, Weili, et al.
Publicado: (2025)
Order Matters: Rethinking Prompt Construction in In-Context Learning
por: Li, Warren, et al.
Publicado: (2025)
por: Li, Warren, et al.
Publicado: (2025)
Hierarchical Auto-Organizing System for Open-Ended Multi-Agent Navigation
por: Zhao, Zhonghan, et al.
Publicado: (2024)
por: Zhao, Zhonghan, et al.
Publicado: (2024)
Toward Student-Oriented Teacher Network Training For Knowledge Distillation
por: Dong, Chengyu, et al.
Publicado: (2022)
por: Dong, Chengyu, et al.
Publicado: (2022)
Smaller Language Models are capable of selecting Instruction-Tuning Training Data for Larger Language Models
por: Mekala, Dheeraj, et al.
Publicado: (2024)
por: Mekala, Dheeraj, et al.
Publicado: (2024)
UltraGen: Extremely Fine-grained Controllable Generation via Attribute Reconstruction and Global Preference Optimization
por: Yun, Longfei, et al.
Publicado: (2025)
por: Yun, Longfei, et al.
Publicado: (2025)
Controllable Data Augmentation for Few-Shot Text Mining with Chain-of-Thought Attribute Manipulation
por: Peng, Letian, et al.
Publicado: (2023)
por: Peng, Letian, et al.
Publicado: (2023)
Evaluating the Smooth Control of Attribute Intensity in Text Generation with LLMs
por: Zhou, Shang, et al.
Publicado: (2024)
por: Zhou, Shang, et al.
Publicado: (2024)
DNAMotifTokenizer: Towards Biologically Informed Tokenization of Genomic Sequences
por: Zhou, Xiaoxiao, et al.
Publicado: (2025)
por: Zhou, Xiaoxiao, et al.
Publicado: (2025)
Nearly Optimal Internal Dictionary Matching
por: Chen, Jingbang, et al.
Publicado: (2023)
por: Chen, Jingbang, et al.
Publicado: (2023)
Assertion-Conditioned Compliance: A Provenance-Aware Vulnerability in Multi-Turn Tool-Calling Agents
por: Waqas, Daud, et al.
Publicado: (2025)
por: Waqas, Daud, et al.
Publicado: (2025)
Time operator from parametrization invariance and implications for cosmology
por: Dimakis, N.
Publicado: (2025)
por: Dimakis, N.
Publicado: (2025)
The moduli space of solutions to the Extended Bogomolny equations on $Σ\times \mathbb{R_+}$
por: Dimakis, Panagiotis
Publicado: (2024)
por: Dimakis, Panagiotis
Publicado: (2024)
Ejemplares similares
-
OpenDeepThink: Parallel Reasoning via Bradley-Terry Aggregation
por: Zhou, Shang, et al.
Publicado: (2026) -
Continuum: Efficient and Robust Multi-Turn LLM Agent Scheduling with KV Cache Time-to-Live
por: Li, Hanchen, et al.
Publicado: (2025) -
PLOP: Cost-Based Placement of Semantic Operators in Hybrid Query Plans
por: Mang, Qiuyang, et al.
Publicado: (2026) -
FrontierCS: Evolving Challenges for Evolving Intelligence
por: Mang, Qiuyang, et al.
Publicado: (2025) -
Automated Discovery of Test Oracles for Database Management Systems Using LLMs
por: Mang, Qiuyang, et al.
Publicado: (2025)