Infinite Problem Generator: Verifiably Scaling Physics Reasoning Data with Agentic Workflows
Fuente:
arXiv
Salvato in:
| Autori principali: | Sharan, Aditya, Hebbale, Sriram, Kumar, Dhruv |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Evaluating Novelty in AI-Generated Research Plans Using Multi-Workflow LLM Pipelines
di: Saraogi, Devesh, et al.
Pubblicazione: (2025)
di: Saraogi, Devesh, et al.
Pubblicazione: (2025)
SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond
di: Liu, Junteng, et al.
Pubblicazione: (2025)
di: Liu, Junteng, et al.
Pubblicazione: (2025)
AgentV-RL: Scaling Reward Modeling with Agentic Verifier
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026)
When To Solve, When To Verify: Compute-Optimal Problem Solving and Generative Verification for LLM Reasoning
di: Singhi, Nishad, et al.
Pubblicazione: (2025)
di: Singhi, Nishad, et al.
Pubblicazione: (2025)
Verifier-Backed Hard Problem Generation for Mathematical Reasoning
di: Lai, Yuhang, et al.
Pubblicazione: (2026)
di: Lai, Yuhang, et al.
Pubblicazione: (2026)
L-MARS: Legal Multi-Agent Workflow with Orchestrated Reasoning and Agentic Search
di: Wang, Ziqi, et al.
Pubblicazione: (2025)
di: Wang, Ziqi, et al.
Pubblicazione: (2025)
Don't Vibe Code, Do Skele-Code: Interactive No-Code Notebooks for Subject Matter Experts to Build Lower-Cost Agentic Workflows
di: Gopalakrishnan, Sriram
Pubblicazione: (2026)
di: Gopalakrishnan, Sriram
Pubblicazione: (2026)
Eliminating Agentic Workflow for Introduction Generation with Parametric Stage Tokens
di: Zhang, Meicong, et al.
Pubblicazione: (2025)
di: Zhang, Meicong, et al.
Pubblicazione: (2025)
AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation
di: Liu, Xianyang, et al.
Pubblicazione: (2025)
di: Liu, Xianyang, et al.
Pubblicazione: (2025)
Ulterior Motives: Detecting Misaligned Reasoning in Continuous Thought Models
di: Ramjee, Sharan
Pubblicazione: (2026)
di: Ramjee, Sharan
Pubblicazione: (2026)
AFlow: Automating Agentic Workflow Generation
di: Zhang, Jiayi, et al.
Pubblicazione: (2024)
di: Zhang, Jiayi, et al.
Pubblicazione: (2024)
A Cloud-based Multi-Agentic Workflow for Science
di: Acharya, Anurag, et al.
Pubblicazione: (2026)
di: Acharya, Anurag, et al.
Pubblicazione: (2026)
Understanding and Optimizing Agentic Workflows via Shapley value
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
Generation Z's Ability to Discriminate Between AI-generated and Human-Authored Text on Discord
di: Ramu, Dhruv, et al.
Pubblicazione: (2023)
di: Ramu, Dhruv, et al.
Pubblicazione: (2023)
Compute Optimal Scaling of Skills: Knowledge vs Reasoning
di: Roberts, Nicholas, et al.
Pubblicazione: (2025)
di: Roberts, Nicholas, et al.
Pubblicazione: (2025)
Benchmarking Agentic Workflow Generation
di: Qiao, Shuofei, et al.
Pubblicazione: (2024)
di: Qiao, Shuofei, et al.
Pubblicazione: (2024)
Enigmata: Scaling Logical Reasoning in Large Language Models with Synthetic Verifiable Puzzles
di: Chen, Jiangjie, et al.
Pubblicazione: (2025)
di: Chen, Jiangjie, et al.
Pubblicazione: (2025)
SEW: Self-Evolving Agentic Workflows for Automated Code Generation
di: Liu, Siwei, et al.
Pubblicazione: (2025)
di: Liu, Siwei, et al.
Pubblicazione: (2025)
A Survey of Frontiers in LLM Reasoning: Inference Scaling, Learning to Reason, and Agentic Systems
di: Ke, Zixuan, et al.
Pubblicazione: (2025)
di: Ke, Zixuan, et al.
Pubblicazione: (2025)
AgentCompass: Towards Reliable Evaluation of Agentic Workflows in Production
di: Kartik, NVJK, et al.
Pubblicazione: (2025)
di: Kartik, NVJK, et al.
Pubblicazione: (2025)
AgentXRay: White-Boxing Agentic Systems via Workflow Reconstruction
di: Shi, Ruijie, et al.
Pubblicazione: (2026)
di: Shi, Ruijie, et al.
Pubblicazione: (2026)
DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
di: Zhang, Yinger, et al.
Pubblicazione: (2026)
Agentic Reasoning: A Streamlined Framework for Enhancing LLM Reasoning with Agentic Tools
di: Wu, Junde, et al.
Pubblicazione: (2025)
di: Wu, Junde, et al.
Pubblicazione: (2025)
On Time, Within Budget: Constraint-Driven Online Resource Allocation for Agentic Workflows
di: Wang, Xinglin, et al.
Pubblicazione: (2026)
di: Wang, Xinglin, et al.
Pubblicazione: (2026)
AstroReason-Bench: Evaluating Unified Agentic Planning across Heterogeneous Space Planning Problems
di: Wang, Weiyi, et al.
Pubblicazione: (2026)
di: Wang, Weiyi, et al.
Pubblicazione: (2026)
ScribeAgent: Towards Specialized Web Agents Using Production-Scale Workflow Data
di: Shen, Junhong, et al.
Pubblicazione: (2024)
di: Shen, Junhong, et al.
Pubblicazione: (2024)
Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards
di: Lara, Luis, et al.
Pubblicazione: (2026)
di: Lara, Luis, et al.
Pubblicazione: (2026)
Reason Like a Radiologist: Chain-of-Thought and Reinforcement Learning for Verifiable Report Generation
di: Jing, Peiyuan, et al.
Pubblicazione: (2025)
di: Jing, Peiyuan, et al.
Pubblicazione: (2025)
Generative Universal Verifier as Multimodal Meta-Reasoner
di: Zhang, Xinchen, et al.
Pubblicazione: (2025)
di: Zhang, Xinchen, et al.
Pubblicazione: (2025)
CopT: Contrastive On-Policy Thinking with Continuous Spaces for General and Agentic Reasoning
di: Shi, Dachuan, et al.
Pubblicazione: (2026)
di: Shi, Dachuan, et al.
Pubblicazione: (2026)
DeepMath-103K: A Large-Scale, Challenging, Decontaminated, and Verifiable Mathematical Dataset for Advancing Reasoning
di: He, Zhiwei, et al.
Pubblicazione: (2025)
di: He, Zhiwei, et al.
Pubblicazione: (2025)
TrustGeoGen: Formal-Verified Data Engine for Trustworthy Multi-modal Geometric Problem Solving
di: Fu, Daocheng, et al.
Pubblicazione: (2025)
di: Fu, Daocheng, et al.
Pubblicazione: (2025)
Logic-Regularized Verifier Elicits Reasoning from LLMs
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
Agentic Reasoning for Large Language Models
di: Wei, Tianxin, et al.
Pubblicazione: (2026)
di: Wei, Tianxin, et al.
Pubblicazione: (2026)
HARMON-E: Hierarchical Agentic Reasoning for Multimodal Oncology Notes to Extract Structured Data
di: Gupta, Shashi Kant, et al.
Pubblicazione: (2025)
di: Gupta, Shashi Kant, et al.
Pubblicazione: (2025)
RL Tango: Reinforcing Generator and Verifier Together for Language Reasoning
di: Zha, Kaiwen, et al.
Pubblicazione: (2025)
di: Zha, Kaiwen, et al.
Pubblicazione: (2025)
Agentic Reward Modeling: Integrating Human Preferences with Verifiable Correctness Signals for Reliable Reward Systems
di: Peng, Hao, et al.
Pubblicazione: (2025)
di: Peng, Hao, et al.
Pubblicazione: (2025)
LAW: Legal Agentic Workflows for Custody and Fund Services Contracts
di: Watson, William, et al.
Pubblicazione: (2024)
di: Watson, William, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Evaluating Novelty in AI-Generated Research Plans Using Multi-Workflow LLM Pipelines
di: Saraogi, Devesh, et al.
Pubblicazione: (2025) -
SynLogic: Synthesizing Verifiable Reasoning Data at Scale for Learning Logical Reasoning and Beyond
di: Liu, Junteng, et al.
Pubblicazione: (2025) -
AgentV-RL: Scaling Reward Modeling with Agentic Verifier
di: Zhang, Jiazheng, et al.
Pubblicazione: (2026) -
When To Solve, When To Verify: Compute-Optimal Problem Solving and Generative Verification for LLM Reasoning
di: Singhi, Nishad, et al.
Pubblicazione: (2025) -
Verifier-Backed Hard Problem Generation for Mathematical Reasoning
di: Lai, Yuhang, et al.
Pubblicazione: (2026)