Population-Evolve: a Parallel Sampling and Evolutionary Method for LLM Math Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yanzhi, Duan, Yitong, Zhang, Zhaoxi, He, Jiyan, Zheng, Shuxin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
No Free Lunch: Rethinking Internal Feedback for LLM Reasoning
par: Zhang, Yanzhi, et autres
Publié: (2025)
par: Zhang, Yanzhi, et autres
Publié: (2025)
Harnessing Pre-Resolution Signals for Future Prediction Agents
par: Wei, Chuyang, et autres
Publié: (2026)
par: Wei, Chuyang, et autres
Publié: (2026)
FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards
par: Han, Zhixin, et autres
Publié: (2026)
par: Han, Zhixin, et autres
Publié: (2026)
GTM: Simulating the World of Tools for AI Agents
par: Ren, Zhenzhen, et autres
Publié: (2025)
par: Ren, Zhenzhen, et autres
Publié: (2025)
Towards Generalist Prompting for Large Language Models by Mental Models
par: Guan, Haoxiang, et autres
Publié: (2024)
par: Guan, Haoxiang, et autres
Publié: (2024)
EvolMathEval: Towards Evolvable Benchmarks for Mathematical Reasoning via Evolutionary Testing
par: Wang, Shengbo, et autres
Publié: (2025)
par: Wang, Shengbo, et autres
Publié: (2025)
PopuLoRA: Co-Evolving LLM Populations for Reasoning Self-Play
par: Castanyer, Roger Creus, et autres
Publié: (2026)
par: Castanyer, Roger Creus, et autres
Publié: (2026)
Seirênes: Adversarial Self-Play with Evolving Distractions for LLM Reasoning
par: Zhang, Chi, et autres
Publié: (2026)
par: Zhang, Chi, et autres
Publié: (2026)
Does Math Reasoning Improve General LLM Capabilities? Understanding Transferability of LLM Reasoning
par: Huan, Maggie, et autres
Publié: (2025)
par: Huan, Maggie, et autres
Publié: (2025)
Can a Lightweight Automated AI Pipeline Solve Research-Level Mathematical Problems?
par: Meng, Lve, et autres
Publié: (2026)
par: Meng, Lve, et autres
Publié: (2026)
MathConstruct: Challenging LLM Reasoning with Constructive Proofs
par: Balunović, Mislav, et autres
Publié: (2025)
par: Balunović, Mislav, et autres
Publié: (2025)
Let's Reason Formally: Natural-Formal Hybrid Reasoning Enhances LLM's Math Capability
par: Wang, Ruida, et autres
Publié: (2025)
par: Wang, Ruida, et autres
Publié: (2025)
Self-Evolving Curriculum for LLM Reasoning
par: Chen, Xiaoyin, et autres
Publié: (2025)
par: Chen, Xiaoyin, et autres
Publié: (2025)
Multi-tool Integration Application for Math Reasoning Using Large Language Model
par: Duan, Zhihua, et autres
Publié: (2024)
par: Duan, Zhihua, et autres
Publié: (2024)
GUIGuard-Bench: Toward a General Evaluation for Privacy-Preserving GUI Agents
par: Wang, Yanxi, et autres
Publié: (2026)
par: Wang, Yanxi, et autres
Publié: (2026)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
par: Pang, Bo, et autres
Publié: (2025)
par: Pang, Bo, et autres
Publié: (2025)
Navigating the Alpha Jungle: An LLM-Powered MCTS Framework for Formulaic Factor Mining
par: Shi, Yu, et autres
Publié: (2025)
par: Shi, Yu, et autres
Publié: (2025)
AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation
par: Liu, Xianyang, et autres
Publié: (2025)
par: Liu, Xianyang, et autres
Publié: (2025)
Genesis: Evolving Attack Strategies for LLM Web Agent Red-Teaming
par: Zhang, Zheng, et autres
Publié: (2025)
par: Zhang, Zheng, et autres
Publié: (2025)
Dynamic Parallel Tree Search for Efficient LLM Reasoning
par: Ding, Yifu, et autres
Publié: (2025)
par: Ding, Yifu, et autres
Publié: (2025)
Making Databases Faster with LLM Evolutionary Sampling
par: Erol, Mehmet Hamza, et autres
Publié: (2026)
par: Erol, Mehmet Hamza, et autres
Publié: (2026)
Neuro-Symbolic Data Generation for Math Reasoning
par: Li, Zenan, et autres
Publié: (2024)
par: Li, Zenan, et autres
Publié: (2024)
AI-Driven Self-Evolving Software: A Promising Path Toward Software Automation
par: Cai, Liyi, et autres
Publié: (2025)
par: Cai, Liyi, et autres
Publié: (2025)
Evolving, Not Training: Zero-Shot Reasoning Segmentation via Evolutionary Prompting
par: Ye, Kai, et autres
Publié: (2025)
par: Ye, Kai, et autres
Publié: (2025)
MathMixup: Boosting LLM Mathematical Reasoning with Difficulty-Controllable Data Synthesis and Curriculum Learning
par: Li, Xuchen, et autres
Publié: (2026)
par: Li, Xuchen, et autres
Publié: (2026)
CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification
par: Zhang, Hanrong, et autres
Publié: (2026)
par: Zhang, Hanrong, et autres
Publié: (2026)
Integrating Visual Interpretation and Linguistic Reasoning for Math Problem Solving
par: Guo, Zixian, et autres
Publié: (2025)
par: Guo, Zixian, et autres
Publié: (2025)
Character-Level Perturbations Disrupt LLM Watermarks
par: Zhang, Zhaoxi, et autres
Publié: (2025)
par: Zhang, Zhaoxi, et autres
Publié: (2025)
MathChat: Benchmarking Mathematical Reasoning and Instruction Following in Multi-Turn Interactions
par: Liang, Zhenwen, et autres
Publié: (2024)
par: Liang, Zhenwen, et autres
Publié: (2024)
Evolving Benchmark Functions to Compare Evolutionary Algorithms via Genetic Programming
par: He, Yifan, et autres
Publié: (2024)
par: He, Yifan, et autres
Publié: (2024)
Confucius3-Math: A Lightweight High-Performance Reasoning LLM for Chinese K-12 Mathematics Learning
par: Wu, Lixin, et autres
Publié: (2025)
par: Wu, Lixin, et autres
Publié: (2025)
Graph-Augmented Reasoning: Evolving Step-by-Step Knowledge Graph Retrieval for LLM Reasoning
par: Wu, Wenjie, et autres
Publié: (2025)
par: Wu, Wenjie, et autres
Publié: (2025)
Rethinking Math Reasoning Evaluation: A Robust LLM-as-a-Judge Framework Beyond Symbolic Rigidity
par: Yosef, Erez, et autres
Publié: (2026)
par: Yosef, Erez, et autres
Publié: (2026)
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
par: Li, Chengpeng, et autres
Publié: (2023)
par: Li, Chengpeng, et autres
Publié: (2023)
COEVO: Co-Evolutionary Framework for Joint Functional Correctness and PPA Optimization in LLM-Based RTL Generation
par: Ping, Heng, et autres
Publié: (2026)
par: Ping, Heng, et autres
Publié: (2026)
Data Diversification Methods In Alignment Enhance Math Performance In LLMs
par: Dokmeci, Berkan, et autres
Publié: (2025)
par: Dokmeci, Berkan, et autres
Publié: (2025)
Real-Time Reasoning Agents in Evolving Environments
par: Wen, Yule, et autres
Publié: (2025)
par: Wen, Yule, et autres
Publié: (2025)
BioGraphFusion: Graph Knowledge Embedding for Biological Completion and Reasoning
par: Lin, Yitong, et autres
Publié: (2025)
par: Lin, Yitong, et autres
Publié: (2025)
Large Language Model-Powered Evolutionary Code Optimization on a Phylogenetic Tree
par: Zhao, Leyi, et autres
Publié: (2026)
par: Zhao, Leyi, et autres
Publié: (2026)
MathSE: Improving Multimodal Mathematical Reasoning via Self-Evolving Iterative Reflection and Reward-Guided Fine-Tuning
par: Chen, Jinhao, et autres
Publié: (2025)
par: Chen, Jinhao, et autres
Publié: (2025)
Documents similaires
-
No Free Lunch: Rethinking Internal Feedback for LLM Reasoning
par: Zhang, Yanzhi, et autres
Publié: (2025) -
Harnessing Pre-Resolution Signals for Future Prediction Agents
par: Wei, Chuyang, et autres
Publié: (2026) -
FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards
par: Han, Zhixin, et autres
Publié: (2026) -
GTM: Simulating the World of Tools for AI Agents
par: Ren, Zhenzhen, et autres
Publié: (2025) -
Towards Generalist Prompting for Large Language Models by Mental Models
par: Guan, Haoxiang, et autres
Publié: (2024)