SCALER:Synthetic Scalable Adaptive Learning Environment for Reasoning
Fuente:
arXiv
Saved in:
| Main Authors: | Xu, Caijun, Xiao, Changyi, Peng, Zhongyuan, Wang, Xinrun, Cao, Yixin |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Reinforcement Learning with Conditional Expectation Reward
by: Xiao, Changyi, et al.
Published: (2026)
by: Xiao, Changyi, et al.
Published: (2026)
CoDiQ: Test-Time Scaling for Controllable Difficult Question Generation
by: Peng, Zhongyuan, et al.
Published: (2026)
by: Peng, Zhongyuan, et al.
Published: (2026)
Complex Logical Query Answering by Calibrating Knowledge Graph Completion Models
by: Xiao, Changyi, et al.
Published: (2024)
by: Xiao, Changyi, et al.
Published: (2024)
Knowledge Graph Completion by Intermediate Variables Regularization
by: Xiao, Changyi, et al.
Published: (2025)
by: Xiao, Changyi, et al.
Published: (2025)
BNPO: Beta Normalization Policy Optimization
by: Xiao, Changyi, et al.
Published: (2025)
by: Xiao, Changyi, et al.
Published: (2025)
Knowledge Graph Embedding by Normalizing Flows
by: Xiao, Changyi, et al.
Published: (2024)
by: Xiao, Changyi, et al.
Published: (2024)
SCALER: SAM-Enhanced Collaborative Learning for Label-Deficient Concealed Object Segmentation
by: He, Chunming, et al.
Published: (2025)
by: He, Chunming, et al.
Published: (2025)
WaferSAGE: Large Language Model-Powered Wafer Defect Analysis via Synthetic Data Generation and Rubric-Guided Reinforcement Learning
by: Xu, Ke, et al.
Published: (2026)
by: Xu, Ke, et al.
Published: (2026)
Learning to Ponder: Adaptive Reasoning in Latent Space
by: He, Yixin, et al.
Published: (2025)
by: He, Yixin, et al.
Published: (2025)
Communication-Efficient Federated Learning with Adaptive Compression under Dynamic Bandwidth
by: Zhuansun, Ying, et al.
Published: (2024)
by: Zhuansun, Ying, et al.
Published: (2024)
NEX: Neuron Explore-Exploit Scoring for Label-Free Chain-of-Thought Selection and Model Ranking
by: Chen, Kang, et al.
Published: (2026)
by: Chen, Kang, et al.
Published: (2026)
CLR-Bench: Evaluating Large Language Models in College-level Reasoning
by: Dong, Junnan, et al.
Published: (2024)
by: Dong, Junnan, et al.
Published: (2024)
Real-Time Reasoning Agents in Evolving Environments
by: Wen, Yule, et al.
Published: (2025)
by: Wen, Yule, et al.
Published: (2025)
ReasoningShield: Safety Detection over Reasoning Traces of Large Reasoning Models
by: Li, Changyi, et al.
Published: (2025)
by: Li, Changyi, et al.
Published: (2025)
SwarmSys: Decentralized Swarm-Inspired Agents for Scalable and Adaptive Reasoning
by: Li, Ruohao, et al.
Published: (2025)
by: Li, Ruohao, et al.
Published: (2025)
Meaningful Learning: Enhancing Abstract Reasoning in Large Language Models via Generic Fact Guidance
by: Xiong, Kai, et al.
Published: (2024)
by: Xiong, Kai, et al.
Published: (2024)
MindRef: Mimicking Human Memory for Hierarchical Reference Retrieval with Fine-Grained Location Awareness
by: Wang, Ye, et al.
Published: (2024)
by: Wang, Ye, et al.
Published: (2024)
Reasoning Core: A Scalable RL Environment for LLM Symbolic Reasoning
by: Lacombe, Valentin, et al.
Published: (2025)
by: Lacombe, Valentin, et al.
Published: (2025)
A Multi-constraint and Multi-objective Allocation Model for Emergency Rescue in IoT Environment
by: Xu, Xinrun, et al.
Published: (2024)
by: Xu, Xinrun, et al.
Published: (2024)
True Knowledge Comes from Practice: Aligning LLMs with Embodied Environments via Reinforcement Learning
by: Tan, Weihao, et al.
Published: (2024)
by: Tan, Weihao, et al.
Published: (2024)
ARM: Role-Conditioned Neuron Transplantation for Training-Free Generalist LLM Agent Merging
by: Feng, Zhuoka, et al.
Published: (2026)
by: Feng, Zhuoka, et al.
Published: (2026)
ReSyn: Autonomously Scaling Synthetic Environments for Reasoning Models
by: He, Andre, et al.
Published: (2026)
by: He, Andre, et al.
Published: (2026)
SliceGraph: Mapping Process Isomers in Multi-Run Chain-of-Thought Reasoning
by: Chen, Kang, et al.
Published: (2026)
by: Chen, Kang, et al.
Published: (2026)
SynAdapt: Learning Adaptive Reasoning in Large Language Models via Synthetic Continuous Chain-of-Thought
by: Wang, Jianwei, et al.
Published: (2025)
by: Wang, Jianwei, et al.
Published: (2025)
LLM-based Automated Theorem Proving Hinges on Scalable Synthetic Data Generation
by: Lai, Junyu, et al.
Published: (2025)
by: Lai, Junyu, et al.
Published: (2025)
LLM-Based World Models Can Make Decisions Solely, But Rigorous Evaluations are Needed
by: Yang, Chang, et al.
Published: (2024)
by: Yang, Chang, et al.
Published: (2024)
Making Mathematical Reasoning Adaptive
by: Lai, Zhejian, et al.
Published: (2025)
by: Lai, Zhejian, et al.
Published: (2025)
Synapse: Trajectory-as-Exemplar Prompting with Memory for Computer Control
by: Zheng, Longtao, et al.
Published: (2023)
by: Zheng, Longtao, et al.
Published: (2023)
AutoControl Arena: Synthesizing Executable Test Environments for Frontier AI Risk Evaluation
by: Li, Changyi, et al.
Published: (2026)
by: Li, Changyi, et al.
Published: (2026)
DeepPHY: Benchmarking Agentic VLMs on Physical Reasoning
by: Xu, Xinrun, et al.
Published: (2025)
by: Xu, Xinrun, et al.
Published: (2025)
Kron-LoRA: Hybrid Kronecker-LoRA Adapters for Scalable, Sustainable Fine-tuning
by: Shen, Yixin
Published: (2025)
by: Shen, Yixin
Published: (2025)
GGBench: A Geometric Generative Reasoning Benchmark for Unified Multimodal Models
by: Wei, Jingxuan, et al.
Published: (2025)
by: Wei, Jingxuan, et al.
Published: (2025)
GDBA Revisited: Unleashing the Power of Guided Local Search for Distributed Constraint Optimization
by: Deng, Yanchen, et al.
Published: (2025)
by: Deng, Yanchen, et al.
Published: (2025)
Agent World Model: Infinity Synthetic Environments for Agentic Reinforcement Learning
by: Wang, Zhaoyang, et al.
Published: (2026)
by: Wang, Zhaoyang, et al.
Published: (2026)
DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model
by: Hong, Shibo, et al.
Published: (2026)
by: Hong, Shibo, et al.
Published: (2026)
Heterogeneous Adversarial Play in Interactive Environments
by: Xu, Manjie, et al.
Published: (2025)
by: Xu, Manjie, et al.
Published: (2025)
MedAgentGym: A Scalable Agentic Training Environment for Code-Centric Reasoning in Biomedical Data Science
by: Xu, Ran, et al.
Published: (2025)
by: Xu, Ran, et al.
Published: (2025)
Scalable Option Learning in High-Throughput Environments
by: Henaff, Mikael, et al.
Published: (2025)
by: Henaff, Mikael, et al.
Published: (2025)
Learning from Reasoning Failures via Synthetic Data Generation
by: Stan, Gabriela Ben Melech, et al.
Published: (2025)
by: Stan, Gabriela Ben Melech, et al.
Published: (2025)
Raising the Bar in Graph OOD Generalization: Invariant Learning Beyond Explicit Environment Modeling
by: Shen, Xu, et al.
Published: (2025)
by: Shen, Xu, et al.
Published: (2025)
Similar Items
-
Reinforcement Learning with Conditional Expectation Reward
by: Xiao, Changyi, et al.
Published: (2026) -
CoDiQ: Test-Time Scaling for Controllable Difficult Question Generation
by: Peng, Zhongyuan, et al.
Published: (2026) -
Complex Logical Query Answering by Calibrating Knowledge Graph Completion Models
by: Xiao, Changyi, et al.
Published: (2024) -
Knowledge Graph Completion by Intermediate Variables Regularization
by: Xiao, Changyi, et al.
Published: (2025) -
BNPO: Beta Normalization Policy Optimization
by: Xiao, Changyi, et al.
Published: (2025)