SCOPE: Compress Mathematical Reasoning Steps for Efficient Automated Process Annotation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Huimin, Mao, Xin, Li, Feng-Lin, Wu, Xiaobao, Chen, Wang, Zhang, Wei, Luu, Anh Tuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unsupervised Hallucination Detection by Inspecting Reasoning Processes
par: Srey, Ponhvoan, et autres
Publié: (2025)
par: Srey, Ponhvoan, et autres
Publié: (2025)
Full-Step-DPO: Self-Supervised Preference Optimization with Step-wise Rewards for Mathematical Reasoning
par: Xu, Huimin, et autres
Publié: (2025)
par: Xu, Huimin, et autres
Publié: (2025)
Understanding and Preventing Entropy Collapse in RLVR with On-Policy Entropy Flow Optimization
par: Xu, Huimin, et autres
Publié: (2026)
par: Xu, Huimin, et autres
Publié: (2026)
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
par: Mao, Xin, et autres
Publié: (2024)
par: Mao, Xin, et autres
Publié: (2024)
A Survey on Neural Topic Models: Methods, Applications, and Challenges
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
Towards the TopMost: A Topic Modeling System Toolkit
par: Wu, Xiaobao, et autres
Publié: (2023)
par: Wu, Xiaobao, et autres
Publié: (2023)
Towards Reliable Truth-Aligned Uncertainty Estimation in Large Language Models
par: Srey, Ponhvoan, et autres
Publié: (2026)
par: Srey, Ponhvoan, et autres
Publié: (2026)
AKEW: Assessing Knowledge Editing in the Wild
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
Learning Uncertainty from Sequential Internal Dispersion in Large Language Models
par: Srey, Ponhvoan, et autres
Publié: (2026)
par: Srey, Ponhvoan, et autres
Publié: (2026)
Modeling Dynamic Topics in Chain-Free Fashion by Evolution-Tracking Contrastive Learning and Unassociated Word Exclusion
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
Aspect-Based Summarization with Self-Aspect Retrieval Enhanced Generation
par: Feng, Yichao, et autres
Publié: (2025)
par: Feng, Yichao, et autres
Publié: (2025)
FASTopic: Pretrained Transformer is a Fast, Adaptive, Stable, and Transferable Topic Model
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
OrchMAS: Orchestrated Reasoning with Multi Collaborative Heterogeneous Scientific Expert Structured Agents
par: Feng, Yichao, et autres
Publié: (2026)
par: Feng, Yichao, et autres
Publié: (2026)
SSPO: Self-traced Step-wise Preference Optimization for Process Supervision and Reasoning Compression
par: Xu, Yuyang, et autres
Publié: (2025)
par: Xu, Yuyang, et autres
Publié: (2025)
Unlearning Backdoor Attacks for LLMs with Weak-to-Strong Knowledge Distillation
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
P2P: A Poison-to-Poison Remedy for Reliable Backdoor Defense in LLMs
par: Zhao, Shuai, et autres
Publié: (2025)
par: Zhao, Shuai, et autres
Publié: (2025)
Enhancing Multimodal Entity Linking with Jaccard Distance-based Conditional Contrastive Learning and Contextual Visual Augmentation
par: Nguyen, Cong-Duy, et autres
Publié: (2025)
par: Nguyen, Cong-Duy, et autres
Publié: (2025)
Rethinking Reasoning: A Survey on Reasoning-based Backdoors in LLMs
par: Hu, Man, et autres
Publié: (2025)
par: Hu, Man, et autres
Publié: (2025)
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
par: Chia, Yew Ken, et autres
Publié: (2024)
par: Chia, Yew Ken, et autres
Publié: (2024)
SCOPE: A Generative Approach for LLM Prompt Compression
par: Zhang, Tinghui, et autres
Publié: (2025)
par: Zhang, Tinghui, et autres
Publié: (2025)
HyperGraphRAG: Retrieval-Augmented Generation via Hypergraph-Structured Knowledge Representation
par: Luo, Haoran, et autres
Publié: (2025)
par: Luo, Haoran, et autres
Publié: (2025)
Encoding and Controlling Global Semantics for Long-form Video Question Answering
par: Nguyen, Thong Thanh, et autres
Publié: (2024)
par: Nguyen, Thong Thanh, et autres
Publié: (2024)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
Step Guided Reasoning: Improving Mathematical Reasoning using Guidance Generation and Step Reasoning
par: Cao, Lang, et autres
Publié: (2024)
par: Cao, Lang, et autres
Publié: (2024)
Step-GRPO: Internalizing Dynamic Early Exit for Efficient Reasoning
par: Chen, Benteng, et autres
Publié: (2026)
par: Chen, Benteng, et autres
Publié: (2026)
MathFimer: Enhancing Mathematical Reasoning by Expanding Reasoning Steps through Fill-in-the-Middle Task
par: Yan, Yuchen, et autres
Publié: (2025)
par: Yan, Yuchen, et autres
Publié: (2025)
Step-KTO: Optimizing Mathematical Reasoning through Stepwise Binary Feedback
par: Lin, Yen-Ting, et autres
Publié: (2025)
par: Lin, Yen-Ting, et autres
Publié: (2025)
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints
par: Xu, Rui, et autres
Publié: (2025)
par: Xu, Rui, et autres
Publié: (2025)
ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning
par: Qiao, Ziqing, et autres
Publié: (2025)
par: Qiao, Ziqing, et autres
Publié: (2025)
Breaking PEFT Limitations: Leveraging Weak-to-Strong Knowledge Transfer for Backdoor Attacks in LLMs
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
KBQA-o1: Agentic Knowledge Base Question Answering with Monte Carlo Tree Search
par: Luo, Haoran, et autres
Publié: (2025)
par: Luo, Haoran, et autres
Publié: (2025)
SCOPE: Sequential Causal Optimization of Process Interventions
par: De Moor, Jakob, et autres
Publié: (2025)
par: De Moor, Jakob, et autres
Publié: (2025)
Masked Thought: Simply Masking Partial Reasoning Steps Can Improve Mathematical Reasoning Learning of Language Models
par: Chen, Changyu, et autres
Publié: (2024)
par: Chen, Changyu, et autres
Publié: (2024)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
par: Zhang, Zhenru, et autres
Publié: (2025)
par: Zhang, Zhenru, et autres
Publié: (2025)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
par: Zheng, Chujie, et autres
Publié: (2024)
par: Zheng, Chujie, et autres
Publié: (2024)
Step-level Value Preference Optimization for Mathematical Reasoning
par: Chen, Guoxin, et autres
Publié: (2024)
par: Chen, Guoxin, et autres
Publié: (2024)
An Efficient and Precise Training Data Construction Framework for Process-supervised Reward Model in Mathematical Reasoning
par: Sun, Wei, et autres
Publié: (2025)
par: Sun, Wei, et autres
Publié: (2025)
Unmasking Reasoning Processes: A Process-aware Benchmark for Evaluating Structural Mathematical Reasoning in LLMs
par: Zheng, Xiang, et autres
Publié: (2026)
par: Zheng, Xiang, et autres
Publié: (2026)
Conjecturing: An Overlooked Step in Formal Mathematical Reasoning
par: Sivakumar, Jasivan Alex, et autres
Publié: (2025)
par: Sivakumar, Jasivan Alex, et autres
Publié: (2025)
SCOPE: Sign Language Contextual Processing with Embedding from LLMs
par: Liu, Yuqi, et autres
Publié: (2024)
par: Liu, Yuqi, et autres
Publié: (2024)
Documents similaires
-
Unsupervised Hallucination Detection by Inspecting Reasoning Processes
par: Srey, Ponhvoan, et autres
Publié: (2025) -
Full-Step-DPO: Self-Supervised Preference Optimization with Step-wise Rewards for Mathematical Reasoning
par: Xu, Huimin, et autres
Publié: (2025) -
Understanding and Preventing Entropy Collapse in RLVR with On-Policy Entropy Flow Optimization
par: Xu, Huimin, et autres
Publié: (2026) -
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
par: Mao, Xin, et autres
Publié: (2024) -
A Survey on Neural Topic Models: Methods, Applications, and Challenges
par: Wu, Xiaobao, et autres
Publié: (2024)