LC-ERD: Mining Latent Logic for Self-Evolving Reasoning via Consistency-Regulated Reward Decomposition
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Yanyu, Jiang, Jiyue, Yu, Dianzhi, Wu, Zheng, Liu, Jiahong, Han, Jiaming, Guo, Xiao, Qi, Jinhu, Li, Yu, Zhang, Yifei, King, Irwin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TRACE: Trajectory-Aware Comprehensive Evaluation for Deep Research Agents
por: Chen, Yanyu, et al.
Publicado: (2026)
por: Chen, Yanyu, et al.
Publicado: (2026)
Dynamic Mixture of Latent Memories for Self-Evolving Agents
por: Yu, Dianzhi, et al.
Publicado: (2026)
por: Yu, Dianzhi, et al.
Publicado: (2026)
Recent Advances of Multimodal Continual Learning: A Comprehensive Survey
por: Yu, Dianzhi, et al.
Publicado: (2024)
por: Yu, Dianzhi, et al.
Publicado: (2024)
Towards trustworthy agentic AI: a comprehensive survey of safety, robustness, privacy, and system security
por: Qi, Jinhu, et al.
Publicado: (2026)
por: Qi, Jinhu, et al.
Publicado: (2026)
An Entropy-based Text Watermarking Detection Method
por: Lu, Yijian, et al.
Publicado: (2024)
por: Lu, Yijian, et al.
Publicado: (2024)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
por: Liu, Junming, et al.
Publicado: (2026)
por: Liu, Junming, et al.
Publicado: (2026)
Efficient Identity and Position Graph Embedding via Spectral-Based Random Feature Aggregation
por: Qin, Meng, et al.
Publicado: (2025)
por: Qin, Meng, et al.
Publicado: (2025)
Self-Rewarding Vision-Language Model via Reasoning Decomposition
por: Li, Zongxia, et al.
Publicado: (2025)
por: Li, Zongxia, et al.
Publicado: (2025)
Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model
por: Wang, Chenfeng, et al.
Publicado: (2026)
por: Wang, Chenfeng, et al.
Publicado: (2026)
ConSurv: Multimodal Continual Learning for Survival Analysis
por: Yu, Dianzhi, et al.
Publicado: (2025)
por: Yu, Dianzhi, et al.
Publicado: (2025)
ERD: A Framework for Improving LLM Reasoning for Cognitive Distortion Classification
por: Lim, Sehee, et al.
Publicado: (2024)
por: Lim, Sehee, et al.
Publicado: (2024)
Recent Advances in Speech Language Models: A Survey
por: Cui, Wenqian, et al.
Publicado: (2024)
por: Cui, Wenqian, et al.
Publicado: (2024)
HiHPQ: Hierarchical Hyperbolic Product Quantization for Unsupervised Image Retrieval
por: Qiu, Zexuan, et al.
Publicado: (2024)
por: Qiu, Zexuan, et al.
Publicado: (2024)
Cross-level Privacy Preserving Utility Mining
por: Cai, Jiahong, et al.
Publicado: (2026)
por: Cai, Jiahong, et al.
Publicado: (2026)
Self-Evolved Reward Learning for LLMs
por: Huang, Chenghua, et al.
Publicado: (2024)
por: Huang, Chenghua, et al.
Publicado: (2024)
Understanding and Mitigating Hyperbolic Dimensional Collapse in Graph Contrastive Learning
por: Zhang, Yifei, et al.
Publicado: (2023)
por: Zhang, Yifei, et al.
Publicado: (2023)
Consistent Paths Lead to Truth: Self-Rewarding Reinforcement Learning for LLM Reasoning
por: Zhang, Kongcheng, et al.
Publicado: (2025)
por: Zhang, Kongcheng, et al.
Publicado: (2025)
Less is More: Extreme Gradient Boost Rank-1 Adaption for Efficient Finetuning of LLMs
por: Zhang, Yifei, et al.
Publicado: (2024)
por: Zhang, Yifei, et al.
Publicado: (2024)
miR6157 Targets ERD2a‐Like and Negatively Regulates Tobacco Resistance Against Tobacco Mosaic Virus
por: Bolei Jiao, et al.
Publicado: (2025)
por: Bolei Jiao, et al.
Publicado: (2025)
HC-GLAD: Dual Hyperbolic Contrastive Learning for Unsupervised Graph-Level Anomaly Detection
por: Fu, Yali, et al.
Publicado: (2024)
por: Fu, Yali, et al.
Publicado: (2024)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
por: Zhou, Xin, et al.
Publicado: (2025)
por: Zhou, Xin, et al.
Publicado: (2025)
Reward Guided Latent Consistency Distillation
por: Li, Jiachen, et al.
Publicado: (2024)
por: Li, Jiachen, et al.
Publicado: (2024)
Beyond Benchmark Islands: Toward Representative Trustworthiness Evaluation for Agentic AI
por: Qi, Jinhu, et al.
Publicado: (2026)
por: Qi, Jinhu, et al.
Publicado: (2026)
Toward Effective Tool-Integrated Reasoning via Self-Evolved Preference Learning
por: Chen, Yifei, et al.
Publicado: (2025)
por: Chen, Yifei, et al.
Publicado: (2025)
LatentEvolve: Self-Evolving Test-Time Scaling in Latent Space
por: Zhang, Guibin, et al.
Publicado: (2025)
por: Zhang, Guibin, et al.
Publicado: (2025)
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
por: Hu, Minda, et al.
Publicado: (2024)
por: Hu, Minda, et al.
Publicado: (2024)
Towards Geometry Problem Solving in the Large Model Era: A Survey
por: Zhao, Yurui, et al.
Publicado: (2025)
por: Zhao, Yurui, et al.
Publicado: (2025)
RewardHarness: Self-Evolving Agentic Post-Training
por: Zhang, Yuxuan, et al.
Publicado: (2026)
por: Zhang, Yuxuan, et al.
Publicado: (2026)
From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation
por: Guo, Zhihan, et al.
Publicado: (2025)
por: Guo, Zhihan, et al.
Publicado: (2025)
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
por: Ouyang, Siru, et al.
Publicado: (2025)
por: Ouyang, Siru, et al.
Publicado: (2025)
From Evidence to Trajectory: Abductive Reasoning Path Synthesis for Training Retrieval-Augmented Generation Agents
por: Li, Muzhi, et al.
Publicado: (2025)
por: Li, Muzhi, et al.
Publicado: (2025)
Diving into Self-Evolving Training for Multimodal Reasoning
por: Liu, Wei, et al.
Publicado: (2024)
por: Liu, Wei, et al.
Publicado: (2024)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
por: Chen, Haolin, et al.
Publicado: (2024)
por: Chen, Haolin, et al.
Publicado: (2024)
ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training
por: Liang, Yu, et al.
Publicado: (2026)
por: Liang, Yu, et al.
Publicado: (2026)
GSEM: Graph-based Self-Evolving Memory for Experience Augmented Clinical Reasoning
por: Han, Xiao, et al.
Publicado: (2026)
por: Han, Xiao, et al.
Publicado: (2026)
$δ$-lifting and $1$-dimensional analytic fields
por: Yu, Jiahong
Publicado: (2025)
por: Yu, Jiahong
Publicado: (2025)
Fields of Fractions in Rigid Geometry
por: Yu, Jiahong
Publicado: (2025)
por: Yu, Jiahong
Publicado: (2025)
On smooth adic spaces over $\mathbb{B}_{\mathrm{dR}}^+$ and sheafified $p$-adic Riemann--Hilbert correspondence
por: Yu, Jiahong
Publicado: (2024)
por: Yu, Jiahong
Publicado: (2024)
A Conjecture of Bhatt--Lurie and weakly $p$-nilpotent Hodge--Tate stacks
por: Yu, Jiahong
Publicado: (2024)
por: Yu, Jiahong
Publicado: (2024)
Prismatic Crystals for schemes in characteristic $p$
por: Yu, Jiahong
Publicado: (2024)
por: Yu, Jiahong
Publicado: (2024)
Ejemplares similares
-
TRACE: Trajectory-Aware Comprehensive Evaluation for Deep Research Agents
por: Chen, Yanyu, et al.
Publicado: (2026) -
Dynamic Mixture of Latent Memories for Self-Evolving Agents
por: Yu, Dianzhi, et al.
Publicado: (2026) -
Recent Advances of Multimodal Continual Learning: A Comprehensive Survey
por: Yu, Dianzhi, et al.
Publicado: (2024) -
Towards trustworthy agentic AI: a comprehensive survey of safety, robustness, privacy, and system security
por: Qi, Jinhu, et al.
Publicado: (2026) -
An Entropy-based Text Watermarking Detection Method
por: Lu, Yijian, et al.
Publicado: (2024)