Gespeichert in:
| Hauptverfasser: | Lou, Chenwei, Sun, Zewei, Liang, Xinnian, Qu, Meng, Shen, Wei, Wang, Wenqi, Li, Yuntao, Yang, Qingping, Wu, Shuangzhi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2505.11896 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
ProtoReasoning: Prototypes as the Foundation for Generalizable Reasoning in LLMs
von: He, Feng, et al.
Veröffentlicht: (2025)
von: He, Feng, et al.
Veröffentlicht: (2025)
AdaMCoT: Rethinking Cross-Lingual Factual Reasoning through Adaptive Multilingual Chain-of-Thought
von: Zheng, Weihua, et al.
Veröffentlicht: (2025)
von: Zheng, Weihua, et al.
Veröffentlicht: (2025)
Pareto-Optimal Energy Alignment for Designing Nature-Like Antibodies
von: Wen, Yibo, et al.
Veröffentlicht: (2024)
von: Wen, Yibo, et al.
Veröffentlicht: (2024)
SCM: Enhancing Large Language Model with Self-Controlled Memory Framework
von: Wang, Bing, et al.
Veröffentlicht: (2023)
von: Wang, Bing, et al.
Veröffentlicht: (2023)
AdaMuon: Adaptive Muon Optimizer
von: Si, Chongjie, et al.
Veröffentlicht: (2025)
von: Si, Chongjie, et al.
Veröffentlicht: (2025)
Crystal-KV: Efficient KV Cache Management for Chain-of-Thought LLMs via Answer-First Principle
von: Wang, Zihan, et al.
Veröffentlicht: (2026)
von: Wang, Zihan, et al.
Veröffentlicht: (2026)
Adaptive Laser Modulation Strategy for Femtosecond Laser Surface Texturing of Uniform Microcorner Features
von: Wenqi Ma, et al.
Veröffentlicht: (2025)
von: Wenqi Ma, et al.
Veröffentlicht: (2025)
EntroCoT: Enhancing Chain-of-Thought via Adaptive Entropy-Guided Segmentation
von: Li, Zihang, et al.
Veröffentlicht: (2026)
von: Li, Zihang, et al.
Veröffentlicht: (2026)
From Dataset to Real-world: General 3D Object Detection via Generalized Cross-domain Few-shot Learning
von: Li, Shuangzhi, et al.
Veröffentlicht: (2025)
von: Li, Shuangzhi, et al.
Veröffentlicht: (2025)
Generalizable Pareto-Optimal Offloading with Reinforcement Learning in Mobile Edge Computing
von: Yang, Ning, et al.
Veröffentlicht: (2025)
von: Yang, Ning, et al.
Veröffentlicht: (2025)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
von: Wang, Jiaan, et al.
Veröffentlicht: (2024)
von: Wang, Jiaan, et al.
Veröffentlicht: (2024)
RationAnomaly: Log Anomaly Detection with Rationality via Chain-of-Thought and Reinforcement Learning
von: Xu, Song, et al.
Veröffentlicht: (2025)
von: Xu, Song, et al.
Veröffentlicht: (2025)
Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
von: Xu, Haolei, et al.
Veröffentlicht: (2025)
von: Xu, Haolei, et al.
Veröffentlicht: (2025)
Stop When Enough: Adaptive Early-Stopping for Chain-of-Thought Reasoning
von: Sun, Renliang, et al.
Veröffentlicht: (2025)
von: Sun, Renliang, et al.
Veröffentlicht: (2025)
Ada-R1: Hybrid-CoT via Bi-Level Adaptive Reasoning Optimization
von: Luo, Haotian, et al.
Veröffentlicht: (2025)
von: Luo, Haotian, et al.
Veröffentlicht: (2025)
UTMath: Math Evaluation with Unit Test via Reasoning-to-Coding Thoughts
von: Yang, Bo, et al.
Veröffentlicht: (2024)
von: Yang, Bo, et al.
Veröffentlicht: (2024)
Learning to Edit Knowledge via Instruction-based Chain-of-Thought Prompting
von: Fu, Jinhu, et al.
Veröffentlicht: (2026)
von: Fu, Jinhu, et al.
Veröffentlicht: (2026)
AdaDecode: Accelerating LLM Decoding with Adaptive Layer Parallelism
von: Wei, Zhepei, et al.
Veröffentlicht: (2025)
von: Wei, Zhepei, et al.
Veröffentlicht: (2025)
CoTGuard: Using Chain-of-Thought Triggering for Copyright Protection in Multi-Agent LLM Systems
von: Wen, Yan, et al.
Veröffentlicht: (2025)
von: Wen, Yan, et al.
Veröffentlicht: (2025)
AdaDoS: Adaptive DoS Attack via Deep Adversarial Reinforcement Learning in SDN
von: Shao, Wei, et al.
Veröffentlicht: (2025)
von: Shao, Wei, et al.
Veröffentlicht: (2025)
In-Context Decision Transformer: Reinforcement Learning via Hierarchical Chain-of-Thought
von: Huang, Sili, et al.
Veröffentlicht: (2024)
von: Huang, Sili, et al.
Veröffentlicht: (2024)
Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search
von: Shen, Maohao, et al.
Veröffentlicht: (2025)
von: Shen, Maohao, et al.
Veröffentlicht: (2025)
On the Equivalence of Synchronous Coordination Game and Asynchronous Coordination Design
von: Pan, Xinnian Kazusa
Veröffentlicht: (2024)
von: Pan, Xinnian Kazusa
Veröffentlicht: (2024)
AdaFuse: Adaptive Multimodal Fusion for Lung Cancer Risk Prediction via Reinforcement Learning
von: Qu, Chongyu, et al.
Veröffentlicht: (2026)
von: Qu, Chongyu, et al.
Veröffentlicht: (2026)
Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning
von: Chen, Yiqun, et al.
Veröffentlicht: (2026)
von: Chen, Yiqun, et al.
Veröffentlicht: (2026)
SurgCoT: Advancing Spatiotemporal Reasoning in Surgical Videos through a Chain-of-Thought Benchmark
von: Wang, Gui, et al.
Veröffentlicht: (2026)
von: Wang, Gui, et al.
Veröffentlicht: (2026)
Optimal Beamforming for Uplink Covert Communication in MIMO GEO Satellite-Terrestrial Systems
von: Guo, Zewei, et al.
Veröffentlicht: (2026)
von: Guo, Zewei, et al.
Veröffentlicht: (2026)
Pareto-Optimal Offline Reinforcement Learning via Smooth Tchebysheff Scalarization
von: Bhatnagar, Aadyot, et al.
Veröffentlicht: (2026)
von: Bhatnagar, Aadyot, et al.
Veröffentlicht: (2026)
RecCoT: Enhancing Recommendation via Chain-of-Thought
von: Yang, Shuo, et al.
Veröffentlicht: (2025)
von: Yang, Shuo, et al.
Veröffentlicht: (2025)
AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
von: Zhang, Shaoqiu, et al.
Veröffentlicht: (2026)
von: Zhang, Shaoqiu, et al.
Veröffentlicht: (2026)
SIM-CoT: Supervised Implicit Chain-of-Thought
von: Wei, Xilin, et al.
Veröffentlicht: (2025)
von: Wei, Xilin, et al.
Veröffentlicht: (2025)
Intention Chain-of-Thought Prompting with Dynamic Routing for Code Generation
von: Li, Shen, et al.
Veröffentlicht: (2025)
von: Li, Shen, et al.
Veröffentlicht: (2025)
CoTEvol: Self-Evolving Chain-of-Thoughts for Data Synthesis in Mathematical Reasoning
von: Wang, Zhuo, et al.
Veröffentlicht: (2026)
von: Wang, Zhuo, et al.
Veröffentlicht: (2026)
AdaThinkDrive: Adaptive Thinking via Reinforcement Learning for Autonomous Driving
von: Luo, Yuechen, et al.
Veröffentlicht: (2025)
von: Luo, Yuechen, et al.
Veröffentlicht: (2025)
CoT-X: An Adaptive Framework for Cross-Model Chain-of-Thought Transfer and Optimization
von: Bi, Ziqian, et al.
Veröffentlicht: (2025)
von: Bi, Ziqian, et al.
Veröffentlicht: (2025)
RULE: Reinforcement UnLEarning Achieves Forget-Retain Pareto Optimality
von: Zhang, Chenlong, et al.
Veröffentlicht: (2025)
von: Zhang, Chenlong, et al.
Veröffentlicht: (2025)
Thoughts-as-Planning: Latent World Models for Chain-of-Thoughts Optimization via Reinforcement Planning
von: Liu, Dong, et al.
Veröffentlicht: (2026)
von: Liu, Dong, et al.
Veröffentlicht: (2026)
ExpThink: Experience-Guided Reinforcement Learning for Adaptive Chain-of-Thought Compression
von: Bian, Tingcheng, et al.
Veröffentlicht: (2026)
von: Bian, Tingcheng, et al.
Veröffentlicht: (2026)
Clear Chain-of-Thought (ClearCoT)
von: Sagić, Andrija
Veröffentlicht: (2026)
von: Sagić, Andrija
Veröffentlicht: (2026)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
von: Feng, Kehua, et al.
Veröffentlicht: (2025)
von: Feng, Kehua, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
ProtoReasoning: Prototypes as the Foundation for Generalizable Reasoning in LLMs
von: He, Feng, et al.
Veröffentlicht: (2025) -
AdaMCoT: Rethinking Cross-Lingual Factual Reasoning through Adaptive Multilingual Chain-of-Thought
von: Zheng, Weihua, et al.
Veröffentlicht: (2025) -
Pareto-Optimal Energy Alignment for Designing Nature-Like Antibodies
von: Wen, Yibo, et al.
Veröffentlicht: (2024) -
SCM: Enhancing Large Language Model with Self-Controlled Memory Framework
von: Wang, Bing, et al.
Veröffentlicht: (2023) -
AdaMuon: Adaptive Muon Optimizer
von: Si, Chongjie, et al.
Veröffentlicht: (2025)