Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Chen, Yiqun, Feng, Jinyuan, Yang, Wei, Zhong, Meizhi, Shi, Zhengliang, Li, Rui, Wei, Xiaochi, Gao, Yan, Wu, Yi, Hu, Yao, Pu, Zhiqiang, Mao, Jiaxin
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!