Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Chen, Yiqun, Feng, Jinyuan, Yang, Wei, Zhong, Meizhi, Shi, Zhengliang, Li, Rui, Wei, Xiaochi, Gao, Yan, Wu, Yi, Hu, Yao, Pu, Zhiqiang, Mao, Jiaxin
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!