CODI: Compressing Chain-of-Thought into Continuous Space via Self-Distillation
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Zhenyi, Yan, Hanqi, Zhang, Linhai, Hu, Zhanghao, Du, Yali, He, Yulan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Beyond Prompting: An Efficient Embedding Framework for Open-Domain Question Answering
di: Hu, Zhanghao, et al.
Pubblicazione: (2025)
di: Hu, Zhanghao, et al.
Pubblicazione: (2025)
Fix the Structural Bottleneck: Context Compression via Explicit Information Transmission
di: Ye, Jiangnan, et al.
Pubblicazione: (2026)
di: Ye, Jiangnan, et al.
Pubblicazione: (2026)
Beyond Perplexity: Let the Reader Select Retrieval Summaries via Spectrum Projection Score
di: Hu, Zhanghao, et al.
Pubblicazione: (2025)
di: Hu, Zhanghao, et al.
Pubblicazione: (2025)
Slow Tuning and Low-Entropy Masking for Safe Chain-of-Thought Distillation
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation
di: Hu, Zhanghao, et al.
Pubblicazione: (2026)
di: Hu, Zhanghao, et al.
Pubblicazione: (2026)
SCOPE: Optimizing Key-Value Cache Compression in Long-context Generation
di: Wu, Jialong, et al.
Pubblicazione: (2024)
di: Wu, Jialong, et al.
Pubblicazione: (2024)
Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning
di: Chen, Yiqun, et al.
Pubblicazione: (2026)
di: Chen, Yiqun, et al.
Pubblicazione: (2026)
R1-Compress: Long Chain-of-Thought Compression via Chunk Compression and Search
di: Wang, Yibo, et al.
Pubblicazione: (2025)
di: Wang, Yibo, et al.
Pubblicazione: (2025)
Explainable Depression Detection in Clinical Interviews with Personalized Retrieval-Augmented Generation
di: Zhang, Linhai, et al.
Pubblicazione: (2025)
di: Zhang, Linhai, et al.
Pubblicazione: (2025)
PROPER: A Progressive Learning Framework for Personalized Large Language Models with Group-Level Adaptation
di: Zhang, Linhai, et al.
Pubblicazione: (2025)
di: Zhang, Linhai, et al.
Pubblicazione: (2025)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
di: Li, Chengzhengxu, et al.
Pubblicazione: (2025)
di: Li, Chengzhengxu, et al.
Pubblicazione: (2025)
Self-Play Only Evolves When Self-Synthetic Pipeline Ensures Learnable Information Gain
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
Addressing Order Sensitivity of In-Context Demonstration Examples in Causal Language Models
di: Xiang, Yanzheng, et al.
Pubblicazione: (2024)
di: Xiang, Yanzheng, et al.
Pubblicazione: (2024)
Mirror: A Multiple-perspective Self-Reflection Method for Knowledge-rich Reasoning
di: Yan, Hanqi, et al.
Pubblicazione: (2024)
di: Yan, Hanqi, et al.
Pubblicazione: (2024)
Soft Reasoning: Navigating Solution Spaces in Large Language Models through Controlled Embedding Exploration
di: Zhu, Qinglin, et al.
Pubblicazione: (2025)
di: Zhu, Qinglin, et al.
Pubblicazione: (2025)
Causal Prompting: Debiasing Large Language Model Prompting based on Front-Door Adjustment
di: Zhang, Congzhi, et al.
Pubblicazione: (2024)
di: Zhang, Congzhi, et al.
Pubblicazione: (2024)
Student-in-the-Loop Chain-of-Thought Distillation via Generation-Time Selection
di: He, Chaoqun, et al.
Pubblicazione: (2026)
di: He, Chaoqun, et al.
Pubblicazione: (2026)
SSA: Sparse Sparse Attention by Aligning Full and Sparse Attention Outputs in Feature Space
di: Shen, Zhenyi, et al.
Pubblicazione: (2025)
di: Shen, Zhenyi, et al.
Pubblicazione: (2025)
Autonomous Chain-of-Thought Distillation for Graph-Based Fraud Detection
di: Li, Yuan, et al.
Pubblicazione: (2026)
di: Li, Yuan, et al.
Pubblicazione: (2026)
Unveiling the Key Factors for Distilling Chain-of-Thought Reasoning
di: Chen, Xinghao, et al.
Pubblicazione: (2025)
di: Chen, Xinghao, et al.
Pubblicazione: (2025)
When Thinking Backfires: Mechanistic Insights Into Reasoning-Induced Misalignment
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
di: Yan, Hanqi, et al.
Pubblicazione: (2025)
Weak Reward Model Transforms Generative Models into Robust Causal Event Extraction Systems
di: da Silva, Italo Luis, et al.
Pubblicazione: (2024)
di: da Silva, Italo Luis, et al.
Pubblicazione: (2024)
Explainable Recommender with Geometric Information Bottleneck
di: Yan, Hanqi, et al.
Pubblicazione: (2023)
di: Yan, Hanqi, et al.
Pubblicazione: (2023)
Keypoint-based Progressive Chain-of-Thought Distillation for LLMs
di: Feng, Kaituo, et al.
Pubblicazione: (2024)
di: Feng, Kaituo, et al.
Pubblicazione: (2024)
GraphMind: Interactive Novelty Assessment System for Accelerating Scientific Discovery
di: da Silva, Italo Luis, et al.
Pubblicazione: (2025)
di: da Silva, Italo Luis, et al.
Pubblicazione: (2025)
Efficient Reasoning via Chain of Unconscious Thought
di: Gong, Ruihan, et al.
Pubblicazione: (2025)
di: Gong, Ruihan, et al.
Pubblicazione: (2025)
CRISP: Compressing Redundancy in Chain-of-Thought via Intrinsic Saliency Pruning
di: Lan, Yangsong, et al.
Pubblicazione: (2026)
di: Lan, Yangsong, et al.
Pubblicazione: (2026)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
di: Feng, Kehua, et al.
Pubblicazione: (2025)
di: Feng, Kehua, et al.
Pubblicazione: (2025)
Self-Harmonized Chain of Thought
di: Jin, Ziqi, et al.
Pubblicazione: (2024)
di: Jin, Ziqi, et al.
Pubblicazione: (2024)
Reasoning Efficiently Through Adaptive Chain-of-Thought Compression: A Self-Optimizing Framework
di: Huang, Kerui, et al.
Pubblicazione: (2025)
di: Huang, Kerui, et al.
Pubblicazione: (2025)
The Mystery of In-Context Learning: A Comprehensive Survey on Interpretation and Analysis
di: Zhou, Yuxiang, et al.
Pubblicazione: (2023)
di: Zhou, Yuxiang, et al.
Pubblicazione: (2023)
PPC-GPT: Federated Task-Specific Compression of Large Language Models via Pruning and Chain-of-Thought Distillation
di: Fan, Tao, et al.
Pubblicazione: (2025)
di: Fan, Tao, et al.
Pubblicazione: (2025)
RGAR: Recurrence Generation-augmented Retrieval for Factual-aware Medical Question Answering
di: Liang, Sichu, et al.
Pubblicazione: (2025)
di: Liang, Sichu, et al.
Pubblicazione: (2025)
Recall with Reasoning: Chain-of-Thought Distillation for Mamba's Long-Context Memory and Extrapolation
di: Ma, Junyu, et al.
Pubblicazione: (2025)
di: Ma, Junyu, et al.
Pubblicazione: (2025)
Are NLP Models Good at Tracing Thoughts: An Overview of Narrative Understanding
di: Zhu, Lixing, et al.
Pubblicazione: (2023)
di: Zhu, Lixing, et al.
Pubblicazione: (2023)
Chain-of-Thought Compression Should Not Be Blind: V-Skip for Efficient Multimodal Reasoning via Dual-Path Anchoring
di: Zhang, Dongxu, et al.
Pubblicazione: (2026)
di: Zhang, Dongxu, et al.
Pubblicazione: (2026)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
di: Liu, Wei, et al.
Pubblicazione: (2025)
di: Liu, Wei, et al.
Pubblicazione: (2025)
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
di: Hu, Minda, et al.
Pubblicazione: (2026)
di: Hu, Minda, et al.
Pubblicazione: (2026)
FedCoT: Federated Chain-of-Thought Distillation for Large Language Models
di: Fan, Tao, et al.
Pubblicazione: (2024)
di: Fan, Tao, et al.
Pubblicazione: (2024)
Parallel Continuous Chain-of-Thought with Jacobi Iteration
di: Wu, Haoyi, et al.
Pubblicazione: (2025)
di: Wu, Haoyi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Beyond Prompting: An Efficient Embedding Framework for Open-Domain Question Answering
di: Hu, Zhanghao, et al.
Pubblicazione: (2025) -
Fix the Structural Bottleneck: Context Compression via Explicit Information Transmission
di: Ye, Jiangnan, et al.
Pubblicazione: (2026) -
Beyond Perplexity: Let the Reader Select Retrieval Summaries via Spectrum Projection Score
di: Hu, Zhanghao, et al.
Pubblicazione: (2025) -
Slow Tuning and Low-Entropy Masking for Safe Chain-of-Thought Distillation
di: Ma, Ziyang, et al.
Pubblicazione: (2025) -
Beyond RAG for Agent Memory: Retrieval by Decoupling and Aggregation
di: Hu, Zhanghao, et al.
Pubblicazione: (2026)