BC Protocol: Structured Dual-Expert Dialogue for Eliciting High-Quality Chain-of-Thought Post-Training Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zou, Bo, Xu, Chao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Calibrated Surprise: An Information-Theoretic Account of Creative Quality
par: Zou, Bo, et autres
Publié: (2026)
par: Zou, Bo, et autres
Publié: (2026)
Chain-of-Defensive-Thought: Structured Reasoning Elicits Robustness in Large Language Models against Reference Corruption
par: Wang, Wenxiao, et autres
Publié: (2025)
par: Wang, Wenxiao, et autres
Publié: (2025)
Dialogue Ontology Relation Extraction via Constrained Chain-of-Thought Decoding
par: Vukovic, Renato, et autres
Publié: (2024)
par: Vukovic, Renato, et autres
Publié: (2024)
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
par: Shang, Yu, et autres
Publié: (2024)
par: Shang, Yu, et autres
Publié: (2024)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
par: Cai, Chengkun, et autres
Publié: (2024)
par: Cai, Chengkun, et autres
Publié: (2024)
A Formal Comparison Between Chain of Thought and Latent Thought
par: Xu, Kevin, et autres
Publié: (2025)
par: Xu, Kevin, et autres
Publié: (2025)
Fractured Chain-of-Thought Reasoning
par: Liao, Baohao, et autres
Publié: (2025)
par: Liao, Baohao, et autres
Publié: (2025)
QUIET: A Multi-Blank Cascaded Story Cloze Benchmark for LLM Creative Generation Capability
par: Zou, Bo, et autres
Publié: (2026)
par: Zou, Bo, et autres
Publié: (2026)
Diversity of Thought Elicits Stronger Reasoning Capabilities in Multi-Agent Debate Frameworks
par: Hegazy, Mahmood
Publié: (2024)
par: Hegazy, Mahmood
Publié: (2024)
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
par: Zaman, Kerem, et autres
Publié: (2025)
par: Zaman, Kerem, et autres
Publié: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
par: Xu, Yuhui, et autres
Publié: (2025)
par: Xu, Yuhui, et autres
Publié: (2025)
Long-Document QA with Chain-of-Structured-Thought and Fine-Tuned SLMs
par: Liang, Zhuowen, et autres
Publié: (2026)
par: Liang, Zhuowen, et autres
Publié: (2026)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
How Instruction and Reasoning Data shape Post-Training: Data Quality through the Lens of Layer-wise Gradients
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
QuantMoE-Bench: Examining Post-Training Quantization for Mixture-of-Experts
par: Li, Pingzhi, et autres
Publié: (2024)
par: Li, Pingzhi, et autres
Publié: (2024)
Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens
par: Zhao, Chengshuai, et autres
Publié: (2025)
par: Zhao, Chengshuai, et autres
Publié: (2025)
Demystifying Chains, Trees, and Graphs of Thoughts
par: Besta, Maciej, et autres
Publié: (2024)
par: Besta, Maciej, et autres
Publié: (2024)
Chain-of-Thought Unfaithfulness as Disguised Accuracy
par: Bentham, Oliver, et autres
Publié: (2024)
par: Bentham, Oliver, et autres
Publié: (2024)
Reprompting: Automated Chain-of-Thought Prompt Inference Through Gibbs Sampling
par: Xu, Weijia, et autres
Publié: (2023)
par: Xu, Weijia, et autres
Publié: (2023)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
par: Xie, Zhuohan, et autres
Publié: (2025)
par: Xie, Zhuohan, et autres
Publié: (2025)
Post-Trained MoE Can Skip Half Experts via Self-Distillation
par: Lv, Xingtai, et autres
Publié: (2026)
par: Lv, Xingtai, et autres
Publié: (2026)
Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations
par: Aravindan, Ashwath Vaithinathan, et autres
Publié: (2026)
par: Aravindan, Ashwath Vaithinathan, et autres
Publié: (2026)
Self-Training Elicits Concise Reasoning in Large Language Models
par: Munkhbat, Tergel, et autres
Publié: (2025)
par: Munkhbat, Tergel, et autres
Publié: (2025)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
par: Arcuschin, Iván, et autres
Publié: (2025)
par: Arcuschin, Iván, et autres
Publié: (2025)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
par: Yehudai, Gilad, et autres
Publié: (2025)
par: Yehudai, Gilad, et autres
Publié: (2025)
Long Chain-of-Thought Reasoning Across Languages
par: Barua, Josh, et autres
Publié: (2025)
par: Barua, Josh, et autres
Publié: (2025)
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
par: Yu, Qifan, et autres
Publié: (2025)
par: Yu, Qifan, et autres
Publié: (2025)
Learning to Rank Chain-of-Thought: Using a Small Model
par: Jiang, Eric Hanchen, et autres
Publié: (2025)
par: Jiang, Eric Hanchen, et autres
Publié: (2025)
Leave It to the Experts: Detecting Knowledge Distillation via MoE Expert Signatures
par: Li, Pingzhi, et autres
Publié: (2025)
par: Li, Pingzhi, et autres
Publié: (2025)
Generating Chain-of-Thoughts with a Pairwise-Comparison Approach to Searching for the Most Promising Intermediate Thought
par: Zhang, Zhen-Yu, et autres
Publié: (2024)
par: Zhang, Zhen-Yu, et autres
Publié: (2024)
Stepwise Penalization for Length-Efficient Chain-of-Thought Reasoning
par: Li, Xintong, et autres
Publié: (2026)
par: Li, Xintong, et autres
Publié: (2026)
Evolving Demonstration Optimization for Chain-of-Thought Feature Transformation
par: Wang, Xinyuan, et autres
Publié: (2026)
par: Wang, Xinyuan, et autres
Publié: (2026)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
par: Wang, Kaiwen, et autres
Publié: (2025)
par: Wang, Kaiwen, et autres
Publié: (2025)
Understanding Chain-of-Thought in LLMs through Information Theory
par: Ton, Jean-Francois, et autres
Publié: (2024)
par: Ton, Jean-Francois, et autres
Publié: (2024)
Latent Chain-of-Thought? Decoding the Depth-Recurrent Transformer
par: Lu, Wenquan, et autres
Publié: (2025)
par: Lu, Wenquan, et autres
Publié: (2025)
Watch Your Steps: Observable and Modular Chains of Thought
par: Cohen, Cassandra A., et autres
Publié: (2024)
par: Cohen, Cassandra A., et autres
Publié: (2024)
Enhancing Generalization in Chain of Thought Reasoning for Smaller Models
par: Yin, Maxwell J., et autres
Publié: (2025)
par: Yin, Maxwell J., et autres
Publié: (2025)
Iteration Head: A Mechanistic Study of Chain-of-Thought
par: Cabannes, Vivien, et autres
Publié: (2024)
par: Cabannes, Vivien, et autres
Publié: (2024)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
par: Hu, Lijie, et autres
Publié: (2024)
par: Hu, Lijie, et autres
Publié: (2024)
Measuring Chain-of-Thought Monitorability Through Faithfulness and Verbosity
par: Meek, Austin, et autres
Publié: (2025)
par: Meek, Austin, et autres
Publié: (2025)
Documents similaires
-
Calibrated Surprise: An Information-Theoretic Account of Creative Quality
par: Zou, Bo, et autres
Publié: (2026) -
Chain-of-Defensive-Thought: Structured Reasoning Elicits Robustness in Large Language Models against Reference Corruption
par: Wang, Wenxiao, et autres
Publié: (2025) -
Dialogue Ontology Relation Extraction via Constrained Chain-of-Thought Decoding
par: Vukovic, Renato, et autres
Publié: (2024) -
Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
par: Shang, Yu, et autres
Publié: (2024) -
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
par: Cai, Chengkun, et autres
Publié: (2024)