AS-ES Learning: Towards Efficient CoT Learning in Small Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xi, Nuwa, Chen, Yuhan, Zhao, Sendong, Wang, Haochun, Qin, Bing, Liu, Ting |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Artificially Real to Real: Leveraging Pseudo Data from Large Language Models for Low-Resource Molecule Discovery
par: Chen, Yuhan, et autres
Publié: (2023)
par: Chen, Yuhan, et autres
Publié: (2023)
Beyond Direct Diagnosis: LLM-based Multi-Specialist Agent Consultation for Automatic Diagnosis
par: Wang, Haochun, et autres
Publié: (2024)
par: Wang, Haochun, et autres
Publié: (2024)
LLMs May Perform MCQA by Selecting the Least Incorrect Option
par: Wang, Haochun, et autres
Publié: (2024)
par: Wang, Haochun, et autres
Publié: (2024)
Manifold-based Verbalizer Space Re-embedding for Tuning-free Prompt-based Classification
par: Wang, Haochun, et autres
Publié: (2023)
par: Wang, Haochun, et autres
Publié: (2023)
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
par: Wang, Haochun, et autres
Publié: (2023)
par: Wang, Haochun, et autres
Publié: (2023)
Uncovering the Role of Initial Saliency in U-Shaped Attention Bias: Scaling Initial Token Weight for Enhanced Long-Text Processing
par: Qiang, Zewen, et autres
Publié: (2025)
par: Qiang, Zewen, et autres
Publié: (2025)
META-RAG: Meta-Analysis-Inspired Evidence-Re-Ranking Method for Retrieval-Augmented Generation in Evidence-Based Medicine
par: Sun, Mengzhou, et autres
Publié: (2025)
par: Sun, Mengzhou, et autres
Publié: (2025)
Easier to Judge than to Find: Predicting In-Context Learning Success for Demonstration Selection
par: Wang, Haochun, et autres
Publié: (2026)
par: Wang, Haochun, et autres
Publié: (2026)
CoCoA: Collaborative Chain-of-Agents for Parametric-Retrieved Knowledge Synergy
par: Jiang, Yi, et autres
Publié: (2025)
par: Jiang, Yi, et autres
Publié: (2025)
MolTailor: Tailoring Chemical Molecular Representation to Specific Tasks via Text Prompts
par: Guo, Haoqiang, et autres
Publié: (2024)
par: Guo, Haoqiang, et autres
Publié: (2024)
M-Eval: A Heterogeneity-Based Framework for Multi-evidence Validation in Medical RAG Systems
par: Sun, Mengzhou, et autres
Publié: (2025)
par: Sun, Mengzhou, et autres
Publié: (2025)
S3-CoT: Self-Sampled Succinct Reasoning Enables Efficient Chain-of-Thought LLMs
par: Du, Yanrui, et autres
Publié: (2026)
par: Du, Yanrui, et autres
Publié: (2026)
ArcAligner: Adaptive Recursive Aligner for Compressed Context Embeddings in RAG
par: Li, Jianbo, et autres
Publié: (2026)
par: Li, Jianbo, et autres
Publié: (2026)
MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security
par: Du, Yanrui, et autres
Publié: (2025)
par: Du, Yanrui, et autres
Publié: (2025)
Analyzing the Inherent Response Tendency of LLMs: Real-World Instructions-Driven Jailbreak
par: Du, Yanrui, et autres
Publié: (2023)
par: Du, Yanrui, et autres
Publié: (2023)
Efficient Long CoT Reasoning in Small Language Models
par: Wang, Zhaoyang, et autres
Publié: (2025)
par: Wang, Zhaoyang, et autres
Publié: (2025)
When Correct Beliefs Collapse: Epistemic Resilience of LLMs under Clinical Pressure
par: Xiao, Boyu, et autres
Publié: (2026)
par: Xiao, Boyu, et autres
Publié: (2026)
From Latent Signals to Reflection Behavior: Tracing Meta-Cognitive Activation Trajectory in R1-Style LLMs
par: Du, Yanrui, et autres
Publié: (2026)
par: Du, Yanrui, et autres
Publié: (2026)
From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step
par: Deng, Yuntian, et autres
Publié: (2024)
par: Deng, Yuntian, et autres
Publié: (2024)
Toward Secure Tuning: Mitigating Security Risks from Instruction Fine-Tuning
par: Du, Yanrui, et autres
Publié: (2024)
par: Du, Yanrui, et autres
Publié: (2024)
Through the Valley: Path to Effective Long CoT Training for Small Language Models
par: Luo, Renjie, et autres
Publié: (2025)
par: Luo, Renjie, et autres
Publié: (2025)
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
par: Jin, Senjie, et autres
Publié: (2025)
par: Jin, Senjie, et autres
Publié: (2025)
$\textit{SKIntern}$: Internalizing Symbolic Knowledge for Distilling Better CoT Capabilities into Small Language Models
par: Liao, Huanxuan, et autres
Publié: (2024)
par: Liao, Huanxuan, et autres
Publié: (2024)
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
par: Zheng, Tianshi, et autres
Publié: (2025)
par: Zheng, Tianshi, et autres
Publié: (2025)
Privacy-preserved LLM Cascade via CoT-enhanced Policy Learning
par: Zhang, Kai, et autres
Publié: (2024)
par: Zhang, Kai, et autres
Publié: (2024)
MoGU: A Framework for Enhancing Safety of Open-Sourced LLMs While Preserving Their Usability
par: Du, Yanrui, et autres
Publié: (2024)
par: Du, Yanrui, et autres
Publié: (2024)
To CoT or not to CoT? Chain-of-thought helps mainly on math and symbolic reasoning
par: Sprague, Zayne, et autres
Publié: (2024)
par: Sprague, Zayne, et autres
Publié: (2024)
Investigating CoT Monitorability in Large Reasoning Models
par: Yang, Shu, et autres
Publié: (2025)
par: Yang, Shu, et autres
Publié: (2025)
PICOs-RAG: PICO-supported Query Rewriting for Retrieval-Augmented Generation in Evidence-Based Medicine
par: Sun, Mengzhou, et autres
Publié: (2025)
par: Sun, Mengzhou, et autres
Publié: (2025)
Towards Efficient CoT Distillation: Self-Guided Rationale Selector for Better Performance with Fewer Rationales
par: Yan, Jianzhi, et autres
Publié: (2025)
par: Yan, Jianzhi, et autres
Publié: (2025)
Stealth Fine-Tuning: Efficiently Breaking Alignment in RVLMs Using Self-Generated CoT
par: Yu, Le, et autres
Publié: (2025)
par: Yu, Le, et autres
Publié: (2025)
Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning
par: Yan, Shaotian, et autres
Publié: (2026)
par: Yan, Shaotian, et autres
Publié: (2026)
Orchestrating Intelligence: Confidence-Aware Routing for Efficient Multi-Agent Collaboration across Multi-Scale Models
par: Wang, Jingbo, et autres
Publié: (2026)
par: Wang, Jingbo, et autres
Publié: (2026)
SL-BiLEM: Structured Learnable Behavior-in-the-Loop Epidemic Modeling for Forecasting and Policy Evaluation
par: Wang, Haochun, et autres
Publié: (2026)
par: Wang, Haochun, et autres
Publié: (2026)
Anchoring Refusal Direction: Mitigating Safety Risks in Tuning via Projection Constraint
par: Du, Yanrui, et autres
Publié: (2025)
par: Du, Yanrui, et autres
Publié: (2025)
Generating Effective CoT Traces for Mitigating Causal Hallucination
par: Zhao, Yiheng, et autres
Publié: (2026)
par: Zhao, Yiheng, et autres
Publié: (2026)
Don't Ignore Dual Logic Ability of LLMs while Privatizing: A Data-Intensive Analysis in Medical Domain
par: Du, Yanrui, et autres
Publié: (2023)
par: Du, Yanrui, et autres
Publié: (2023)
MolFusion: Multimodal Fusion Learning for Molecular Representations via Multi-granularity Views
par: Cai, Muzhen, et autres
Publié: (2024)
par: Cai, Muzhen, et autres
Publié: (2024)
Mol-R1: Towards Explicit Long-CoT Reasoning in Molecule Discovery
par: Li, Jiatong, et autres
Publié: (2025)
par: Li, Jiatong, et autres
Publié: (2025)
Dual-Track CoT: Budget-Aware Stepwise Guidance for Small LMs
par: Chatterjee, Sagnik, et autres
Publié: (2026)
par: Chatterjee, Sagnik, et autres
Publié: (2026)
Documents similaires
-
From Artificially Real to Real: Leveraging Pseudo Data from Large Language Models for Low-Resource Molecule Discovery
par: Chen, Yuhan, et autres
Publié: (2023) -
Beyond Direct Diagnosis: LLM-based Multi-Specialist Agent Consultation for Automatic Diagnosis
par: Wang, Haochun, et autres
Publié: (2024) -
LLMs May Perform MCQA by Selecting the Least Incorrect Option
par: Wang, Haochun, et autres
Publié: (2024) -
Manifold-based Verbalizer Space Re-embedding for Tuning-free Prompt-based Classification
par: Wang, Haochun, et autres
Publié: (2023) -
Knowledge-tuning Large Language Models with Structured Medical Knowledge Bases for Reliable Response Generation in Chinese
par: Wang, Haochun, et autres
Publié: (2023)