Amplify Adjacent Token Differences: Enhancing Long Chain-of-Thought Reasoning with Shift-FFN
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Yao, Xu, Mingyu, Lei, Fangyu, Sun, Wangtao, Zeng, Xiangrong, Wang, Bingning, Liu, Guang, He, Shizhu, Zhao, Jun, Liu, Kang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LLaSA: Large Language and Structured Data Assistant
por: Xu, Yao, et al.
Publicado: (2024)
por: Xu, Yao, et al.
Publicado: (2024)
From Chain to Tree: Refining Chain-like Rules into Tree-like Rules on Knowledge Graphs
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
KV Shifting Attention Enhances Language Modeling
por: Xu, Mingyu, et al.
Publicado: (2024)
por: Xu, Mingyu, et al.
Publicado: (2024)
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
por: Sun, Wangtao, et al.
Publicado: (2023)
por: Sun, Wangtao, et al.
Publicado: (2023)
Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
por: Lei, Fangyu, et al.
Publicado: (2025)
por: Lei, Fangyu, et al.
Publicado: (2025)
ItD: Large Language Models Can Teach Themselves Induction through Deduction
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
Towards Agentic Self-Learning LLMs in Search Environment
por: Sun, Wangtao, et al.
Publicado: (2025)
por: Sun, Wangtao, et al.
Publicado: (2025)
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
por: Lei, Fangyu, et al.
Publicado: (2023)
por: Lei, Fangyu, et al.
Publicado: (2023)
MoELoRA: Contrastive Learning Guided Mixture of Experts on Parameter-Efficient Fine-Tuning for Large Language Models
por: Luo, Tongxu, et al.
Publicado: (2024)
por: Luo, Tongxu, et al.
Publicado: (2024)
Probabilistic Uncertain Reward Model
por: Sun, Wangtao, et al.
Publicado: (2025)
por: Sun, Wangtao, et al.
Publicado: (2025)
Shuttle Between the Instructions and the Parameters of Large Language Models
por: Sun, Wangtao, et al.
Publicado: (2025)
por: Sun, Wangtao, et al.
Publicado: (2025)
Neural-Symbolic Collaborative Distillation: Advancing Small Language Models for Complex Reasoning Tasks
por: Liao, Huanxuan, et al.
Publicado: (2024)
por: Liao, Huanxuan, et al.
Publicado: (2024)
Improve Rule Retrieval and Reasoning with Self-Induction and Relevance ReEstimate
por: Huang, Ziyang, et al.
Publicado: (2025)
por: Huang, Ziyang, et al.
Publicado: (2025)
S$^3$HQA: A Three-Stage Approach for Multi-hop Text-Table Hybrid Question Answering
por: Lei, Fangyu, et al.
Publicado: (2023)
por: Lei, Fangyu, et al.
Publicado: (2023)
Token Signature: Predicting Chain-of-Thought Gains with Token Decoding Feature in Large Language Models
por: Liu, Peijie, et al.
Publicado: (2025)
por: Liu, Peijie, et al.
Publicado: (2025)
SoftCoT: Soft Chain-of-Thought for Efficient Reasoning with LLMs
por: Xu, Yige, et al.
Publicado: (2025)
por: Xu, Yige, et al.
Publicado: (2025)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
por: Chen, Qiguang, et al.
Publicado: (2026)
por: Chen, Qiguang, et al.
Publicado: (2026)
SoftCoT++: Test-Time Scaling with Soft Chain-of-Thought Reasoning
por: Xu, Yige, et al.
Publicado: (2025)
por: Xu, Yige, et al.
Publicado: (2025)
The Zero-Step Thinking: An Empirical Study of Mode Selection as Harder Early Exit in Reasoning Models
por: Tan, Yuqiao, et al.
Publicado: (2025)
por: Tan, Yuqiao, et al.
Publicado: (2025)
Feature Extraction and Steering for Enhanced Chain-of-Thought Reasoning in Language Models
por: Li, Zihao, et al.
Publicado: (2025)
por: Li, Zihao, et al.
Publicado: (2025)
ImgCoT: Compressing Long Chain of Thought into Compact Visual Tokens for Efficient Reasoning of Large Language Model
por: Chen, Xiaoshu, et al.
Publicado: (2026)
por: Chen, Xiaoshu, et al.
Publicado: (2026)
Reason from Future: Reverse Thought Chain Enhances LLM Reasoning
por: Xu, Yinlong, et al.
Publicado: (2025)
por: Xu, Yinlong, et al.
Publicado: (2025)
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
por: Yu, Qifan, et al.
Publicado: (2025)
por: Yu, Qifan, et al.
Publicado: (2025)
Preemptive Answer "Attacks" on Chain-of-Thought Reasoning
por: Xu, Rongwu, et al.
Publicado: (2024)
por: Xu, Rongwu, et al.
Publicado: (2024)
Let's Think with Images Efficiently! An Interleaved-Modal Chain-of-Thought Reasoning Framework with Dynamic and Precise Visual Thoughts
por: Liu, Xu, et al.
Publicado: (2026)
por: Liu, Xu, et al.
Publicado: (2026)
Scalable Chain of Thoughts via Elastic Reasoning
por: Xu, Yuhui, et al.
Publicado: (2025)
por: Xu, Yuhui, et al.
Publicado: (2025)
SafeChain: Safety of Language Models with Long Chain-of-Thought Reasoning Capabilities
por: Jiang, Fengqing, et al.
Publicado: (2025)
por: Jiang, Fengqing, et al.
Publicado: (2025)
Streaming Hallucination Detection in Long Chain-of-Thought Reasoning
por: Lu, Haolang, et al.
Publicado: (2026)
por: Lu, Haolang, et al.
Publicado: (2026)
Pretraining with Token-Level Adaptive Latent Chain-of-Thought
por: Zeng, Boyi, et al.
Publicado: (2026)
por: Zeng, Boyi, et al.
Publicado: (2026)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
por: Mu, Yongyu, et al.
Publicado: (2025)
por: Mu, Yongyu, et al.
Publicado: (2025)
Query2Triple: Unified Query Encoding for Answering Diverse Complex Queries over Knowledge Graphs
por: Xu, Yao, et al.
Publicado: (2023)
por: Xu, Yao, et al.
Publicado: (2023)
Beyond Hard and Soft: Hybrid Context Compression for Balancing Local and Global Information Retention
por: Liao, Huanxuan, et al.
Publicado: (2025)
por: Liao, Huanxuan, et al.
Publicado: (2025)
Beyond Chain-of-Thought, Effective Graph-of-Thought Reasoning in Language Models
por: Yao, Yao, et al.
Publicado: (2023)
por: Yao, Yao, et al.
Publicado: (2023)
Fractured Chain-of-Thought Reasoning
por: Liao, Baohao, et al.
Publicado: (2025)
por: Liao, Baohao, et al.
Publicado: (2025)
Beyond Instruction Following: Evaluating Inferential Rule Following of Large Language Models
por: Sun, Wangtao, et al.
Publicado: (2024)
por: Sun, Wangtao, et al.
Publicado: (2024)
Demystifying Long Chain-of-Thought Reasoning in LLMs
por: Yeo, Edward, et al.
Publicado: (2025)
por: Yeo, Edward, et al.
Publicado: (2025)
Long Chain-of-Thought Reasoning Across Languages
por: Barua, Josh, et al.
Publicado: (2025)
por: Barua, Josh, et al.
Publicado: (2025)
Generate-on-Graph: Treat LLM as both Agent and KG in Incomplete Knowledge Graph Question Answering
por: Xu, Yao, et al.
Publicado: (2024)
por: Xu, Yao, et al.
Publicado: (2024)
Faithful Logical Reasoning via Symbolic Chain-of-Thought
por: Xu, Jundong, et al.
Publicado: (2024)
por: Xu, Jundong, et al.
Publicado: (2024)
What Makes a Good Reasoning Chain? Uncovering Structural Patterns in Long Chain-of-Thought Reasoning
por: Jiang, Gangwei, et al.
Publicado: (2025)
por: Jiang, Gangwei, et al.
Publicado: (2025)
Ejemplares similares
-
LLaSA: Large Language and Structured Data Assistant
por: Xu, Yao, et al.
Publicado: (2024) -
From Chain to Tree: Refining Chain-like Rules into Tree-like Rules on Knowledge Graphs
por: Sun, Wangtao, et al.
Publicado: (2024) -
KV Shifting Attention Enhances Language Modeling
por: Xu, Mingyu, et al.
Publicado: (2024) -
ExpNote: Black-box Large Language Models are Better Task Solvers with Experience Notebook
por: Sun, Wangtao, et al.
Publicado: (2023) -
Reasoning-Table: Exploring Reinforcement Learning for Table Reasoning
por: Lei, Fangyu, et al.
Publicado: (2025)