Analyzing the Power of Chain of Thought through Memorization Capabilities
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Lijia, Gao, Xiao-Shan, Zhang, Lijun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generalizability of Memorization Neural Networks
di: Yu, Lijia, et al.
Pubblicazione: (2024)
di: Yu, Lijia, et al.
Pubblicazione: (2024)
Generalizability of Neural Networks Minimizing Empirical Risk Based on Expressive Ability
di: Yu, Lijia, et al.
Pubblicazione: (2025)
di: Yu, Lijia, et al.
Pubblicazione: (2025)
Generalization Bound and New Algorithm for Clean-Label Backdoor Attack
di: Yu, Lijia, et al.
Pubblicazione: (2024)
di: Yu, Lijia, et al.
Pubblicazione: (2024)
Provable Watermarking for Data Poisoning Attacks
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
PowerMLP: An Efficient Version of KAN
di: Qiu, Ruichen, et al.
Pubblicazione: (2024)
di: Qiu, Ruichen, et al.
Pubblicazione: (2024)
Analyzing Memorization in Large Language Models through the Lens of Model Attribution
di: Menta, Tarun Ram, et al.
Pubblicazione: (2025)
di: Menta, Tarun Ram, et al.
Pubblicazione: (2025)
Capabilities and Fundamental Limits of Latent Chain-of-Thought
di: Zou, Jiaxuan, et al.
Pubblicazione: (2026)
di: Zou, Jiaxuan, et al.
Pubblicazione: (2026)
Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers
di: Huang, Xingyue, et al.
Pubblicazione: (2025)
di: Huang, Xingyue, et al.
Pubblicazione: (2025)
Chain of Preference Optimization: Improving Chain-of-Thought Reasoning in LLMs
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
di: Zhang, Xuan, et al.
Pubblicazione: (2024)
Analyzing and Improving Chain-of-Thought Monitorability Through Information Theory
di: Anwar, Usman, et al.
Pubblicazione: (2026)
di: Anwar, Usman, et al.
Pubblicazione: (2026)
The Expressive Power of Transformers with Chain of Thought
di: Merrill, William, et al.
Pubblicazione: (2023)
di: Merrill, William, et al.
Pubblicazione: (2023)
Enhancing Auto-regressive Chain-of-Thought through Loop-Aligned Reasoning
di: Yu, Qifan, et al.
Pubblicazione: (2025)
di: Yu, Qifan, et al.
Pubblicazione: (2025)
Analysis of the Memorization and Generalization Capabilities of AI Agents: Are Continual Learners Robust?
di: Kim, Minsu, et al.
Pubblicazione: (2023)
di: Kim, Minsu, et al.
Pubblicazione: (2023)
Understanding Chain-of-Thought in LLMs through Information Theory
di: Ton, Jean-Francois, et al.
Pubblicazione: (2024)
di: Ton, Jean-Francois, et al.
Pubblicazione: (2024)
Interleaved-Modal Chain-of-Thought
di: Gao, Jun, et al.
Pubblicazione: (2024)
di: Gao, Jun, et al.
Pubblicazione: (2024)
Convergence and Emergence of In-Context Reinforcement Learning with Chain of Thought
di: Xie, Zixuan, et al.
Pubblicazione: (2026)
di: Xie, Zixuan, et al.
Pubblicazione: (2026)
Pause and Reflect: Conformal Aggregation for Chain-of-Thought Reasoning
di: Gu, Yu, et al.
Pubblicazione: (2026)
di: Gu, Yu, et al.
Pubblicazione: (2026)
CTRLS: Chain-of-Thought Reasoning via Latent State-Transition
di: Wu, Junda, et al.
Pubblicazione: (2025)
di: Wu, Junda, et al.
Pubblicazione: (2025)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
di: Ye, Jiacheng, et al.
Pubblicazione: (2024)
Continuous Chain of Thought Enables Parallel Exploration and Reasoning
di: Gozeten, Halil Alperen, et al.
Pubblicazione: (2025)
di: Gozeten, Halil Alperen, et al.
Pubblicazione: (2025)
Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
The Expressive Power of Low Precision Softmax Transformers with (Summarized) Chain-of-Thought
di: Brösamle, Moritz, et al.
Pubblicazione: (2026)
di: Brösamle, Moritz, et al.
Pubblicazione: (2026)
Chain-of-Thought and Compressed Looped Transformers: A Memory-Budget Separation
di: Zhang, Haozhou
Pubblicazione: (2026)
di: Zhang, Haozhou
Pubblicazione: (2026)
On the Cost and Benefit of Chain of Thought: A Learning-Theoretic Perspective
di: Zhang, Yue, et al.
Pubblicazione: (2026)
di: Zhang, Yue, et al.
Pubblicazione: (2026)
Deep Thinking by Markov Chain of Continuous Thoughts
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
di: Liu, Jiayu, et al.
Pubblicazione: (2025)
On Learning Verifiers and Implications to Chain-of-Thought Reasoning
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
di: Balcan, Maria-Florina, et al.
Pubblicazione: (2025)
Transformers Provably Learn to Internalize Chain-of-Thought
di: Huang, Yixiao, et al.
Pubblicazione: (2026)
di: Huang, Yixiao, et al.
Pubblicazione: (2026)
Re-understanding Graph Unlearning through Memorization
di: Ding, Pengfei, et al.
Pubblicazione: (2026)
di: Ding, Pengfei, et al.
Pubblicazione: (2026)
Generating Chain-of-Thoughts with a Pairwise-Comparison Approach to Searching for the Most Promising Intermediate Thought
di: Zhang, Zhen-Yu, et al.
Pubblicazione: (2024)
di: Zhang, Zhen-Yu, et al.
Pubblicazione: (2024)
Constraint-Rectified Training for Efficient Chain-of-Thought
di: Wu, Qinhang, et al.
Pubblicazione: (2026)
di: Wu, Qinhang, et al.
Pubblicazione: (2026)
Curriculum Learning for Efficient Chain-of-Thought Distillation via Structure-Aware Masking and GRPO
di: Yu, Bowen, et al.
Pubblicazione: (2026)
di: Yu, Bowen, et al.
Pubblicazione: (2026)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
Exploring Chain-of-Thought Reasoning for Steerable Pluralistic Alignment
di: Zhang, Yunfan, et al.
Pubblicazione: (2025)
di: Zhang, Yunfan, et al.
Pubblicazione: (2025)
Asynchronous Personalized Federated Learning through Global Memorization
di: Wan, Fan, et al.
Pubblicazione: (2025)
di: Wan, Fan, et al.
Pubblicazione: (2025)
Chain-of-Thought Predictive Control
di: Jia, Zhiwei, et al.
Pubblicazione: (2023)
di: Jia, Zhiwei, et al.
Pubblicazione: (2023)
PA3: Policy-Aware Agent Alignment through Chain-of-Thought
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2026)
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2026)
Reasoning Models Sometimes Output Illegible Chains of Thought
di: Jose, Arun
Pubblicazione: (2025)
di: Jose, Arun
Pubblicazione: (2025)
Latent Chain-of-Thought Improves Structured-Data Transformers
di: Dudley, Carson, et al.
Pubblicazione: (2026)
di: Dudley, Carson, et al.
Pubblicazione: (2026)
Transformers Provably Solve Parity Efficiently with Chain of Thought
di: Kim, Juno, et al.
Pubblicazione: (2024)
di: Kim, Juno, et al.
Pubblicazione: (2024)
Ehrenfeucht-Haussler Rank and Chain of Thought
di: Barceló, Pablo, et al.
Pubblicazione: (2025)
di: Barceló, Pablo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generalizability of Memorization Neural Networks
di: Yu, Lijia, et al.
Pubblicazione: (2024) -
Generalizability of Neural Networks Minimizing Empirical Risk Based on Expressive Ability
di: Yu, Lijia, et al.
Pubblicazione: (2025) -
Generalization Bound and New Algorithm for Clean-Label Backdoor Attack
di: Yu, Lijia, et al.
Pubblicazione: (2024) -
Provable Watermarking for Data Poisoning Attacks
di: Zhu, Yifan, et al.
Pubblicazione: (2025) -
PowerMLP: An Efficient Version of KAN
di: Qiu, Ruichen, et al.
Pubblicazione: (2024)