CyclicReflex: Improving Reasoning Models via Cyclical Reflection Token Scheduling
Fuente:
arXiv
Guardado en:
| Autores principales: | Fan, Chongyu, Zhang, Yihua, Jia, Jinghan, Hero, Alfred, Liu, Sijia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond
por: Fan, Chongyu, et al.
Publicado: (2025)
por: Fan, Chongyu, et al.
Publicado: (2025)
Challenging Forgets: Unveiling the Worst-Case Forget Sets in Machine Unlearning
por: Fan, Chongyu, et al.
Publicado: (2024)
por: Fan, Chongyu, et al.
Publicado: (2024)
Beyond SFT: Reinforcement Learning for Safer Large Reasoning Models with Better Reasoning Ability
por: Jia, Jinghan, et al.
Publicado: (2025)
por: Jia, Jinghan, et al.
Publicado: (2025)
Simplicity Prevails: Rethinking Negative Preference Optimization for LLM Unlearning
por: Fan, Chongyu, et al.
Publicado: (2024)
por: Fan, Chongyu, et al.
Publicado: (2024)
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
por: Zhuang, Haomin, et al.
Publicado: (2024)
por: Zhuang, Haomin, et al.
Publicado: (2024)
SOUL: Unlocking the Power of Second-Order Optimization for LLM Unlearning
por: Jia, Jinghan, et al.
Publicado: (2024)
por: Jia, Jinghan, et al.
Publicado: (2024)
Reasoning Model Unlearning: Forgetting Traces, Not Just Answers, While Preserving Reasoning Skills
por: Wang, Changsheng, et al.
Publicado: (2025)
por: Wang, Changsheng, et al.
Publicado: (2025)
One Token Embedding Is Enough to Deadlock Your Large Reasoning Model
por: Zhang, Mohan, et al.
Publicado: (2025)
por: Zhang, Mohan, et al.
Publicado: (2025)
Defensive Unlearning with Adversarial Training for Robust Concept Erasure in Diffusion Models
por: Zhang, Yimeng, et al.
Publicado: (2024)
por: Zhang, Yimeng, et al.
Publicado: (2024)
Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning
por: Lang, Yicheng, et al.
Publicado: (2025)
por: Lang, Yicheng, et al.
Publicado: (2025)
LLM Unlearning Under the Microscope: A Full-Stack View on Methods and Metrics
por: Fan, Chongyu, et al.
Publicado: (2025)
por: Fan, Chongyu, et al.
Publicado: (2025)
Zero Token-Driven Deep Thinking in LLMs: Unlocking the Full Potential of Existing Parameters via Cyclic Refinement
por: Li, Guanghao, et al.
Publicado: (2025)
por: Li, Guanghao, et al.
Publicado: (2025)
Improved Neural Protoform Reconstruction via Reflex Prediction
por: Lu, Liang, et al.
Publicado: (2024)
por: Lu, Liang, et al.
Publicado: (2024)
A Multiscale Geometric Method for Capturing Relational Topic Alignment
por: Hougen, Conrad D., et al.
Publicado: (2025)
por: Hougen, Conrad D., et al.
Publicado: (2025)
UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models
por: Zhang, Yihua, et al.
Publicado: (2024)
por: Zhang, Yihua, et al.
Publicado: (2024)
Vision-Language Models Can Self-Improve Reasoning via Reflection
por: Cheng, Kanzhi, et al.
Publicado: (2024)
por: Cheng, Kanzhi, et al.
Publicado: (2024)
Token Assorted: Mixing Latent and Text Tokens for Improved Language Model Reasoning
por: Su, DiJia, et al.
Publicado: (2025)
por: Su, DiJia, et al.
Publicado: (2025)
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
por: Jia, Jinghan, et al.
Publicado: (2026)
por: Jia, Jinghan, et al.
Publicado: (2026)
Improve Decoding Factuality by Token-wise Cross Layer Entropy of Large Language Models
por: Wu, Jialiang, et al.
Publicado: (2025)
por: Wu, Jialiang, et al.
Publicado: (2025)
Forgetting to Forget: Attention Sink as A Gateway for Backdooring LLM Unlearning
por: Shang, Bingqi, et al.
Publicado: (2025)
por: Shang, Bingqi, et al.
Publicado: (2025)
EPiC: Towards Lossless Speedup for Reasoning Training through Edge-Preserving CoT Condensation
por: Jia, Jinghan, et al.
Publicado: (2025)
por: Jia, Jinghan, et al.
Publicado: (2025)
Bring Reason to Vision: Understanding Perception and Reasoning through Model Merging
por: Chen, Shiqi, et al.
Publicado: (2025)
por: Chen, Shiqi, et al.
Publicado: (2025)
Cyclic Proofs in Hoare Logic and its Reverse
por: Brotherston, James, et al.
Publicado: (2025)
por: Brotherston, James, et al.
Publicado: (2025)
Disentangling Reasoning Tokens and Boilerplate Tokens For Language Model Fine-tuning
por: Ye, Ziang, et al.
Publicado: (2024)
por: Ye, Ziang, et al.
Publicado: (2024)
CyclicJudge: Mitigating Judge Bias Efficiently in LLM-based Evaluation
por: Zhu, Ziyi, et al.
Publicado: (2026)
por: Zhu, Ziyi, et al.
Publicado: (2026)
Complete the Cycle: Reachability Types with Expressive Cyclic References (Extended Version)
por: Deng, Haotian, et al.
Publicado: (2025)
por: Deng, Haotian, et al.
Publicado: (2025)
Instruct-of-Reflection: Enhancing Large Language Models Iterative Reflection Capabilities via Dynamic-Meta Instruction
por: Liu, Liping, et al.
Publicado: (2025)
por: Liu, Liping, et al.
Publicado: (2025)
FINEREASON: Evaluating and Improving LLMs' Deliberate Reasoning through Reflective Puzzle Solving
por: Chen, Guizhen, et al.
Publicado: (2025)
por: Chen, Guizhen, et al.
Publicado: (2025)
Learn Beyond The Answer: Training Language Models with Reflection for Mathematical Reasoning
por: Zhang, Zhihan, et al.
Publicado: (2024)
por: Zhang, Zhihan, et al.
Publicado: (2024)
Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment
por: Huang, Yucong, et al.
Publicado: (2026)
por: Huang, Yucong, et al.
Publicado: (2026)
Think Clearly: Improving Reasoning via Redundant Token Pruning
por: Choi, Daewon, et al.
Publicado: (2025)
por: Choi, Daewon, et al.
Publicado: (2025)
iCLP: Large Language Model Reasoning with Implicit Cognition Latent Planning
por: Chen, Sijia, et al.
Publicado: (2025)
por: Chen, Sijia, et al.
Publicado: (2025)
Blind Spot Navigation in Large Language Model Reasoning with Thought Space Explorer
por: Zhang, Jinghan, et al.
Publicado: (2024)
por: Zhang, Jinghan, et al.
Publicado: (2024)
Enhancing Large Language Model Reasoning via Selective Critical Token Fine-Tuning
por: Ruan, Zhiwen, et al.
Publicado: (2025)
por: Ruan, Zhiwen, et al.
Publicado: (2025)
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
por: Zhang, Zihou, et al.
Publicado: (2026)
por: Zhang, Zihou, et al.
Publicado: (2026)
Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models
por: Liu, Kaiyuan, et al.
Publicado: (2025)
por: Liu, Kaiyuan, et al.
Publicado: (2025)
Arithmetic in the Wild: Llama uses Base-10 Addition to Reason About Cyclic Concepts
por: Feucht, Sheridan, et al.
Publicado: (2026)
por: Feucht, Sheridan, et al.
Publicado: (2026)
RATT: A Thought Structure for Coherent and Correct LLM Reasoning
por: Zhang, Jinghan, et al.
Publicado: (2024)
por: Zhang, Jinghan, et al.
Publicado: (2024)
SEED: Accelerating Reasoning Tree Construction via Scheduled Speculative Decoding
por: Wang, Zhenglin, et al.
Publicado: (2024)
por: Wang, Zhenglin, et al.
Publicado: (2024)
Order Matters in Hallucination: Reasoning Order as Benchmark and Reflexive Prompting for Large-Language-Models
por: Xie, Zikai
Publicado: (2024)
por: Xie, Zikai
Publicado: (2024)
Ejemplares similares
-
Towards LLM Unlearning Resilient to Relearning Attacks: A Sharpness-Aware Minimization Perspective and Beyond
por: Fan, Chongyu, et al.
Publicado: (2025) -
Challenging Forgets: Unveiling the Worst-Case Forget Sets in Machine Unlearning
por: Fan, Chongyu, et al.
Publicado: (2024) -
Beyond SFT: Reinforcement Learning for Safer Large Reasoning Models with Better Reasoning Ability
por: Jia, Jinghan, et al.
Publicado: (2025) -
Simplicity Prevails: Rethinking Negative Preference Optimization for LLM Unlearning
por: Fan, Chongyu, et al.
Publicado: (2024) -
SEUF: Is Unlearning One Expert Enough for Mixture-of-Experts LLMs?
por: Zhuang, Haomin, et al.
Publicado: (2024)