NEX: Neuron Explore-Exploit Scoring for Label-Free Chain-of-Thought Selection and Model Ranking
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Kang, Feng, Zhuoka, Zhao, Sihan, Xiong, Kai, Nian, Junjie, Wang, Yaoning, Xiao, Changyi, Cao, Yixin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ARM: Role-Conditioned Neuron Transplantation for Training-Free Generalist LLM Agent Merging
por: Feng, Zhuoka, et al.
Publicado: (2026)
por: Feng, Zhuoka, et al.
Publicado: (2026)
Do LLMs Signal When They're Right? Evidence from Neuron Agreement
por: Chen, Kang, et al.
Publicado: (2025)
por: Chen, Kang, et al.
Publicado: (2025)
Thinking Traps in Long Chain-of-Thought: A Measurable Study and Trap-Aware Adaptive Restart
por: Chen, Kang, et al.
Publicado: (2026)
por: Chen, Kang, et al.
Publicado: (2026)
SliceGraph: Mapping Process Isomers in Multi-Run Chain-of-Thought Reasoning
por: Chen, Kang, et al.
Publicado: (2026)
por: Chen, Kang, et al.
Publicado: (2026)
Complex Logical Query Answering by Calibrating Knowledge Graph Completion Models
por: Xiao, Changyi, et al.
Publicado: (2024)
por: Xiao, Changyi, et al.
Publicado: (2024)
Knowledge Graph Completion by Intermediate Variables Regularization
por: Xiao, Changyi, et al.
Publicado: (2025)
por: Xiao, Changyi, et al.
Publicado: (2025)
Long or short CoT? Investigating Instance-level Switch of Large Reasoning Models
por: Zhang, Ruiqi, et al.
Publicado: (2025)
por: Zhang, Ruiqi, et al.
Publicado: (2025)
BNPO: Beta Normalization Policy Optimization
por: Xiao, Changyi, et al.
Publicado: (2025)
por: Xiao, Changyi, et al.
Publicado: (2025)
Knowledge Graph Embedding by Normalizing Flows
por: Xiao, Changyi, et al.
Publicado: (2024)
por: Xiao, Changyi, et al.
Publicado: (2024)
Reinforcement Learning with Conditional Expectation Reward
por: Xiao, Changyi, et al.
Publicado: (2026)
por: Xiao, Changyi, et al.
Publicado: (2026)
Learning to Rank Chain-of-Thought: Using a Small Model
por: Jiang, Eric Hanchen, et al.
Publicado: (2025)
por: Jiang, Eric Hanchen, et al.
Publicado: (2025)
TraceGraph: Shared Decision Landscapes for Diagnosing and Improving Agent Trajectories
por: Nian, Junjie, et al.
Publicado: (2026)
por: Nian, Junjie, et al.
Publicado: (2026)
EffiEval: Efficient and Generalizable Model Evaluation via Capability Coverage Maximization
por: Wang, Yaoning, et al.
Publicado: (2025)
por: Wang, Yaoning, et al.
Publicado: (2025)
Automatic Prompt Augmentation and Selection with Chain-of-Thought from Labeled Data
por: Shum, KaShun, et al.
Publicado: (2023)
por: Shum, KaShun, et al.
Publicado: (2023)
SCALER:Synthetic Scalable Adaptive Learning Environment for Reasoning
por: Xu, Caijun, et al.
Publicado: (2026)
por: Xu, Caijun, et al.
Publicado: (2026)
Thoughts-as-Planning: Latent World Models for Chain-of-Thoughts Optimization via Reinforcement Planning
por: Liu, Dong, et al.
Publicado: (2026)
por: Liu, Dong, et al.
Publicado: (2026)
Ehrenfeucht-Haussler Rank and Chain of Thought
por: Barceló, Pablo, et al.
Publicado: (2025)
por: Barceló, Pablo, et al.
Publicado: (2025)
Diagnosing and Remedying Knowledge Deficiencies in LLMs via Label-free Curricular Meaningful Learning
por: Xiong, Kai, et al.
Publicado: (2024)
por: Xiong, Kai, et al.
Publicado: (2024)
NEX FRONTIERS: CHANGING CHANNELS FOROOHAR, RANA
Publicado: (2005)
Publicado: (2005)
Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
por: Yuan, Aojie, et al.
Publicado: (2026)
por: Yuan, Aojie, et al.
Publicado: (2026)
Model Utility Law: Evaluating LLMs beyond Performance through Mechanism Interpretable Metric
por: Cao, Yixin, et al.
Publicado: (2025)
por: Cao, Yixin, et al.
Publicado: (2025)
Thought Purity: A Defense Framework For Chain-of-Thought Attack
por: Xue, Zihao, et al.
Publicado: (2025)
por: Xue, Zihao, et al.
Publicado: (2025)
Tailed Low-Rank Matrix Factorization for Similarity Matrix Completion
por: Ma, Changyi, et al.
Publicado: (2024)
por: Ma, Changyi, et al.
Publicado: (2024)
Mitigating Misleading Chain-of-Thought Reasoning with Selective Filtering
por: Wu, Yexin, et al.
Publicado: (2024)
por: Wu, Yexin, et al.
Publicado: (2024)
MEMLA: Enhancing Multilingual Knowledge Editing with Neuron-Masked Low-Rank Adaptation
por: Xie, Jiakuan, et al.
Publicado: (2024)
por: Xie, Jiakuan, et al.
Publicado: (2024)
Explainable Action Form Assessment by Exploiting Multimodal Chain-of-Thoughts Reasoning
por: Qi, Mengshi, et al.
Publicado: (2025)
por: Qi, Mengshi, et al.
Publicado: (2025)
An Empirical Study of Retrieval Augmented Generation with Chain-of-Thought
por: Zhao, Yuetong, et al.
Publicado: (2024)
por: Zhao, Yuetong, et al.
Publicado: (2024)
Chain of Event-Centric Causal Thought for Physically Plausible Video Generation
por: Wang, Zixuan, et al.
Publicado: (2026)
por: Wang, Zixuan, et al.
Publicado: (2026)
Applying Large Language Models and Chain-of-Thought for Automatic Scoring
por: Lee, Gyeong-Geon, et al.
Publicado: (2023)
por: Lee, Gyeong-Geon, et al.
Publicado: (2023)
Towards Better Chain-of-Thought: A Reflection on Effectiveness and Faithfulness
por: Li, Jiachun, et al.
Publicado: (2024)
por: Li, Jiachun, et al.
Publicado: (2024)
Pairwise Similarity Distribution Clustering for Noisy Label Learning
por: Bai, Sihan
Publicado: (2024)
por: Bai, Sihan
Publicado: (2024)
How Many Validation Labels Do You Need? Exploring the Design Space of Label-Efficient Model Ranking
por: Hu, Zhengyu, et al.
Publicado: (2023)
por: Hu, Zhengyu, et al.
Publicado: (2023)
RaCT: Ranking-aware Chain-of-Thought Optimization for LLMs
por: Liu, Haowei, et al.
Publicado: (2024)
por: Liu, Haowei, et al.
Publicado: (2024)
Student-in-the-Loop Chain-of-Thought Distillation via Generation-Time Selection
por: He, Chaoqun, et al.
Publicado: (2026)
por: He, Chaoqun, et al.
Publicado: (2026)
RankCoT: Refining Knowledge for Retrieval-Augmented Generation through Ranking Chain-of-Thoughts
por: Wu, Mingyan, et al.
Publicado: (2025)
por: Wu, Mingyan, et al.
Publicado: (2025)
Think When You Need: Self-Adaptive Chain-of-Thought Learning
por: Yang, Junjie, et al.
Publicado: (2025)
por: Yang, Junjie, et al.
Publicado: (2025)
Interleaved-Modal Chain-of-Thought
por: Gao, Jun, et al.
Publicado: (2024)
por: Gao, Jun, et al.
Publicado: (2024)
Capabilities and Fundamental Limits of Latent Chain-of-Thought
por: Zou, Jiaxuan, et al.
Publicado: (2026)
por: Zou, Jiaxuan, et al.
Publicado: (2026)
Fractured Chain-of-Thought Reasoning
por: Liao, Baohao, et al.
Publicado: (2025)
por: Liao, Baohao, et al.
Publicado: (2025)
Examining Inter-Consistency of Large Language Models Collaboration: An In-depth Analysis via Debate
por: Xiong, Kai, et al.
Publicado: (2023)
por: Xiong, Kai, et al.
Publicado: (2023)
Ejemplares similares
-
ARM: Role-Conditioned Neuron Transplantation for Training-Free Generalist LLM Agent Merging
por: Feng, Zhuoka, et al.
Publicado: (2026) -
Do LLMs Signal When They're Right? Evidence from Neuron Agreement
por: Chen, Kang, et al.
Publicado: (2025) -
Thinking Traps in Long Chain-of-Thought: A Measurable Study and Trap-Aware Adaptive Restart
por: Chen, Kang, et al.
Publicado: (2026) -
SliceGraph: Mapping Process Isomers in Multi-Run Chain-of-Thought Reasoning
por: Chen, Kang, et al.
Publicado: (2026) -
Complex Logical Query Answering by Calibrating Knowledge Graph Completion Models
por: Xiao, Changyi, et al.
Publicado: (2024)