Exploring the Hidden Reasoning Process of Large Language Models by Misleading Them
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Guanyu, Wang, Peiyang, Jiang, Yizhou, Liu, Yuqian, Zhao, Chujie, Fang, Ying, Zhang, Tianren, Chen, Feng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Feature contamination: Neural networks learn uncorrelated features and fail to generalize
di: Zhang, Tianren, et al.
Pubblicazione: (2024)
di: Zhang, Tianren, et al.
Pubblicazione: (2024)
Preserving Silent Features for Domain Generalization
di: Zhao, Chujie, et al.
Pubblicazione: (2024)
di: Zhao, Chujie, et al.
Pubblicazione: (2024)
When Do Neural Networks Learn World Models?
di: Zhang, Tianren, et al.
Pubblicazione: (2025)
di: Zhang, Tianren, et al.
Pubblicazione: (2025)
A method of supervised learning from conflicting data with hidden contexts
di: Zhang, Tianren, et al.
Pubblicazione: (2021)
di: Zhang, Tianren, et al.
Pubblicazione: (2021)
Reconciling In-Context and In-Weight Learning via Dual Representation Space Encoding
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
Large Language Model Reasoning Failures
di: Song, Peiyang, et al.
Pubblicazione: (2026)
di: Song, Peiyang, et al.
Pubblicazione: (2026)
Discovering and Reasoning of Causality in the Hidden World with Large Language Models
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
Exploring the Potential of the Large Language Models (LLMs) in Identifying Misleading News Headlines
di: Rony, Md Main Uddin, et al.
Pubblicazione: (2024)
di: Rony, Md Main Uddin, et al.
Pubblicazione: (2024)
Fantastic Reasoning Behaviors and Where to Find Them: Unsupervised Discovery of the Reasoning Process
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
di: Zhang, Zhenyu, et al.
Pubblicazione: (2025)
The Lessons of Developing Process Reward Models in Mathematical Reasoning
di: Zhang, Zhenru, et al.
Pubblicazione: (2025)
di: Zhang, Zhenru, et al.
Pubblicazione: (2025)
Efficient Reasoning with Hidden Thinking
di: Shen, Xuan, et al.
Pubblicazione: (2025)
di: Shen, Xuan, et al.
Pubblicazione: (2025)
Watch Out for Your Guidance on Generation! Exploring Conditional Backdoor Attacks against Large Language Models
di: He, Jiaming, et al.
Pubblicazione: (2024)
di: He, Jiaming, et al.
Pubblicazione: (2024)
Exploring the Feasibility of End-to-End Large Language Model as a Compiler
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
di: Zhang, Hongbin, et al.
Pubblicazione: (2025)
Landscape of Thoughts: Visualizing the Reasoning Process of Large Language Models
di: Zhou, Zhanke, et al.
Pubblicazione: (2025)
di: Zhou, Zhanke, et al.
Pubblicazione: (2025)
ProcessBench: Identifying Process Errors in Mathematical Reasoning
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
One Mask to Rule Them All: On Hidden Facts after Editing and How to Find Them
di: Holmov, Ali, et al.
Pubblicazione: (2026)
di: Holmov, Ali, et al.
Pubblicazione: (2026)
Humanizing the Machine: Proxy Attacks to Mislead LLM Detectors
di: Wang, Tianchun, et al.
Pubblicazione: (2024)
di: Wang, Tianchun, et al.
Pubblicazione: (2024)
Exploring Response Uncertainty in MLLMs: An Empirical Evaluation under Misleading Scenarios
di: Dang, Yunkai, et al.
Pubblicazione: (2024)
di: Dang, Yunkai, et al.
Pubblicazione: (2024)
Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models
di: Tang, Yuanbo, et al.
Pubblicazione: (2025)
di: Tang, Yuanbo, et al.
Pubblicazione: (2025)
Value-Action Alignment in Large Language Models under Privacy-Prosocial Conflict
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
di: Song, Peiyang, et al.
Pubblicazione: (2024)
di: Song, Peiyang, et al.
Pubblicazione: (2024)
Large Language Model Can Be a Foundation for Hidden Rationale-Based Retrieval
di: Ji, Luo, et al.
Pubblicazione: (2024)
di: Ji, Luo, et al.
Pubblicazione: (2024)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
di: Chen, Haolin, et al.
Pubblicazione: (2024)
di: Chen, Haolin, et al.
Pubblicazione: (2024)
DRL-STAF: A Deep Reinforcement Learning Framework for State-Aware Forecasting of Complex Multivariate Hidden Markov Processes
di: Jiang, Manrui, et al.
Pubblicazione: (2026)
di: Jiang, Manrui, et al.
Pubblicazione: (2026)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
Reasoning in Diffusion Large Language Models is Concentrated in Dynamic Confusion Zones
di: Chen, Ranfei, et al.
Pubblicazione: (2025)
di: Chen, Ranfei, et al.
Pubblicazione: (2025)
Revealing Multimodal Causality with Large Language Models
di: Li, Jin, et al.
Pubblicazione: (2025)
di: Li, Jin, et al.
Pubblicazione: (2025)
Retrieval-Reasoning Large Language Model-based Synthetic Clinical Trial Generation
di: Xu, Zerui, et al.
Pubblicazione: (2024)
di: Xu, Zerui, et al.
Pubblicazione: (2024)
Learning Shortcuts: On the Misleading Promise of NLU in Language Models
di: Bihani, Geetanjali, et al.
Pubblicazione: (2024)
di: Bihani, Geetanjali, et al.
Pubblicazione: (2024)
Large Language Models as Analogical Reasoners
di: Yasunaga, Michihiro, et al.
Pubblicazione: (2023)
di: Yasunaga, Michihiro, et al.
Pubblicazione: (2023)
Exploring the Secondary Risks of Large Language Models
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
Robust Infidelity: When Faithfulness Measures on Masked Language Models Are Misleading
di: Crothers, Evan, et al.
Pubblicazione: (2023)
di: Crothers, Evan, et al.
Pubblicazione: (2023)
DS-Agent: Automated Data Science by Empowering Large Language Models with Case-Based Reasoning
di: Guo, Siyuan, et al.
Pubblicazione: (2024)
di: Guo, Siyuan, et al.
Pubblicazione: (2024)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
The Role of Deductive and Inductive Reasoning in Large Language Models
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
di: Cai, Chengkun, et al.
Pubblicazione: (2024)
Generation Meets Verification: Accelerating Large Language Model Inference with Smart Parallel Auto-Correct Decoding
di: Yi, Hanling, et al.
Pubblicazione: (2024)
di: Yi, Hanling, et al.
Pubblicazione: (2024)
CoRA: Collaborative Information Perception by Large Language Model's Weights for Recommendation
di: Liu, Yuting, et al.
Pubblicazione: (2024)
di: Liu, Yuting, et al.
Pubblicazione: (2024)
Automated Molecular Concept Generation and Labeling with Large Language Models
di: Zhang, Zimin, et al.
Pubblicazione: (2024)
di: Zhang, Zimin, et al.
Pubblicazione: (2024)
Physics of Language Models: Part 2.1, Grade-School Math and the Hidden Reasoning Process
di: Ye, Tian, et al.
Pubblicazione: (2024)
di: Ye, Tian, et al.
Pubblicazione: (2024)
MM-OPERA: Benchmarking Open-ended Association Reasoning for Large Vision-Language Models
di: Huang, Zimeng, et al.
Pubblicazione: (2025)
di: Huang, Zimeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Feature contamination: Neural networks learn uncorrelated features and fail to generalize
di: Zhang, Tianren, et al.
Pubblicazione: (2024) -
Preserving Silent Features for Domain Generalization
di: Zhao, Chujie, et al.
Pubblicazione: (2024) -
When Do Neural Networks Learn World Models?
di: Zhang, Tianren, et al.
Pubblicazione: (2025) -
A method of supervised learning from conflicting data with hidden contexts
di: Zhang, Tianren, et al.
Pubblicazione: (2021) -
Reconciling In-Context and In-Weight Learning via Dual Representation Space Encoding
di: Chen, Guanyu, et al.
Pubblicazione: (2026)