From Implicit to Explicit: Enhancing Self-Recognition in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Yinghan, Zhu, Weifeng, Wen, Juan, Peng, Wanli, Wu, Zhengxian, Xue, Yiming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Kill two birds with one stone: generalized and robust AI-generated text detection via dynamic perturbations
di: Zhou, Yinghan, et al.
Pubblicazione: (2025)
di: Zhou, Yinghan, et al.
Pubblicazione: (2025)
ImF: Implicit Fingerprint for Large Language Models
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025)
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025)
BadApex: Backdoor Attack Based on Adaptive Optimization Mechanism of Black-box Large Language Models
di: Wu, Zhengxian, et al.
Pubblicazione: (2025)
di: Wu, Zhengxian, et al.
Pubblicazione: (2025)
Self-Disguise Attack: Induce the LLM to disguise itself for AIGT detection evasion
di: Zhou, Yinghan, et al.
Pubblicazione: (2025)
di: Zhou, Yinghan, et al.
Pubblicazione: (2025)
Generative Text Steganography with Large Language Model
di: Wu, Jiaxuan, et al.
Pubblicazione: (2024)
di: Wu, Jiaxuan, et al.
Pubblicazione: (2024)
Is Your Writing Being Mimicked by AI? Unveiling Imitation with Invisible Watermarks in Creative Writing
di: Zhang, Ziwei, et al.
Pubblicazione: (2025)
di: Zhang, Ziwei, et al.
Pubblicazione: (2025)
EditMF: Drawing an Invisible Fingerprint for Your Large Language Models
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025)
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025)
Implicit Probabilistic Reasoning Does Not Reflect Explicit Answers in Large Language Models
di: Mondal, Manuel, et al.
Pubblicazione: (2024)
di: Mondal, Manuel, et al.
Pubblicazione: (2024)
Evaluating Implicit Bias in Large Language Models by Attacking From a Psychometric Perspective
di: Wen, Yuchen, et al.
Pubblicazione: (2024)
di: Wen, Yuchen, et al.
Pubblicazione: (2024)
Self-assessment, Exhibition, and Recognition: a Review of Personality in Large Language Models
di: Wen, Zhiyuan, et al.
Pubblicazione: (2024)
di: Wen, Zhiyuan, et al.
Pubblicazione: (2024)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023)
di: Wang, Zekun Moore, et al.
Pubblicazione: (2023)
From Implicit to Explicit: Token-Efficient Logical Supervision for Mathematical Reasoning in LLMs
di: Wang, Shaojie, et al.
Pubblicazione: (2026)
di: Wang, Shaojie, et al.
Pubblicazione: (2026)
Theory of Mind in Large Language Models: Assessment and Enhancement
di: Chen, Ruirui, et al.
Pubblicazione: (2025)
di: Chen, Ruirui, et al.
Pubblicazione: (2025)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2026)
di: Peng, Runyu, et al.
Pubblicazione: (2026)
Unlocking the Power of Large Language Models for Entity Alignment
di: Jiang, Xuhui, et al.
Pubblicazione: (2024)
di: Jiang, Xuhui, et al.
Pubblicazione: (2024)
Making Implicit Premises Explicit in Logical Understanding of Enthymemes
di: Feng, Xuyao, et al.
Pubblicazione: (2026)
di: Feng, Xuyao, et al.
Pubblicazione: (2026)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
Evontree: Ontology Rule-Guided Self-Evolution of Large Language Models
di: Tu, Mingchen, et al.
Pubblicazione: (2025)
di: Tu, Mingchen, et al.
Pubblicazione: (2025)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
di: Zhou, Zhi, et al.
Pubblicazione: (2024)
di: Zhou, Zhi, et al.
Pubblicazione: (2024)
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
di: Vedula, Bhaskara Hanuma, et al.
Pubblicazione: (2026)
di: Vedula, Bhaskara Hanuma, et al.
Pubblicazione: (2026)
Think in Sentences: Explicit Sentence Boundaries Enhance Language Model's Capabilities
di: Liu, Zhichen, et al.
Pubblicazione: (2026)
di: Liu, Zhichen, et al.
Pubblicazione: (2026)
Enhance Reasoning for Large Language Models in the Game Werewolf
di: Wu, Shuang, et al.
Pubblicazione: (2024)
di: Wu, Shuang, et al.
Pubblicazione: (2024)
Comparing Human and Large Language Model Interpretation of Implicit Information
di: De Santis, Antonio, et al.
Pubblicazione: (2026)
di: De Santis, Antonio, et al.
Pubblicazione: (2026)
Implicit Reasoning in Large Language Models: A Comprehensive Survey
di: Li, Jindong, et al.
Pubblicazione: (2025)
di: Li, Jindong, et al.
Pubblicazione: (2025)
ThreatCore: A Benchmark for Explicit and Implicit Threat Detection
di: Bruni, Davide, et al.
Pubblicazione: (2026)
di: Bruni, Davide, et al.
Pubblicazione: (2026)
Large Language Models can Learn Rules
di: Zhu, Zhaocheng, et al.
Pubblicazione: (2023)
di: Zhu, Zhaocheng, et al.
Pubblicazione: (2023)
Scalable In-Context Learning on Tabular Data via Retrieval-Augmented Large Language Models
di: Wen, Xumeng, et al.
Pubblicazione: (2025)
di: Wen, Xumeng, et al.
Pubblicazione: (2025)
LTNER: Large Language Model Tagging for Named Entity Recognition with Contextualized Entity Marking
di: Yan, Faren, et al.
Pubblicazione: (2024)
di: Yan, Faren, et al.
Pubblicazione: (2024)
AutoSCORE: Enhancing Automated Scoring with Multi-Agent Large Language Models via Structured Component Recognition
di: Wang, Yun, et al.
Pubblicazione: (2025)
di: Wang, Yun, et al.
Pubblicazione: (2025)
A Survey on Self-Evolution of Large Language Models
di: Tao, Zhengwei, et al.
Pubblicazione: (2024)
di: Tao, Zhengwei, et al.
Pubblicazione: (2024)
From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step
di: Deng, Yuntian, et al.
Pubblicazione: (2024)
di: Deng, Yuntian, et al.
Pubblicazione: (2024)
Agentic Jigsaw Interaction Learning for Enhancing Visual Perception and Reasoning in Vision-Language Models
di: Zeng, Yu, et al.
Pubblicazione: (2025)
di: Zeng, Yu, et al.
Pubblicazione: (2025)
Self-Discover: Large Language Models Self-Compose Reasoning Structures
di: Zhou, Pei, et al.
Pubblicazione: (2024)
di: Zhou, Pei, et al.
Pubblicazione: (2024)
Importance Weighting Can Help Large Language Models Self-Improve
di: Jiang, Chunyang, et al.
Pubblicazione: (2024)
di: Jiang, Chunyang, et al.
Pubblicazione: (2024)
Uncovering Implicit Bias in Large Language Models with Concept Learning Dataset
di: Wang, Leroy Z.
Pubblicazione: (2025)
di: Wang, Leroy Z.
Pubblicazione: (2025)
Copy-Paste to Mitigate Large Language Model Hallucinations
di: Long, Yongchao, et al.
Pubblicazione: (2025)
di: Long, Yongchao, et al.
Pubblicazione: (2025)
M-GRPO: Stabilizing Self-Supervised Reinforcement Learning for Large Language Models with Momentum-Anchored Policy Optimization
di: Bai, Bizhe, et al.
Pubblicazione: (2025)
di: Bai, Bizhe, et al.
Pubblicazione: (2025)
Self-Recognition in Language Models
di: Davidson, Tim R., et al.
Pubblicazione: (2024)
di: Davidson, Tim R., et al.
Pubblicazione: (2024)
Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment
di: Huang, Yucong, et al.
Pubblicazione: (2026)
di: Huang, Yucong, et al.
Pubblicazione: (2026)
Self-Cognition in Large Language Models: An Exploratory Study
di: Chen, Dongping, et al.
Pubblicazione: (2024)
di: Chen, Dongping, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Kill two birds with one stone: generalized and robust AI-generated text detection via dynamic perturbations
di: Zhou, Yinghan, et al.
Pubblicazione: (2025) -
ImF: Implicit Fingerprint for Large Language Models
di: Wu, Jiaxuan, et al.
Pubblicazione: (2025) -
BadApex: Backdoor Attack Based on Adaptive Optimization Mechanism of Black-box Large Language Models
di: Wu, Zhengxian, et al.
Pubblicazione: (2025) -
Self-Disguise Attack: Induce the LLM to disguise itself for AIGT detection evasion
di: Zhou, Yinghan, et al.
Pubblicazione: (2025) -
Generative Text Steganography with Large Language Model
di: Wu, Jiaxuan, et al.
Pubblicazione: (2024)