On the Tip of the Tongue: Analyzing Conceptual Representation in Large Language Models with Reverse-Dictionary Probe
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Ningyu, Zhang, Qi, Zhang, Menghan, Qian, Peng, Huang, Xuanjing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
Revealing emergent human-like conceptual representations from language prediction
di: Xu, Ningyu, et al.
Pubblicazione: (2025)
di: Xu, Ningyu, et al.
Pubblicazione: (2025)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
Probing Multimodal Large Language Models for Global and Local Semantic Representations
di: Tao, Mingxu, et al.
Pubblicazione: (2024)
di: Tao, Mingxu, et al.
Pubblicazione: (2024)
Are Large Language Models Good Prompt Optimizers?
di: Ma, Ruotian, et al.
Pubblicazione: (2024)
di: Ma, Ruotian, et al.
Pubblicazione: (2024)
Editing Conceptual Knowledge for Large Language Models
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
Analyzing the Effects of Supervised Fine-Tuning on Model Knowledge from Token and Parameter Levels
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
Unsupervised Memorability Modeling from Tip-of-the-Tongue Retrieval Queries
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective
di: Li, Tianlong, et al.
Pubblicazione: (2024)
di: Li, Tianlong, et al.
Pubblicazione: (2024)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
Emergent Hierarchical Structure in Large Language Models: An Information-Theoretic Framework for Multi-Scale Representation
di: Zhang, Yukin, et al.
Pubblicazione: (2025)
di: Zhang, Yukin, et al.
Pubblicazione: (2025)
Slovak Conceptual Dictionary
di: Blšták, Miroslav
Pubblicazione: (2025)
di: Blšták, Miroslav
Pubblicazione: (2025)
Navigating the OverKill in Large Language Models
di: Shi, Chenyu, et al.
Pubblicazione: (2024)
di: Shi, Chenyu, et al.
Pubblicazione: (2024)
Probing Causality Manipulation of Large Language Models
di: Zhang, Chenyang, et al.
Pubblicazione: (2024)
di: Zhang, Chenyang, et al.
Pubblicazione: (2024)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
di: He, Wei, et al.
Pubblicazione: (2024)
di: He, Wei, et al.
Pubblicazione: (2024)
Analyzing the Role of Semantic Representations in the Era of Large Language Models
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Probing Ethical Framework Representations in Large Language Models: Structure, Entanglement, and Methodological Challenges
di: Xu, Weilun, et al.
Pubblicazione: (2026)
di: Xu, Weilun, et al.
Pubblicazione: (2026)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
di: Lv, Huijie, et al.
Pubblicazione: (2024)
di: Lv, Huijie, et al.
Pubblicazione: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
Browsing Lost Unformed Recollections: A Benchmark for Tip-of-the-Tongue Search and Reasoning
di: CH-Wang, Sky, et al.
Pubblicazione: (2025)
di: CH-Wang, Sky, et al.
Pubblicazione: (2025)
RoTBench: A Multi-Level Benchmark for Evaluating the Robustness of Large Language Models in Tool Learning
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
Understanding the Dilemma of Unlearning for Large Language Models
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
di: Zhang, Qingjie, et al.
Pubblicazione: (2025)
Analyzing Nobel Prize Literature with Large Language Models
di: Yang, Zhenyuan, et al.
Pubblicazione: (2024)
di: Yang, Zhenyuan, et al.
Pubblicazione: (2024)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Reverse Probing: Supervised Token-level Uncertainty Quantification for Large Language Models in Clinical Text
di: Xiao, Bushi, et al.
Pubblicazione: (2026)
di: Xiao, Bushi, et al.
Pubblicazione: (2026)
WordAlchemy: A transformer-based Reverse Dictionary
di: Madaswar, Kanhaiya, et al.
Pubblicazione: (2022)
di: Madaswar, Kanhaiya, et al.
Pubblicazione: (2022)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Reversal of Thought: Enhancing Large Language Models with Preference-Guided Reverse Reasoning Warm-up
di: Yuan, Jiahao, et al.
Pubblicazione: (2024)
di: Yuan, Jiahao, et al.
Pubblicazione: (2024)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world Scenarios
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
REEF: Representation Encoding Fingerprints for Large Language Models
di: Zhang, Jie, et al.
Pubblicazione: (2024)
di: Zhang, Jie, et al.
Pubblicazione: (2024)
MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
Separating Tongue from Thought: Activation Patching Reveals Language-Agnostic Concept Representations in Transformers
di: Dumas, Clément, et al.
Pubblicazione: (2024)
di: Dumas, Clément, et al.
Pubblicazione: (2024)
Probing the Difficulty Perception Mechanism of Large Language Models
di: Lee, Sunbowen, et al.
Pubblicazione: (2025)
di: Lee, Sunbowen, et al.
Pubblicazione: (2025)
Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models
di: Lin, Qika, et al.
Pubblicazione: (2025)
di: Lin, Qika, et al.
Pubblicazione: (2025)
CORE: A Conceptual Reasoning Layer for Large Language Models
di: Hegde, Vishwas, et al.
Pubblicazione: (2025)
di: Hegde, Vishwas, et al.
Pubblicazione: (2025)
PIORS: Personalized Intelligent Outpatient Reception based on Large Language Model with Multi-Agents Medical Scenario Simulation
di: Bao, Zhijie, et al.
Pubblicazione: (2024)
di: Bao, Zhijie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
di: Xu, Ningyu, et al.
Pubblicazione: (2026) -
Revealing emergent human-like conceptual representations from language prediction
di: Xu, Ningyu, et al.
Pubblicazione: (2025) -
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
di: Zhao, Jun, et al.
Pubblicazione: (2024) -
Probing Multimodal Large Language Models for Global and Local Semantic Representations
di: Tao, Mingxu, et al.
Pubblicazione: (2024) -
Are Large Language Models Good Prompt Optimizers?
di: Ma, Ruotian, et al.
Pubblicazione: (2024)