The Geometry of Categorical and Hierarchical Concepts in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Park, Kiho, Choe, Yo Joong, Jiang, Yibo, Veitch, Victor |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Linear Representation Hypothesis and the Geometry of Large Language Models
di: Park, Kiho, et al.
Pubblicazione: (2023)
di: Park, Kiho, et al.
Pubblicazione: (2023)
The Information Geometry of Softmax: Probing and Steering
di: Park, Kiho, et al.
Pubblicazione: (2026)
di: Park, Kiho, et al.
Pubblicazione: (2026)
Incorporating Hierarchical Semantics in Sparse Autoencoder Architectures
di: Muchane, Mark, et al.
Pubblicazione: (2025)
di: Muchane, Mark, et al.
Pubblicazione: (2025)
The Geometry of Refusal in Large Language Models: Concept Cones and Representational Independence
di: Wollschläger, Tom, et al.
Pubblicazione: (2025)
di: Wollschläger, Tom, et al.
Pubblicazione: (2025)
On the Origins of Linear Representations in Large Language Models
di: Jiang, Yibo, et al.
Pubblicazione: (2024)
di: Jiang, Yibo, et al.
Pubblicazione: (2024)
Bridging the Semantic Gap for Categorical Data Clustering via Large Language Models
di: Yang, Zihua, et al.
Pubblicazione: (2026)
di: Yang, Zihua, et al.
Pubblicazione: (2026)
A Markov Categorical Framework for Language Modeling
di: Zhang, Yifan
Pubblicazione: (2025)
di: Zhang, Yifan
Pubblicazione: (2025)
Beyond Individual Facts: Investigating Categorical Knowledge Locality of Taxonomy and Meronomy Concepts in GPT Models
di: Burger, Christopher, et al.
Pubblicazione: (2024)
di: Burger, Christopher, et al.
Pubblicazione: (2024)
Hierarchical Federated Unlearning for Large Language Models
di: Zhong, Yisheng, et al.
Pubblicazione: (2025)
di: Zhong, Yisheng, et al.
Pubblicazione: (2025)
Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
di: Jin, Mingyu, et al.
Pubblicazione: (2024)
Recursive Concept Evolution for Compositional Reasoning in Large Language Models
di: Chaudhry, Sarim
Pubblicazione: (2026)
di: Chaudhry, Sarim
Pubblicazione: (2026)
Improving Large Language Models with Concept-Aware Fine-Tuning
di: Chen, Michael K., et al.
Pubblicazione: (2025)
di: Chen, Michael K., et al.
Pubblicazione: (2025)
Emergence of Hierarchical Emotion Organization in Large Language Models
di: Zhao, Bo, et al.
Pubblicazione: (2025)
di: Zhao, Bo, et al.
Pubblicazione: (2025)
Cancer Diagnosis Categorization in Electronic Health Records Using Large Language Models and BioBERT: Model Performance Evaluation Study
di: Hashtarkhani, Soheil, et al.
Pubblicazione: (2025)
di: Hashtarkhani, Soheil, et al.
Pubblicazione: (2025)
Sparse Shift Autoencoders for Identifying Concepts from Large Language Model Activations
di: Joshi, Shruti, et al.
Pubblicazione: (2025)
di: Joshi, Shruti, et al.
Pubblicazione: (2025)
KaSA: Knowledge-Aware Singular-Value Adaptation of Large Language Models
di: Wang, Fan, et al.
Pubblicazione: (2024)
di: Wang, Fan, et al.
Pubblicazione: (2024)
An Empirical Categorization of Prompting Techniques for Large Language Models: A Practitioner's Guide
di: Fagbohun, Oluwole, et al.
Pubblicazione: (2024)
di: Fagbohun, Oluwole, et al.
Pubblicazione: (2024)
The Information of Large Language Model Geometry
di: Tan, Zhiquan, et al.
Pubblicazione: (2024)
di: Tan, Zhiquan, et al.
Pubblicazione: (2024)
Characterizing Large Language Model Geometry Helps Solve Toxicity Detection and Generation
di: Balestriero, Randall, et al.
Pubblicazione: (2023)
di: Balestriero, Randall, et al.
Pubblicazione: (2023)
Hierarchical Orthogonal Residual Spread for Precise Massive Editing in Large Language Models
di: Gu, Xiaojie, et al.
Pubblicazione: (2026)
di: Gu, Xiaojie, et al.
Pubblicazione: (2026)
Variational Language Concepts for Interpreting Foundation Language Models
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
Geometry of Decision Making in Language Models
di: Joshi, Abhinav, et al.
Pubblicazione: (2025)
di: Joshi, Abhinav, et al.
Pubblicazione: (2025)
AECBench: A Hierarchical Benchmark for Knowledge Evaluation of Large Language Models in the AEC Field
di: Liang, Chen, et al.
Pubblicazione: (2025)
di: Liang, Chen, et al.
Pubblicazione: (2025)
The Geometry of Meaning: Perfect Spacetime Representations of Hierarchical Structures
di: Anabalon, Andres, et al.
Pubblicazione: (2025)
di: Anabalon, Andres, et al.
Pubblicazione: (2025)
Textual Aesthetics in Large Language Models
di: Jiang, Lingjie, et al.
Pubblicazione: (2024)
di: Jiang, Lingjie, et al.
Pubblicazione: (2024)
On Speculative Decoding for Multimodal Large Language Models
di: Gagrani, Mukul, et al.
Pubblicazione: (2024)
di: Gagrani, Mukul, et al.
Pubblicazione: (2024)
Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods
di: Cao, Yuji, et al.
Pubblicazione: (2024)
di: Cao, Yuji, et al.
Pubblicazione: (2024)
Geometry-Lite: Interpretable Safety Probing via Layer-Wise Margin Geometry
di: Sim, Woo Seob, et al.
Pubblicazione: (2026)
di: Sim, Woo Seob, et al.
Pubblicazione: (2026)
Advancing Tool-Augmented Large Language Models: Integrating Insights from Errors in Inference Trees
di: Chen, Sijia, et al.
Pubblicazione: (2024)
di: Chen, Sijia, et al.
Pubblicazione: (2024)
Latent Concept Disentanglement in Transformer-based Language Models
di: Hong, Guan Zhe, et al.
Pubblicazione: (2025)
di: Hong, Guan Zhe, et al.
Pubblicazione: (2025)
Delta Knowledge Distillation for Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2025)
di: Cao, Yihan, et al.
Pubblicazione: (2025)
PaCE: Parsimonious Concept Engineering for Large Language Models
di: Luo, Jinqi, et al.
Pubblicazione: (2024)
di: Luo, Jinqi, et al.
Pubblicazione: (2024)
A Survey on Large Language Models from Concept to Implementation
di: Wang, Chen, et al.
Pubblicazione: (2024)
di: Wang, Chen, et al.
Pubblicazione: (2024)
Language over Content: Tracing Cultural Understanding in Multilingual Large Language Models
di: Cho, Seungho, et al.
Pubblicazione: (2025)
di: Cho, Seungho, et al.
Pubblicazione: (2025)
Cross-Layer Discrete Concept Discovery for Interpreting Language Models
di: Garg, Ankur, et al.
Pubblicazione: (2025)
di: Garg, Ankur, et al.
Pubblicazione: (2025)
Interpreting Language Models Through Concept Descriptions: A Survey
di: Feldhus, Nils, et al.
Pubblicazione: (2025)
di: Feldhus, Nils, et al.
Pubblicazione: (2025)
Physics of Language Models: Part 1, Learning Hierarchical Language Structures
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
di: Allen-Zhu, Zeyuan, et al.
Pubblicazione: (2023)
Large Language Models Are Better Logical Fallacy Reasoners with Counterargument, Explanation, and Goal-Aware Prompt Formulation
di: Jeong, Jiwon, et al.
Pubblicazione: (2025)
di: Jeong, Jiwon, et al.
Pubblicazione: (2025)
CPR: Mitigating Large Language Model Hallucinations with Curative Prompt Refinement
di: Shim, Jung-Woo, et al.
Pubblicazione: (2025)
di: Shim, Jung-Woo, et al.
Pubblicazione: (2025)
Multi-stage Prompt Refinement for Mitigating Hallucinations in Large Language Models
di: Shim, Jung-Woo, et al.
Pubblicazione: (2025)
di: Shim, Jung-Woo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
The Linear Representation Hypothesis and the Geometry of Large Language Models
di: Park, Kiho, et al.
Pubblicazione: (2023) -
The Information Geometry of Softmax: Probing and Steering
di: Park, Kiho, et al.
Pubblicazione: (2026) -
Incorporating Hierarchical Semantics in Sparse Autoencoder Architectures
di: Muchane, Mark, et al.
Pubblicazione: (2025) -
The Geometry of Refusal in Large Language Models: Concept Cones and Representational Independence
di: Wollschläger, Tom, et al.
Pubblicazione: (2025) -
On the Origins of Linear Representations in Large Language Models
di: Jiang, Yibo, et al.
Pubblicazione: (2024)