The Birth of Knowledge: Emergent Features across Time, Space, and Scale in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Sawmya, Shashata, Adler, Micah, Shavit, Nir |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Wasserstein Distances, Neuronal Entanglement, and Sparsity
por: Sawmya, Shashata, et al.
Publicado: (2024)
por: Sawmya, Shashata, et al.
Publicado: (2024)
Cascade Detector Analysis and Application to Biomedical Microscopy
por: Athey, Thomas L., et al.
Publicado: (2025)
por: Athey, Thomas L., et al.
Publicado: (2025)
Towards Combinatorial Interpretability of Neural Computation
por: Adler, Micah, et al.
Publicado: (2025)
por: Adler, Micah, et al.
Publicado: (2025)
NeuroADDA: Active Discriminative Domain Adaptation in Connectomic
por: Sawmya, Shashata, et al.
Publicado: (2025)
por: Sawmya, Shashata, et al.
Publicado: (2025)
Learning to Interpret Weight Differences in Language Models
por: Goel, Avichal, et al.
Publicado: (2025)
por: Goel, Avichal, et al.
Publicado: (2025)
Negative Pre-activations Differentiate Syntax
por: Kong, Linghao, et al.
Publicado: (2025)
por: Kong, Linghao, et al.
Publicado: (2025)
Understanding Empirical Unlearning with Combinatorial Interpretability
por: Kodama, Shingo, et al.
Publicado: (2026)
por: Kodama, Shingo, et al.
Publicado: (2026)
Toy Combinatorial Interpretability Models Reveal Lottery Tickets in Early Feature Space
por: Bebchuk, Alon, et al.
Publicado: (2026)
por: Bebchuk, Alon, et al.
Publicado: (2026)
Expand Neurons, Not Parameters
por: Kong, Linghao, et al.
Publicado: (2025)
por: Kong, Linghao, et al.
Publicado: (2025)
On the Complexity of Neural Computation in Superposition
por: Adler, Micah, et al.
Publicado: (2024)
por: Adler, Micah, et al.
Publicado: (2024)
Semantic Structure of Feature Space in Large Language Models
por: Kozlowski, Austin C., et al.
Publicado: (2026)
por: Kozlowski, Austin C., et al.
Publicado: (2026)
Emergent Abilities in Reduced-Scale Generative Language Models
por: Muckatira, Sherin, et al.
Publicado: (2024)
por: Muckatira, Sherin, et al.
Publicado: (2024)
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
por: Yang, Junjie, et al.
Publicado: (2025)
por: Yang, Junjie, et al.
Publicado: (2025)
Forbidden Facts: An Investigation of Competing Objectives in Llama-2
por: Wang, Tony T., et al.
Publicado: (2023)
por: Wang, Tony T., et al.
Publicado: (2023)
Knowledge-Driven Feature Selection and Engineering for Genotype Data with Large Language Models
por: Lee, Joseph, et al.
Publicado: (2024)
por: Lee, Joseph, et al.
Publicado: (2024)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
por: Liu, Xiaoze, et al.
Publicado: (2024)
por: Liu, Xiaoze, et al.
Publicado: (2024)
Emergent Abilities in Large Language Models: A Survey
por: Berti, Leonardo, et al.
Publicado: (2025)
por: Berti, Leonardo, et al.
Publicado: (2025)
Rotary Offset Features in Large Language Models
por: Jonasson, André
Publicado: (2025)
por: Jonasson, André
Publicado: (2025)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
por: Zhang, Xue, et al.
Publicado: (2025)
por: Zhang, Xue, et al.
Publicado: (2025)
Automatically Interpreting Millions of Features in Large Language Models
por: Paulo, Gonçalo, et al.
Publicado: (2024)
por: Paulo, Gonçalo, et al.
Publicado: (2024)
RFG: Test-Time Scaling for Diffusion Large Language Model Reasoning with Reward-Free Guidance
por: Chen, Tianlang, et al.
Publicado: (2025)
por: Chen, Tianlang, et al.
Publicado: (2025)
Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models
por: Jain, Neel, et al.
Publicado: (2024)
por: Jain, Neel, et al.
Publicado: (2024)
Quantifying Feature Space Universality Across Large Language Models via Sparse Autoencoders
por: Lan, Michael, et al.
Publicado: (2024)
por: Lan, Michael, et al.
Publicado: (2024)
Neuron-Level Knowledge Attribution in Large Language Models
por: Yu, Zeping, et al.
Publicado: (2023)
por: Yu, Zeping, et al.
Publicado: (2023)
Persistent Topological Features in Large Language Models
por: Gardinazzi, Yuri, et al.
Publicado: (2024)
por: Gardinazzi, Yuri, et al.
Publicado: (2024)
Latent Feature Mining for Predictive Model Enhancement with Large Language Models
por: Li, Bingxuan, et al.
Publicado: (2024)
por: Li, Bingxuan, et al.
Publicado: (2024)
Uncovering Emergent Physics Representations Learned In-Context by Large Language Models
por: Song, Yeongwoo, et al.
Publicado: (2025)
por: Song, Yeongwoo, et al.
Publicado: (2025)
Machine Bullshit: Characterizing the Emergent Disregard for Truth in Large Language Models
por: Liang, Kaiqu, et al.
Publicado: (2025)
por: Liang, Kaiqu, et al.
Publicado: (2025)
Knowledge Distillation from Large Language Models for Household Energy Modeling
por: Takrouri, Mohannad, et al.
Publicado: (2025)
por: Takrouri, Mohannad, et al.
Publicado: (2025)
Provable Scaling Laws for the Test-Time Compute of Large Language Models
por: Chen, Yanxi, et al.
Publicado: (2024)
por: Chen, Yanxi, et al.
Publicado: (2024)
Scaling Laws for Discriminative Classification in Large Language Models
por: Wyatte, Dean, et al.
Publicado: (2024)
por: Wyatte, Dean, et al.
Publicado: (2024)
Task-Stratified Knowledge Scaling Laws for Post-Training Quantized Large Language Models
por: Zhou, Chenxi, et al.
Publicado: (2025)
por: Zhou, Chenxi, et al.
Publicado: (2025)
A Survey on Symbolic Knowledge Distillation of Large Language Models
por: Acharya, Kamal, et al.
Publicado: (2024)
por: Acharya, Kamal, et al.
Publicado: (2024)
Testing Uncertainty of Large Language Models for Physics Knowledge and Reasoning
por: Reganova, Elizaveta, et al.
Publicado: (2024)
por: Reganova, Elizaveta, et al.
Publicado: (2024)
Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models
por: Chua, Lynn, et al.
Publicado: (2024)
por: Chua, Lynn, et al.
Publicado: (2024)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
por: Ruis, Laura, et al.
Publicado: (2024)
por: Ruis, Laura, et al.
Publicado: (2024)
Large Language Models Lack Temporal Awareness of Medical Knowledge
por: Guan, Zihan, et al.
Publicado: (2026)
por: Guan, Zihan, et al.
Publicado: (2026)
Emergent Stack Representations in Modeling Counter Languages Using Transformers
por: Tiwari, Utkarsh, et al.
Publicado: (2025)
por: Tiwari, Utkarsh, et al.
Publicado: (2025)
On the Reliability of Watermarks for Large Language Models
por: Kirchenbauer, John, et al.
Publicado: (2023)
por: Kirchenbauer, John, et al.
Publicado: (2023)
HEART: Emotionally-Driven Test-Time Scaling of Language Models
por: Pinto, Gabriela, et al.
Publicado: (2025)
por: Pinto, Gabriela, et al.
Publicado: (2025)
Ejemplares similares
-
Wasserstein Distances, Neuronal Entanglement, and Sparsity
por: Sawmya, Shashata, et al.
Publicado: (2024) -
Cascade Detector Analysis and Application to Biomedical Microscopy
por: Athey, Thomas L., et al.
Publicado: (2025) -
Towards Combinatorial Interpretability of Neural Computation
por: Adler, Micah, et al.
Publicado: (2025) -
NeuroADDA: Active Discriminative Domain Adaptation in Connectomic
por: Sawmya, Shashata, et al.
Publicado: (2025) -
Learning to Interpret Weight Differences in Language Models
por: Goel, Avichal, et al.
Publicado: (2025)