Language Models Use Trigonometry to Do Addition
Fuente:
arXiv
Guardado en:
| Autores principales: | Kantamneni, Subhash, Tegmark, Max |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
How Do Transformers "Do" Physics? Investigating the Simple Harmonic Oscillator
por: Kantamneni, Subhash, et al.
Publicado: (2024)
por: Kantamneni, Subhash, et al.
Publicado: (2024)
Scaling Laws For Scalable Oversight
por: Engels, Joshua, et al.
Publicado: (2025)
por: Engels, Joshua, et al.
Publicado: (2025)
Language Models Represent Space and Time
por: Gurnee, Wes, et al.
Publicado: (2023)
por: Gurnee, Wes, et al.
Publicado: (2023)
Are Sparse Autoencoders Useful? A Case Study in Sparse Probing
por: Kantamneni, Subhash, et al.
Publicado: (2025)
por: Kantamneni, Subhash, et al.
Publicado: (2025)
OptPDE: Discovering Novel Integrable Systems via AI-Human Collaboration
por: Kantamneni, Subhash, et al.
Publicado: (2024)
por: Kantamneni, Subhash, et al.
Publicado: (2024)
The Remarkable Robustness of LLMs: Stages of Inference?
por: Lad, Vedang, et al.
Publicado: (2024)
por: Lad, Vedang, et al.
Publicado: (2024)
Activation Oracles: Training and Evaluating LLMs as General-Purpose Activation Explainers
por: Karvonen, Adam, et al.
Publicado: (2025)
por: Karvonen, Adam, et al.
Publicado: (2025)
Dense SAE Latents Are Features, Not Bugs
por: Sun, Xiaoqing, et al.
Publicado: (2025)
por: Sun, Xiaoqing, et al.
Publicado: (2025)
Why Do Safety Guardrails Degrade Across Languages?
por: Zhang, Max, et al.
Publicado: (2026)
por: Zhang, Max, et al.
Publicado: (2026)
Do Two AI Scientists Agree?
por: Fu, Xinghong, et al.
Publicado: (2025)
por: Fu, Xinghong, et al.
Publicado: (2025)
Interpretable Steering of Large Language Models with Feature Guided Activation Additions
por: Soo, Samuel, et al.
Publicado: (2025)
por: Soo, Samuel, et al.
Publicado: (2025)
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
por: Lamparth, Max, et al.
Publicado: (2023)
por: Lamparth, Max, et al.
Publicado: (2023)
(How) Do Language Models Track State?
por: Li, Belinda Z., et al.
Publicado: (2025)
por: Li, Belinda Z., et al.
Publicado: (2025)
Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks
por: Gambardella, Andrew, et al.
Publicado: (2024)
por: Gambardella, Andrew, et al.
Publicado: (2024)
Do Large Language Models Know How Much They Know?
por: Prato, Gabriele, et al.
Publicado: (2025)
por: Prato, Gabriele, et al.
Publicado: (2025)
Do Large Language Models Show Biases in Causal Learning?
por: Carro, Maria Victoria, et al.
Publicado: (2024)
por: Carro, Maria Victoria, et al.
Publicado: (2024)
Why Larger Language Models Do In-context Learning Differently?
por: Shi, Zhenmei, et al.
Publicado: (2024)
por: Shi, Zhenmei, et al.
Publicado: (2024)
FLUID-LLM: Learning Computational Fluid Dynamics with Spatiotemporal-aware Large Language Models
por: Zhu, Max, et al.
Publicado: (2024)
por: Zhu, Max, et al.
Publicado: (2024)
Do Retrieval-Augmented Language Models Adapt to Varying User Needs?
por: Wu, Peilin, et al.
Publicado: (2025)
por: Wu, Peilin, et al.
Publicado: (2025)
Why Do Multilingual Reasoning Gaps Emerge in Reasoning Language Models?
por: Kang, Deokhyung, et al.
Publicado: (2025)
por: Kang, Deokhyung, et al.
Publicado: (2025)
Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models
por: Ferrando, Javier, et al.
Publicado: (2024)
por: Ferrando, Javier, et al.
Publicado: (2024)
Do Language Models Have Bayesian Brains? Distinguishing Stochastic and Deterministic Decision Patterns within Large Language Models
por: Cui, Andrea Yaoyun, et al.
Publicado: (2025)
por: Cui, Andrea Yaoyun, et al.
Publicado: (2025)
Questionnaire Responses Do not Capture the Safety of AI Agents
por: Hellrigel-Holderbaum, Max, et al.
Publicado: (2026)
por: Hellrigel-Holderbaum, Max, et al.
Publicado: (2026)
DoLa: Decoding by Contrasting Layers Improves Factuality in Large Language Models
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
por: Chuang, Yung-Sung, et al.
Publicado: (2023)
Do Large Language Models Have Compositional Ability? An Investigation into Limitations and Scalability
por: Xu, Zhuoyan, et al.
Publicado: (2024)
por: Xu, Zhuoyan, et al.
Publicado: (2024)
Should You Use Your Large Language Model to Explore or Exploit?
por: Harris, Keegan, et al.
Publicado: (2025)
por: Harris, Keegan, et al.
Publicado: (2025)
A Resource Model For Neural Scaling Law
por: Song, Jinyeop, et al.
Publicado: (2024)
por: Song, Jinyeop, et al.
Publicado: (2024)
Do Language Models Understand Morality? Towards a Robust Detection of Moral Content
por: Bulla, Luana, et al.
Publicado: (2024)
por: Bulla, Luana, et al.
Publicado: (2024)
BertaQA: How Much Do Language Models Know About Local Culture?
por: Etxaniz, Julen, et al.
Publicado: (2024)
por: Etxaniz, Julen, et al.
Publicado: (2024)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
por: Opedal, Andreas, et al.
Publicado: (2024)
por: Opedal, Andreas, et al.
Publicado: (2024)
A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio
por: Xi, Ningyuan, et al.
Publicado: (2024)
por: Xi, Ningyuan, et al.
Publicado: (2024)
Do Large Language Models Truly Grasp Mathematics? An Empirical Exploration From Cognitive Psychology
por: Xie, Wei, et al.
Publicado: (2024)
por: Xie, Wei, et al.
Publicado: (2024)
MobileLLM: Optimizing Sub-billion Parameter Language Models for On-Device Use Cases
por: Liu, Zechun, et al.
Publicado: (2024)
por: Liu, Zechun, et al.
Publicado: (2024)
Agentic Large Language Models, a survey
por: Plaat, Aske, et al.
Publicado: (2025)
por: Plaat, Aske, et al.
Publicado: (2025)
Self-Improvement in Language Models: The Sharpening Mechanism
por: Huang, Audrey, et al.
Publicado: (2024)
por: Huang, Audrey, et al.
Publicado: (2024)
What Do Large Language Models Know? Tacit Knowledge as a Potential Causal-Explanatory Structure
por: Budding, Céline
Publicado: (2025)
por: Budding, Céline
Publicado: (2025)
Understanding In-context Learning of Addition via Activation Subspaces
por: Hu, Xinyan, et al.
Publicado: (2025)
por: Hu, Xinyan, et al.
Publicado: (2025)
Steering Llama 2 via Contrastive Activation Addition
por: Panickssery, Nina, et al.
Publicado: (2023)
por: Panickssery, Nina, et al.
Publicado: (2023)
Large Language Models for Automating Clinical Data Standardization: HL7 FHIR Use Case
por: Riquelme, Alvaro, et al.
Publicado: (2025)
por: Riquelme, Alvaro, et al.
Publicado: (2025)
Where Do Reasoning Models Refuse?
por: Yamaguchi, Kureha, et al.
Publicado: (2025)
por: Yamaguchi, Kureha, et al.
Publicado: (2025)
Ejemplares similares
-
How Do Transformers "Do" Physics? Investigating the Simple Harmonic Oscillator
por: Kantamneni, Subhash, et al.
Publicado: (2024) -
Scaling Laws For Scalable Oversight
por: Engels, Joshua, et al.
Publicado: (2025) -
Language Models Represent Space and Time
por: Gurnee, Wes, et al.
Publicado: (2023) -
Are Sparse Autoencoders Useful? A Case Study in Sparse Probing
por: Kantamneni, Subhash, et al.
Publicado: (2025) -
OptPDE: Discovering Novel Integrable Systems via AI-Human Collaboration
por: Kantamneni, Subhash, et al.
Publicado: (2024)