Language Models are Symbolic Learners in Arithmetic
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Deng, Chunyuan, Li, Zhiqi, Xie, Roy, Chang, Ruidi, Chen, Hanjie |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Learning Distribution-Wise Control in Representation Space for Language Models
von: Deng, Chunyuan, et al.
Veröffentlicht: (2025)
von: Deng, Chunyuan, et al.
Veröffentlicht: (2025)
Steering Information Utility in Key-Value Memory for Language Model Post-Training
von: Deng, Chunyuan, et al.
Veröffentlicht: (2025)
von: Deng, Chunyuan, et al.
Veröffentlicht: (2025)
The Generalization Ridge: Information Flow in Natural Language Generation
von: Chang, Ruidi, et al.
Veröffentlicht: (2025)
von: Chang, Ruidi, et al.
Veröffentlicht: (2025)
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
von: You, Zejia, et al.
Veröffentlicht: (2026)
von: You, Zejia, et al.
Veröffentlicht: (2026)
SAFR: Neuron Redistribution for Interpretability
von: Chang, Ruidi, et al.
Veröffentlicht: (2025)
von: Chang, Ruidi, et al.
Veröffentlicht: (2025)
PRISM: A Dual View of LLM Reasoning through Semantic Flow and Latent Computation
von: Chang, Ruidi, et al.
Veröffentlicht: (2026)
von: Chang, Ruidi, et al.
Veröffentlicht: (2026)
Unraveling Arithmetic in Large Language Models: The Role of Algebraic Structures
von: Chang, Fu-Chieh, et al.
Veröffentlicht: (2024)
von: Chang, Fu-Chieh, et al.
Veröffentlicht: (2024)
ByteFlow: Language Modeling through Adaptive Byte Compression without a Tokenizer
von: Deng, Chunyuan, et al.
Veröffentlicht: (2026)
von: Deng, Chunyuan, et al.
Veröffentlicht: (2026)
ProgGen: Generating Named Entity Recognition Datasets Step-by-step with Self-Reflexive Large Language Models
von: Heng, Yuzhao, et al.
Veröffentlicht: (2024)
von: Heng, Yuzhao, et al.
Veröffentlicht: (2024)
Steering Language Models with Weight Arithmetic
von: Fierro, Constanza, et al.
Veröffentlicht: (2025)
von: Fierro, Constanza, et al.
Veröffentlicht: (2025)
Orchestrating Dual-Boundaries: An Arithmetic Intensity Inspired Acceleration Framework for Diffusion Language Models
von: Wei, Linye, et al.
Veröffentlicht: (2025)
von: Wei, Linye, et al.
Veröffentlicht: (2025)
Are Large Language Models Good Temporal Graph Learners?
von: Huang, Shenyang, et al.
Veröffentlicht: (2025)
von: Huang, Shenyang, et al.
Veröffentlicht: (2025)
Investigating Symbolic Capabilities of Large Language Models
von: Dave, Neisarg, et al.
Veröffentlicht: (2024)
von: Dave, Neisarg, et al.
Veröffentlicht: (2024)
Towards Modeling Learner Performance with Large Language Models
von: Neshaei, Seyed Parsa, et al.
Veröffentlicht: (2024)
von: Neshaei, Seyed Parsa, et al.
Veröffentlicht: (2024)
Large Language Models are Miscalibrated In-Context Learners
von: Li, Chengzu, et al.
Veröffentlicht: (2023)
von: Li, Chengzu, et al.
Veröffentlicht: (2023)
Language Models Implement Simple Word2Vec-style Vector Arithmetic
von: Merullo, Jack, et al.
Veröffentlicht: (2023)
von: Merullo, Jack, et al.
Veröffentlicht: (2023)
Language Models Do Hard Arithmetic Tasks Easily and Hardly Do Easy Arithmetic Tasks
von: Gambardella, Andrew, et al.
Veröffentlicht: (2024)
von: Gambardella, Andrew, et al.
Veröffentlicht: (2024)
A Survey on Symbolic Knowledge Distillation of Large Language Models
von: Acharya, Kamal, et al.
Veröffentlicht: (2024)
von: Acharya, Kamal, et al.
Veröffentlicht: (2024)
Large Language Models are Null-Shot Learners
von: Taveekitworachai, Pittawat, et al.
Veröffentlicht: (2024)
von: Taveekitworachai, Pittawat, et al.
Veröffentlicht: (2024)
Large Language Models are Biased Reinforcement Learners
von: Hayes, William M., et al.
Veröffentlicht: (2024)
von: Hayes, William M., et al.
Veröffentlicht: (2024)
Large Language Models are Good Relational Learners
von: Wu, Fang, et al.
Veröffentlicht: (2025)
von: Wu, Fang, et al.
Veröffentlicht: (2025)
A Mathematical Theory for Learning Semantic Languages by Abstract Learners
von: Liao, Kuo-Yu, et al.
Veröffentlicht: (2024)
von: Liao, Kuo-Yu, et al.
Veröffentlicht: (2024)
OccamLLM: Fast and Exact Language Model Arithmetic in a Single Step
von: Dugan, Owen, et al.
Veröffentlicht: (2024)
von: Dugan, Owen, et al.
Veröffentlicht: (2024)
In-Context Symbolic Regression: Leveraging Large Language Models for Function Discovery
von: Merler, Matteo, et al.
Veröffentlicht: (2024)
von: Merler, Matteo, et al.
Veröffentlicht: (2024)
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
von: Ramakrishna, Anil, et al.
Veröffentlicht: (2025)
von: Ramakrishna, Anil, et al.
Veröffentlicht: (2025)
Instruction-tuned Language Models are Better Knowledge Learners
von: Jiang, Zhengbao, et al.
Veröffentlicht: (2024)
von: Jiang, Zhengbao, et al.
Veröffentlicht: (2024)
Rewriting the Code: A Simple Method for Large Language Model Augmented Code Search
von: Li, Haochen, et al.
Veröffentlicht: (2024)
von: Li, Haochen, et al.
Veröffentlicht: (2024)
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
von: Shen, Si, et al.
Veröffentlicht: (2024)
von: Shen, Si, et al.
Veröffentlicht: (2024)
A Careful Examination of Large Language Model Performance on Grade School Arithmetic
von: Zhang, Hugh, et al.
Veröffentlicht: (2024)
von: Zhang, Hugh, et al.
Veröffentlicht: (2024)
PrivacyMind: Large Language Models Can Be Contextual Privacy Protection Learners
von: Xiao, Yijia, et al.
Veröffentlicht: (2023)
von: Xiao, Yijia, et al.
Veröffentlicht: (2023)
Geometry-Calibrated Conformal Abstention for Language Models
von: Xu, Rui, et al.
Veröffentlicht: (2026)
von: Xu, Rui, et al.
Veröffentlicht: (2026)
Pruner-Zero: Evolving Symbolic Pruning Metric from scratch for Large Language Models
von: Dong, Peijie, et al.
Veröffentlicht: (2024)
von: Dong, Peijie, et al.
Veröffentlicht: (2024)
Logically Consistent Language Models via Neuro-Symbolic Integration
von: Calanzone, Diego, et al.
Veröffentlicht: (2024)
von: Calanzone, Diego, et al.
Veröffentlicht: (2024)
Kiki or Bouba? Sound Symbolism in Vision-and-Language Models
von: Alper, Morris, et al.
Veröffentlicht: (2023)
von: Alper, Morris, et al.
Veröffentlicht: (2023)
AGGC: Adaptive Group Gradient Clipping for Stabilizing Large Language Model Training
von: Li, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Li, Zhiyuan, et al.
Veröffentlicht: (2026)
Transformers are Universal In-context Learners
von: Furuya, Takashi, et al.
Veröffentlicht: (2024)
von: Furuya, Takashi, et al.
Veröffentlicht: (2024)
GLBench: A Comprehensive Benchmark for Graph with Large Language Models
von: Li, Yuhan, et al.
Veröffentlicht: (2024)
von: Li, Yuhan, et al.
Veröffentlicht: (2024)
A Component-Based Survey of Interactions between Large Language Models and Multi-Armed Bandits
von: Chen, Siguang, et al.
Veröffentlicht: (2026)
von: Chen, Siguang, et al.
Veröffentlicht: (2026)
Progressive-Hint Prompting Improves Reasoning in Large Language Models
von: Zheng, Chuanyang, et al.
Veröffentlicht: (2023)
von: Zheng, Chuanyang, et al.
Veröffentlicht: (2023)
How Quantization Shapes Bias in Large Language Models
von: Marcuzzi, Federico, et al.
Veröffentlicht: (2025)
von: Marcuzzi, Federico, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Learning Distribution-Wise Control in Representation Space for Language Models
von: Deng, Chunyuan, et al.
Veröffentlicht: (2025) -
Steering Information Utility in Key-Value Memory for Language Model Post-Training
von: Deng, Chunyuan, et al.
Veröffentlicht: (2025) -
The Generalization Ridge: Information Flow in Natural Language Generation
von: Chang, Ruidi, et al.
Veröffentlicht: (2025) -
Spherical Steering: Geometry-Aware Activation Rotation for Language Models
von: You, Zejia, et al.
Veröffentlicht: (2026) -
SAFR: Neuron Redistribution for Interpretability
von: Chang, Ruidi, et al.
Veröffentlicht: (2025)