Case-Based or Rule-Based: How Do Transformers Do the Math?
Fuente:
arXiv
Guardado en:
| Autores principales: | Hu, Yi, Tang, Xiaojuan, Yang, Haotong, Zhang, Muhan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Number Cookbook: Number Understanding of Language Models and How to Improve It
por: Yang, Haotong, et al.
Publicado: (2024)
por: Yang, Haotong, et al.
Publicado: (2024)
Parrot Mind: Towards Explaining the Complex Task Reasoning of Pretrained Large Language Models with Template-Content Structure
por: Yang, Haotong, et al.
Publicado: (2023)
por: Yang, Haotong, et al.
Publicado: (2023)
GL-Fusion: Rethinking the Combination of Graph Neural Network and Large Language model
por: Yang, Haotong, et al.
Publicado: (2024)
por: Yang, Haotong, et al.
Publicado: (2024)
SubTokenTest: A Practical Benchmark for Real-World Sub-token Understanding
por: Hou, Shuyang, et al.
Publicado: (2026)
por: Hou, Shuyang, et al.
Publicado: (2026)
Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2024)
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2024)
How Do Answer Tokens Read Reasoning Traces? Self-Reading Patterns in Thinking LLMs for Quantitative Reasoning
por: Chen, Haoyang, et al.
Publicado: (2026)
por: Chen, Haoyang, et al.
Publicado: (2026)
How Do LLMs Use Their Depth?
por: Gupta, Akshat, et al.
Publicado: (2025)
por: Gupta, Akshat, et al.
Publicado: (2025)
How Do Humans Write Code? Large Models Do It the Same Way Too
por: Li, Long, et al.
Publicado: (2024)
por: Li, Long, et al.
Publicado: (2024)
How Do Transformers Learn Variable Binding in Symbolic Programs?
por: Wu, Yiwei, et al.
Publicado: (2025)
por: Wu, Yiwei, et al.
Publicado: (2025)
How Do Language Models Compose Functions?
por: Khandelwal, Apoorv, et al.
Publicado: (2025)
por: Khandelwal, Apoorv, et al.
Publicado: (2025)
How Well Do Deep Learning Models Capture Human Concepts? The Case of the Typicality Effect
por: Vemuri, Siddhartha K., et al.
Publicado: (2024)
por: Vemuri, Siddhartha K., et al.
Publicado: (2024)
Mars: Situated Inductive Reasoning in an Open-World Environment
por: Tang, Xiaojuan, et al.
Publicado: (2024)
por: Tang, Xiaojuan, et al.
Publicado: (2024)
How Likely Do LLMs with CoT Mimic Human Reasoning?
por: Bao, Guangsheng, et al.
Publicado: (2024)
por: Bao, Guangsheng, et al.
Publicado: (2024)
How Do LLMs Perform Two-Hop Reasoning in Context?
por: Guo, Tianyu, et al.
Publicado: (2025)
por: Guo, Tianyu, et al.
Publicado: (2025)
Do Efficient Transformers Really Save Computation?
por: Yang, Kai, et al.
Publicado: (2024)
por: Yang, Kai, et al.
Publicado: (2024)
How Well Do LLMs Understand Tunisian Arabic?
por: Mahdi, Mohamed
Publicado: (2025)
por: Mahdi, Mohamed
Publicado: (2025)
Do They Understand Them? An Updated Evaluation on Nonbinary Pronoun Handling in Large Language Models
por: Tang, Xushuo, et al.
Publicado: (2025)
por: Tang, Xushuo, et al.
Publicado: (2025)
Playing With AI: How Do State-Of-The-Art Large Language Models Perform in the 1977 Text-Based Adventure Game Zork?
por: Gerrits, Berry
Publicado: (2026)
por: Gerrits, Berry
Publicado: (2026)
How Well Do Large Language Models Truly Ground?
por: Lee, Hyunji, et al.
Publicado: (2023)
por: Lee, Hyunji, et al.
Publicado: (2023)
How Do AI Agents Do Human Work? Comparing AI and Human Workflows Across Diverse Occupations
por: Wang, Zora Zhiruo, et al.
Publicado: (2025)
por: Wang, Zora Zhiruo, et al.
Publicado: (2025)
Do Large Language Models Possess Sensitive to Sentiment?
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
por: Tang, Pingzhi, et al.
Publicado: (2026)
por: Tang, Pingzhi, et al.
Publicado: (2026)
Do Physicians Know How to Prompt? The Need for Automatic Prompt Optimization Help in Clinical Note Generation
por: Yao, Zonghai, et al.
Publicado: (2023)
por: Yao, Zonghai, et al.
Publicado: (2023)
Do GFlowNets Transfer? Case Study on the Game of 24/42
por: Gupta, Adesh, et al.
Publicado: (2025)
por: Gupta, Adesh, et al.
Publicado: (2025)
(How) Do Language Models Track State?
por: Li, Belinda Z., et al.
Publicado: (2025)
por: Li, Belinda Z., et al.
Publicado: (2025)
OMEGA: Can LLMs Reason Outside the Box in Math? Evaluating Exploratory, Compositional, and Transformative Generalization
por: Sun, Yiyou, et al.
Publicado: (2025)
por: Sun, Yiyou, et al.
Publicado: (2025)
Do as I Say, Not as I Do: Instruction-Induction Conflict in LLMs
por: Camassa, Carolina, et al.
Publicado: (2026)
por: Camassa, Carolina, et al.
Publicado: (2026)
GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?
por: Zhou, Yang, et al.
Publicado: (2025)
por: Zhou, Yang, et al.
Publicado: (2025)
TabularMath: Understanding Math Reasoning over Tables with Large Language Models
por: Tian, Shi-Yu, et al.
Publicado: (2025)
por: Tian, Shi-Yu, et al.
Publicado: (2025)
How Do Latent Reasoning Methods Perform Under Weak and Strong Supervision?
por: Cui, Yingqian, et al.
Publicado: (2026)
por: Cui, Yingqian, et al.
Publicado: (2026)
Law in Silico: Simulating Legal Society with LLM-Based Agents
por: Wang, Yiding, et al.
Publicado: (2025)
por: Wang, Yiding, et al.
Publicado: (2025)
Lost in the Pipeline: How Well Do Large Language Models Handle Data Preparation?
por: Spreafico, Matteo, et al.
Publicado: (2025)
por: Spreafico, Matteo, et al.
Publicado: (2025)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
por: Gui, Jiayi, et al.
Publicado: (2024)
por: Gui, Jiayi, et al.
Publicado: (2024)
Do Chinese models speak Chinese languages?
por: Wen-Yi, Andrea W, et al.
Publicado: (2025)
por: Wen-Yi, Andrea W, et al.
Publicado: (2025)
Do Theory of Mind Benchmarks Need Explicit Human-like Reasoning in Language Models?
por: Lu, Yi-Long, et al.
Publicado: (2025)
por: Lu, Yi-Long, et al.
Publicado: (2025)
Do pretrained Transformers Learn In-Context by Gradient Descent?
por: Shen, Lingfeng, et al.
Publicado: (2023)
por: Shen, Lingfeng, et al.
Publicado: (2023)
Do Large Language Models Solve ARC Visual Analogies Like People Do?
por: Opiełka, Gustaw, et al.
Publicado: (2024)
por: Opiełka, Gustaw, et al.
Publicado: (2024)
Do Language Models Track Entities Across State Changes?
por: Tang, Zilu, et al.
Publicado: (2026)
por: Tang, Zilu, et al.
Publicado: (2026)
MathArena: Evaluating LLMs on Uncontaminated Math Competitions
por: Balunović, Mislav, et al.
Publicado: (2025)
por: Balunović, Mislav, et al.
Publicado: (2025)
Do LLMs Follow Their Own Rules? A Reflexive Audit of Self-Stated Safety Policies
por: Mittal, Avni
Publicado: (2026)
por: Mittal, Avni
Publicado: (2026)
Ejemplares similares
-
Number Cookbook: Number Understanding of Language Models and How to Improve It
por: Yang, Haotong, et al.
Publicado: (2024) -
Parrot Mind: Towards Explaining the Complex Task Reasoning of Pretrained Large Language Models with Template-Content Structure
por: Yang, Haotong, et al.
Publicado: (2023) -
GL-Fusion: Rethinking the Combination of Graph Neural Network and Large Language model
por: Yang, Haotong, et al.
Publicado: (2024) -
SubTokenTest: A Practical Benchmark for Real-World Sub-token Understanding
por: Hou, Shuyang, et al.
Publicado: (2026) -
Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning
por: Piriyakulkij, Wasu Top, et al.
Publicado: (2024)