Scaling Behavior for Large Language Models regarding Numeral Systems: An Example using Pythia
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Zhejian, Wang, Jiayu, Lin, Dahua, Chen, Kai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models
por: Gu, Yuzhe, et al.
Publicado: (2024)
por: Gu, Yuzhe, et al.
Publicado: (2024)
LEAN-GitHub: Compiling GitHub LEAN repositories for a versatile LEAN prover
por: Wu, Zijian, et al.
Publicado: (2024)
por: Wu, Zijian, et al.
Publicado: (2024)
How Language Models Process Negation
por: Zhou, Zhejian, et al.
Publicado: (2026)
por: Zhou, Zhejian, et al.
Publicado: (2026)
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
por: Ying, Huaiyuan, et al.
Publicado: (2024)
por: Ying, Huaiyuan, et al.
Publicado: (2024)
InternLM2.5-StepProver: Advancing Automated Theorem Proving via Critic-Guided Search
por: Wu, Zijian, et al.
Publicado: (2024)
por: Wu, Zijian, et al.
Publicado: (2024)
ANAH: Analytical Annotation of Hallucinations in Large Language Models
por: Ji, Ziwei, et al.
Publicado: (2024)
por: Ji, Ziwei, et al.
Publicado: (2024)
Conceptual Steganography
por: Zhou, Zhejian, et al.
Publicado: (2026)
por: Zhou, Zhejian, et al.
Publicado: (2026)
Agent-FLAN: Designing Data and Methods of Effective Agent Tuning for Large Language Models
por: Chen, Zehui, et al.
Publicado: (2024)
por: Chen, Zehui, et al.
Publicado: (2024)
CriticEval: Evaluating Large Language Model as Critic
por: Lan, Tian, et al.
Publicado: (2024)
por: Lan, Tian, et al.
Publicado: (2024)
Data-free Weight Compress and Denoise for Large Language Models
por: Peng, Runyu, et al.
Publicado: (2024)
por: Peng, Runyu, et al.
Publicado: (2024)
InternLM-Law: An Open Source Chinese Legal Large Language Model
por: Fei, Zhiwei, et al.
Publicado: (2024)
por: Fei, Zhiwei, et al.
Publicado: (2024)
PolyPythias: Stability and Outliers across Fifty Language Model Pre-Training Runs
por: van der Wal, Oskar, et al.
Publicado: (2025)
por: van der Wal, Oskar, et al.
Publicado: (2025)
PointLLM: Empowering Large Language Models to Understand Point Clouds
por: Xu, Runsen, et al.
Publicado: (2023)
por: Xu, Runsen, et al.
Publicado: (2023)
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
por: Wang, Xiao, et al.
Publicado: (2024)
por: Wang, Xiao, et al.
Publicado: (2024)
Beyond Fixed: Training-Free Variable-Length Denoising for Diffusion Large Language Models
por: Li, Jinsong, et al.
Publicado: (2025)
por: Li, Jinsong, et al.
Publicado: (2025)
T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
por: Chen, Zehui, et al.
Publicado: (2023)
por: Chen, Zehui, et al.
Publicado: (2023)
Learning to Retrieve In-Context Examples for Large Language Models
por: Wang, Liang, et al.
Publicado: (2023)
por: Wang, Liang, et al.
Publicado: (2023)
The Oracle Has Spoken: A Multi-Aspect Evaluation of Dialogue in Pythia
por: Chen, Zixun, et al.
Publicado: (2025)
por: Chen, Zixun, et al.
Publicado: (2025)
Training Language Models to Critique With Multi-agent Feedback
por: Lan, Tian, et al.
Publicado: (2024)
por: Lan, Tian, et al.
Publicado: (2024)
Uncertainty Aware Learning for Language Model Alignment
por: Wang, Yikun, et al.
Publicado: (2024)
por: Wang, Yikun, et al.
Publicado: (2024)
Temporal Scaling Law for Large Language Models
por: Xiong, Yizhe, et al.
Publicado: (2024)
por: Xiong, Yizhe, et al.
Publicado: (2024)
SKVQ: Sliding-window Key and Value Cache Quantization for Large Language Models
por: Duanmu, Haojie, et al.
Publicado: (2024)
por: Duanmu, Haojie, et al.
Publicado: (2024)
How to Retrieve Examples in In-context Learning to Improve Conversational Emotion Recognition using Large Language Models?
por: Wang, Mengqi, et al.
Publicado: (2025)
por: Wang, Mengqi, et al.
Publicado: (2025)
Exploring the Effects of Alignment on Numerical Bias in Large Language Models
por: Sato, Ayako, et al.
Publicado: (2026)
por: Sato, Ayako, et al.
Publicado: (2026)
Learning and Forgetting Unsafe Examples in Large Language Models
por: Zhao, Jiachen, et al.
Publicado: (2023)
por: Zhao, Jiachen, et al.
Publicado: (2023)
Investigating Numerical Translation with Large Language Models
por: Tang, Wei, et al.
Publicado: (2025)
por: Tang, Wei, et al.
Publicado: (2025)
Scaling Laws for Fact Memorization of Large Language Models
por: Lu, Xingyu, et al.
Publicado: (2024)
por: Lu, Xingyu, et al.
Publicado: (2024)
Navigating the OverKill in Large Language Models
por: Shi, Chenyu, et al.
Publicado: (2024)
por: Shi, Chenyu, et al.
Publicado: (2024)
Mask-DPO: Generalizable Fine-grained Factuality Alignment of LLMs
por: Gu, Yuzhe, et al.
Publicado: (2025)
por: Gu, Yuzhe, et al.
Publicado: (2025)
Uncertainty Unveiled: Can Exposure to More In-context Examples Mitigate Uncertainty for Large Language Models?
por: Wang, Yifei, et al.
Publicado: (2025)
por: Wang, Yifei, et al.
Publicado: (2025)
Scaling Behavior of Machine Translation with Large Language Models under Prompt Injection Attacks
por: Sun, Zhifan, et al.
Publicado: (2024)
por: Sun, Zhifan, et al.
Publicado: (2024)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
por: Wang, Yiping, et al.
Publicado: (2025)
por: Wang, Yiping, et al.
Publicado: (2025)
MetaRuleGPT: Recursive Numerical Reasoning of Language Models Trained with Simple Rules
por: Chen, Kejie, et al.
Publicado: (2024)
por: Chen, Kejie, et al.
Publicado: (2024)
Ada-LEval: Evaluating long-context LLMs with length-adaptable benchmarks
por: Wang, Chonghua, et al.
Publicado: (2024)
por: Wang, Chonghua, et al.
Publicado: (2024)
NUMCoT: Numerals and Units of Measurement in Chain-of-Thought Reasoning using Large Language Models
por: Xu, Ancheng, et al.
Publicado: (2024)
por: Xu, Ancheng, et al.
Publicado: (2024)
End-to-End Graph Flattening Method for Large Language Models
por: Hong, Bin, et al.
Publicado: (2024)
por: Hong, Bin, et al.
Publicado: (2024)
Addressing Order Sensitivity of In-Context Demonstration Examples in Causal Language Models
por: Xiang, Yanzheng, et al.
Publicado: (2024)
por: Xiang, Yanzheng, et al.
Publicado: (2024)
MLP Memory: A Retriever-Pretrained Memory for Large Language Models
por: Wei, Rubin, et al.
Publicado: (2025)
por: Wei, Rubin, et al.
Publicado: (2025)
Revisiting Epistemic Markers in Confidence Estimation: Can Markers Accurately Reflect Large Language Models' Uncertainty?
por: Liu, Jiayu, et al.
Publicado: (2025)
por: Liu, Jiayu, et al.
Publicado: (2025)
BACH-V: Bridging Abstract and Concrete Human-Values in Large Language Models
por: Zhang, Junyu, et al.
Publicado: (2026)
por: Zhang, Junyu, et al.
Publicado: (2026)
Ejemplares similares
-
ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models
por: Gu, Yuzhe, et al.
Publicado: (2024) -
LEAN-GitHub: Compiling GitHub LEAN repositories for a versatile LEAN prover
por: Wu, Zijian, et al.
Publicado: (2024) -
How Language Models Process Negation
por: Zhou, Zhejian, et al.
Publicado: (2026) -
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
por: Ying, Huaiyuan, et al.
Publicado: (2024) -
InternLM2.5-StepProver: Advancing Automated Theorem Proving via Critic-Guided Search
por: Wu, Zijian, et al.
Publicado: (2024)