Skip to content
VuFind
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Advanced
  • Cite this
  • Text this
  • Email this
  • Print
  • Export Record
    • Export to RefWorks
    • Export to EndNoteWeb
    • Export to EndNote
  • Save to List
  • Permanent link
Cover Image

Saved in:
Bibliographic Details
Main Authors: Zhu, Xuekai, Cheng, Daixuan, Zhang, Dinghuai, Li, Hengli, Zhang, Kaiyan, Jiang, Che, Sun, Youbang, Hua, Ermo, Zuo, Yuxin, Lv, Xingtai, Zhang, Qizheng, Chen, Lin, Shao, Fanghao, Xue, Bo, Song, Yunchong, Yang, Zhenjie, Cui, Ganqu, Ding, Ning, Gao, Jianfeng, Liu, Xiaodong, Zhou, Bowen, Mei, Hongyuan, Lin, Zhouhan
Format: Preprint
Published: 2025
Subjects:
Machine Learning
Artificial Intelligence
Computation and Language
Online Access:https://arxiv.org/abs/2509.15207
Tags: Add Tag
No Tags, Be the first to tag this record!
  • Holdings
  • Description
  • Table of Contents
  • Comments
  • Similar Items
  • Staff View

Internet

https://arxiv.org/abs/2509.15207

Similar Items

  • How to Synthesize Text Data without Model Collapse?
    by: Zhu, Xuekai, et al.
    Published: (2024)
  • Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
    by: Lv, Xingtai, et al.
    Published: (2024)
  • Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
    by: Hua, Ermo, et al.
    Published: (2024)
  • Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
    by: Lv, Xingtai, et al.
    Published: (2025)
  • PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuning
    by: Zhu, Xuekai, et al.
    Published: (2023)

Search Options

  • Search History
  • Advanced Search

Find More

  • Browse the Catalog
  • Browse Alphabetically
  • Explore Channels
  • Course Reserves
  • New Items

Need Help?

  • Search Tips
  • Ask a Librarian
  • FAQs