Salvato in:
| Autore principale: | Li, Zixi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2508.02631 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pointer-Guided Pre-Training: Infusing Large Language Models with Paragraph-Level Contextual Awareness
di: Hillebrand, Lars, et al.
Pubblicazione: (2024)
di: Hillebrand, Lars, et al.
Pubblicazione: (2024)
MappedTrace: Tracing Pointer Remotely with Compiler-generated Maps
di: Ma, Zhiyao, et al.
Pubblicazione: (2025)
di: Ma, Zhiyao, et al.
Pubblicazione: (2025)
Iterating Pointers: Enabling Static Analysis for Loop-based Pointers
di: Lepori, Andrea, et al.
Pubblicazione: (2025)
di: Lepori, Andrea, et al.
Pubblicazione: (2025)
Revealing the Learning Dynamics of Long-Context Continual Pre-training
di: Liang, Yupu, et al.
Pubblicazione: (2026)
di: Liang, Yupu, et al.
Pubblicazione: (2026)
Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces Selection
di: Qi, Dacheng, et al.
Pubblicazione: (2026)
di: Qi, Dacheng, et al.
Pubblicazione: (2026)
Reasoning: From Reflection to Solution
di: Li, Zixi
Pubblicazione: (2025)
di: Li, Zixi
Pubblicazione: (2025)
On Predicting the Post-training Potential of Pre-trained LLMs
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
Semantic Aware Linear Transfer by Recycling Pre-trained Language Models for Cross-lingual Transfer
di: Lee, Seungyoon, et al.
Pubblicazione: (2025)
di: Lee, Seungyoon, et al.
Pubblicazione: (2025)
Fine-tuning Pre-trained Language Models for Few-shot Intent Detection: Supervised Pre-training and Isotropization
di: Zhang, Haode, et al.
Pubblicazione: (2022)
di: Zhang, Haode, et al.
Pubblicazione: (2022)
Pre-training LLM without Learning Rate Decay Enhances Supervised Fine-Tuning
di: Yano, Kazuki, et al.
Pubblicazione: (2026)
di: Yano, Kazuki, et al.
Pubblicazione: (2026)
Examining Forgetting in Continual Pre-training of Aligned Large Language Models
di: Li, Chen-An, et al.
Pubblicazione: (2024)
di: Li, Chen-An, et al.
Pubblicazione: (2024)
Enhancing Length Extrapolation in Sequential Models with Pointer-Augmented Neural Memory
di: Le, Hung, et al.
Pubblicazione: (2024)
di: Le, Hung, et al.
Pubblicazione: (2024)
KoCo: Conditioning Language Model Pre-training on Knowledge Coordinates
di: Li, Yudong, et al.
Pubblicazione: (2026)
di: Li, Yudong, et al.
Pubblicazione: (2026)
LargePiG: Your Large Language Model is Secretly a Pointer Generator
di: Sun, Zhongxiang, et al.
Pubblicazione: (2024)
di: Sun, Zhongxiang, et al.
Pubblicazione: (2024)
Thinking Augmented Pre-training
di: Wang, Liang, et al.
Pubblicazione: (2025)
di: Wang, Liang, et al.
Pubblicazione: (2025)
SparseLLM: Towards Global Pruning for Pre-trained Language Models
di: Bai, Guangji, et al.
Pubblicazione: (2024)
di: Bai, Guangji, et al.
Pubblicazione: (2024)
Metadata Conditioning Accelerates Language Model Pre-training
di: Gao, Tianyu, et al.
Pubblicazione: (2025)
di: Gao, Tianyu, et al.
Pubblicazione: (2025)
Evaluating Discourse Cohesion in Pre-trained Language Models
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
Pre-training and Diagnosing Knowledge Base Completion Models
di: Kocijan, Vid, et al.
Pubblicazione: (2024)
di: Kocijan, Vid, et al.
Pubblicazione: (2024)
Development of Cognitive Intelligence in Pre-trained Language Models
di: Shah, Raj Sanjay, et al.
Pubblicazione: (2024)
di: Shah, Raj Sanjay, et al.
Pubblicazione: (2024)
Summarization of Investment Reports Using Pre-trained Model
di: Sakaji, Hiroki, et al.
Pubblicazione: (2024)
di: Sakaji, Hiroki, et al.
Pubblicazione: (2024)
Model Merging in Pre-training of Large Language Models
di: Li, Yunshui, et al.
Pubblicazione: (2025)
di: Li, Yunshui, et al.
Pubblicazione: (2025)
A Comparative Study of Pre-training and Self-training
di: Wang, Yiheng, et al.
Pubblicazione: (2024)
di: Wang, Yiheng, et al.
Pubblicazione: (2024)
Masked Structural Growth for 2x Faster Language Model Pre-training
di: Yao, Yiqun, et al.
Pubblicazione: (2023)
di: Yao, Yiqun, et al.
Pubblicazione: (2023)
Pointer-Generator Networks for Low-Resource Machine Translation: Don't Copy That!
di: Bafna, Niyati, et al.
Pubblicazione: (2024)
di: Bafna, Niyati, et al.
Pubblicazione: (2024)
Cross-layer Attention Sharing for Pre-trained Large Language Models
di: Mu, Yongyu, et al.
Pubblicazione: (2024)
di: Mu, Yongyu, et al.
Pubblicazione: (2024)
ColBERT-Zero: To Pre-train Or Not To Pre-train ColBERT models
di: Chaffin, Antoine, et al.
Pubblicazione: (2026)
di: Chaffin, Antoine, et al.
Pubblicazione: (2026)
Can Pre-trained Language Models Understand Chinese Humor?
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
SongSage: A Large Musical Language Model with Lyric Generative Pre-training
di: Guo, Jiani, et al.
Pubblicazione: (2026)
di: Guo, Jiani, et al.
Pubblicazione: (2026)
Scaling Agents via Continual Pre-training
di: Su, Liangcai, et al.
Pubblicazione: (2025)
di: Su, Liangcai, et al.
Pubblicazione: (2025)
Tracr-Injection: Distilling Algorithms into Pre-trained Language Models
di: Vergara-Browne, Tomás, et al.
Pubblicazione: (2025)
di: Vergara-Browne, Tomás, et al.
Pubblicazione: (2025)
Stable Language Model Pre-training by Reducing Embedding Variability
di: Chung, Woojin, et al.
Pubblicazione: (2024)
di: Chung, Woojin, et al.
Pubblicazione: (2024)
Segment-Based Interactive Machine Translation for Pre-trained Models
di: Navarro, Angel, et al.
Pubblicazione: (2024)
di: Navarro, Angel, et al.
Pubblicazione: (2024)
Reconsidering Degeneration of Token Embeddings with Definitions for Encoder-based Pre-trained Language Models
di: Zhang, Ying, et al.
Pubblicazione: (2024)
di: Zhang, Ying, et al.
Pubblicazione: (2024)
Rethinking 1-bit Optimization Leveraging Pre-trained Large Language Models
di: Tu, Zhijun, et al.
Pubblicazione: (2025)
di: Tu, Zhijun, et al.
Pubblicazione: (2025)
Scaling Laws for Linear Complexity Language Models
di: Shen, Xuyang, et al.
Pubblicazione: (2024)
di: Shen, Xuyang, et al.
Pubblicazione: (2024)
Domain Pre-training Impact on Representations
di: Gonzalez-Gutierrez, Cesar, et al.
Pubblicazione: (2025)
di: Gonzalez-Gutierrez, Cesar, et al.
Pubblicazione: (2025)
Token Weighting for Long-Range Language Modeling
di: Helm, Falko, et al.
Pubblicazione: (2025)
di: Helm, Falko, et al.
Pubblicazione: (2025)
UOR: Universal Backdoor Attacks on Pre-trained Language Models
di: Du, Wei, et al.
Pubblicazione: (2023)
di: Du, Wei, et al.
Pubblicazione: (2023)
Optimal path for Biomedical Text Summarization Using Pointer GPT
di: Han, Hyunkyung, et al.
Pubblicazione: (2024)
di: Han, Hyunkyung, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Pointer-Guided Pre-Training: Infusing Large Language Models with Paragraph-Level Contextual Awareness
di: Hillebrand, Lars, et al.
Pubblicazione: (2024) -
MappedTrace: Tracing Pointer Remotely with Compiler-generated Maps
di: Ma, Zhiyao, et al.
Pubblicazione: (2025) -
Iterating Pointers: Enabling Static Analysis for Loop-based Pointers
di: Lepori, Andrea, et al.
Pubblicazione: (2025) -
Revealing the Learning Dynamics of Long-Context Continual Pre-training
di: Liang, Yupu, et al.
Pubblicazione: (2026) -
Pointer-CAD: Unifying B-Rep and Command Sequences via Pointer-based Edges & Faces Selection
di: Qi, Dacheng, et al.
Pubblicazione: (2026)