The Fine Line: Navigating Large Language Model Pretraining with Down-streaming Capability Analysis
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Chen, Li, Junzhuo, Niu, Xinyao, Du, Xinrun, Gao, Songyang, Zhang, Haoran, Chen, Zhaoliang, Qu, Xingwei, Yuan, Ruibin, Li, Yizhi, Liu, Jiaheng, Huang, Stephen W., Yue, Shawn, Zhang, Ge |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Chinese Tiny LLM: Pretraining a Chinese-Centric Large Language Model
di: Du, Xinrun, et al.
Pubblicazione: (2024)
di: Du, Xinrun, et al.
Pubblicazione: (2024)
Overview of the NLPCC 2024 Shared Task on Chinese Metaphor Generation
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
di: Ge, Qiming, et al.
Pubblicazione: (2025)
di: Ge, Qiming, et al.
Pubblicazione: (2025)
MuPT: A Generative Symbolic Music Pretrained Transformer
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
PLANET: A Collection of Benchmarks for Evaluating LLMs' Planning Capabilities
di: Li, Haoming, et al.
Pubblicazione: (2025)
di: Li, Haoming, et al.
Pubblicazione: (2025)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
di: Ma, Kaijing, et al.
Pubblicazione: (2024)
di: Ma, Kaijing, et al.
Pubblicazione: (2024)
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models
di: Que, Haoran, et al.
Pubblicazione: (2024)
di: Que, Haoran, et al.
Pubblicazione: (2024)
I-SHEEP: Self-Alignment of LLM from Scratch through an Iterative Self-Enhancement Paradigm
di: Liang, Yiming, et al.
Pubblicazione: (2024)
di: Liang, Yiming, et al.
Pubblicazione: (2024)
Are Your LLMs Capable of Stable Reasoning?
di: Liu, Junnan, et al.
Pubblicazione: (2024)
di: Liu, Junnan, et al.
Pubblicazione: (2024)
CMMMU: A Chinese Massive Multi-discipline Multimodal Understanding Benchmark
di: Zhang, Ge, et al.
Pubblicazione: (2024)
di: Zhang, Ge, et al.
Pubblicazione: (2024)
FineCops-Ref: A new Dataset and Task for Fine-Grained Compositional Referring Expression Comprehension
di: Liu, Junzhuo, et al.
Pubblicazione: (2024)
di: Liu, Junzhuo, et al.
Pubblicazione: (2024)
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
di: Guo, Jiawei, et al.
Pubblicazione: (2024)
di: Guo, Jiawei, et al.
Pubblicazione: (2024)
AITH: A Post-Quantum Continuous Delegation Protocol for Human-AI Trust Establishment
di: Chen, Zhaoliang
Pubblicazione: (2026)
di: Chen, Zhaoliang
Pubblicazione: (2026)
MMRA: A Benchmark for Evaluating Multi-Granularity and Multi-Image Relational Association Capabilities in Large Visual Language Models
di: Wu, Siwei, et al.
Pubblicazione: (2024)
di: Wu, Siwei, et al.
Pubblicazione: (2024)
DeepInnovator: Triggering the Innovative Capabilities of LLMs
di: Fan, Tianyu, et al.
Pubblicazione: (2026)
di: Fan, Tianyu, et al.
Pubblicazione: (2026)
PreConfig: A Pretrained Model for Automating Network Configuration
di: Li, Fuliang, et al.
Pubblicazione: (2024)
di: Li, Fuliang, et al.
Pubblicazione: (2024)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
di: LI, Yizhi, et al.
Pubblicazione: (2024)
di: LI, Yizhi, et al.
Pubblicazione: (2024)
MAPL: Memory Augmentation and Pseudo-Labeling for Semi-Supervised Anomaly Detection
di: Chen, Junzhuo, et al.
Pubblicazione: (2024)
di: Chen, Junzhuo, et al.
Pubblicazione: (2024)
AutoMV: An Automatic Multi-Agent System for Music Video Generation
di: Tang, Xiaoxuan, et al.
Pubblicazione: (2025)
di: Tang, Xiaoxuan, et al.
Pubblicazione: (2025)
SAM-OCTA2: Layer Sequence OCTA Segmentation with Fine-tuned Segment Anything Model 2
di: Chen, Xinrun, et al.
Pubblicazione: (2024)
di: Chen, Xinrun, et al.
Pubblicazione: (2024)
MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series
di: Zhang, Ge, et al.
Pubblicazione: (2024)
di: Zhang, Ge, et al.
Pubblicazione: (2024)
Singing Timbre Popularity Assessment Based on Multimodal Large Foundation Model
di: Wang, Zihao, et al.
Pubblicazione: (2025)
di: Wang, Zihao, et al.
Pubblicazione: (2025)
Multi-Accent Mandarin Dry-Vocal Singing Dataset: Benchmark for Singing Accent Recognition
di: Wang, Zihao, et al.
Pubblicazione: (2025)
di: Wang, Zihao, et al.
Pubblicazione: (2025)
Aligning Instruction Tuning with Pre-training
di: Liang, Yiming, et al.
Pubblicazione: (2025)
di: Liang, Yiming, et al.
Pubblicazione: (2025)
LASP: Surveying the State-of-the-Art in Large Language Model-Assisted AI Planning
di: Li, Haoming, et al.
Pubblicazione: (2024)
di: Li, Haoming, et al.
Pubblicazione: (2024)
MORE-3S:Multimodal-based Offline Reinforcement Learning with Shared Semantic Spaces
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
Kun: Answer Polishment for Chinese Self-Alignment with Instruction Back-Translation
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
di: Zheng, Tianyu, et al.
Pubblicazione: (2024)
ConceptMoE: Adaptive Token-to-Concept Compression for Implicit Compute Allocation
di: Huang, Zihao, et al.
Pubblicazione: (2026)
di: Huang, Zihao, et al.
Pubblicazione: (2026)
Bionic Design and 3D Printing of Leaf‐Vein Like Ceramic/Resin Composite Liquid Cooling Plates with Excellent Thermal Management Capacity
di: Zhichao Gong, et al.
Pubblicazione: (2025)
di: Zhichao Gong, et al.
Pubblicazione: (2025)
LoTA-QAF: Lossless Ternary Adaptation for Quantization-Aware Fine-Tuning
di: Chen, Junyu, et al.
Pubblicazione: (2025)
di: Chen, Junyu, et al.
Pubblicazione: (2025)
FineLAP: Taming Heterogeneous Supervision for Fine-grained Language-Audio Pretraining
di: Li, Xiquan, et al.
Pubblicazione: (2026)
di: Li, Xiquan, et al.
Pubblicazione: (2026)
An Artificial Tactile Perception System with Spatio‐Temporal Recognition Capability
di: Li Yuan, et al.
Pubblicazione: (2024)
di: Li Yuan, et al.
Pubblicazione: (2024)
Digital Agricultural Technology Extension and Farmers' Use of Biopesticides: Evidence From Rural China
di: Zhaoliang Li, et al.
Pubblicazione: (2025)
di: Zhaoliang Li, et al.
Pubblicazione: (2025)
ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world Scenarios
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
How Real is Your Jailbreak? Fine-grained Jailbreak Evaluation with Anchored Reference
di: Liu, Songyang, et al.
Pubblicazione: (2026)
di: Liu, Songyang, et al.
Pubblicazione: (2026)
OmniBench: Towards The Future of Universal Omni-Language Models
di: Li, Yizhi, et al.
Pubblicazione: (2024)
di: Li, Yizhi, et al.
Pubblicazione: (2024)
Can Muon Fine-tune Adam-Pretrained Models?
di: Qu, Xingyu, et al.
Pubblicazione: (2026)
di: Qu, Xingyu, et al.
Pubblicazione: (2026)
Step-level Reward for Free in RL-based T2I Diffusion Model Fine-tuning
di: Liao, Xinyao, et al.
Pubblicazione: (2025)
di: Liao, Xinyao, et al.
Pubblicazione: (2025)
Pretrained LLMs as Real-Time Controllers for Robot Operated Serial Production Line
di: Waseem, Muhammad, et al.
Pubblicazione: (2025)
di: Waseem, Muhammad, et al.
Pubblicazione: (2025)
Prism: A Framework for Decoupling and Assessing the Capabilities of VLMs
di: Qiao, Yuxuan, et al.
Pubblicazione: (2024)
di: Qiao, Yuxuan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Chinese Tiny LLM: Pretraining a Chinese-Centric Large Language Model
di: Du, Xinrun, et al.
Pubblicazione: (2024) -
Overview of the NLPCC 2024 Shared Task on Chinese Metaphor Generation
di: Qu, Xingwei, et al.
Pubblicazione: (2024) -
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
di: Ge, Qiming, et al.
Pubblicazione: (2025) -
MuPT: A Generative Symbolic Music Pretrained Transformer
di: Qu, Xingwei, et al.
Pubblicazione: (2024) -
PLANET: A Collection of Benchmarks for Evaluating LLMs' Planning Capabilities
di: Li, Haoming, et al.
Pubblicazione: (2025)