Enregistré dans:
| Auteurs principaux: | Wan, Zhongwei, Yin, Yichun, Zhang, Wei, Shi, Jiaxin, Shang, Lifeng, Chen, Guangyong, Jiang, Xin, Liu, Qun |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2212.03613 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prompt-Based Length Controlled Generation with Multiple Control Types
par: Jie, Renlong, et autres
Publié: (2024)
par: Jie, Renlong, et autres
Publié: (2024)
Preparing Lessons for Progressive Training on Language Models
par: Pan, Yu, et autres
Publié: (2024)
par: Pan, Yu, et autres
Publié: (2024)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
par: Liu, Chengwu, et autres
Publié: (2025)
par: Liu, Chengwu, et autres
Publié: (2025)
Visually Guided Generative Text-Layout Pre-training for Document Intelligence
par: Mao, Zhiming, et autres
Publié: (2024)
par: Mao, Zhiming, et autres
Publié: (2024)
Retrieval-based Disentangled Representation Learning with Natural Language Supervision
par: Zhou, Jiawei, et autres
Publié: (2022)
par: Zhou, Jiawei, et autres
Publié: (2022)
M4LE: A Multi-Ability Multi-Range Multi-Task Multi-Domain Long-Context Evaluation Benchmark for Large Language Models
par: Kwan, Wai-Chung, et autres
Publié: (2023)
par: Kwan, Wai-Chung, et autres
Publié: (2023)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
FollowBench: A Multi-level Fine-grained Constraints Following Benchmark for Large Language Models
par: Jiang, Yuxin, et autres
Publié: (2023)
par: Jiang, Yuxin, et autres
Publié: (2023)
Thinking Augmented Pre-training
par: Wang, Liang, et autres
Publié: (2025)
par: Wang, Liang, et autres
Publié: (2025)
Memory Grafting: Scaling Language Model Pre-training via Offline Conditional Memory
par: Cheng, Runxi, et autres
Publié: (2026)
par: Cheng, Runxi, et autres
Publié: (2026)
MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models
par: Kwan, Wai-Chung, et autres
Publié: (2024)
par: Kwan, Wai-Chung, et autres
Publié: (2024)
Data Management For Training Large Language Models: A Survey
par: Wang, Zige, et autres
Publié: (2023)
par: Wang, Zige, et autres
Publié: (2023)
Switch Attention: Towards Dynamic and Fine-grained Hybrid Transformers
par: Zhao, Yusheng, et autres
Publié: (2026)
par: Zhao, Yusheng, et autres
Publié: (2026)
Gradually Excavating External Knowledge for Implicit Complex Question Answering
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
ARTIS: Agentic Risk-Aware Test-Time Scaling via Iterative Simulation
par: Zeng, Xingshan, et autres
Publié: (2026)
par: Zeng, Xingshan, et autres
Publié: (2026)
CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Model
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
Domain Pre-training Impact on Representations
par: Gonzalez-Gutierrez, Cesar, et autres
Publié: (2025)
par: Gonzalez-Gutierrez, Cesar, et autres
Publié: (2025)
Effectiveness of Pre-training for Few-shot Intent Classification
par: Zhang, Haode, et autres
Publié: (2021)
par: Zhang, Haode, et autres
Publié: (2021)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
The Harder The Better: Maintaining Supervised Fine-tuning Generalization with Less but Harder Data
par: Shang, Zhaoyang, et autres
Publié: (2025)
par: Shang, Zhaoyang, et autres
Publié: (2025)
Improving Low-Resource Knowledge Tracing Tasks by Supervised Pre-training and Importance Mechanism Fine-tuning
par: Zhang, Hengyuan, et autres
Publié: (2024)
par: Zhang, Hengyuan, et autres
Publié: (2024)
PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models
par: Tan, Haochen, et autres
Publié: (2024)
par: Tan, Haochen, et autres
Publié: (2024)
Crafting Personalized Agents through Retrieval-Augmented Generation on Editable Memory Graphs
par: Wang, Zheng, et autres
Publié: (2024)
par: Wang, Zheng, et autres
Publié: (2024)
Can Memory-Augmented Language Models Generalize on Reasoning-in-a-Haystack Tasks?
par: Das, Payel, et autres
Publié: (2025)
par: Das, Payel, et autres
Publié: (2025)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
par: Li, Jiatao, et autres
Publié: (2024)
par: Li, Jiatao, et autres
Publié: (2024)
Enhancing Linguistic Competence of Language Models through Pre-training with Language Learning Tasks
par: Yamaguchi, Atsuki, et autres
Publié: (2026)
par: Yamaguchi, Atsuki, et autres
Publié: (2026)
Towards Effective and Efficient Continual Pre-training of Large Language Models
par: Chen, Jie, et autres
Publié: (2024)
par: Chen, Jie, et autres
Publié: (2024)
Pre-trained Language Models for Keyphrase Generation: A Thorough Empirical Study
par: Wu, Di, et autres
Publié: (2022)
par: Wu, Di, et autres
Publié: (2022)
On Leveraging Encoder-only Pre-trained Language Models for Effective Keyphrase Generation
par: Wu, Di, et autres
Publié: (2024)
par: Wu, Di, et autres
Publié: (2024)
Enhancing Test-Time Scaling of Large Language Models with Hierarchical Retrieval-Augmented MCTS
par: Dou, Alex ZH, et autres
Publié: (2025)
par: Dou, Alex ZH, et autres
Publié: (2025)
Efficient Continual Pre-training for Building Domain Specific Large Language Models
par: Xie, Yong, et autres
Publié: (2023)
par: Xie, Yong, et autres
Publié: (2023)
SVD-LLM V2: Optimizing Singular Value Truncation for Large Language Model Compression
par: Wang, Xin, et autres
Publié: (2025)
par: Wang, Xin, et autres
Publié: (2025)
Generative Pre-training for Speech with Flow Matching
par: Liu, Alexander H., et autres
Publié: (2023)
par: Liu, Alexander H., et autres
Publié: (2023)
Pre-training Limited Memory Language Models with Internal and External Knowledge
par: Zhao, Linxi, et autres
Publié: (2025)
par: Zhao, Linxi, et autres
Publié: (2025)
ToolFlow: Boosting LLM Tool-Calling Through Natural and Coherent Dialogue Synthesis
par: Wang, Zezhong, et autres
Publié: (2024)
par: Wang, Zezhong, et autres
Publié: (2024)
Superpixel Semantics Representation and Pre-training for Vision-Language Task
par: Zhang, Siyu, et autres
Publié: (2023)
par: Zhang, Siyu, et autres
Publié: (2023)
Learning to Align Multi-Faceted Evaluation: A Unified and Robust Framework
par: Xu, Kaishuai, et autres
Publié: (2025)
par: Xu, Kaishuai, et autres
Publié: (2025)
MaP: A Unified Framework for Reliable Evaluation of Pre-training Dynamics
par: Wang, Jiapeng, et autres
Publié: (2025)
par: Wang, Jiapeng, et autres
Publié: (2025)
Learning to Edit: Aligning LLMs with Knowledge Editing
par: Jiang, Yuxin, et autres
Publié: (2024)
par: Jiang, Yuxin, et autres
Publié: (2024)
Documents similaires
-
Prompt-Based Length Controlled Generation with Multiple Control Types
par: Jie, Renlong, et autres
Publié: (2024) -
Preparing Lessons for Progressive Training on Language Models
par: Pan, Yu, et autres
Publié: (2024) -
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
par: Liu, Chengwu, et autres
Publié: (2025) -
Visually Guided Generative Text-Layout Pre-training for Document Intelligence
par: Mao, Zhiming, et autres
Publié: (2024) -
Retrieval-based Disentangled Representation Learning with Natural Language Supervision
par: Zhou, Jiawei, et autres
Publié: (2022)