Gespeichert in:
| Hauptverfasser: | Li, Shujie, Li, Liang, Geng, Ruiying, Yang, Min, Li, Binhua, Yuan, Guanghu, He, Wanwei, Yuan, Shao, Ma, Can, Huang, Fei, Li, Yongbin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2401.01183 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Alibaba LingmaAgent: Improving Automated Issue Resolution via Comprehensive Repository Exploration
von: Ma, Yingwei, et al.
Veröffentlicht: (2024)
von: Ma, Yingwei, et al.
Veröffentlicht: (2024)
Iterative Forward Tuning Boosts In-Context Learning in Language Models
von: Yang, Jiaxi, et al.
Veröffentlicht: (2023)
von: Yang, Jiaxi, et al.
Veröffentlicht: (2023)
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
von: Chen, Longze, et al.
Veröffentlicht: (2024)
von: Chen, Longze, et al.
Veröffentlicht: (2024)
HeTGB: A Comprehensive Benchmark for Heterophilic Text-Attributed Graphs
von: Li, Shujie, et al.
Veröffentlicht: (2025)
von: Li, Shujie, et al.
Veröffentlicht: (2025)
Extend Model Merging from Fine-Tuned to Pre-Trained Large Language Models via Weight Disentanglement
von: Yu, Le, et al.
Veröffentlicht: (2024)
von: Yu, Le, et al.
Veröffentlicht: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
von: Li, Jia, et al.
Veröffentlicht: (2024)
von: Li, Jia, et al.
Veröffentlicht: (2024)
To Diff or Not to Diff? Structure-Aware and Adaptive Output Formats for Efficient LLM-based Code Editing
von: Cheng, Wei, et al.
Veröffentlicht: (2026)
von: Cheng, Wei, et al.
Veröffentlicht: (2026)
Format-Adapter: Improving Reasoning Capability of LLMs by Adapting Suitable Format
von: Wang, Dingzirui, et al.
Veröffentlicht: (2025)
von: Wang, Dingzirui, et al.
Veröffentlicht: (2025)
Debate Helps Weak-to-Strong Generalization
von: Lang, Hao, et al.
Veröffentlicht: (2025)
von: Lang, Hao, et al.
Veröffentlicht: (2025)
Selective Weak-to-Strong Generalization
von: Lang, Hao, et al.
Veröffentlicht: (2025)
von: Lang, Hao, et al.
Veröffentlicht: (2025)
Reinforcement Learning on Pre-Training Data
von: Li, Siheng, et al.
Veröffentlicht: (2025)
von: Li, Siheng, et al.
Veröffentlicht: (2025)
DialCLIP: Empowering CLIP as Multi-Modal Dialog Retriever
von: Yin, Zhichao, et al.
Veröffentlicht: (2024)
von: Yin, Zhichao, et al.
Veröffentlicht: (2024)
Exploring the Potential of Large Language Models for Heterophilic Graphs
von: Wu, Yuxia, et al.
Veröffentlicht: (2024)
von: Wu, Yuxia, et al.
Veröffentlicht: (2024)
Fine-Tuning Language Models with Reward Learning on Policy
von: Lang, Hao, et al.
Veröffentlicht: (2024)
von: Lang, Hao, et al.
Veröffentlicht: (2024)
In-Context Transfer Learning: Demonstration Synthesis by Transferring Similar Tasks
von: Wang, Dingzirui, et al.
Veröffentlicht: (2024)
von: Wang, Dingzirui, et al.
Veröffentlicht: (2024)
Saber: An Efficient Sampling with Adaptive Acceleration and Backtracking Enhanced Remasking for Diffusion Language Model
von: Dong, Yihong, et al.
Veröffentlicht: (2025)
von: Dong, Yihong, et al.
Veröffentlicht: (2025)
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
von: Song, Feifan, et al.
Veröffentlicht: (2024)
von: Song, Feifan, et al.
Veröffentlicht: (2024)
Balanced Data Sampling for Language Model Training with Clustering
von: Shao, Yunfan, et al.
Veröffentlicht: (2024)
von: Shao, Yunfan, et al.
Veröffentlicht: (2024)
RL-PLUS: Countering Capability Boundary Collapse of LLMs in Reinforcement Learning with Hybrid-policy Optimization
von: Dong, Yihong, et al.
Veröffentlicht: (2025)
von: Dong, Yihong, et al.
Veröffentlicht: (2025)
Train a Unified Multimodal Data Quality Classifier with Synthetic Data
von: Wang, Weizhi, et al.
Veröffentlicht: (2025)
von: Wang, Weizhi, et al.
Veröffentlicht: (2025)
Understanding Generalization in Role-Playing Models via Information Theory
von: Li, Yongqi, et al.
Veröffentlicht: (2025)
von: Li, Yongqi, et al.
Veröffentlicht: (2025)
One-Shot Learning as Instruction Data Prospector for Large Language Models
von: Li, Yunshui, et al.
Veröffentlicht: (2023)
von: Li, Yunshui, et al.
Veröffentlicht: (2023)
CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment
von: Jiang, Xue, et al.
Veröffentlicht: (2025)
von: Jiang, Xue, et al.
Veröffentlicht: (2025)
DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models
von: Liang, Hao, et al.
Veröffentlicht: (2026)
von: Liang, Hao, et al.
Veröffentlicht: (2026)
Information Capacity: Evaluating the Efficiency of Large Language Models via Text Compression
von: Yuan, Cheng, et al.
Veröffentlicht: (2025)
von: Yuan, Cheng, et al.
Veröffentlicht: (2025)
MOA: Multi-Objective Alignment for Role-Playing Agents
von: Liao, Chonghua, et al.
Veröffentlicht: (2025)
von: Liao, Chonghua, et al.
Veröffentlicht: (2025)
ELSPR: Evaluator LLM Training Data Self-Purification on Non-Transitive Preferences via Tournament Graph Reconstruction
von: Yu, Yan, et al.
Veröffentlicht: (2025)
von: Yu, Yan, et al.
Veröffentlicht: (2025)
Implicit Actor Critic Coupling via a Supervised Learning Framework for RLVR
von: Li, Jiaming, et al.
Veröffentlicht: (2025)
von: Li, Jiaming, et al.
Veröffentlicht: (2025)
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
von: Si, Shuzheng, et al.
Veröffentlicht: (2023)
von: Si, Shuzheng, et al.
Veröffentlicht: (2023)
LLMs as Continuous Learners: Improving the Reproduction of Defective Code in Software Issues
von: Lin, Yalan, et al.
Veröffentlicht: (2024)
von: Lin, Yalan, et al.
Veröffentlicht: (2024)
Unified Data Selection for LLM Reasoning
von: Li, Xiaoyuan, et al.
Veröffentlicht: (2026)
von: Li, Xiaoyuan, et al.
Veröffentlicht: (2026)
From I/O to Code with Discovery Agent
von: Dong, Yihong, et al.
Veröffentlicht: (2026)
von: Dong, Yihong, et al.
Veröffentlicht: (2026)
ToReMi: Topic-Aware Data Reweighting for Dynamic Pre-Training Data Selection
von: Zhu, Xiaoxuan, et al.
Veröffentlicht: (2025)
von: Zhu, Xiaoxuan, et al.
Veröffentlicht: (2025)
Dual Tuning for Reasoning Efficacy-Driven Data Curation in Multimodal LLM Training
von: Zheng, Ruobing, et al.
Veröffentlicht: (2026)
von: Zheng, Ruobing, et al.
Veröffentlicht: (2026)
Inside the Black Box: Detecting Data Leakage in Pre-trained Language Encoders
von: Xin, Yuan, et al.
Veröffentlicht: (2024)
von: Xin, Yuan, et al.
Veröffentlicht: (2024)
Verifiable by Design: Aligning Language Models to Quote from Pre-Training Data
von: Zhang, Jingyu, et al.
Veröffentlicht: (2024)
von: Zhang, Jingyu, et al.
Veröffentlicht: (2024)
Language Models are Super Mario: Absorbing Abilities from Homologous Models as a Free Lunch
von: Yu, Le, et al.
Veröffentlicht: (2023)
von: Yu, Le, et al.
Veröffentlicht: (2023)
IOPO: Empowering LLMs with Complex Instruction Following via Input-Output Preference Optimization
von: Zhang, Xinghua, et al.
Veröffentlicht: (2024)
von: Zhang, Xinghua, et al.
Veröffentlicht: (2024)
MultiGPrompt for Multi-Task Pre-Training and Prompting on Graphs
von: Yu, Xingtong, et al.
Veröffentlicht: (2023)
von: Yu, Xingtong, et al.
Veröffentlicht: (2023)
GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents
von: Luo, Run, et al.
Veröffentlicht: (2025)
von: Luo, Run, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Alibaba LingmaAgent: Improving Automated Issue Resolution via Comprehensive Repository Exploration
von: Ma, Yingwei, et al.
Veröffentlicht: (2024) -
Iterative Forward Tuning Boosts In-Context Learning in Language Models
von: Yang, Jiaxi, et al.
Veröffentlicht: (2023) -
Long Context is Not Long at All: A Prospector of Long-Dependency Data for Large Language Models
von: Chen, Longze, et al.
Veröffentlicht: (2024) -
HeTGB: A Comprehensive Benchmark for Heterophilic Text-Attributed Graphs
von: Li, Shujie, et al.
Veröffentlicht: (2025) -
Extend Model Merging from Fine-Tuned to Pre-Trained Large Language Models via Weight Disentanglement
von: Yu, Le, et al.
Veröffentlicht: (2024)