Designing Algorithms Empowered by Language Models: An Analytical Framework, Case Studies, and Insights
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Yanxi, Li, Yaliang, Ding, Bolin, Zhou, Jingren |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Provable Scaling Laws for the Test-Time Compute of Large Language Models
von: Chen, Yanxi, et al.
Veröffentlicht: (2024)
von: Chen, Yanxi, et al.
Veröffentlicht: (2024)
EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models
von: Pan, Xuchen, et al.
Veröffentlicht: (2024)
von: Pan, Xuchen, et al.
Veröffentlicht: (2024)
EE-LLM: Large-Scale Training and Inference of Early-Exit Large Language Models with 3D Parallelism
von: Chen, Yanxi, et al.
Veröffentlicht: (2023)
von: Chen, Yanxi, et al.
Veröffentlicht: (2023)
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
von: Yao, Chaorui, et al.
Veröffentlicht: (2025)
von: Yao, Chaorui, et al.
Veröffentlicht: (2025)
BiMix: A Bivariate Data Mixing Law for Language Model Pretraining
von: Ge, Ce, et al.
Veröffentlicht: (2024)
von: Ge, Ce, et al.
Veröffentlicht: (2024)
Enhancing Latent Computation in Transformers with Latent Tokens
von: Sun, Yuchang, et al.
Veröffentlicht: (2025)
von: Sun, Yuchang, et al.
Veröffentlicht: (2025)
Tree-based Models for Vertical Federated Learning: A Survey
von: Qian, Bingchen, et al.
Veröffentlicht: (2025)
von: Qian, Bingchen, et al.
Veröffentlicht: (2025)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
Branch-and-Browse: Efficient and Controllable Web Exploration with Tree-Structured Reasoning and Action Memory
von: He, Shiqi, et al.
Veröffentlicht: (2025)
von: He, Shiqi, et al.
Veröffentlicht: (2025)
Data-Juicer Sandbox: A Feedback-Driven Suite for Multimodal Data-Model Co-development
von: Chen, Daoyuan, et al.
Veröffentlicht: (2024)
von: Chen, Daoyuan, et al.
Veröffentlicht: (2024)
Towards Anthropomorphic Conversational AI Part I: A Practical Framework
von: Wei, Fei, et al.
Veröffentlicht: (2025)
von: Wei, Fei, et al.
Veröffentlicht: (2025)
CataLM: Empowering Catalyst Design Through Large Language Models
von: Wang, Ludi, et al.
Veröffentlicht: (2024)
von: Wang, Ludi, et al.
Veröffentlicht: (2024)
Sparse but Critical: A Token-Level Analysis of Distributional Shifts in RLVR Fine-Tuning of LLMs
von: Meng, Haoming, et al.
Veröffentlicht: (2026)
von: Meng, Haoming, et al.
Veröffentlicht: (2026)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
von: Dong, Guanting, et al.
Veröffentlicht: (2024)
von: Dong, Guanting, et al.
Veröffentlicht: (2024)
Trinity-RFT: A General-Purpose and Unified Framework for Reinforcement Fine-Tuning of Large Language Models
von: Pan, Xuchen, et al.
Veröffentlicht: (2025)
von: Pan, Xuchen, et al.
Veröffentlicht: (2025)
AgentEvolver: Towards Efficient Self-Evolving Agent System
von: Zhai, Yunpeng, et al.
Veröffentlicht: (2025)
von: Zhai, Yunpeng, et al.
Veröffentlicht: (2025)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
von: Dong, Guanting, et al.
Veröffentlicht: (2023)
von: Dong, Guanting, et al.
Veröffentlicht: (2023)
Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization
von: Wu, Junkang, et al.
Veröffentlicht: (2024)
von: Wu, Junkang, et al.
Veröffentlicht: (2024)
An Auction-based Marketplace for Model Trading in Federated Learning
von: Cui, Yue, et al.
Veröffentlicht: (2024)
von: Cui, Yue, et al.
Veröffentlicht: (2024)
EdgeMoE: Empowering Sparse Large Language Models on Mobile Devices
von: Yi, Rongjie, et al.
Veröffentlicht: (2023)
von: Yi, Rongjie, et al.
Veröffentlicht: (2023)
A Systematic Survey on Large Language Models for Algorithm Design
von: Liu, Fei, et al.
Veröffentlicht: (2024)
von: Liu, Fei, et al.
Veröffentlicht: (2024)
CityGPT: Empowering Urban Spatial Cognition of Large Language Models
von: Feng, Jie, et al.
Veröffentlicht: (2024)
von: Feng, Jie, et al.
Veröffentlicht: (2024)
Small Language Models for Application Interactions: A Case Study
von: Li, Beibin, et al.
Veröffentlicht: (2024)
von: Li, Beibin, et al.
Veröffentlicht: (2024)
Diversity as a Reward: Fine-Tuning LLMs on a Mixture of Domain-Undetermined Data
von: Ling, Zhenqing, et al.
Veröffentlicht: (2025)
von: Ling, Zhenqing, et al.
Veröffentlicht: (2025)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
von: Bhatt, Gantavya, et al.
Veröffentlicht: (2024)
von: Bhatt, Gantavya, et al.
Veröffentlicht: (2024)
Scaling Unverifiable Rewards: A Case Study on Visual Insights
von: Gan, Shuyu, et al.
Veröffentlicht: (2025)
von: Gan, Shuyu, et al.
Veröffentlicht: (2025)
WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct
von: Luo, Haipeng, et al.
Veröffentlicht: (2023)
von: Luo, Haipeng, et al.
Veröffentlicht: (2023)
Small Language Models: Survey, Measurements, and Insights
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
von: Lu, Zhenyan, et al.
Veröffentlicht: (2024)
Output Scaling: YingLong-Delayed Chain of Thought in a Large Pretrained Time Series Forecasting Model
von: Wang, Xue, et al.
Veröffentlicht: (2025)
von: Wang, Xue, et al.
Veröffentlicht: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
IAA: Inner-Adaptor Architecture Empowers Frozen Large Language Model with Multimodal Capabilities
von: Wang, Bin, et al.
Veröffentlicht: (2024)
von: Wang, Bin, et al.
Veröffentlicht: (2024)
A Survey of Low-bit Large Language Models: Basics, Systems, and Algorithms
von: Gong, Ruihao, et al.
Veröffentlicht: (2024)
von: Gong, Ruihao, et al.
Veröffentlicht: (2024)
Large AI Model Empowered Multimodal Semantic Communications
von: Jiang, Feibo, et al.
Veröffentlicht: (2023)
von: Jiang, Feibo, et al.
Veröffentlicht: (2023)
Towards Interpreting Language Models: A Case Study in Multi-Hop Reasoning
von: Sakarvadia, Mansi
Veröffentlicht: (2024)
von: Sakarvadia, Mansi
Veröffentlicht: (2024)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
von: Tang, Haoyu, et al.
Veröffentlicht: (2024)
von: Tang, Haoyu, et al.
Veröffentlicht: (2024)
RePST: Language Model Empowered Spatio-Temporal Forecasting via Semantic-Oriented Reprogramming
von: Wang, Hao, et al.
Veröffentlicht: (2024)
von: Wang, Hao, et al.
Veröffentlicht: (2024)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
von: Luo, Haipeng, et al.
Veröffentlicht: (2025)
von: Luo, Haipeng, et al.
Veröffentlicht: (2025)
Harnessing Business and Media Insights with Large Language Models
von: Bao, Yujia, et al.
Veröffentlicht: (2024)
von: Bao, Yujia, et al.
Veröffentlicht: (2024)
Mini-Giants: "Small" Language Models and Open Source Win-Win
von: Zhou, Zhengping, et al.
Veröffentlicht: (2023)
von: Zhou, Zhengping, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Provable Scaling Laws for the Test-Time Compute of Large Language Models
von: Chen, Yanxi, et al.
Veröffentlicht: (2024) -
EE-Tuning: An Economical yet Scalable Solution for Tuning Early-Exit Large Language Models
von: Pan, Xuchen, et al.
Veröffentlicht: (2024) -
EE-LLM: Large-Scale Training and Inference of Early-Exit Large Language Models with 3D Parallelism
von: Chen, Yanxi, et al.
Veröffentlicht: (2023) -
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
von: Yao, Chaorui, et al.
Veröffentlicht: (2025) -
BiMix: A Bivariate Data Mixing Law for Language Model Pretraining
von: Ge, Ce, et al.
Veröffentlicht: (2024)