Enregistré dans:
| Auteurs principaux: | Liu, Yang, Sun, Peng, Li, Hang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.08078 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
player2vec: A Language Modeling Approach to Understand Player Behavior in Games
par: Wang, Tianze, et autres
Publié: (2024)
par: Wang, Tianze, et autres
Publié: (2024)
DuoGuard: A Two-Player RL-Driven Framework for Multilingual LLM Guardrails
par: Deng, Yihe, et autres
Publié: (2025)
par: Deng, Yihe, et autres
Publié: (2025)
Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts
par: Pang, Jing-Cheng, et autres
Publié: (2024)
par: Pang, Jing-Cheng, et autres
Publié: (2024)
Reflect-RL: Two-Player Online RL Fine-Tuning for LMs
par: Zhou, Runlong, et autres
Publié: (2024)
par: Zhou, Runlong, et autres
Publié: (2024)
CoBa: Convergence Balancer for Multitask Finetuning of Large Language Models
par: Gong, Zi, et autres
Publié: (2024)
par: Gong, Zi, et autres
Publié: (2024)
Spatial-Temporal Large Language Model for Traffic Prediction
par: Liu, Chenxi, et autres
Publié: (2024)
par: Liu, Chenxi, et autres
Publié: (2024)
Rethinking Machine Unlearning for Large Language Models
par: Liu, Sijia, et autres
Publié: (2024)
par: Liu, Sijia, et autres
Publié: (2024)
Robust and Scalable Model Editing for Large Language Models
par: Chen, Yingfa, et autres
Publié: (2024)
par: Chen, Yingfa, et autres
Publié: (2024)
Structured Agent Distillation for Large Language Model
par: Liu, Jun, et autres
Publié: (2025)
par: Liu, Jun, et autres
Publié: (2025)
CPMobius: Iterative Coach-Player Reasoning for Data-Free Reinforcement Learning
par: Li, Ran, et autres
Publié: (2026)
par: Li, Ran, et autres
Publié: (2026)
Off-Policy Value-Based Reinforcement Learning for Large Language Models
par: Wang, Peng-Yuan, et autres
Publié: (2026)
par: Wang, Peng-Yuan, et autres
Publié: (2026)
Multi-Head Attention Is a Multi-Player Game
par: Chakrabarti, Kushal, et autres
Publié: (2026)
par: Chakrabarti, Kushal, et autres
Publié: (2026)
Massive Activations in Large Language Models
par: Sun, Mingjie, et autres
Publié: (2024)
par: Sun, Mingjie, et autres
Publié: (2024)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
par: Sun, Huashan, et autres
Publié: (2024)
par: Sun, Huashan, et autres
Publié: (2024)
Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?
par: Li, Wenzhe, et autres
Publié: (2025)
par: Li, Wenzhe, et autres
Publié: (2025)
Game of LLMs: Discovering Structural Constructs in Activities using Large Language Models
par: Hiremath, Shruthi K., et autres
Publié: (2024)
par: Hiremath, Shruthi K., et autres
Publié: (2024)
Large Language Models Are Bad Dice Players: LLMs Struggle to Generate Random Numbers from Statistical Distributions
par: Zhao, Minda, et autres
Publié: (2026)
par: Zhao, Minda, et autres
Publié: (2026)
AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent
par: Luo, Haipeng, et autres
Publié: (2025)
par: Luo, Haipeng, et autres
Publié: (2025)
Optimizing Large Language Model Training Using FP4 Quantization
par: Wang, Ruizhe, et autres
Publié: (2025)
par: Wang, Ruizhe, et autres
Publié: (2025)
Discovering Decoupled Functional Modules in Large Language Models
par: Yu, Yanke, et autres
Publié: (2026)
par: Yu, Yanke, et autres
Publié: (2026)
Can Large Language Models Play Text Games Well? Current State-of-the-Art and Open Questions
par: Tsai, Chen Feng, et autres
Publié: (2023)
par: Tsai, Chen Feng, et autres
Publié: (2023)
SparseEval: Efficient Evaluation of Large Language Models by Sparse Optimization
par: Zhang, Taolin, et autres
Publié: (2026)
par: Zhang, Taolin, et autres
Publié: (2026)
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
par: Shao, Wenqi, et autres
Publié: (2023)
par: Shao, Wenqi, et autres
Publié: (2023)
Demystifying and Enhancing the Efficiency of Large Language Model Based Search Agents
par: Yang, Tiannuo, et autres
Publié: (2025)
par: Yang, Tiannuo, et autres
Publié: (2025)
KwaiAgents: Generalized Information-seeking Agent System with Large Language Models
par: Pan, Haojie, et autres
Publié: (2023)
par: Pan, Haojie, et autres
Publié: (2023)
On the Thinking-Language Modeling Gap in Large Language Models
par: Liu, Chenxi, et autres
Publié: (2025)
par: Liu, Chenxi, et autres
Publié: (2025)
MUCAR: Benchmarking Multilingual Cross-Modal Ambiguity Resolution for Multimodal Large Language Models
par: Wang, Xiaolong, et autres
Publié: (2025)
par: Wang, Xiaolong, et autres
Publié: (2025)
TextAtari: 100K Frames Game Playing with Language Agents
par: Li, Wenhao, et autres
Publié: (2025)
par: Li, Wenhao, et autres
Publié: (2025)
Training Optimal Large Diffusion Language Models
par: Ni, Jinjie, et autres
Publié: (2025)
par: Ni, Jinjie, et autres
Publié: (2025)
CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models
par: Wang, Song, et autres
Publié: (2024)
par: Wang, Song, et autres
Publié: (2024)
Large Language Models for Intent-Driven Session Recommendations
par: Sun, Zhu, et autres
Publié: (2023)
par: Sun, Zhu, et autres
Publié: (2023)
ClinicalAgent: Clinical Trial Multi-Agent System with Large Language Model-based Reasoning
par: Yue, Ling, et autres
Publié: (2024)
par: Yue, Ling, et autres
Publié: (2024)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
par: Guo, Yufei, et autres
Publié: (2024)
par: Guo, Yufei, et autres
Publié: (2024)
Controlling Large Language Model with Latent Actions
par: Jia, Chengxing, et autres
Publié: (2025)
par: Jia, Chengxing, et autres
Publié: (2025)
Large Language Model Unlearning
par: Yao, Yuanshun, et autres
Publié: (2023)
par: Yao, Yuanshun, et autres
Publié: (2023)
Concept Bottleneck Large Language Models
par: Sun, Chung-En, et autres
Publié: (2024)
par: Sun, Chung-En, et autres
Publié: (2024)
Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models
par: Zhang, Jingyang, et autres
Publié: (2024)
par: Zhang, Jingyang, et autres
Publié: (2024)
A Survey on Medical Large Language Models: Technology, Application, Trustworthiness, and Future Directions
par: Liu, Lei, et autres
Publié: (2024)
par: Liu, Lei, et autres
Publié: (2024)
How Attention Sinks Emerge in Large Language Models: An Interpretability Perspective
par: Peng, Runyu, et autres
Publié: (2026)
par: Peng, Runyu, et autres
Publié: (2026)
Shuttle Between the Instructions and the Parameters of Large Language Models
par: Sun, Wangtao, et autres
Publié: (2025)
par: Sun, Wangtao, et autres
Publié: (2025)
Documents similaires
-
player2vec: A Language Modeling Approach to Understand Player Behavior in Games
par: Wang, Tianze, et autres
Publié: (2024) -
DuoGuard: A Two-Player RL-Driven Framework for Multilingual LLM Guardrails
par: Deng, Yihe, et autres
Publié: (2025) -
Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts
par: Pang, Jing-Cheng, et autres
Publié: (2024) -
Reflect-RL: Two-Player Online RL Fine-Tuning for LMs
par: Zhou, Runlong, et autres
Publié: (2024) -
CoBa: Convergence Balancer for Multitask Finetuning of Large Language Models
par: Gong, Zi, et autres
Publié: (2024)