Navigating the OverKill in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Chenyu, Wang, Xiao, Ge, Qiming, Gao, Songyang, Yang, Xianjun, Gui, Tao, Zhang, Qi, Huang, Xuanjing, Zhao, Xun, Lin, Dahua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data
par: Xia, Han, et autres
Publié: (2024)
par: Xia, Han, et autres
Publié: (2024)
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
par: Xi, Zhiheng, et autres
Publié: (2023)
par: Xi, Zhiheng, et autres
Publié: (2023)
Unveiling Linguistic Regions in Large Language Models
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
RoTBench: A Multi-Level Benchmark for Evaluating the Robustness of Large Language Models in Tool Learning
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world Scenarios
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
par: Zhang, Yuansen, et autres
Publié: (2024)
par: Zhang, Yuansen, et autres
Publié: (2024)
Linear Alignment: A Closed-form Solution for Aligning Human Preferences without Tuning and Feedback
par: Gao, Songyang, et autres
Publié: (2024)
par: Gao, Songyang, et autres
Publié: (2024)
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
LoRAMoE: Alleviate World Knowledge Forgetting in Large Language Models via MoE-Style Plugin
par: Dou, Shihan, et autres
Publié: (2023)
par: Dou, Shihan, et autres
Publié: (2023)
Are Large Language Models Good Prompt Optimizers?
par: Ma, Ruotian, et autres
Publié: (2024)
par: Ma, Ruotian, et autres
Publié: (2024)
CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models
par: Lv, Huijie, et autres
Publié: (2024)
par: Lv, Huijie, et autres
Publié: (2024)
Self-Demos: Eliciting Out-of-Demonstration Generalizability in Large Language Models
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
InternLM-Law: An Open Source Chinese Legal Large Language Model
par: Fei, Zhiwei, et autres
Publié: (2024)
par: Fei, Zhiwei, et autres
Publié: (2024)
The Fine Line: Navigating Large Language Model Pretraining with Down-streaming Capability Analysis
par: Yang, Chen, et autres
Publié: (2024)
par: Yang, Chen, et autres
Publié: (2024)
Capability Salience Vector: Fine-grained Alignment of Loss and Capabilities for Downstream Task Scaling Law
par: Ge, Qiming, et autres
Publié: (2025)
par: Ge, Qiming, et autres
Publié: (2025)
Domain Generalization via Causal Adjustment for Cross-Domain Sentiment Analysis
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
par: Xu, Ningyu, et autres
Publié: (2026)
par: Xu, Ningyu, et autres
Publié: (2026)
EasyJailbreak: A Unified Framework for Jailbreaking Large Language Models
par: Zhou, Weikang, et autres
Publié: (2024)
par: Zhou, Weikang, et autres
Publié: (2024)
TL-Training: A Task-Feature-Based Framework for Training Large Language Models in Tool Use
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
PACE: A Pragmatic Agent for Enhancing Communication Efficiency Using Large Language Models
par: Li, Jiaxuan, et autres
Publié: (2024)
par: Li, Jiaxuan, et autres
Publié: (2024)
T-Eval: Evaluating the Tool Utilization Capability of Large Language Models Step by Step
par: Chen, Zehui, et autres
Publié: (2023)
par: Chen, Zehui, et autres
Publié: (2023)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
60 Data Points are Sufficient to Fine-Tune LLMs for Question-Answering
par: Ye, Junjie, et autres
Publié: (2024)
par: Ye, Junjie, et autres
Publié: (2024)
Evaluating Large Language Model with Knowledge Oriented Language Specific Simple Question Answering
par: Jiang, Bowen, et autres
Publié: (2025)
par: Jiang, Bowen, et autres
Publié: (2025)
CCTU: A Benchmark for Tool Use under Complex Constraints
par: Ye, Junjie, et autres
Publié: (2026)
par: Ye, Junjie, et autres
Publié: (2026)
Soft Reasoning: Navigating Solution Spaces in Large Language Models through Controlled Embedding Exploration
par: Zhu, Qinglin, et autres
Publié: (2025)
par: Zhu, Qinglin, et autres
Publié: (2025)
Ada-LEval: Evaluating long-context LLMs with length-adaptable benchmarks
par: Wang, Chonghua, et autres
Publié: (2024)
par: Wang, Chonghua, et autres
Publié: (2024)
Beyond Boundaries: Learning a Universal Entity Taxonomy across Datasets and Languages for Open Named Entity Recognition
par: Yang, Yuming, et autres
Publié: (2024)
par: Yang, Yuming, et autres
Publié: (2024)
AgentGym: Evolving Large Language Model-based Agents across Diverse Environments
par: Xi, Zhiheng, et autres
Publié: (2024)
par: Xi, Zhiheng, et autres
Publié: (2024)
MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models
par: Ye, Junjie, et autres
Publié: (2025)
par: Ye, Junjie, et autres
Publié: (2025)
LongHeads: Multi-Head Attention is Secretly a Long Context Processor
par: Lu, Yi, et autres
Publié: (2024)
par: Lu, Yi, et autres
Publié: (2024)
LongAgent: Scaling Language Models to 128k Context through Multi-Agent Collaboration
par: Zhao, Jun, et autres
Publié: (2024)
par: Zhao, Jun, et autres
Publié: (2024)
PLLaMa: An Open-source Large Language Model for Plant Science
par: Yang, Xianjun, et autres
Publié: (2024)
par: Yang, Xianjun, et autres
Publié: (2024)
Data-free Weight Compress and Denoise for Large Language Models
par: Peng, Runyu, et autres
Publié: (2024)
par: Peng, Runyu, et autres
Publié: (2024)
Subspace Defense: Discarding Adversarial Perturbations by Learning a Subspace for Clean Signals
par: Zheng, Rui, et autres
Publié: (2024)
par: Zheng, Rui, et autres
Publié: (2024)
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
par: Ye, Junjie, et autres
Publié: (2025)
par: Ye, Junjie, et autres
Publié: (2025)
Length Generalization of Causal Transformers without Position Encoding
par: Wang, Jie, et autres
Publié: (2024)
par: Wang, Jie, et autres
Publié: (2024)
Documents similaires
-
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data
par: Xia, Han, et autres
Publié: (2024) -
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
par: Wang, Xiao, et autres
Publié: (2024) -
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
par: Xi, Zhiheng, et autres
Publié: (2023) -
Unveiling Linguistic Regions in Large Language Models
par: Zhang, Zhihao, et autres
Publié: (2024) -
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
par: Ye, Junjie, et autres
Publié: (2024)