Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xiao, Chen, Tianze, Yang, Xianjun, Zhang, Qi, Zhao, Xun, Lin, Dahua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Navigating the OverKill in Large Language Models
di: Shi, Chenyu, et al.
Pubblicazione: (2024)
di: Shi, Chenyu, et al.
Pubblicazione: (2024)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
di: Zhang, Xinlu, et al.
Pubblicazione: (2024)
di: Zhang, Xinlu, et al.
Pubblicazione: (2024)
ANAH: Analytical Annotation of Hallucinations in Large Language Models
di: Ji, Ziwei, et al.
Pubblicazione: (2024)
di: Ji, Ziwei, et al.
Pubblicazione: (2024)
AlpaCare:Instruction-tuned Large Language Models for Medical Application
di: Zhang, Xinlu, et al.
Pubblicazione: (2023)
di: Zhang, Xinlu, et al.
Pubblicazione: (2023)
The Role of Diversity in In-Context Learning for Large Language Models
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)
G-MemLLM: Gated Latent Memory Augmentation for Long-Context Reasoning in Large Language Models
di: Xu, Xun
Pubblicazione: (2026)
di: Xu, Xun
Pubblicazione: (2026)
CriticEval: Evaluating Large Language Model as Critic
di: Lan, Tian, et al.
Pubblicazione: (2024)
di: Lan, Tian, et al.
Pubblicazione: (2024)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
ANAH-v2: Scaling Analytical Hallucination Annotation of Large Language Models
di: Gu, Yuzhe, et al.
Pubblicazione: (2024)
di: Gu, Yuzhe, et al.
Pubblicazione: (2024)
In-context Autoencoder for Context Compression in a Large Language Model
di: Ge, Tao, et al.
Pubblicazione: (2023)
di: Ge, Tao, et al.
Pubblicazione: (2023)
Learning to Check: Unleashing Potentials for Self-Correction in Large Language Models
di: Zhang, Che, et al.
Pubblicazione: (2024)
di: Zhang, Che, et al.
Pubblicazione: (2024)
MultiAgent Collaboration Attack: Investigating Adversarial Attacks in Large Language Model Collaborations via Debate
di: Amayuelas, Alfonso, et al.
Pubblicazione: (2024)
di: Amayuelas, Alfonso, et al.
Pubblicazione: (2024)
Learning to Compress: Unlocking the Potential of Large Language Models for Text Representation
di: Zhang, Yeqin, et al.
Pubblicazione: (2025)
di: Zhang, Yeqin, et al.
Pubblicazione: (2025)
Methodology of Adapting Large English Language Models for Specific Cultural Contexts
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
di: Zhang, Wenjing, et al.
Pubblicazione: (2024)
Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
di: Li, Haoling, et al.
Pubblicazione: (2024)
di: Li, Haoling, et al.
Pubblicazione: (2024)
Identifying Semantic Induction Heads to Understand In-Context Learning
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
Data Augmentation using Large Language Models: Data Perspectives, Learning Paradigms and Challenges
di: Ding, Bosheng, et al.
Pubblicazione: (2024)
di: Ding, Bosheng, et al.
Pubblicazione: (2024)
PACE: A Pragmatic Agent for Enhancing Communication Efficiency Using Large Language Models
di: Li, Jiaxuan, et al.
Pubblicazione: (2024)
di: Li, Jiaxuan, et al.
Pubblicazione: (2024)
Quokka: An Open-source Large Language Model ChatBot for Material Science
di: Yang, Xianjun, et al.
Pubblicazione: (2024)
di: Yang, Xianjun, et al.
Pubblicazione: (2024)
Context-level Language Modeling by Learning Predictive Context Embeddings
di: Dai, Beiya, et al.
Pubblicazione: (2025)
di: Dai, Beiya, et al.
Pubblicazione: (2025)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
di: Xu, Yijie, et al.
Pubblicazione: (2025)
di: Xu, Yijie, et al.
Pubblicazione: (2025)
ToolSword: Unveiling Safety Issues of Large Language Models in Tool Learning Across Three Stages
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
PrivacyMind: Large Language Models Can Be Contextual Privacy Protection Learners
di: Xiao, Yijia, et al.
Pubblicazione: (2023)
di: Xiao, Yijia, et al.
Pubblicazione: (2023)
Generative Psycho-Lexical Approach for Constructing Value Systems in Large Language Models
di: Ye, Haoran, et al.
Pubblicazione: (2025)
di: Ye, Haoran, et al.
Pubblicazione: (2025)
BoostStep: Boosting mathematical capability of Large Language Models via improved single-step reasoning
di: Zhang, Beichen, et al.
Pubblicazione: (2025)
di: Zhang, Beichen, et al.
Pubblicazione: (2025)
PointLLM: Empowering Large Language Models to Understand Point Clouds
di: Xu, Runsen, et al.
Pubblicazione: (2023)
di: Xu, Runsen, et al.
Pubblicazione: (2023)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
ELPO: Ensemble Learning Based Prompt Optimization for Large Language Models
di: Zhang, Qing, et al.
Pubblicazione: (2025)
di: Zhang, Qing, et al.
Pubblicazione: (2025)
Rethinking Data Mixing from the Perspective of Large Language Models
di: Xu, Yuanjian, et al.
Pubblicazione: (2026)
di: Xu, Yuanjian, et al.
Pubblicazione: (2026)
Unveiling the Learning Mind of Language Models: A Cognitive Framework and Empirical Study
di: Hu, Zhengyu, et al.
Pubblicazione: (2025)
di: Hu, Zhengyu, et al.
Pubblicazione: (2025)
CBT-Bench: Evaluating Large Language Models on Assisting Cognitive Behavior Therapy
di: Zhang, Mian, et al.
Pubblicazione: (2024)
di: Zhang, Mian, et al.
Pubblicazione: (2024)
Towards Context-Invariant Safety Alignment for Large Language Models
di: Wang, Yixu, et al.
Pubblicazione: (2026)
di: Wang, Yixu, et al.
Pubblicazione: (2026)
Paying More Attention to Source Context: Mitigating Unfaithful Translations from Large Language Model
di: Zhang, Hongbin, et al.
Pubblicazione: (2024)
di: Zhang, Hongbin, et al.
Pubblicazione: (2024)
Scalable In-Context Learning on Tabular Data via Retrieval-Augmented Large Language Models
di: Wen, Xumeng, et al.
Pubblicazione: (2025)
di: Wen, Xumeng, et al.
Pubblicazione: (2025)
Learning Evolving Tools for Large Language Models
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
di: Chen, Guoxin, et al.
Pubblicazione: (2024)
Unveiling the Potential of Sentiment: Can Large Language Models Predict Chinese Stock Price Movements?
di: Zhang, Haohan, et al.
Pubblicazione: (2023)
di: Zhang, Haohan, et al.
Pubblicazione: (2023)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
di: Yang, Linyao, et al.
Pubblicazione: (2023)
di: Yang, Linyao, et al.
Pubblicazione: (2023)
Contrastive Learning for Knowledge-Based Question Generation in Large Language Models
di: Zhang, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhang, Zhenhong, et al.
Pubblicazione: (2024)
Unveiling Factual Recall Behaviors of Large Language Models through Knowledge Neurons
di: Wang, Yifei, et al.
Pubblicazione: (2024)
di: Wang, Yifei, et al.
Pubblicazione: (2024)
Teaching Large Language Models to Maintain Contextual Faithfulness via Synthetic Tasks and Reinforcement Learning
di: Si, Shuzheng, et al.
Pubblicazione: (2025)
di: Si, Shuzheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Navigating the OverKill in Large Language Models
di: Shi, Chenyu, et al.
Pubblicazione: (2024) -
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
di: Zhang, Xinlu, et al.
Pubblicazione: (2024) -
ANAH: Analytical Annotation of Hallucinations in Large Language Models
di: Ji, Ziwei, et al.
Pubblicazione: (2024) -
AlpaCare:Instruction-tuned Large Language Models for Medical Application
di: Zhang, Xinlu, et al.
Pubblicazione: (2023) -
The Role of Diversity in In-Context Learning for Large Language Models
di: Xiao, Wenyang, et al.
Pubblicazione: (2025)