JoPA:Explaining Large Language Model's Generation via Joint Prompt Attribution
Fuente:
arXiv
Salvato in:
| Autori principali: | Chang, Yurui, Cao, Bochuan, Wang, Yujia, Chen, Jinghui, Lin, Lu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Monitoring Decoding: Mitigating Hallucination via Evaluating the Factuality of Partial Response during Generation
di: Chang, Yurui, et al.
Pubblicazione: (2025)
di: Chang, Yurui, et al.
Pubblicazione: (2025)
TruthFlow: Truthful LLM Generation via Representation Flow Correction
di: Wang, Hanyu, et al.
Pubblicazione: (2025)
di: Wang, Hanyu, et al.
Pubblicazione: (2025)
Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM
di: Cao, Bochuan, et al.
Pubblicazione: (2023)
di: Cao, Bochuan, et al.
Pubblicazione: (2023)
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
di: Cao, Yuanpu, et al.
Pubblicazione: (2024)
di: Cao, Yuanpu, et al.
Pubblicazione: (2024)
Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections
di: Cao, Yuanpu, et al.
Pubblicazione: (2023)
di: Cao, Yuanpu, et al.
Pubblicazione: (2023)
On the Convergence of Moral Self-Correction in Large Language Models
di: Liu, Guangliang, et al.
Pubblicazione: (2025)
di: Liu, Guangliang, et al.
Pubblicazione: (2025)
WordGame: Efficient & Effective LLM Jailbreak via Simultaneous Obfuscation in Query and Response
di: Zhang, Tianrong, et al.
Pubblicazione: (2024)
di: Zhang, Tianrong, et al.
Pubblicazione: (2024)
ParaBlock: Communication-Computation Parallel Block Coordinate Federated Learning for Large Language Models
di: Wang, Yujia, et al.
Pubblicazione: (2025)
di: Wang, Yujia, et al.
Pubblicazione: (2025)
PromptFix: Few-shot Backdoor Removal via Adversarial Prompt Tuning
di: Zhang, Tianrong, et al.
Pubblicazione: (2024)
di: Zhang, Tianrong, et al.
Pubblicazione: (2024)
ForecastCompass: Guiding Agentic Forecasting with Adaptive Factor Memory
di: Chang, Yurui, et al.
Pubblicazione: (2026)
di: Chang, Yurui, et al.
Pubblicazione: (2026)
ProCut: LLM Prompt Compression via Attribution Estimation
di: Xu, Zhentao, et al.
Pubblicazione: (2025)
di: Xu, Zhentao, et al.
Pubblicazione: (2025)
Benchmarking Large Language Model Uncertainty for Prompt Optimization
di: Guo, Pei-Fu, et al.
Pubblicazione: (2024)
di: Guo, Pei-Fu, et al.
Pubblicazione: (2024)
Question-Aware Knowledge Graph Prompting for Enhancing Large Language Models
di: Liu, Haochen, et al.
Pubblicazione: (2025)
di: Liu, Haochen, et al.
Pubblicazione: (2025)
AttriLens-Mol: Attribute Guided Reinforcement Learning for Molecular Property Prediction with Large Language Models
di: Lin, Xuan, et al.
Pubblicazione: (2025)
di: Lin, Xuan, et al.
Pubblicazione: (2025)
JoMA: Demystifying Multilayer Transformers via JOint Dynamics of MLP and Attention
di: Tian, Yuandong, et al.
Pubblicazione: (2023)
di: Tian, Yuandong, et al.
Pubblicazione: (2023)
Large Language Model Prompt Datasets: An In-depth Analysis and Insights
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
di: Zhang, Yuanming, et al.
Pubblicazione: (2025)
Explaining Large Language Models with gSMILE
di: Dehghani, Zeinab, et al.
Pubblicazione: (2025)
di: Dehghani, Zeinab, et al.
Pubblicazione: (2025)
Disentangled Representation Learning with Large Language Models for Text-Attributed Graphs
di: Qin, Yijian, et al.
Pubblicazione: (2023)
di: Qin, Yijian, et al.
Pubblicazione: (2023)
Neuron-Level Knowledge Attribution in Large Language Models
di: Yu, Zeping, et al.
Pubblicazione: (2023)
di: Yu, Zeping, et al.
Pubblicazione: (2023)
LatentExplainer: Explaining Latent Representations in Deep Generative Models with Multimodal Large Language Models
di: Zhu, Mengdan, et al.
Pubblicazione: (2024)
di: Zhu, Mengdan, et al.
Pubblicazione: (2024)
Large Language Model Unlearning via Embedding-Corrupted Prompts
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
di: Liu, Chris Yuhao, et al.
Pubblicazione: (2024)
You Can't Steal Nothing: Mitigating Prompt Leakages in LLMs via System Vectors
di: Cao, Bochuan, et al.
Pubblicazione: (2025)
di: Cao, Bochuan, et al.
Pubblicazione: (2025)
On Prompt-Driven Safeguarding for Large Language Models
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
MuJo: Multimodal Joint Feature Space Learning for Human Activity Recognition
di: Fritsch, Stefan Gerd, et al.
Pubblicazione: (2024)
di: Fritsch, Stefan Gerd, et al.
Pubblicazione: (2024)
Distilling Large Language Models for Text-Attributed Graph Learning
di: Pan, Bo, et al.
Pubblicazione: (2024)
di: Pan, Bo, et al.
Pubblicazione: (2024)
Unraveling Arithmetic in Large Language Models: The Role of Algebraic Structures
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
Automatic Prompt Selection for Large Language Models
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
di: Do, Viet-Tung, et al.
Pubblicazione: (2024)
Regurgitative Training: The Value of Real Data in Training Large Language Models
di: Zhang, Jinghui, et al.
Pubblicazione: (2024)
di: Zhang, Jinghui, et al.
Pubblicazione: (2024)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing
di: Zhang, Rongzhi, et al.
Pubblicazione: (2025)
di: Zhang, Rongzhi, et al.
Pubblicazione: (2025)
Phi: Preference Hijacking in Multi-modal Large Language Models at Inference Time
di: Lan, Yifan, et al.
Pubblicazione: (2025)
di: Lan, Yifan, et al.
Pubblicazione: (2025)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
An Examination on the Effectiveness of Divide-and-Conquer Prompting in Large Language Models
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
di: Zhang, Yizhou, et al.
Pubblicazione: (2024)
Large Language Models are Superpositions of All Characters: Attaining Arbitrary Role-play via Self-Alignment
di: Lu, Keming, et al.
Pubblicazione: (2024)
di: Lu, Keming, et al.
Pubblicazione: (2024)
Large Language Models as Topological Structure Enhancers for Text-Attributed Graphs
di: Sun, Shengyin, et al.
Pubblicazione: (2023)
di: Sun, Shengyin, et al.
Pubblicazione: (2023)
Jointly Reinforcing Diversity and Quality in Language Model Generations
di: Li, Tianjian, et al.
Pubblicazione: (2025)
di: Li, Tianjian, et al.
Pubblicazione: (2025)
Graph Neural Prompting with Large Language Models
di: Tian, Yijun, et al.
Pubblicazione: (2023)
di: Tian, Yijun, et al.
Pubblicazione: (2023)
Beyond the Prompt in Large Language Models: Comprehension, In-Context Learning, and Chain-of-Thought
di: Jiao, Yuling, et al.
Pubblicazione: (2026)
di: Jiao, Yuling, et al.
Pubblicazione: (2026)
Learning to Explain: Supervised Token Attribution from Transformer Attention Patterns
di: Mihaila, George
Pubblicazione: (2026)
di: Mihaila, George
Pubblicazione: (2026)
Documenti analoghi
-
Monitoring Decoding: Mitigating Hallucination via Evaluating the Factuality of Partial Response during Generation
di: Chang, Yurui, et al.
Pubblicazione: (2025) -
TruthFlow: Truthful LLM Generation via Representation Flow Correction
di: Wang, Hanyu, et al.
Pubblicazione: (2025) -
Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM
di: Cao, Bochuan, et al.
Pubblicazione: (2023) -
Personalized Steering of Large Language Models: Versatile Steering Vectors Through Bi-directional Preference Optimization
di: Cao, Yuanpu, et al.
Pubblicazione: (2024) -
Stealthy and Persistent Unalignment on Large Language Models via Backdoor Injections
di: Cao, Yuanpu, et al.
Pubblicazione: (2023)