Salvato in:
| Autori principali: | Duan, Zenghao, Duan, Wenbin, Yin, Zhiyi, Shen, Yinghan, Jing, Shaoling, Zhang, Jie, Shen, Huawei, Cheng, Xueqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2502.06868 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace
di: Duan, Zenghao, et al.
Pubblicazione: (2025)
di: Duan, Zenghao, et al.
Pubblicazione: (2025)
Large Language Model Sourcing: A Survey
di: Pang, Liang, et al.
Pubblicazione: (2025)
di: Pang, Liang, et al.
Pubblicazione: (2025)
Projecting Out the Malice: A Global Subspace Approach to LLM Detoxification
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
Knowledge Boundary and Persona Dynamic Shape A Better Social Media Agent
di: Zhou, Junkai, et al.
Pubblicazione: (2024)
di: Zhou, Junkai, et al.
Pubblicazione: (2024)
Stable Knowledge Editing in Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
The Evolution of Thought: Tracking LLM Overthinking via Reasoning Dynamics Analysis
di: Wei, Zihao, et al.
Pubblicazione: (2025)
di: Wei, Zihao, et al.
Pubblicazione: (2025)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Circular Reasoning: Understanding Self-Reinforcing Loops in Large Reasoning Models
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models
di: Deng, Jingcheng, et al.
Pubblicazione: (2024)
di: Deng, Jingcheng, et al.
Pubblicazione: (2024)
Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner Monologue
di: Zhou, Junkai, et al.
Pubblicazione: (2023)
di: Zhou, Junkai, et al.
Pubblicazione: (2023)
A Theory for Token-Level Harmonization in Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
LLM Latent Reasoning as Chain of Superposition
di: Deng, Jingcheng, et al.
Pubblicazione: (2025)
di: Deng, Jingcheng, et al.
Pubblicazione: (2025)
Latent-GRPO: Group Relative Policy Optimization for Latent Reasoning
di: Deng, Jingcheng, et al.
Pubblicazione: (2026)
di: Deng, Jingcheng, et al.
Pubblicazione: (2026)
List-aware Reranking-Truncation Joint Model for Search and Retrieval-augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Search-in-the-Chain: Interactively Enhancing Large Language Models with Search for Knowledge-intensive Tasks
di: Xu, Shicheng, et al.
Pubblicazione: (2023)
di: Xu, Shicheng, et al.
Pubblicazione: (2023)
from Benign import Toxic: Jailbreaking the Language Model via Adversarial Metaphors
di: Yan, Yu, et al.
Pubblicazione: (2025)
di: Yan, Yu, et al.
Pubblicazione: (2025)
Adaptive Token Biaser: Knowledge Editing via Biasing Key Entities
di: Bi, Baolong, et al.
Pubblicazione: (2024)
di: Bi, Baolong, et al.
Pubblicazione: (2024)
Cross-Modal Safety Mechanism Transfer in Large Vision-Language Models
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
StruEdit: Structured Outputs Enable the Fast and Accurate Knowledge Editing for Large Language Models
di: Bi, Baolong, et al.
Pubblicazione: (2024)
di: Bi, Baolong, et al.
Pubblicazione: (2024)
Understanding the Collapse of LLMs in Model Editing
di: Yang, Wanli, et al.
Pubblicazione: (2024)
di: Yang, Wanli, et al.
Pubblicazione: (2024)
The Mirage of Model Editing: Revisiting Evaluation in the Wild
di: Yang, Wanli, et al.
Pubblicazione: (2025)
di: Yang, Wanli, et al.
Pubblicazione: (2025)
Reverse Physician-AI Relationship: Full-process Clinical Diagnosis Driven by a Large Language Model
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
di: Xu, Shicheng, et al.
Pubblicazione: (2025)
Unlocking the Power of Large Language Models for Entity Alignment
di: Jiang, Xuhui, et al.
Pubblicazione: (2024)
di: Jiang, Xuhui, et al.
Pubblicazione: (2024)
JudgeAgent: Beyond Static Benchmarks for Knowledge-Driven and Dynamic LLM Evaluation
di: Shi, Zhichao, et al.
Pubblicazione: (2025)
di: Shi, Zhichao, et al.
Pubblicazione: (2025)
The Labyrinth and the Thread: Rethinking Regularizations in Sequential Knowledge Editing for Large Language Models
di: Wang, Zheng, et al.
Pubblicazione: (2026)
di: Wang, Zheng, et al.
Pubblicazione: (2026)
D-Models and E-Models: Diversity-Stability Trade-offs in the Sampling Behavior of Large Language Models
di: Gu, Jia, et al.
Pubblicazione: (2026)
di: Gu, Jia, et al.
Pubblicazione: (2026)
Enhancing Training Data Attribution for Large Language Models with Fitting Error Consideration
di: Wu, Kangxi, et al.
Pubblicazione: (2024)
di: Wu, Kangxi, et al.
Pubblicazione: (2024)
Do LLMs Play Dice? Exploring Probability Distribution Sampling in Large Language Models for Behavioral Simulation
di: Gu, Jia, et al.
Pubblicazione: (2024)
di: Gu, Jia, et al.
Pubblicazione: (2024)
Inference-time Alignment in Continuous Space
di: Yuan, Yige, et al.
Pubblicazione: (2025)
di: Yuan, Yige, et al.
Pubblicazione: (2025)
Fact-Level Confidence Calibration and Self-Correction
di: Yuan, Yige, et al.
Pubblicazione: (2024)
di: Yuan, Yige, et al.
Pubblicazione: (2024)
LLM4MEA: Data-free Model Extraction Attacks on Sequential Recommenders via Large Language Models
di: Zhao, Shilong, et al.
Pubblicazione: (2025)
di: Zhao, Shilong, et al.
Pubblicazione: (2025)
Beyond the Covariance Trap: Unlocking Generalization in Same-Subject Knowledge Editing for Large Language Models
di: Liu, Xiyu, et al.
Pubblicazione: (2026)
di: Liu, Xiyu, et al.
Pubblicazione: (2026)
ChainEdit: Propagating Ripple Effects in LLM Knowledge Editing through Logical Rule-Guided Chains
di: Dong, Zilu, et al.
Pubblicazione: (2025)
di: Dong, Zilu, et al.
Pubblicazione: (2025)
Do We Always Need Query-Level Workflows? Rethinking Agentic Workflow Generation for Multi-Agent Systems
di: Wang, Zixu, et al.
Pubblicazione: (2026)
di: Wang, Zixu, et al.
Pubblicazione: (2026)
MEMIT-Merge: Addressing MEMIT's Key-Value Conflicts in Same-Subject Batch Editing for LLMs
di: Dong, Zilu, et al.
Pubblicazione: (2025)
di: Dong, Zilu, et al.
Pubblicazione: (2025)
Decoupling Reasoning and Knowledge Injection for In-Context Knowledge Editing
di: Wang, Changyue, et al.
Pubblicazione: (2025)
di: Wang, Changyue, et al.
Pubblicazione: (2025)
Modeling Balanced Explicit and Implicit Relations with Contrastive Learning for Knowledge Concept Recommendation in MOOCs
di: Gu, Hengnian, et al.
Pubblicazione: (2024)
di: Gu, Hengnian, et al.
Pubblicazione: (2024)
Editing Conceptual Knowledge for Large Language Models
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
Identifying Knowledge Editing Types in Large Language Models
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
di: Li, Xiaopeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
GloSS over Toxicity: Understanding and Mitigating Toxicity in LLMs via Global Toxic Subspace
di: Duan, Zenghao, et al.
Pubblicazione: (2025) -
Large Language Model Sourcing: A Survey
di: Pang, Liang, et al.
Pubblicazione: (2025) -
Projecting Out the Malice: A Global Subspace Approach to LLM Detoxification
di: Duan, Zenghao, et al.
Pubblicazione: (2026) -
Knowledge Boundary and Persona Dynamic Shape A Better Social Media Agent
di: Zhou, Junkai, et al.
Pubblicazione: (2024) -
Stable Knowledge Editing in Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)