Salvato in:
| Autori principali: | Yao, Junchi, Yang, Shu, Xu, Jianhua, Hu, Lijie, Li, Mengdi, Wang, Di |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2504.14218 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images
di: You, Liangliang, et al.
Pubblicazione: (2025)
di: You, Liangliang, et al.
Pubblicazione: (2025)
Exploring the Personality Traits of LLMs through Latent Features Steering
di: Yang, Shu, et al.
Pubblicazione: (2024)
di: Yang, Shu, et al.
Pubblicazione: (2024)
Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness
di: Yang, Zhipeng, et al.
Pubblicazione: (2026)
di: Yang, Zhipeng, et al.
Pubblicazione: (2026)
Fraud-R1 : A Multi-Round Benchmark for Assessing the Robustness of LLM Against Augmented Fraud and Phishing Inducements
di: Yang, Shu, et al.
Pubblicazione: (2025)
di: Yang, Shu, et al.
Pubblicazione: (2025)
Can Large Language Models Identify Implicit Suicidal Ideation? An Empirical Evaluation
di: Li, Tong, et al.
Pubblicazione: (2025)
di: Li, Tong, et al.
Pubblicazione: (2025)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
di: Li, Hongji, et al.
Pubblicazione: (2025)
di: Li, Hongji, et al.
Pubblicazione: (2025)
UGID: Unified Graph Isomorphism for Debiasing Large Language Models
di: Ding, Zikang, et al.
Pubblicazione: (2026)
di: Ding, Zikang, et al.
Pubblicazione: (2026)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
di: Hu, Lijie, et al.
Pubblicazione: (2024)
di: Hu, Lijie, et al.
Pubblicazione: (2024)
The Compositional Architecture of Regret in Large Language Models
di: Cui, Xiangxiang, et al.
Pubblicazione: (2025)
di: Cui, Xiangxiang, et al.
Pubblicazione: (2025)
Understanding How Value Neurons Shape the Generation of Specified Values in LLMs
di: Su, Yi, et al.
Pubblicazione: (2025)
di: Su, Yi, et al.
Pubblicazione: (2025)
Understanding and Mitigating Cross-lingual Privacy Leakage via Language-specific and Universal Privacy Neurons
di: Dong, Wenshuo, et al.
Pubblicazione: (2025)
di: Dong, Wenshuo, et al.
Pubblicazione: (2025)
Rethinking Data Mixture for Large Language Models: A Comprehensive Survey and New Perspectives
di: Liu, Yajiao, et al.
Pubblicazione: (2025)
di: Liu, Yajiao, et al.
Pubblicazione: (2025)
Dissecting Fine-Tuning Unlearning in Large Language Models
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Dialectical Alignment: Resolving the Tension of 3H and Security Threats of LLMs
di: Yang, Shu, et al.
Pubblicazione: (2024)
di: Yang, Shu, et al.
Pubblicazione: (2024)
MONAL: Model Autophagy Analysis for Modeling Human-AI Interactions
di: Yang, Shu, et al.
Pubblicazione: (2024)
di: Yang, Shu, et al.
Pubblicazione: (2024)
WenyanGPT: A Large Language Model for Classical Chinese Tasks
di: Yao, Xinyu, et al.
Pubblicazione: (2025)
di: Yao, Xinyu, et al.
Pubblicazione: (2025)
Faithful-Patchscopes: Understanding and Mitigating Model Bias in Hidden Representations Explanation of Large Language Models
di: Gong, Xilin, et al.
Pubblicazione: (2026)
di: Gong, Xilin, et al.
Pubblicazione: (2026)
Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?
di: Jiang, Jin, et al.
Pubblicazione: (2025)
di: Jiang, Jin, et al.
Pubblicazione: (2025)
Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
Mitigating Reversal Curse in Large Language Models via Semantic-aware Permutation Training
di: Guo, Qingyan, et al.
Pubblicazione: (2024)
di: Guo, Qingyan, et al.
Pubblicazione: (2024)
Induction Head Toxicity Mechanistically Explains Repetition Curse in Large Language Models
di: Wang, Shuxun, et al.
Pubblicazione: (2025)
di: Wang, Shuxun, et al.
Pubblicazione: (2025)
Quantifying Uncertainty in Natural Language Explanations of Large Language Models for Question Answering
di: Li, Yangyi, et al.
Pubblicazione: (2025)
di: Li, Yangyi, et al.
Pubblicazione: (2025)
DiffER: Diffusion Entity-Relation Modeling for Reversal Curse in Diffusion Large Language Models
di: He, Shaokai, et al.
Pubblicazione: (2026)
di: He, Shaokai, et al.
Pubblicazione: (2026)
Private Language Models via Truncated Laplacian Mechanism
di: Huang, Tianhao, et al.
Pubblicazione: (2024)
di: Huang, Tianhao, et al.
Pubblicazione: (2024)
A Hopfieldian View-based Interpretation for Chain-of-Thought Reasoning
di: Hu, Lijie, et al.
Pubblicazione: (2024)
di: Hu, Lijie, et al.
Pubblicazione: (2024)
Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models
di: Wang, Yinjie, et al.
Pubblicazione: (2025)
di: Wang, Yinjie, et al.
Pubblicazione: (2025)
Delving into the Reversal Curse: How Far Can Large Language Models Generalize?
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)
Additive Multi-Step Markov Chains and the Curse of Dimensionality in Large Language Models
di: Usatenko, O. V., et al.
Pubblicazione: (2026)
di: Usatenko, O. V., et al.
Pubblicazione: (2026)
When Truth Is Overridden: Uncovering the Internal Origins of Sycophancy in Large Language Models
di: Wang, Keyu, et al.
Pubblicazione: (2025)
di: Wang, Keyu, et al.
Pubblicazione: (2025)
AC-EVAL: Evaluating Ancient Chinese Language Understanding in Large Language Models
di: Wei, Yuting, et al.
Pubblicazione: (2024)
di: Wei, Yuting, et al.
Pubblicazione: (2024)
CODEMENV: Benchmarking Large Language Models on Code Migration
di: Cheng, Keyuan, et al.
Pubblicazione: (2025)
di: Cheng, Keyuan, et al.
Pubblicazione: (2025)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
di: Liu, Aiwei, et al.
Pubblicazione: (2023)
di: Liu, Aiwei, et al.
Pubblicazione: (2023)
MoRAL: MoE Augmented LoRA for LLMs' Lifelong Learning
di: Yang, Shu, et al.
Pubblicazione: (2024)
di: Yang, Shu, et al.
Pubblicazione: (2024)
Exploring the Reversal Curse and Other Deductive Logical Reasoning in BERT and GPT-Based Large Language Models
di: Wu, Da, et al.
Pubblicazione: (2023)
di: Wu, Da, et al.
Pubblicazione: (2023)
Benford's Curse: Tracing Digit Bias to Numerical Hallucination in LLMs
di: Shao, Jiandong, et al.
Pubblicazione: (2025)
di: Shao, Jiandong, et al.
Pubblicazione: (2025)
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
di: Blevins, Terra, et al.
Pubblicazione: (2024)
di: Blevins, Terra, et al.
Pubblicazione: (2024)
Evaluating the Reversal Curse in Model Editing
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2023)
di: Xu, Hao-Xiang, et al.
Pubblicazione: (2023)
Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning
di: Wang, Jianing, et al.
Pubblicazione: (2025)
di: Wang, Jianing, et al.
Pubblicazione: (2025)
What Gets Activated: Uncovering Domain and Driver Experts in MoE Language Models
di: Hu, Guimin, et al.
Pubblicazione: (2026)
di: Hu, Guimin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Mitigating Behavioral Hallucination in Multimodal Large Language Models for Sequential Images
di: You, Liangliang, et al.
Pubblicazione: (2025) -
Exploring the Personality Traits of LLMs through Latent Features Steering
di: Yang, Shu, et al.
Pubblicazione: (2024) -
Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness
di: Yang, Zhipeng, et al.
Pubblicazione: (2026) -
Fraud-R1 : A Multi-Round Benchmark for Assessing the Robustness of LLM Against Augmented Fraud and Phishing Inducements
di: Yang, Shu, et al.
Pubblicazione: (2025) -
Can Large Language Models Identify Implicit Suicidal Ideation? An Empirical Evaluation
di: Li, Tong, et al.
Pubblicazione: (2025)