The Forgotten Shield: Safety Grafting in Parameter-Space for Medical MLLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Jiale, Mou, Xing, Wu, Jinlin, Yu, Hongyuan, Sun, Mingrui, Shi, Yang, Yin, Xuanwu, Chen, Zhen, Lei, Zhen, Wang, Yaohua |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graft: Integrating the Domain Knowledge via Efficient Parameter Synergy for MLLMs
par: Dai, Yang, et autres
Publié: (2025)
par: Dai, Yang, et autres
Publié: (2025)
AM$^3$Safety: Towards Data Efficient Alignment of Multi-modal Multi-turn Safety for MLLMs
par: Zhu, Han, et autres
Publié: (2026)
par: Zhu, Han, et autres
Publié: (2026)
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
par: Lei, Zeyu, et autres
Publié: (2025)
par: Lei, Zeyu, et autres
Publié: (2025)
Transforming Surgical Interventions with Embodied Intelligence for Ultrasound Robotics
par: Xu, Huan, et autres
Publié: (2024)
par: Xu, Huan, et autres
Publié: (2024)
Enhancing Surgical Robots with Embodied Intelligence for Autonomous Ultrasound Scanning
par: Xu, Huan, et autres
Publié: (2024)
par: Xu, Huan, et autres
Publié: (2024)
What Matters For Safety Alignment?
par: Li, Xing, et autres
Publié: (2026)
par: Li, Xing, et autres
Publié: (2026)
Learning from Medical Entity Trees: An Entity-Centric Medical Data Engineering Framework for MLLMs
par: Lin, Jianghang, et autres
Publié: (2026)
par: Lin, Jianghang, et autres
Publié: (2026)
MedXIAOHE: A Comprehensive Recipe for Building Medical MLLMs
par: Shi, Baorong, et autres
Publié: (2026)
par: Shi, Baorong, et autres
Publié: (2026)
ShieldLM: Empowering LLMs as Aligned, Customizable and Explainable Safety Detectors
par: Zhang, Zhexin, et autres
Publié: (2024)
par: Zhang, Zhexin, et autres
Publié: (2024)
LoR2C : Low-Rank Residual Connection Adaptation for Parameter-Efficient Fine-Tuning
par: Zhao, Jiancheng, et autres
Publié: (2025)
par: Zhao, Jiancheng, et autres
Publié: (2025)
Do Images Speak Louder than Words? Investigating the Effect of Textual Misinformation in VLMs
par: Zhang, Chi, et autres
Publié: (2026)
par: Zhang, Chi, et autres
Publié: (2026)
Octavius: Mitigating Task Interference in MLLMs via LoRA-MoE
par: Chen, Zeren, et autres
Publié: (2023)
par: Chen, Zeren, et autres
Publié: (2023)
Adaptive Shielding via Parametric Safety Proofs
par: Feng, Yao, et autres
Publié: (2025)
par: Feng, Yao, et autres
Publié: (2025)
Are Tools Always Beneficial? Learning to Invoke Tools Adaptively for Dual-Mode Multimodal LLM Reasoning
par: Ma, Qinghe, et autres
Publié: (2026)
par: Ma, Qinghe, et autres
Publié: (2026)
Exploring the Design Space of Visual Context Representation in Video MLLMs
par: Du, Yifan, et autres
Publié: (2024)
par: Du, Yifan, et autres
Publié: (2024)
From Pruning to Grafting: Dynamic Knowledge Redistribution via Learnable Layer Fusion
par: Pei, Zehua, et autres
Publié: (2024)
par: Pei, Zehua, et autres
Publié: (2024)
ChartEdit: How Far Are MLLMs From Automating Chart Analysis? Evaluating MLLMs' Capability via Chart Editing
par: Zhao, Xuanle, et autres
Publié: (2025)
par: Zhao, Xuanle, et autres
Publié: (2025)
UNO Arena for Evaluating Sequential Decision-Making Capability of Large Language Models
par: Qin, Zhanyue, et autres
Publié: (2024)
par: Qin, Zhanyue, et autres
Publié: (2024)
Elucidating the Design Space of Decay in Linear Attention
par: Qin, Zhen, et autres
Publié: (2025)
par: Qin, Zhen, et autres
Publié: (2025)
Span-level Detection of AI-generated Scientific Text via Contrastive Learning and Structural Calibration
par: Yin, Zhen, et autres
Publié: (2025)
par: Yin, Zhen, et autres
Publié: (2025)
A Prompt-driven Task Planning Method for Multi-drones based on Large Language Model
par: Liu, Yaohua
Publié: (2024)
par: Liu, Yaohua
Publié: (2024)
Swift Parameter-free Attention Network for Efficient Super-Resolution
par: Wan, Cheng, et autres
Publié: (2023)
par: Wan, Cheng, et autres
Publié: (2023)
Language, the Forgotten Content.
par: Kelly, Patricia P., Ed., et autres
Publié: (1987)
par: Kelly, Patricia P., Ed., et autres
Publié: (1987)
InfiMed: Low-Resource Medical MLLMs with Advancing Understanding and Reasoning
par: Liu, Zeyu, et autres
Publié: (2025)
par: Liu, Zeyu, et autres
Publié: (2025)
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
par: Xu, Yixing, et autres
Publié: (2025)
par: Xu, Yixing, et autres
Publié: (2025)
A LongFormer-Based Framework for Accurate and Efficient Medical Text Summarization
par: Sun, Dan, et autres
Publié: (2025)
par: Sun, Dan, et autres
Publié: (2025)
From Specific-MLLMs to Omni-MLLMs: A Survey on MLLMs Aligned with Multi-modalities
par: Jiang, Shixin, et autres
Publié: (2024)
par: Jiang, Shixin, et autres
Publié: (2024)
SafeInt: Shielding Large Language Models from Jailbreak Attacks via Safety-Aware Representation Intervention
par: Wu, Jiaqi, et autres
Publié: (2025)
par: Wu, Jiaqi, et autres
Publié: (2025)
UnlearnShield: Shielding Forgotten Privacy against Unlearning Inversion
par: Xue, Lulu, et autres
Publié: (2026)
par: Xue, Lulu, et autres
Publié: (2026)
SG-Bench: Evaluating LLM Safety Generalization Across Diverse Tasks and Prompt Types
par: Mou, Yutao, et autres
Publié: (2024)
par: Mou, Yutao, et autres
Publié: (2024)
Ethos: Rectifying Language Models in Orthogonal Parameter Space
par: Gao, Lei, et autres
Publié: (2024)
par: Gao, Lei, et autres
Publié: (2024)
Green Shielding: A User-Centric Approach Towards Trustworthy AI
par: Li, Aaron J., et autres
Publié: (2026)
par: Li, Aaron J., et autres
Publié: (2026)
Right to be Forgotten in the Era of Large Language Models: Implications, Challenges, and Solutions
par: Zhang, Dawen, et autres
Publié: (2023)
par: Zhang, Dawen, et autres
Publié: (2023)
FullFront: Benchmarking MLLMs Across the Full Front-End Engineering Workflow
par: Sun, Haoyu, et autres
Publié: (2025)
par: Sun, Haoyu, et autres
Publié: (2025)
SafetyBench: Evaluating the Safety of Large Language Models
par: Zhang, Zhexin, et autres
Publié: (2023)
par: Zhang, Zhexin, et autres
Publié: (2023)
MiSS: Revisiting the Trade-off in LoRA with an Efficient Shard-Sharing Structure
par: Kang, Jiale, et autres
Publié: (2024)
par: Kang, Jiale, et autres
Publié: (2024)
Unhackable Temporal Rewarding for Scalable Video MLLMs
par: Yu, En, et autres
Publié: (2025)
par: Yu, En, et autres
Publié: (2025)
MSPLoRA: A Multi-Scale Pyramid Low-Rank Adaptation for Efficient Model Fine-Tuning
par: Zhao, Jiancheng, et autres
Publié: (2025)
par: Zhao, Jiancheng, et autres
Publié: (2025)
Affordance Benchmark for MLLMs
par: Wang, Junying, et autres
Publié: (2025)
par: Wang, Junying, et autres
Publié: (2025)
Unlearned but Not Forgotten: Data Extraction after Exact Unlearning in LLM
par: Wu, Xiaoyu, et autres
Publié: (2025)
par: Wu, Xiaoyu, et autres
Publié: (2025)
Documents similaires
-
Graft: Integrating the Domain Knowledge via Efficient Parameter Synergy for MLLMs
par: Dai, Yang, et autres
Publié: (2025) -
AM$^3$Safety: Towards Data Efficient Alignment of Multi-modal Multi-turn Safety for MLLMs
par: Zhu, Han, et autres
Publié: (2026) -
SurgVisAgent: Multimodal Agentic Model for Versatile Surgical Visual Enhancement
par: Lei, Zeyu, et autres
Publié: (2025) -
Transforming Surgical Interventions with Embodied Intelligence for Ultrasound Robotics
par: Xu, Huan, et autres
Publié: (2024) -
Enhancing Surgical Robots with Embodied Intelligence for Autonomous Ultrasound Scanning
par: Xu, Huan, et autres
Publié: (2024)