SAPT: A Shared Attention Framework for Parameter-Efficient Continual Learning of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Weixiang, Wang, Shilong, Hu, Yulin, Zhao, Yanyan, Qin, Bing, Zhang, Xuanyu, Yang, Qing, Xu, Dongliang, Che, Wanxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Lens: Rethinking Multilingual Enhancement for Large Language Models
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
Both Matter: Enhancing the Emotional Intelligence of Large Language Models without Compromising the General Intelligence
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
Large Language Model Agents Are Not Always Faithful Self-Evolvers
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
Large Language Models Meet Text-Centric Multimodal Sentiment Analysis: A Survey
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
When Less Language is More: Language-Reasoning Disentanglement Makes LLMs Better Multilingual Reasoners
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Trade-offs in Large Reasoning Models: An Empirical Analysis of Deliberative and Adaptive Reasoning over Foundational Capabilities
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Python is Not Always the Best Choice: Embracing Multilingual Program of Thoughts
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
How does Architecture Influence the Base Capabilities of Pre-trained Language Models? A Case Study Based on FFN-Wider and MoE Transformers
di: Lu, Xin, et al.
Pubblicazione: (2024)
di: Lu, Xin, et al.
Pubblicazione: (2024)
Towards Comprehensive Post Safety Alignment of Large Language Models via Safety Patching
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
Semi-Instruct: Bridging Natural-Instruct and Self-Instruct for Code Large Language Models
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
Teaching Language Models to Evolve with Users: Dynamic Profile Modeling for Personalized Alignment
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Chain of Strategy Optimization Makes Large Language Models Better Emotional Supporter
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
ENPMR-Bench: Benchmarking Proactive Memory Retrieval for Emotional Support Agents
di: Fu, Xing, et al.
Pubblicazione: (2026)
di: Fu, Xing, et al.
Pubblicazione: (2026)
OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents
di: Hu, Yulin, et al.
Pubblicazione: (2026)
di: Hu, Yulin, et al.
Pubblicazione: (2026)
Make Some Noise: Unlocking Language Model Parallel Inference Capability through Noisy Training
di: Wang, Yixuan, et al.
Pubblicazione: (2024)
di: Wang, Yixuan, et al.
Pubblicazione: (2024)
On Safety Risks in Experience-Driven Self-Evolving Agents
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
Pro-HAN: A Heterogeneous Graph Attention Network for Profile-Based Spoken Language Understanding
di: Teng, Dechuan, et al.
Pubblicazione: (2024)
di: Teng, Dechuan, et al.
Pubblicazione: (2024)
Exploring and Exploiting the Inherent Efficiency within Large Reasoning Models for Self-Guided Efficiency Enhancement
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
SmartTrim: Adaptive Tokens and Attention Pruning for Efficient Vision-Language Models
di: Wang, Zekun, et al.
Pubblicazione: (2023)
di: Wang, Zekun, et al.
Pubblicazione: (2023)
Improving Language Model Reasoning with Self-motivated Learning
di: Feng, Yunlong, et al.
Pubblicazione: (2024)
di: Feng, Yunlong, et al.
Pubblicazione: (2024)
MPO: Multilingual Safety Alignment via Reward Gap Optimization
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Beware of Your Po! Measuring and Mitigating AI Safety Risks in Role-Play Fine-Tuning of LLMs
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Rethinking Experience Utilization in Self-Evolving Language Model Agents
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
AdaSteer: Your Aligned LLM is Inherently an Adaptive Jailbreak Defender
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)
Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models
di: Wang, Bichen, et al.
Pubblicazione: (2024)
di: Wang, Bichen, et al.
Pubblicazione: (2024)
Meaningful Learning: Enhancing Abstract Reasoning in Large Language Models via Generic Fact Guidance
di: Xiong, Kai, et al.
Pubblicazione: (2024)
di: Xiong, Kai, et al.
Pubblicazione: (2024)
MoGU: A Framework for Enhancing Safety of Open-Sourced LLMs While Preserving Their Usability
di: Du, Yanrui, et al.
Pubblicazione: (2024)
di: Du, Yanrui, et al.
Pubblicazione: (2024)
TEA-Bench: A Systematic Benchmarking of Tool-enhanced Emotional Support Dialogue Agent
di: Sui, Xingyu, et al.
Pubblicazione: (2026)
di: Sui, Xingyu, et al.
Pubblicazione: (2026)
ConflictBench: Evaluating Human-AI Conflict via Interactive and Visually Grounded Environments
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
di: Zhao, Weixiang, et al.
Pubblicazione: (2026)
Separate the Wheat from the Chaff: A Post-Hoc Approach to Safety Re-Alignment for Fine-Tuned Language Models
di: Wu, Di, et al.
Pubblicazione: (2024)
di: Wu, Di, et al.
Pubblicazione: (2024)
Advancing Large Language Model Attribution through Self-Improving
di: Huang, Lei, et al.
Pubblicazione: (2024)
di: Huang, Lei, et al.
Pubblicazione: (2024)
A Two-Stage Framework with Self-Supervised Distillation For Cross-Domain Text Classification
di: Feng, Yunlong, et al.
Pubblicazione: (2023)
di: Feng, Yunlong, et al.
Pubblicazione: (2023)
Data Uncertainty-Aware Learning for Multimodal Aspect-based Sentiment Analysis
di: Yang, Hao, et al.
Pubblicazione: (2024)
di: Yang, Hao, et al.
Pubblicazione: (2024)
Extending Context Window of Large Language Models from a Distributional Perspective
di: Wu, Yingsheng, et al.
Pubblicazione: (2024)
di: Wu, Yingsheng, et al.
Pubblicazione: (2024)
ESAinsTOD: A Unified End-to-End Schema-Aware Instruction-Tuning Framework for Task-Oriented Dialog Modeling
di: Teng, Dechuan, et al.
Pubblicazione: (2026)
di: Teng, Dechuan, et al.
Pubblicazione: (2026)
Language Anisotropic Cross-Lingual Model Editing
di: Xu, Yang, et al.
Pubblicazione: (2022)
di: Xu, Yang, et al.
Pubblicazione: (2022)
Basis Sharing: Cross-Layer Parameter Sharing for Large Language Model Compression
di: Wang, Jingcun, et al.
Pubblicazione: (2024)
di: Wang, Jingcun, et al.
Pubblicazione: (2024)
ShareLoRA: Parameter Efficient and Robust Large Language Model Fine-tuning via Shared Low-Rank Adaptation
di: Song, Yurun, et al.
Pubblicazione: (2024)
di: Song, Yurun, et al.
Pubblicazione: (2024)
A Survey of Table Reasoning with Large Language Models
di: Zhang, Xuanliang, et al.
Pubblicazione: (2024)
di: Zhang, Xuanliang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Lens: Rethinking Multilingual Enhancement for Large Language Models
di: Zhao, Weixiang, et al.
Pubblicazione: (2024) -
Both Matter: Enhancing the Emotional Intelligence of Large Language Models without Compromising the General Intelligence
di: Zhao, Weixiang, et al.
Pubblicazione: (2024) -
Large Language Model Agents Are Not Always Faithful Self-Evolvers
di: Zhao, Weixiang, et al.
Pubblicazione: (2026) -
Large Language Models Meet Text-Centric Multimodal Sentiment Analysis: A Survey
di: Yang, Hao, et al.
Pubblicazione: (2024) -
When Less Language is More: Language-Reasoning Disentanglement Makes LLMs Better Multilingual Reasoners
di: Zhao, Weixiang, et al.
Pubblicazione: (2025)