Enregistré dans:
| Auteurs principaux: | Li, Hong, Zhou, Zhen, Zhang, Honggang, Luo, Yuping, Wang, Xinyue, Gong, Han, Liu, Zhiyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.14462 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Helpfulness to Toxic Proactivity: Diagnosing Behavioral Misalignment in LLM Agents
par: Wang, Xinyue, et autres
Publié: (2026)
par: Wang, Xinyue, et autres
Publié: (2026)
Unintended Misalignment from Agentic Fine-Tuning: Risks and Mitigation
par: Hahm, Dongyoon, et autres
Publié: (2025)
par: Hahm, Dongyoon, et autres
Publié: (2025)
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
par: Luo, Yaxin, et autres
Publié: (2026)
par: Luo, Yaxin, et autres
Publié: (2026)
LENSLLM: Unveiling Fine-Tuning Dynamics for LLM Selection
par: Zeng, Xinyue, et autres
Publié: (2025)
par: Zeng, Xinyue, et autres
Publié: (2025)
Data Mixing Optimization for Supervised Fine-Tuning of Large Language Models
par: Li, Yuan, et autres
Publié: (2025)
par: Li, Yuan, et autres
Publié: (2025)
To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model
par: Zhao, Chengshuai, et autres
Publié: (2026)
par: Zhao, Chengshuai, et autres
Publié: (2026)
Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs
par: Giordani, Jeremiah
Publié: (2025)
par: Giordani, Jeremiah
Publié: (2025)
Silent Sabotage During Fine-Tuning: Few-Shot Rationale Poisoning of Compact Medical LLMs
par: Xie, Jingyuan, et autres
Publié: (2026)
par: Xie, Jingyuan, et autres
Publié: (2026)
Parameter-Efficient Fine-Tuning for Medical Text Summarization: A Comparative Study of Lora, Prompt Tuning, and Full Fine-Tuning
par: Shernazarov, Ulugbek, et autres
Publié: (2026)
par: Shernazarov, Ulugbek, et autres
Publié: (2026)
FRoD: Full-Rank Efficient Fine-Tuning with Rotational Degrees for Fast Convergence
par: Wan, Guoan, et autres
Publié: (2025)
par: Wan, Guoan, et autres
Publié: (2025)
Diagnosing Generalization Failures in Fine-Tuned LLMs: A Cross-Architectural Study on Phishing Detection
par: Bobe III, Frank, et autres
Publié: (2026)
par: Bobe III, Frank, et autres
Publié: (2026)
"Dark Triad" Model Organisms of Misalignment: Narrow Fine-Tuning Mirrors Human Antisocial Behavior
par: Lulla, Roshni, et autres
Publié: (2026)
par: Lulla, Roshni, et autres
Publié: (2026)
TRIP-Evaluate: An Open Multimodal Benchmark for Evaluating Large Models in Transportation
par: Gong, Han, et autres
Publié: (2026)
par: Gong, Han, et autres
Publié: (2026)
Beyond LoRA vs. Full Fine-Tuning: Gradient-Guided Optimizer Routing for LLM Adaptation
par: Tang, Haozhan, et autres
Publié: (2026)
par: Tang, Haozhan, et autres
Publié: (2026)
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
par: Liu, Yilun, et autres
Publié: (2024)
par: Liu, Yilun, et autres
Publié: (2024)
Omni-scale Learning-based Sequential Decision Framework for Order Fulfillment of Tote-handling Robotic Systems
par: Liu, Jiaxin, et autres
Publié: (2026)
par: Liu, Jiaxin, et autres
Publié: (2026)
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
Mirror-Consistency: Harnessing Inconsistency in Majority Voting
par: Huang, Siyuan, et autres
Publié: (2024)
par: Huang, Siyuan, et autres
Publié: (2024)
SEEA-R1: Tree-Structured Reinforcement Fine-Tuning for Self-Evolving Embodied Agents
par: Tian, Wanxin, et autres
Publié: (2025)
par: Tian, Wanxin, et autres
Publié: (2025)
CantonMT: Cantonese to English NMT Platform with Fine-Tuned Models Using Synthetic Back-Translation Data
par: Hong, Kung Yin, et autres
Publié: (2024)
par: Hong, Kung Yin, et autres
Publié: (2024)
AirLLM: Diffusion Policy-based Adaptive LoRA for Remote Fine-Tuning of LLM over the Air
par: Yang, Shiyi, et autres
Publié: (2025)
par: Yang, Shiyi, et autres
Publié: (2025)
An LLM-Powered Cooperative Framework for Large-Scale Multi-Vehicle Navigation
par: Zhou, Yuping, et autres
Publié: (2025)
par: Zhou, Yuping, et autres
Publié: (2025)
Data Efficient Adaptation in Large Language Models via Continuous Low-Rank Fine-Tuning
par: Han, Xiao, et autres
Publié: (2025)
par: Han, Xiao, et autres
Publié: (2025)
RevFFN: Memory-Efficient Full-Parameter Fine-Tuning of Mixture-of-Experts LLMs with Reversible Blocks
par: Liu, Ningyuan, et autres
Publié: (2025)
par: Liu, Ningyuan, et autres
Publié: (2025)
Assessing Domain-Level Susceptibility to Emergent Misalignment from Narrow Finetuning
par: Mishra, Abhishek, et autres
Publié: (2026)
par: Mishra, Abhishek, et autres
Publié: (2026)
Bridging Draft Policy Misalignment: Group Tree Optimization for Speculative Decoding
par: Hu, Shijing, et autres
Publié: (2025)
par: Hu, Shijing, et autres
Publié: (2025)
SPARD: Defending Harmful Fine-Tuning Attack via Safety Projection with Relevance-Diversity Data Selection
par: Chen, Shuhao, et autres
Publié: (2026)
par: Chen, Shuhao, et autres
Publié: (2026)
StableAnimator++: Overcoming Pose Misalignment and Face Distortion for Human Image Animation
par: Tu, Shuyuan, et autres
Publié: (2025)
par: Tu, Shuyuan, et autres
Publié: (2025)
Progressive Rendering Distillation: Adapting Stable Diffusion for Instant Text-to-Mesh Generation without 3D Data
par: Ma, Zhiyuan, et autres
Publié: (2025)
par: Ma, Zhiyuan, et autres
Publié: (2025)
Fine-grained Analysis of Stability and Generalization for Stochastic Bilevel Optimization
par: Zhang, Xuelin, et autres
Publié: (2026)
par: Zhang, Xuelin, et autres
Publié: (2026)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
par: Li, Xiaomin, et autres
Publié: (2024)
par: Li, Xiaomin, et autres
Publié: (2024)
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
par: Han, Bing, et autres
Publié: (2025)
par: Han, Bing, et autres
Publié: (2025)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
par: Pang, Jinlong, et autres
Publié: (2025)
par: Pang, Jinlong, et autres
Publié: (2025)
Fine-Tuning without Performance Degradation
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
Library Drift: Diagnosing and Fixing a Silent Failure Mode in Self-Evolving LLM Skill Libraries
par: Zhang, Xing, et autres
Publié: (2026)
par: Zhang, Xing, et autres
Publié: (2026)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
par: Zhou, Jiajun, et autres
Publié: (2025)
par: Zhou, Jiajun, et autres
Publié: (2025)
Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning
par: Guo, Chenyou, et autres
Publié: (2026)
par: Guo, Chenyou, et autres
Publié: (2026)
A Layer-wise Analysis of Supervised Fine-Tuning
par: Zhao, Qinghua, et autres
Publié: (2026)
par: Zhao, Qinghua, et autres
Publié: (2026)
Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning
par: Liu, Siyuan, et autres
Publié: (2026)
par: Liu, Siyuan, et autres
Publié: (2026)
An Embedding-based Approach to Inconsistency-tolerant Reasoning with Inconsistent Ontologies
par: Wang, Keyu, et autres
Publié: (2023)
par: Wang, Keyu, et autres
Publié: (2023)
Documents similaires
-
From Helpfulness to Toxic Proactivity: Diagnosing Behavioral Misalignment in LLM Agents
par: Wang, Xinyue, et autres
Publié: (2026) -
Unintended Misalignment from Agentic Fine-Tuning: Risks and Mitigation
par: Hahm, Dongyoon, et autres
Publié: (2025) -
LLMSurgeon: Diagnosing Data Mixture of Large Language Models
par: Luo, Yaxin, et autres
Publié: (2026) -
LENSLLM: Unveiling Fine-Tuning Dynamics for LLM Selection
par: Zeng, Xinyue, et autres
Publié: (2025) -
Data Mixing Optimization for Supervised Fine-Tuning of Large Language Models
par: Li, Yuan, et autres
Publié: (2025)