MAIN: Mutual Alignment Is Necessary for instruction tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Fanyi, Liu, Jianfeng, Zhang, Xin, Liu, Haoyu, Cao, Xixin, Zhan, Yuefeng, Sun, Hao, Deng, Weiwei, Sun, Feng, Zhang, Qi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
$Se^2$: Sequential Example Selection for In-Context Learning
di: Liu, Haoyu, et al.
Pubblicazione: (2024)
di: Liu, Haoyu, et al.
Pubblicazione: (2024)
GeAR: Generation Augmented Retrieval
di: Liu, Haoyu, et al.
Pubblicazione: (2025)
di: Liu, Haoyu, et al.
Pubblicazione: (2025)
StreamAdapter: Efficient Test Time Adaptation from Contextual Streams
di: Muhtar, Dilxat, et al.
Pubblicazione: (2024)
di: Muhtar, Dilxat, et al.
Pubblicazione: (2024)
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
di: Yang, Yaming, et al.
Pubblicazione: (2024)
di: Yang, Yaming, et al.
Pubblicazione: (2024)
Unsupervised Distractor Generation via Large Language Model Distilling and Counterfactual Contrastive Decoding
di: Qu, Fanyi, et al.
Pubblicazione: (2024)
di: Qu, Fanyi, et al.
Pubblicazione: (2024)
RPG: A Repository Planning Graph for Unified and Scalable Codebase Generation
di: Luo, Jane, et al.
Pubblicazione: (2025)
di: Luo, Jane, et al.
Pubblicazione: (2025)
HD-Eval: Aligning Large Language Model Evaluators Through Hierarchical Criteria Decomposition
di: Liu, Yuxuan, et al.
Pubblicazione: (2024)
di: Liu, Yuxuan, et al.
Pubblicazione: (2024)
Reinforcement learning fine-tuning of language model for instruction following and math reasoning
di: Han, Yifu, et al.
Pubblicazione: (2025)
di: Han, Yifu, et al.
Pubblicazione: (2025)
Beyond Static Alignment: Hierarchical Policy Control for LLM Safety via Risk-Aware Chain-of-Thought
di: Si, Jianfeng, et al.
Pubblicazione: (2026)
di: Si, Jianfeng, et al.
Pubblicazione: (2026)
As Simple as Fine-tuning: LLM Alignment via Bidirectional Negative Feedback Loss
di: Mao, Xin, et al.
Pubblicazione: (2024)
di: Mao, Xin, et al.
Pubblicazione: (2024)
Integrating gender inclusivity into large language models via instruction tuning
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)
di: Wróblewska, Alina, et al.
Pubblicazione: (2025)
Beyond Static Dialogues: Benchmarking Realistic, Heterogeneous, and Evolving Long-Term Memory
di: Zhang, Han, et al.
Pubblicazione: (2026)
di: Zhang, Han, et al.
Pubblicazione: (2026)
Towards the Resistance of Neural Network Watermarking to Fine-tuning
di: Tang, Ling, et al.
Pubblicazione: (2025)
di: Tang, Ling, et al.
Pubblicazione: (2025)
Text Diffusion with Reinforced Conditioning
di: Liu, Yuxuan, et al.
Pubblicazione: (2024)
di: Liu, Yuxuan, et al.
Pubblicazione: (2024)
Birbal: An efficient 7B instruct-model fine-tuned with curated datasets
di: Jindal, Ashvini Kumar, et al.
Pubblicazione: (2024)
di: Jindal, Ashvini Kumar, et al.
Pubblicazione: (2024)
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Fine-tuning Done Right in Model Editing
di: Yang, Wanli, et al.
Pubblicazione: (2025)
di: Yang, Wanli, et al.
Pubblicazione: (2025)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
Training Large Reasoning Models Efficiently via Progressive Thought Encoding
di: Zhang, Zeliang, et al.
Pubblicazione: (2026)
di: Zhang, Zeliang, et al.
Pubblicazione: (2026)
Senses Wide Shut: A Representation-Action Gap in Omnimodal LLMs
di: Quang, Trung Nguyen, et al.
Pubblicazione: (2026)
di: Quang, Trung Nguyen, et al.
Pubblicazione: (2026)
Learning or Self-aligning? Rethinking Instruction Fine-tuning
di: Ren, Mengjie, et al.
Pubblicazione: (2024)
di: Ren, Mengjie, et al.
Pubblicazione: (2024)
SEMA: Simple yet Effective Learning for Multi-Turn Jailbreak Attacks
di: Feng, Mingqian, et al.
Pubblicazione: (2026)
di: Feng, Mingqian, et al.
Pubblicazione: (2026)
MultiBreak: A Scalable and Diverse Multi-turn Jailbreak Benchmark for Evaluating LLM Safety
di: Song, Jialin, et al.
Pubblicazione: (2026)
di: Song, Jialin, et al.
Pubblicazione: (2026)
Zero-shot cross-lingual transfer in instruction tuning of large language models
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
di: Chirkova, Nadezhda, et al.
Pubblicazione: (2024)
Rendering Data Unlearnable by Exploiting LLM Alignment Mechanisms
di: Zhang, Ruihan, et al.
Pubblicazione: (2026)
di: Zhang, Ruihan, et al.
Pubblicazione: (2026)
URL: Universal Referential Knowledge Linking via Task-instructed Representation Compression
di: Li, Zhuoqun, et al.
Pubblicazione: (2024)
di: Li, Zhuoqun, et al.
Pubblicazione: (2024)
Iterative Self-Tuning LLMs for Enhanced Jailbreaking Capabilities
di: Sun, Chung-En, et al.
Pubblicazione: (2024)
di: Sun, Chung-En, et al.
Pubblicazione: (2024)
Mutual Reasoning Makes Smaller LLMs Stronger Problem-Solvers
di: Qi, Zhenting, et al.
Pubblicazione: (2024)
di: Qi, Zhenting, et al.
Pubblicazione: (2024)
Are Full Rollouts Necessary for On-Policy Distillation?
di: Zhang, Yaocheng, et al.
Pubblicazione: (2026)
di: Zhang, Yaocheng, et al.
Pubblicazione: (2026)
THCM-CAL: Temporal-Hierarchical Causal Modelling with Conformal Calibration for Clinical Risk Prediction
di: Zhang, Xin, et al.
Pubblicazione: (2025)
di: Zhang, Xin, et al.
Pubblicazione: (2025)
Scaling Long-Horizon LLM Agent via Context-Folding
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
Improving Domain Adaptation through Extended-Text Reading Comprehension
di: Jiang, Ting, et al.
Pubblicazione: (2024)
di: Jiang, Ting, et al.
Pubblicazione: (2024)
Phonetic Reconstruction of the Consonant System of Middle Chinese via Mixed Integer Optimization
di: Luo, Xiaoxi, et al.
Pubblicazione: (2025)
di: Luo, Xiaoxi, et al.
Pubblicazione: (2025)
WarriorMath: Enhancing the Mathematical Ability of Large Language Models with a Defect-aware Framework
di: Chen, Yue, et al.
Pubblicazione: (2025)
di: Chen, Yue, et al.
Pubblicazione: (2025)
Mnemis: Dual-Route Retrieval on Hierarchical Graphs for Long-Term LLM Memory
di: Tang, Zihao, et al.
Pubblicazione: (2026)
di: Tang, Zihao, et al.
Pubblicazione: (2026)
E5-V: Universal Embeddings with Multimodal Large Language Models
di: Jiang, Ting, et al.
Pubblicazione: (2024)
di: Jiang, Ting, et al.
Pubblicazione: (2024)
Not All Layers of LLMs Are Necessary During Inference
di: Fan, Siqi, et al.
Pubblicazione: (2024)
di: Fan, Siqi, et al.
Pubblicazione: (2024)
Are LLMs Effective Backbones for Fine-tuning? An Experimental Investigation of Supervised LLMs on Chinese Short Text Matching
di: Liu, Shulin, et al.
Pubblicazione: (2024)
di: Liu, Shulin, et al.
Pubblicazione: (2024)
Disentangling Reasoning Tokens and Boilerplate Tokens For Language Model Fine-tuning
di: Ye, Ziang, et al.
Pubblicazione: (2024)
di: Ye, Ziang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
$Se^2$: Sequential Example Selection for In-Context Learning
di: Liu, Haoyu, et al.
Pubblicazione: (2024) -
GeAR: Generation Augmented Retrieval
di: Liu, Haoyu, et al.
Pubblicazione: (2025) -
StreamAdapter: Efficient Test Time Adaptation from Contextual Streams
di: Muhtar, Dilxat, et al.
Pubblicazione: (2024) -
MTL-LoRA: Low-Rank Adaptation for Multi-Task Learning
di: Yang, Yaming, et al.
Pubblicazione: (2024) -
Unsupervised Distractor Generation via Large Language Model Distilling and Counterfactual Contrastive Decoding
di: Qu, Fanyi, et al.
Pubblicazione: (2024)