Parameter Efficient Diverse Paraphrase Generation Using Sequence-Level Knowledge Distillation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jayawardena, Lasal, Yapa, Prasan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ParaFusion: A Large-Scale LLM-Driven English Paraphrase Dataset Infused with High-Quality Lexical and Syntactic Diversity
par: Jayawardena, Lasal, et autres
Publié: (2024)
par: Jayawardena, Lasal, et autres
Publié: (2024)
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
par: Yang, Runming, et autres
Publié: (2024)
par: Yang, Runming, et autres
Publié: (2024)
Impossible Distillation: from Low-Quality Model to High-Quality Dataset & Model for Summarization and Paraphrasing
par: Jung, Jaehun, et autres
Publié: (2023)
par: Jung, Jaehun, et autres
Publié: (2023)
Action Controlled Paraphrasing
par: Shi, Ning, et autres
Publié: (2024)
par: Shi, Ning, et autres
Publié: (2024)
KDA: A Knowledge-Distilled Attacker for Generating Diverse Prompts to Jailbreak LLMs
par: Liang, Buyun, et autres
Publié: (2025)
par: Liang, Buyun, et autres
Publié: (2025)
AdaSPEC: Selective Knowledge Distillation for Efficient Speculative Decoders
par: Hu, Yuezhou, et autres
Publié: (2025)
par: Hu, Yuezhou, et autres
Publié: (2025)
Paraphrasing Adversarial Attack on LLM-as-a-Reviewer
par: Kaneko, Masahiro
Publié: (2026)
par: Kaneko, Masahiro
Publié: (2026)
Efficient Mathematical Reasoning Models via Dynamic Pruning and Knowledge Distillation
par: Yu, Fengming, et autres
Publié: (2025)
par: Yu, Fengming, et autres
Publié: (2025)
AliMark: Enhancing Robustness of Sentence-Level Watermarking Against Text Paraphrasing
par: Li, Yuexin, et autres
Publié: (2026)
par: Li, Yuexin, et autres
Publié: (2026)
TAID: Temporally Adaptive Interpolated Distillation for Efficient Knowledge Transfer in Language Models
par: Shing, Makoto, et autres
Publié: (2025)
par: Shing, Makoto, et autres
Publié: (2025)
DOGe: Defensive Output Generation for LLM Protection Against Knowledge Distillation
par: Li, Pingzhi, et autres
Publié: (2025)
par: Li, Pingzhi, et autres
Publié: (2025)
DistillSpec: Improving Speculative Decoding via Knowledge Distillation
par: Zhou, Yongchao, et autres
Publié: (2023)
par: Zhou, Yongchao, et autres
Publié: (2023)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
par: Zhang, Songming, et autres
Publié: (2026)
par: Zhang, Songming, et autres
Publié: (2026)
Paraphrase and Aggregate with Large Language Models for Minimizing Intent Classification Errors
par: Yadav, Vikas, et autres
Publié: (2024)
par: Yadav, Vikas, et autres
Publié: (2024)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
par: Zhang, Xue, et autres
Publié: (2025)
par: Zhang, Xue, et autres
Publié: (2025)
COLLEAGUE.SKILL: Automated AI Skill Generation via Expert Knowledge Distillation
par: Zhou, Tianyi, et autres
Publié: (2026)
par: Zhou, Tianyi, et autres
Publié: (2026)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
par: Zhang, Songming, et autres
Publié: (2025)
par: Zhang, Songming, et autres
Publié: (2025)
Clip Your Sequences Fairly: Enforcing Length Fairness for Sequence-Level RL
par: Mao, Hanyi, et autres
Publié: (2025)
par: Mao, Hanyi, et autres
Publié: (2025)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
par: Tian, Yijun, et autres
Publié: (2024)
par: Tian, Yijun, et autres
Publié: (2024)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
par: Azimi, Rambod, et autres
Publié: (2024)
par: Azimi, Rambod, et autres
Publié: (2024)
Delta Knowledge Distillation for Large Language Models
par: Cao, Yihan, et autres
Publié: (2025)
par: Cao, Yihan, et autres
Publié: (2025)
Analyzing Persuasive Strategies in Meme Texts: A Fusion of Language Models with Paraphrase Enrichment
par: Nayak, Kota Shamanth Ramanath, et autres
Publié: (2024)
par: Nayak, Kota Shamanth Ramanath, et autres
Publié: (2024)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
par: Kim, Gyeongman, et autres
Publié: (2024)
par: Kim, Gyeongman, et autres
Publié: (2024)
Improving Neutral Point-of-View Generation with Data- and Parameter-Efficient RL
par: Hoffmann, Jessica, et autres
Publié: (2025)
par: Hoffmann, Jessica, et autres
Publié: (2025)
Compact Language Models via Pruning and Knowledge Distillation
par: Muralidharan, Saurav, et autres
Publié: (2024)
par: Muralidharan, Saurav, et autres
Publié: (2024)
Efficiently Distilling LLMs for Edge Applications
par: Kundu, Achintya, et autres
Publié: (2024)
par: Kundu, Achintya, et autres
Publié: (2024)
Diversity of Transformer Layers: One Aspect of Parameter Scaling Laws
par: Kamigaito, Hidetaka, et autres
Publié: (2025)
par: Kamigaito, Hidetaka, et autres
Publié: (2025)
Beyond Mimicry to Contextual Guidance: Knowledge Distillation for Interactive AI
par: Wang, Tong, et autres
Publié: (2024)
par: Wang, Tong, et autres
Publié: (2024)
Distilling Multi-Scale Knowledge for Event Temporal Relation Extraction
par: Yao, Hao-Ren, et autres
Publié: (2022)
par: Yao, Hao-Ren, et autres
Publié: (2022)
Confidence-aware Self-Semantic Distillation on Knowledge Graph Embedding
par: Liu, Yichen, et autres
Publié: (2022)
par: Liu, Yichen, et autres
Publié: (2022)
Assessing the Portability of Parameter Matrices Trained by Parameter-Efficient Finetuning Methods
par: Sabry, Mohammed, et autres
Publié: (2024)
par: Sabry, Mohammed, et autres
Publié: (2024)
AMPS: ASR with Multimodal Paraphrase Supervision
par: Gupta, Abhishek, et autres
Publié: (2024)
par: Gupta, Abhishek, et autres
Publié: (2024)
DRAG: Distilling RAG for SLMs from LLMs to Transfer Knowledge and Mitigate Hallucination via Evidence and Graph-based Distillation
par: Chen, Jennifer, et autres
Publié: (2025)
par: Chen, Jennifer, et autres
Publié: (2025)
Native Hybrid Attention for Efficient Sequence Modeling
par: Du, Jusen, et autres
Publié: (2025)
par: Du, Jusen, et autres
Publié: (2025)
AdaExplore: Failure-Driven Adaptation and Diversity-Preserving Search for Efficient Kernel Generation
par: Du, Weihua, et autres
Publié: (2026)
par: Du, Weihua, et autres
Publié: (2026)
Principled RL for Diffusion LLMs Emerges from a Sequence-Level Perspective
par: Ou, Jingyang, et autres
Publié: (2025)
par: Ou, Jingyang, et autres
Publié: (2025)
Leave It to the Experts: Detecting Knowledge Distillation via MoE Expert Signatures
par: Li, Pingzhi, et autres
Publié: (2025)
par: Li, Pingzhi, et autres
Publié: (2025)
Parameter Efficient Instruction Tuning: An Empirical Study
par: He, Pengfei
Publié: (2024)
par: He, Pengfei
Publié: (2024)
Parameter-Efficient Fine-Tuning for Foundation Models
par: Zhang, Dan, et autres
Publié: (2025)
par: Zhang, Dan, et autres
Publié: (2025)
Leveraging Zero-Shot Prompting for Efficient Language Model Distillation
par: Vöge, Lukas, et autres
Publié: (2024)
par: Vöge, Lukas, et autres
Publié: (2024)
Documents similaires
-
ParaFusion: A Large-Scale LLM-Driven English Paraphrase Dataset Infused with High-Quality Lexical and Syntactic Diversity
par: Jayawardena, Lasal, et autres
Publié: (2024) -
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
par: Yang, Runming, et autres
Publié: (2024) -
Impossible Distillation: from Low-Quality Model to High-Quality Dataset & Model for Summarization and Paraphrasing
par: Jung, Jaehun, et autres
Publié: (2023) -
Action Controlled Paraphrasing
par: Shi, Ning, et autres
Publié: (2024) -
KDA: A Knowledge-Distilled Attacker for Generating Diverse Prompts to Jailbreak LLMs
par: Liang, Buyun, et autres
Publié: (2025)