When Perplexity Lies: Generation-Focused Distillation of Hybrid Sequence Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kostelec, Juan Gabriel, Wang, Xiang, Laborieux, Axel, Sourmpis, Christos, Guo, Qinghai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AllMem: A Memory-centric Recipe for Efficient Long-context Modeling
par: Wang, Ziming, et autres
Publié: (2026)
par: Wang, Ziming, et autres
Publié: (2026)
FlashEVA: Accelerating LLM inference via Efficient Attention
par: Kostelec, Juan Gabriel, et autres
Publié: (2025)
par: Kostelec, Juan Gabriel, et autres
Publié: (2025)
PLPP: Prompt Learning with Perplexity Is Self-Distillation for Vision-Language Models
par: Liu, Biao, et autres
Publié: (2024)
par: Liu, Biao, et autres
Publié: (2024)
Perplexity Cannot Always Tell Right from Wrong
par: Veličković, Petar, et autres
Publié: (2026)
par: Veličković, Petar, et autres
Publié: (2026)
Perplexity Trap: PLM-Based Retrievers Overrate Low Perplexity Documents
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
Improving equilibrium propagation without weight symmetry through Jacobian homeostasis
par: Laborieux, Axel, et autres
Publié: (2023)
par: Laborieux, Axel, et autres
Publié: (2023)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
par: Hsu, Chan-Jan, et autres
Publié: (2026)
par: Hsu, Chan-Jan, et autres
Publié: (2026)
Theories of synaptic memory consolidation and intelligent plasticity for continual learning
par: Zenke, Friedemann, et autres
Publié: (2024)
par: Zenke, Friedemann, et autres
Publié: (2024)
Model Organisms Are Leaky: Perplexity Differencing Often Reveals Finetuning Objectives
par: Baker, Mohammed Abu, et autres
Publié: (2026)
par: Baker, Mohammed Abu, et autres
Publié: (2026)
Mapping Overlaps in Benchmarks through Perplexity in the Wild
par: Wu, Siyang, et autres
Publié: (2025)
par: Wu, Siyang, et autres
Publié: (2025)
Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation
par: Chen, Wei-Rui, et autres
Publié: (2025)
par: Chen, Wei-Rui, et autres
Publié: (2025)
RePPL: Recalibrating Perplexity by Uncertainty in Semantic Propagation and Language Generation for Explainable QA Hallucination Detection
par: Huang, Yiming, et autres
Publié: (2025)
par: Huang, Yiming, et autres
Publié: (2025)
Momentum Point-Perplexity Mechanics in Large Language Models
par: Tomaz, Lorenzo, et autres
Publié: (2025)
par: Tomaz, Lorenzo, et autres
Publié: (2025)
Slaves to the Law of Large Numbers: An Asymptotic Equipartition Property for Perplexity in Generative Language Models
par: Bell, Tyler, et autres
Publié: (2024)
par: Bell, Tyler, et autres
Publié: (2024)
Hybrid Policy Distillation for LLMs
par: Zhu, Wenhong, et autres
Publié: (2026)
par: Zhu, Wenhong, et autres
Publié: (2026)
Distilling Event Sequence Knowledge From Large Language Models
par: Wadhwa, Somin, et autres
Publié: (2024)
par: Wadhwa, Somin, et autres
Publié: (2024)
Rethinking GSPO: The Perplexity-Entropy Equivalence
par: Liu, Chi
Publié: (2025)
par: Liu, Chi
Publié: (2025)
Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar
par: Gambardella, Andrew, et autres
Publié: (2025)
par: Gambardella, Andrew, et autres
Publié: (2025)
Multi-Stage Balanced Distillation: Addressing Long-Tail Challenges in Sequence-Level Knowledge Distillation
par: Zhou, Yuhang, et autres
Publié: (2024)
par: Zhou, Yuhang, et autres
Publié: (2024)
Beyond Perplexity: A Lightweight Benchmark for Knowledge Retention in Supervised Fine-Tuning
par: Shabgahi, Soheil Zibakhsh, et autres
Publié: (2026)
par: Shabgahi, Soheil Zibakhsh, et autres
Publié: (2026)
Cognitive Decision Routing in Large Language Models: When to Think Fast, When to Think Slow
par: Du, Y., et autres
Publié: (2025)
par: Du, Y., et autres
Publié: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
Alzheimer's Dementia Detection Using Perplexity from Paired Large Language Models
par: Xiao, Yao, et autres
Publié: (2025)
par: Xiao, Yao, et autres
Publié: (2025)
Luminol-AIDetect: Fast Zero-shot Machine-Generated Text Detection based on Perplexity under Text Shuffling
par: La Cava, Lucio, et autres
Publié: (2026)
par: La Cava, Lucio, et autres
Publié: (2026)
Distilling to Hybrid Attention Models via KL-Guided Layer Selection
par: Li, Yanhong, et autres
Publié: (2025)
par: Li, Yanhong, et autres
Publié: (2025)
Not all tokens are created equal: Perplexity Attention Weighted Networks for AI generated text detection
par: Miralles-González, Pablo, et autres
Publié: (2025)
par: Miralles-González, Pablo, et autres
Publié: (2025)
Backtracking When It Strays: Mitigating Dual Exposure Biases in LLM Reasoning Distillation
par: Wang, Bing, et autres
Publié: (2026)
par: Wang, Bing, et autres
Publié: (2026)
LuxVeri at GenAI Detection Task 3: Cross-Domain Detection of AI-Generated Text Using Inverse Perplexity-Weighted Ensemble of Fine-Tuned Transformer Models
par: Mobin, Md Kamrujjaman, et autres
Publié: (2025)
par: Mobin, Md Kamrujjaman, et autres
Publié: (2025)
Robust Guidance for Unsupervised Data Selection: Capturing Perplexing Named Entities for Domain-Specific Machine Translation
par: Ji, Seunghyun, et autres
Publié: (2024)
par: Ji, Seunghyun, et autres
Publié: (2024)
Parameter Efficient Diverse Paraphrase Generation Using Sequence-Level Knowledge Distillation
par: Jayawardena, Lasal, et autres
Publié: (2024)
par: Jayawardena, Lasal, et autres
Publié: (2024)
Native Hybrid Attention for Efficient Sequence Modeling
par: Du, Jusen, et autres
Publié: (2025)
par: Du, Jusen, et autres
Publié: (2025)
SOD: Step-wise On-policy Distillation for Small Language Model Agents
par: Zhong, Qiyong, et autres
Publié: (2026)
par: Zhong, Qiyong, et autres
Publié: (2026)
LuxVeri at GenAI Detection Task 1: Inverse Perplexity Weighted Ensemble for Robust Detection of AI-Generated Text across English and Multilingual Contexts
par: Mobin, Md Kamrujjaman, et autres
Publié: (2025)
par: Mobin, Md Kamrujjaman, et autres
Publié: (2025)
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
par: Boreiko, Valentyn, et autres
Publié: (2024)
par: Boreiko, Valentyn, et autres
Publié: (2024)
When Thinking LLMs Lie: Unveiling the Strategic Deception in Representations of Reasoning Models
par: Wang, Kai, et autres
Publié: (2025)
par: Wang, Kai, et autres
Publié: (2025)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
par: Cheng, Zifeng, et autres
Publié: (2025)
par: Cheng, Zifeng, et autres
Publié: (2025)
HowkGPT: Investigating the Detection of ChatGPT-generated University Student Homework through Context-Aware Perplexity Analysis
par: Vasilatos, Christoforos, et autres
Publié: (2023)
par: Vasilatos, Christoforos, et autres
Publié: (2023)
Warmup Generations: A Task-Agnostic Approach for Guiding Sequence-to-Sequence Learning with Unsupervised Initial State Generation
par: Li, Senyu, et autres
Publié: (2025)
par: Li, Senyu, et autres
Publié: (2025)
Blinded by Generated Contexts: How Language Models Merge Generated and Retrieved Contexts When Knowledge Conflicts?
par: Tan, Hexiang, et autres
Publié: (2024)
par: Tan, Hexiang, et autres
Publié: (2024)
Beyond Perplexity: A Geometric and Spectral Study of Low-Rank Pre-Training
par: Shivagunde, Namrata, et autres
Publié: (2026)
par: Shivagunde, Namrata, et autres
Publié: (2026)
Documents similaires
-
AllMem: A Memory-centric Recipe for Efficient Long-context Modeling
par: Wang, Ziming, et autres
Publié: (2026) -
FlashEVA: Accelerating LLM inference via Efficient Attention
par: Kostelec, Juan Gabriel, et autres
Publié: (2025) -
PLPP: Prompt Learning with Perplexity Is Self-Distillation for Vision-Language Models
par: Liu, Biao, et autres
Publié: (2024) -
Perplexity Cannot Always Tell Right from Wrong
par: Veličković, Petar, et autres
Publié: (2026) -
Perplexity Trap: PLM-Based Retrievers Overrate Low Perplexity Documents
par: Wang, Haoyu, et autres
Publié: (2025)