Demystifying Prompts in Language Models via Perplexity Estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gonen, Hila, Iyer, Srini, Blevins, Terra, Smith, Noah A., Zettlemoyer, Luke |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
par: Gonen, Hila, et autres
Publié: (2024)
par: Gonen, Hila, et autres
Publié: (2024)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
par: Blevins, Terra, et autres
Publié: (2024)
par: Blevins, Terra, et autres
Publié: (2024)
Comparing Hallucination Detection Metrics for Multilingual Generation
par: Kang, Haoqiang, et autres
Publié: (2024)
par: Kang, Haoqiang, et autres
Publié: (2024)
Accommodation Goes Both Ways: Studying Linguistic Convergence Between Humans and Language Models
par: Blevins, Terra
Publié: (2026)
par: Blevins, Terra
Publié: (2026)
Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior
par: Nadkarni, Rahul, et autres
Publié: (2025)
par: Nadkarni, Rahul, et autres
Publié: (2025)
Parameter Alignment Mitigates Catastrophic Forgetting in Multilingual Expert Language Models
par: Ahuja, Sanchit, et autres
Publié: (2026)
par: Ahuja, Sanchit, et autres
Publié: (2026)
OMNIGUARD: An Efficient Approach for AI Safety Moderation Across Languages and Modalities
par: Verma, Sahil, et autres
Publié: (2025)
par: Verma, Sahil, et autres
Publié: (2025)
Detecting Pretraining Data from Large Language Models
par: Shi, Weijia, et autres
Publié: (2023)
par: Shi, Weijia, et autres
Publié: (2023)
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
par: Ahia, Orevaoghene, et autres
Publié: (2024)
par: Ahia, Orevaoghene, et autres
Publié: (2024)
Calibration Is Not Enough: Evaluating Confidence Estimation Under Language Variations
par: Xia, Yuxi, et autres
Publié: (2026)
par: Xia, Yuxi, et autres
Publié: (2026)
Do language models accommodate their users? A study of linguistic convergence
par: Blevins, Terra, et autres
Publié: (2025)
par: Blevins, Terra, et autres
Publié: (2025)
Compute Optimal Tokenization
par: Limisiewicz, Tomasz, et autres
Publié: (2026)
par: Limisiewicz, Tomasz, et autres
Publié: (2026)
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
par: Ahia, Orevaoghene, et autres
Publié: (2024)
par: Ahia, Orevaoghene, et autres
Publié: (2024)
Relation Extraction or Pattern Matching? Unravelling the Generalisation Limits of Language Models for Biographical RE
par: Arzt, Varvara, et autres
Publié: (2025)
par: Arzt, Varvara, et autres
Publié: (2025)
Evaluating Copyright Takedown Methods for Language Models
par: Wei, Boyi, et autres
Publié: (2024)
par: Wei, Boyi, et autres
Publié: (2024)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
par: Min, Sewon, et autres
Publié: (2023)
par: Min, Sewon, et autres
Publié: (2023)
Universal NER v2: Towards a Massively Multilingual Named Entity Recognition Benchmark
par: Blevins, Terra, et autres
Publié: (2026)
par: Blevins, Terra, et autres
Publié: (2026)
Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark
par: Mayhew, Stephen, et autres
Publié: (2023)
par: Mayhew, Stephen, et autres
Publié: (2023)
Bolmo: Byteifying the Next Generation of Language Models
par: Minixhofer, Benjamin, et autres
Publié: (2025)
par: Minixhofer, Benjamin, et autres
Publié: (2025)
PLPP: Prompt Learning with Perplexity Is Self-Distillation for Vision-Language Models
par: Liu, Biao, et autres
Publié: (2024)
par: Liu, Biao, et autres
Publié: (2024)
Demystifying CLIP Data
par: Xu, Hu, et autres
Publié: (2023)
par: Xu, Hu, et autres
Publié: (2023)
Visual Sketchpad: Sketching as a Visual Chain of Thought for Multimodal Language Models
par: Hu, Yushi, et autres
Publié: (2024)
par: Hu, Yushi, et autres
Publié: (2024)
FamiCom: Further Demystifying Prompts for Language Models with Task-Agnostic Performance Estimation
par: Li, Bangzheng, et autres
Publié: (2024)
par: Li, Bangzheng, et autres
Publié: (2024)
Targeted Multilingual Adaptation for Low-resource Language Families
par: Downey, C. M., et autres
Publié: (2024)
par: Downey, C. M., et autres
Publié: (2024)
Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models
par: Ankner, Zachary, et autres
Publié: (2024)
par: Ankner, Zachary, et autres
Publié: (2024)
Dementia Through Different Eyes: Explainable Modeling of Human and LLM Perceptions for Early Awareness
par: Peled-Cohen, Lotem, et autres
Publié: (2025)
par: Peled-Cohen, Lotem, et autres
Publié: (2025)
ASTPrompter: Preference-Aligned Automated Language Model Red-Teaming to Generate Low-Perplexity Unsafe Prompts
par: Hardy, Amelia F., et autres
Publié: (2024)
par: Hardy, Amelia F., et autres
Publié: (2024)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
par: Shi, Weijia, et autres
Publié: (2024)
par: Shi, Weijia, et autres
Publié: (2024)
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025)
par: Schoenegger, Loris, et autres
Publié: (2025)
Micro Language Models Enable Instant Responses
par: Cheng, Wen, et autres
Publié: (2026)
par: Cheng, Wen, et autres
Publié: (2026)
What is Wrong with Perplexity for Long-context Language Modeling?
par: Fang, Lizhe, et autres
Publié: (2024)
par: Fang, Lizhe, et autres
Publié: (2024)
Pack of LLMs: Model Fusion at Test-Time via Perplexity Optimization
par: Mavromatis, Costas, et autres
Publié: (2024)
par: Mavromatis, Costas, et autres
Publié: (2024)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
par: Hsu, Chan-Jan, et autres
Publié: (2026)
par: Hsu, Chan-Jan, et autres
Publié: (2026)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
Demystifying Singular Defects in Large Language Models
par: Wang, Haoqi, et autres
Publié: (2025)
par: Wang, Haoqi, et autres
Publié: (2025)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
par: He, Jacqueline, et autres
Publié: (2026)
par: He, Jacqueline, et autres
Publié: (2026)
The Root Shapes the Fruit: On the Persistence of Gender-Exclusive Harms in Aligned Language Models
par: Ovalle, Anaelia, et autres
Publié: (2024)
par: Ovalle, Anaelia, et autres
Publié: (2024)
Momentum Point-Perplexity Mechanics in Large Language Models
par: Tomaz, Lorenzo, et autres
Publié: (2025)
par: Tomaz, Lorenzo, et autres
Publié: (2025)
Assessing the Reliability of Large Language Models for Deductive Qualitative Coding: A Comparative Study of ChatGPT Interventions
par: Hila, Angjelin, et autres
Publié: (2025)
par: Hila, Angjelin, et autres
Publié: (2025)
Documents similaires
-
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
par: Gonen, Hila, et autres
Publié: (2024) -
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
par: Limisiewicz, Tomasz, et autres
Publié: (2024) -
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
par: Blevins, Terra, et autres
Publié: (2024) -
Comparing Hallucination Detection Metrics for Multilingual Generation
par: Kang, Haoqiang, et autres
Publié: (2024) -
Accommodation Goes Both Ways: Studying Linguistic Convergence Between Humans and Language Models
par: Blevins, Terra
Publié: (2026)