A Perplexity and Menger Curvature-Based Approach for Similarity Evaluation of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yuantao, Yang, Zhankui |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models
par: Ankner, Zachary, et autres
Publié: (2024)
par: Ankner, Zachary, et autres
Publié: (2024)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
par: Yoon, Se-eun, et autres
Publié: (2024)
par: Yoon, Se-eun, et autres
Publié: (2024)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
par: Hsu, Chan-Jan, et autres
Publié: (2026)
par: Hsu, Chan-Jan, et autres
Publié: (2026)
Momentum Point-Perplexity Mechanics in Large Language Models
par: Tomaz, Lorenzo, et autres
Publié: (2025)
par: Tomaz, Lorenzo, et autres
Publié: (2025)
Contrastive Perplexity for Controlled Generation: An Application in Detoxifying Large Language Models
par: Klein, Tassilo, et autres
Publié: (2024)
par: Klein, Tassilo, et autres
Publié: (2024)
Rethinking Perplexity: Revealing the Impact of Input Length on Perplexity Evaluation in LLMs
par: Cheng, Letian, et autres
Publié: (2026)
par: Cheng, Letian, et autres
Publié: (2026)
Demystifying Prompts in Language Models via Perplexity Estimation
par: Gonen, Hila, et autres
Publié: (2022)
par: Gonen, Hila, et autres
Publié: (2022)
What is Wrong with Perplexity for Long-context Language Modeling?
par: Fang, Lizhe, et autres
Publié: (2024)
par: Fang, Lizhe, et autres
Publié: (2024)
Perplexity Trap: PLM-Based Retrievers Overrate Low Perplexity Documents
par: Wang, Haoyu, et autres
Publié: (2025)
par: Wang, Haoyu, et autres
Publié: (2025)
PLPP: Prompt Learning with Perplexity Is Self-Distillation for Vision-Language Models
par: Liu, Biao, et autres
Publié: (2024)
par: Liu, Biao, et autres
Publié: (2024)
Alzheimer's Dementia Detection Using Perplexity from Paired Large Language Models
par: Xiao, Yao, et autres
Publié: (2025)
par: Xiao, Yao, et autres
Publié: (2025)
Efficient Response Generation Strategy Selection for Fine-Tuning Large Language Models Through Self-Aligned Perplexity
par: Ren, Xuan, et autres
Publié: (2025)
par: Ren, Xuan, et autres
Publié: (2025)
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
par: Boreiko, Valentyn, et autres
Publié: (2024)
par: Boreiko, Valentyn, et autres
Publié: (2024)
Beyond Perplexity: Multi-dimensional Safety Evaluation of LLM Compression
par: Xu, Zhichao, et autres
Publié: (2024)
par: Xu, Zhichao, et autres
Publié: (2024)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
Slaves to the Law of Large Numbers: An Asymptotic Equipartition Property for Perplexity in Generative Language Models
par: Bell, Tyler, et autres
Publié: (2024)
par: Bell, Tyler, et autres
Publié: (2024)
Inconsistent Tokenizations Cause Language Models to be Perplexed by Japanese Grammar
par: Gambardella, Andrew, et autres
Publié: (2025)
par: Gambardella, Andrew, et autres
Publié: (2025)
Reindex-Then-Adapt: Improving Large Language Models for Conversational Recommendation
par: He, Zhankui, et autres
Publié: (2024)
par: He, Zhankui, et autres
Publié: (2024)
Confidence in Large Language Model Evaluation: A Bayesian Approach to Limited-Sample Challenges
par: Xiao, Xiao, et autres
Publié: (2025)
par: Xiao, Xiao, et autres
Publié: (2025)
Automated Creativity Evaluation for Large Language Models: A Reference-Based Approach
par: Li, Ruizhe, et autres
Publié: (2025)
par: Li, Ruizhe, et autres
Publié: (2025)
ASTPrompter: Preference-Aligned Automated Language Model Red-Teaming to Generate Low-Perplexity Unsafe Prompts
par: Hardy, Amelia F., et autres
Publié: (2024)
par: Hardy, Amelia F., et autres
Publié: (2024)
A Comprehensive Evaluation of Large Language Models on Aspect-Based Sentiment Analysis
par: Zhou, Changzhi, et autres
Publié: (2024)
par: Zhou, Changzhi, et autres
Publié: (2024)
Perplexity-Aware Data Scaling Law: Perplexity Landscapes Predict Performance for Continual Pre-training
par: Liu, Lei, et autres
Publié: (2025)
par: Liu, Lei, et autres
Publié: (2025)
destroR: Attacking Transfer Models with Obfuscous Examples to Discard Perplexity
par: Ahmed, Saadat Rafid, et autres
Publié: (2025)
par: Ahmed, Saadat Rafid, et autres
Publié: (2025)
Pack of LLMs: Model Fusion at Test-Time via Perplexity Optimization
par: Mavromatis, Costas, et autres
Publié: (2024)
par: Mavromatis, Costas, et autres
Publié: (2024)
SIMBA UQ: Similarity-Based Aggregation for Uncertainty Quantification in Large Language Models
par: Bhattacharjya, Debarun, et autres
Publié: (2025)
par: Bhattacharjya, Debarun, et autres
Publié: (2025)
Beyond Natural Language Perplexity: Detecting Dead Code Poisoning in Code Generation Datasets
par: Tsai, Chi-Chien, et autres
Publié: (2025)
par: Tsai, Chi-Chien, et autres
Publié: (2025)
A Comprehensive Analysis of Large Language Model Outputs: Similarity, Diversity, and Bias
par: Smith, Brandon, et autres
Publié: (2025)
par: Smith, Brandon, et autres
Publié: (2025)
Token-Level Adversarial Prompt Detection Based on Perplexity Measures and Contextual Information
par: Hu, Zhengmian, et autres
Publié: (2023)
par: Hu, Zhengmian, et autres
Publié: (2023)
Confidence, Not Perplexity: A Better Metric for the Creative Era of LLMs
par: Parupudi, V. S. Raghu
Publié: (2025)
par: Parupudi, V. S. Raghu
Publié: (2025)
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
par: Zhou, Xinyu, et autres
Publié: (2024)
par: Zhou, Xinyu, et autres
Publié: (2024)
Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models
par: Zhang, Gaifan, et autres
Publié: (2025)
par: Zhang, Gaifan, et autres
Publié: (2025)
BAS: A Decision-Theoretic Approach to Evaluating Large Language Model Confidence
par: Wu, Sean, et autres
Publié: (2026)
par: Wu, Sean, et autres
Publié: (2026)
Hessian of Perplexity for Large Language Models by PyTorch autograd (Open Source)
par: Ilin, Ivan
Publié: (2025)
par: Ilin, Ivan
Publié: (2025)
Interpreting Bias in Large Language Models: A Feature-Based Approach
par: Prakash, Nirmalendu, et autres
Publié: (2024)
par: Prakash, Nirmalendu, et autres
Publié: (2024)
Rectify Evaluation Preference: Improving LLMs' Critique on Math Reasoning via Perplexity-aware Reinforcement Learning
par: Tian, Changyuan, et autres
Publié: (2025)
par: Tian, Changyuan, et autres
Publié: (2025)
Can Perplexity Predict Fine-tuning Performance? An Investigation of Tokenization Effects on Sequential Language Models for Nepali
par: Luitel, Nishant, et autres
Publié: (2024)
par: Luitel, Nishant, et autres
Publié: (2024)
Enhancing Multimodal Large Language Models Complex Reason via Similarity Computation
par: Zhang, Xiaofeng, et autres
Publié: (2024)
par: Zhang, Xiaofeng, et autres
Publié: (2024)
Two Spelling Normalization Approaches Based on Large Language Models
par: Domingo, Miguel, et autres
Publié: (2025)
par: Domingo, Miguel, et autres
Publié: (2025)
Documents similaires
-
Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models
par: Ankner, Zachary, et autres
Publié: (2024) -
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024) -
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
par: Yoon, Se-eun, et autres
Publié: (2024) -
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
par: Hsu, Chan-Jan, et autres
Publié: (2026) -
Momentum Point-Perplexity Mechanics in Large Language Models
par: Tomaz, Lorenzo, et autres
Publié: (2025)