Measuring the Inconsistency of Large Language Models in Preferential Ranking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Xiutian, Wang, Ke, Peng, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ORCHID: A Chinese Debate Corpus for Target-Independent Stance Detection and Argumentative Dialogue Summarization
par: Zhao, Xiutian, et autres
Publié: (2024)
par: Zhao, Xiutian, et autres
Publié: (2024)
An Electoral Approach to Diversify LLM-based Multi-Agent Collective Decision-Making
par: Zhao, Xiutian, et autres
Publié: (2024)
par: Zhao, Xiutian, et autres
Publié: (2024)
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
par: Zhao, Xiutian, et autres
Publié: (2026)
par: Zhao, Xiutian, et autres
Publié: (2026)
A Survey on Hallucination in Large Vision-Language Models
par: Liu, Hanchao, et autres
Publié: (2024)
par: Liu, Hanchao, et autres
Publié: (2024)
Measuring Moral Inconsistencies in Large Language Models
par: Bonagiri, Vamshi Krishna, et autres
Publié: (2024)
par: Bonagiri, Vamshi Krishna, et autres
Publié: (2024)
Neuron-Level Emotion Control in Speech-Generative Large Audio-Language Models
par: Zhao, Xiutian, et autres
Publié: (2026)
par: Zhao, Xiutian, et autres
Publié: (2026)
Finding Culture-Sensitive Neurons in Vision-Language Models
par: Zhao, Xiutian, et autres
Publié: (2025)
par: Zhao, Xiutian, et autres
Publié: (2025)
Jailbreaking Multimodal Large Language Models via Shuffle Inconsistency
par: Zhao, Shiji, et autres
Publié: (2025)
par: Zhao, Shiji, et autres
Publié: (2025)
Evaluating Knowledge-based Cross-lingual Inconsistency in Large Language Models
par: Xing, Xiaolin, et autres
Publié: (2024)
par: Xing, Xiaolin, et autres
Publié: (2024)
Detecting Corpus-Level Knowledge Inconsistencies in Wikipedia with Large Language Models
par: Semnani, Sina J., et autres
Publié: (2025)
par: Semnani, Sina J., et autres
Publié: (2025)
Bias and Volatility: A Statistical Framework for Evaluating Large Language Model's Stereotypes and the Associated Generation Inconsistency
par: Liu, Yiran, et autres
Publié: (2024)
par: Liu, Yiran, et autres
Publié: (2024)
Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models
par: Yan, Ruiyi, et autres
Publié: (2025)
par: Yan, Ruiyi, et autres
Publié: (2025)
Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges
par: Samuel, Vinay, et autres
Publié: (2024)
par: Samuel, Vinay, et autres
Publié: (2024)
AgentBank: Towards Generalized LLM Agents via Fine-Tuning on 50000+ Interaction Trajectories
par: Song, Yifan, et autres
Publié: (2024)
par: Song, Yifan, et autres
Publié: (2024)
Inconsistencies in Masked Language Models
par: Young, Tom, et autres
Publié: (2022)
par: Young, Tom, et autres
Publié: (2022)
Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement
par: Xiong, Weimin, et autres
Publié: (2024)
par: Xiong, Weimin, et autres
Publié: (2024)
KG-Rank: Enhancing Large Language Models for Medical QA with Knowledge Graphs and Ranking Techniques
par: Yang, Rui, et autres
Publié: (2024)
par: Yang, Rui, et autres
Publié: (2024)
LLM-RankFusion: Mitigating Intrinsic Inconsistency in LLM-based Ranking
par: Zeng, Yifan, et autres
Publié: (2024)
par: Zeng, Yifan, et autres
Publié: (2024)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
par: Li, Mingda, et autres
Publié: (2024)
par: Li, Mingda, et autres
Publié: (2024)
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
par: Shrivastava, Aryan, et autres
Publié: (2024)
par: Shrivastava, Aryan, et autres
Publié: (2024)
Ranked Voting based Self-Consistency of Large Language Models
par: Wang, Weiqin, et autres
Publié: (2025)
par: Wang, Weiqin, et autres
Publié: (2025)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
par: Zhang, Jingfan, et autres
Publié: (2024)
par: Zhang, Jingfan, et autres
Publié: (2024)
Measuring Maximum Activations in Open Large Language Models
par: Chen, Luxuan, et autres
Publié: (2026)
par: Chen, Luxuan, et autres
Publié: (2026)
Lost in Multilinguality: Dissecting Cross-lingual Factual Inconsistency in Transformer Language Models
par: Wang, Mingyang, et autres
Publié: (2025)
par: Wang, Mingyang, et autres
Publié: (2025)
Flexora: Flexible Low Rank Adaptation for Large Language Models
par: Wei, Chenxing, et autres
Publié: (2024)
par: Wei, Chenxing, et autres
Publié: (2024)
Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
par: Pan, Yurui, et autres
Publié: (2026)
par: Pan, Yurui, et autres
Publié: (2026)
Measuring Spiritual Values and Bias of Large Language Models
par: Liu, Songyuan, et autres
Publié: (2024)
par: Liu, Songyuan, et autres
Publié: (2024)
RankAlign: A Ranking View of the Generator-Validator Gap in Large Language Models
par: Rodriguez, Juan Diego, et autres
Publié: (2025)
par: Rodriguez, Juan Diego, et autres
Publié: (2025)
Semantic Sensitivities and Inconsistent Predictions: Measuring the Fragility of NLI Models
par: Arakelyan, Erik, et autres
Publié: (2024)
par: Arakelyan, Erik, et autres
Publié: (2024)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
par: Liu, Zequan, et autres
Publié: (2024)
par: Liu, Zequan, et autres
Publié: (2024)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
par: Wang, Yuhang, et autres
Publié: (2023)
par: Wang, Yuhang, et autres
Publié: (2023)
TourRank: Utilizing Large Language Models for Documents Ranking with a Tournament-Inspired Strategy
par: Chen, Yiqun, et autres
Publié: (2024)
par: Chen, Yiqun, et autres
Publié: (2024)
Measuring Stereotype and Deviation Biases in Large Language Models
par: Wang, Daniel, et autres
Publié: (2025)
par: Wang, Daniel, et autres
Publié: (2025)
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction
par: Ma, Mingyu Derek, et autres
Publié: (2025)
par: Ma, Mingyu Derek, et autres
Publié: (2025)
Multi-Conditional Ranking with Large Language Models
par: Pezeshkpour, Pouya, et autres
Publié: (2024)
par: Pezeshkpour, Pouya, et autres
Publié: (2024)
Modality-Inconsistent Continual Learning of Multimodal Large Language Models
par: Pian, Weiguo, et autres
Publié: (2024)
par: Pian, Weiguo, et autres
Publié: (2024)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
par: Liu, Kainan, et autres
Publié: (2026)
par: Liu, Kainan, et autres
Publié: (2026)
Time-To-Inconsistency: A Survival Analysis of Large Language Model Robustness to Adversarial Attacks
par: Li, Yubo, et autres
Publié: (2025)
par: Li, Yubo, et autres
Publié: (2025)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
par: Liu, Wenhan, et autres
Publié: (2024)
par: Liu, Wenhan, et autres
Publié: (2024)
Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models
par: Wei, Lai, et autres
Publié: (2024)
par: Wei, Lai, et autres
Publié: (2024)
Documents similaires
-
ORCHID: A Chinese Debate Corpus for Target-Independent Stance Detection and Argumentative Dialogue Summarization
par: Zhao, Xiutian, et autres
Publié: (2024) -
An Electoral Approach to Diversify LLM-based Multi-Agent Collective Decision-Making
par: Zhao, Xiutian, et autres
Publié: (2024) -
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
par: Zhao, Xiutian, et autres
Publié: (2026) -
A Survey on Hallucination in Large Vision-Language Models
par: Liu, Hanchao, et autres
Publié: (2024) -
Measuring Moral Inconsistencies in Large Language Models
par: Bonagiri, Vamshi Krishna, et autres
Publié: (2024)