Measuring the Inconsistency of Large Language Models in Preferential Ranking
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Xiutian, Wang, Ke, Peng, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ORCHID: A Chinese Debate Corpus for Target-Independent Stance Detection and Argumentative Dialogue Summarization
di: Zhao, Xiutian, et al.
Pubblicazione: (2024)
di: Zhao, Xiutian, et al.
Pubblicazione: (2024)
An Electoral Approach to Diversify LLM-based Multi-Agent Collective Decision-Making
di: Zhao, Xiutian, et al.
Pubblicazione: (2024)
di: Zhao, Xiutian, et al.
Pubblicazione: (2024)
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
A Survey on Hallucination in Large Vision-Language Models
di: Liu, Hanchao, et al.
Pubblicazione: (2024)
di: Liu, Hanchao, et al.
Pubblicazione: (2024)
Measuring Moral Inconsistencies in Large Language Models
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)
Neuron-Level Emotion Control in Speech-Generative Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
Finding Culture-Sensitive Neurons in Vision-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
Jailbreaking Multimodal Large Language Models via Shuffle Inconsistency
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
di: Zhao, Shiji, et al.
Pubblicazione: (2025)
Evaluating Knowledge-based Cross-lingual Inconsistency in Large Language Models
di: Xing, Xiaolin, et al.
Pubblicazione: (2024)
di: Xing, Xiaolin, et al.
Pubblicazione: (2024)
Detecting Corpus-Level Knowledge Inconsistencies in Wikipedia with Large Language Models
di: Semnani, Sina J., et al.
Pubblicazione: (2025)
di: Semnani, Sina J., et al.
Pubblicazione: (2025)
Bias and Volatility: A Statistical Framework for Evaluating Large Language Model's Stereotypes and the Associated Generation Inconsistency
di: Liu, Yiran, et al.
Pubblicazione: (2024)
di: Liu, Yiran, et al.
Pubblicazione: (2024)
Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models
di: Yan, Ruiyi, et al.
Pubblicazione: (2025)
di: Yan, Ruiyi, et al.
Pubblicazione: (2025)
Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
AgentBank: Towards Generalized LLM Agents via Fine-Tuning on 50000+ Interaction Trajectories
di: Song, Yifan, et al.
Pubblicazione: (2024)
di: Song, Yifan, et al.
Pubblicazione: (2024)
Inconsistencies in Masked Language Models
di: Young, Tom, et al.
Pubblicazione: (2022)
di: Young, Tom, et al.
Pubblicazione: (2022)
Watch Every Step! LLM Agent Learning via Iterative Step-Level Process Refinement
di: Xiong, Weimin, et al.
Pubblicazione: (2024)
di: Xiong, Weimin, et al.
Pubblicazione: (2024)
KG-Rank: Enhancing Large Language Models for Medical QA with Knowledge Graphs and Ranking Techniques
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
LLM-RankFusion: Mitigating Intrinsic Inconsistency in LLM-based Ranking
di: Zeng, Yifan, et al.
Pubblicazione: (2024)
di: Zeng, Yifan, et al.
Pubblicazione: (2024)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2024)
di: Li, Mingda, et al.
Pubblicazione: (2024)
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
di: Shrivastava, Aryan, et al.
Pubblicazione: (2024)
di: Shrivastava, Aryan, et al.
Pubblicazione: (2024)
Ranked Voting based Self-Consistency of Large Language Models
di: Wang, Weiqin, et al.
Pubblicazione: (2025)
di: Wang, Weiqin, et al.
Pubblicazione: (2025)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
di: Zhang, Jingfan, et al.
Pubblicazione: (2024)
di: Zhang, Jingfan, et al.
Pubblicazione: (2024)
Measuring Maximum Activations in Open Large Language Models
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
Lost in Multilinguality: Dissecting Cross-lingual Factual Inconsistency in Transformer Language Models
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
Flexora: Flexible Low Rank Adaptation for Large Language Models
di: Wei, Chenxing, et al.
Pubblicazione: (2024)
di: Wei, Chenxing, et al.
Pubblicazione: (2024)
Topology-Enhanced Alignment for Large Language Models: Trajectory Topology Loss and Topological Preference Optimization
di: Pan, Yurui, et al.
Pubblicazione: (2026)
di: Pan, Yurui, et al.
Pubblicazione: (2026)
Measuring Spiritual Values and Bias of Large Language Models
di: Liu, Songyuan, et al.
Pubblicazione: (2024)
di: Liu, Songyuan, et al.
Pubblicazione: (2024)
RankAlign: A Ranking View of the Generator-Validator Gap in Large Language Models
di: Rodriguez, Juan Diego, et al.
Pubblicazione: (2025)
di: Rodriguez, Juan Diego, et al.
Pubblicazione: (2025)
Semantic Sensitivities and Inconsistent Predictions: Measuring the Fragility of NLI Models
di: Arakelyan, Erik, et al.
Pubblicazione: (2024)
di: Arakelyan, Erik, et al.
Pubblicazione: (2024)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
di: Liu, Zequan, et al.
Pubblicazione: (2024)
di: Liu, Zequan, et al.
Pubblicazione: (2024)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
di: Wang, Yuhang, et al.
Pubblicazione: (2023)
TourRank: Utilizing Large Language Models for Documents Ranking with a Tournament-Inspired Strategy
di: Chen, Yiqun, et al.
Pubblicazione: (2024)
di: Chen, Yiqun, et al.
Pubblicazione: (2024)
Measuring Stereotype and Deviation Biases in Large Language Models
di: Wang, Daniel, et al.
Pubblicazione: (2025)
di: Wang, Daniel, et al.
Pubblicazione: (2025)
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)
Multi-Conditional Ranking with Large Language Models
di: Pezeshkpour, Pouya, et al.
Pubblicazione: (2024)
di: Pezeshkpour, Pouya, et al.
Pubblicazione: (2024)
Modality-Inconsistent Continual Learning of Multimodal Large Language Models
di: Pian, Weiguo, et al.
Pubblicazione: (2024)
di: Pian, Weiguo, et al.
Pubblicazione: (2024)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
di: Liu, Kainan, et al.
Pubblicazione: (2026)
di: Liu, Kainan, et al.
Pubblicazione: (2026)
Time-To-Inconsistency: A Survival Analysis of Large Language Model Robustness to Adversarial Attacks
di: Li, Yubo, et al.
Pubblicazione: (2025)
di: Li, Yubo, et al.
Pubblicazione: (2025)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
di: Liu, Wenhan, et al.
Pubblicazione: (2024)
di: Liu, Wenhan, et al.
Pubblicazione: (2024)
Diff-eRank: A Novel Rank-Based Metric for Evaluating Large Language Models
di: Wei, Lai, et al.
Pubblicazione: (2024)
di: Wei, Lai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
ORCHID: A Chinese Debate Corpus for Target-Independent Stance Detection and Argumentative Dialogue Summarization
di: Zhao, Xiutian, et al.
Pubblicazione: (2024) -
An Electoral Approach to Diversify LLM-based Multi-Agent Collective Decision-Making
di: Zhao, Xiutian, et al.
Pubblicazione: (2024) -
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026) -
A Survey on Hallucination in Large Vision-Language Models
di: Liu, Hanchao, et al.
Pubblicazione: (2024) -
Measuring Moral Inconsistencies in Large Language Models
di: Bonagiri, Vamshi Krishna, et al.
Pubblicazione: (2024)