Evolutionary Search for Automated Design of Uncertainty Quantification Methods
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Seleznyov, Mikhail, Korbut, Daniil, Moskvoretskii, Viktor, Somov, Oleg, Panchenko, Alexander, Tutubalina, Elena |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
When Punctuation Matters: A Large-Scale Comparison of Prompt Robustness Methods for LLMs
par: Seleznyov, Mikhail, et autres
Publié: (2025)
par: Seleznyov, Mikhail, et autres
Publié: (2025)
Breaking the Chain: A Causal Analysis of LLM Faithfulness to Intermediate Structures
par: Somov, Oleg, et autres
Publié: (2026)
par: Somov, Oleg, et autres
Publié: (2026)
Leveraging LLM Parametric Knowledge for Fact Checking without Retrieval
par: Vazhentsev, Artem, et autres
Publié: (2026)
par: Vazhentsev, Artem, et autres
Publié: (2026)
Confidence Estimation for Error Detection in Text-to-SQL Systems
par: Somov, Oleg, et autres
Publié: (2025)
par: Somov, Oleg, et autres
Publié: (2025)
The benefits of query-based KGQA systems for complex and temporal questions in LLM era
par: Alekseev, Artem, et autres
Publié: (2025)
par: Alekseev, Artem, et autres
Publié: (2025)
<think> So let's replace this phrase with insult... </think> Lessons learned from generation of toxic texts with LLMs
par: Pletenev, Sergey, et autres
Publié: (2025)
par: Pletenev, Sergey, et autres
Publié: (2025)
Harnessing non-adversarial robustness in large language models
par: Zhou, Qinghua, et autres
Publié: (2026)
par: Zhou, Qinghua, et autres
Publié: (2026)
The Chronicles of RiDiC: Generating Datasets with Controlled Popularity Distribution for Long-form Factuality Evaluation
par: Braslavski, Pavel, et autres
Publié: (2026)
par: Braslavski, Pavel, et autres
Publié: (2026)
xCOMET-lite: Bridging the Gap Between Efficiency and Quality in Learned MT Evaluation Metrics
par: Larionov, Daniil, et autres
Publié: (2024)
par: Larionov, Daniil, et autres
Publié: (2024)
SynthDetoxM: Modern LLMs are Few-Shot Parallel Detoxification Data Annotators
par: Moskovskiy, Daniil, et autres
Publié: (2025)
par: Moskovskiy, Daniil, et autres
Publié: (2025)
Tracing Persona Vectors Through LLM Pretraining
par: Moskvoretskii, Viktor, et autres
Publié: (2026)
par: Moskvoretskii, Viktor, et autres
Publié: (2026)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
par: Fadeeva, Ekaterina, et autres
Publié: (2024)
par: Fadeeva, Ekaterina, et autres
Publié: (2024)
Facilitating large language model Russian adaptation with Learned Embedding Propagation
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
par: Tikhomirov, Mikhail, et autres
Publié: (2024)
Evaluating Uncertainty Quantification Methods in Argumentative Large Language Models
par: Zhou, Kevin, et autres
Publié: (2025)
par: Zhou, Kevin, et autres
Publié: (2025)
SparseGrad: A Selective Method for Efficient Fine-tuning of MLP Layers
par: Chekalina, Viktoriia, et autres
Publié: (2024)
par: Chekalina, Viktoriia, et autres
Publié: (2024)
MultiParaDetox: Extending Text Detoxification with Parallel Data to New Languages
par: Dementieva, Daryna, et autres
Publié: (2024)
par: Dementieva, Daryna, et autres
Publié: (2024)
S3: A Simple Strong Sample-effective Multimodal Dialog System
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
TaxoLLaMA: WordNet-based Model for Solving Multiple Lexical Semantic Tasks
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
par: Moskvoretskii, Viktor, et autres
Publié: (2024)
Agentic Uncertainty Quantification
par: Zhang, Jiaxin, et autres
Publié: (2026)
par: Zhang, Jiaxin, et autres
Publié: (2026)
RuCCoD: Towards Automated ICD Coding in Russian
par: Nesterov, Aleksandr, et autres
Publié: (2025)
par: Nesterov, Aleksandr, et autres
Publié: (2025)
Anatomy of Unlearning: The Dual Impact of Fact Salience and Model Fine-Tuning
par: Borisiuk, Anna, et autres
Publié: (2026)
par: Borisiuk, Anna, et autres
Publié: (2026)
Emergent Misalignment via In-Context Learning: Narrow in-context examples can produce broadly misaligned LLMs
par: Afonin, Nikita, et autres
Publié: (2025)
par: Afonin, Nikita, et autres
Publié: (2025)
Combining Confidence Elicitation and Sample-based Methods for Uncertainty Quantification in Misinformation Mitigation
par: Rivera, Mauricio, et autres
Publié: (2024)
par: Rivera, Mauricio, et autres
Publié: (2024)
MAQA: Evaluating Uncertainty Quantification in LLMs Regarding Data Uncertainty
par: Yang, Yongjin, et autres
Publié: (2024)
par: Yang, Yongjin, et autres
Publié: (2024)
BALI: Enhancing Biomedical Language Representations through Knowledge Graph and Language Model Alignment
par: Sakhovskiy, Andrey, et autres
Publié: (2025)
par: Sakhovskiy, Andrey, et autres
Publié: (2025)
CSS: Contrastive Semantic Similarity for Uncertainty Quantification of LLMs
par: Ao, Shuang, et autres
Publié: (2024)
par: Ao, Shuang, et autres
Publié: (2024)
Adaptive Retrieval Without Self-Knowledge? Bringing Uncertainty Back Home
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
SPUQ: Perturbation-Based Uncertainty Quantification for Large Language Models
par: Gao, Xiang, et autres
Publié: (2024)
par: Gao, Xiang, et autres
Publié: (2024)
Uncertainty-Based Methods for Automated Process Reward Data Construction and Output Aggregation in Mathematical Reasoning
par: Han, Jiuzhou, et autres
Publié: (2025)
par: Han, Jiuzhou, et autres
Publié: (2025)
Semantic Consistency-Based Uncertainty Quantification for Factuality in Radiology Report Generation
par: Wang, Chenyu, et autres
Publié: (2024)
par: Wang, Chenyu, et autres
Publié: (2024)
Uncertainty Quantification of Large Language Models through Multi-Dimensional Responses
par: Chen, Tiejin, et autres
Publié: (2025)
par: Chen, Tiejin, et autres
Publié: (2025)
Uncertainty Quantification in Large Language Models Through Convex Hull Analysis
par: Catak, Ferhat Ozgur, et autres
Publié: (2024)
par: Catak, Ferhat Ozgur, et autres
Publié: (2024)
Do I look like a `cat.n.01` to you? A Taxonomy Image Generation Benchmark
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
par: Moskvoretskii, Viktor, et autres
Publié: (2025)
SmurfCat at SemEval-2024 Task 6: Leveraging Synthetic Data for Hallucination Detection
par: Rykov, Elisei, et autres
Publié: (2024)
par: Rykov, Elisei, et autres
Publié: (2024)
Kernel Language Entropy: Fine-grained Uncertainty Quantification for LLMs from Semantic Similarities
par: Nikitin, Alexander, et autres
Publié: (2024)
par: Nikitin, Alexander, et autres
Publié: (2024)
Mind the Ambiguity: Aleatoric Uncertainty Quantification in LLMs for Safe Medical Question Answering
par: Liu, Yaokun, et autres
Publié: (2026)
par: Liu, Yaokun, et autres
Publié: (2026)
SIMBA UQ: Similarity-Based Aggregation for Uncertainty Quantification in Large Language Models
par: Bhattacharjya, Debarun, et autres
Publié: (2025)
par: Bhattacharjya, Debarun, et autres
Publié: (2025)
Optimizing Instruction Synthesis: Effective Exploration of Evolutionary Space with Tree Search
par: Li, Chenglin, et autres
Publié: (2024)
par: Li, Chenglin, et autres
Publié: (2024)
Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
par: Wu, Peilin, et autres
Publié: (2025)
par: Wu, Peilin, et autres
Publié: (2025)
Calibrating Uncertainty Quantification of Multi-Modal LLMs using Grounding
par: Padhi, Trilok, et autres
Publié: (2025)
par: Padhi, Trilok, et autres
Publié: (2025)
Documents similaires
-
When Punctuation Matters: A Large-Scale Comparison of Prompt Robustness Methods for LLMs
par: Seleznyov, Mikhail, et autres
Publié: (2025) -
Breaking the Chain: A Causal Analysis of LLM Faithfulness to Intermediate Structures
par: Somov, Oleg, et autres
Publié: (2026) -
Leveraging LLM Parametric Knowledge for Fact Checking without Retrieval
par: Vazhentsev, Artem, et autres
Publié: (2026) -
Confidence Estimation for Error Detection in Text-to-SQL Systems
par: Somov, Oleg, et autres
Publié: (2025) -
The benefits of query-based KGQA systems for complex and temporal questions in LLM era
par: Alekseev, Artem, et autres
Publié: (2025)