Consistency Checks for Language Model Forecasters
Fuente:
arXiv
Salvato in:
| Autori principali: | Paleka, Daniel, Sudhir, Abhimanyu Pallavi, Alvarez, Alejandro, Bhat, Vineeth, Shen, Adam, Wang, Evan, Tramèr, Florian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pitfalls in Evaluating Language Model Forecasters
di: Paleka, Daniel, et al.
Pubblicazione: (2025)
di: Paleka, Daniel, et al.
Pubblicazione: (2025)
Large-scale online deanonymization with LLMs
di: Lermen, Simon, et al.
Pubblicazione: (2026)
di: Lermen, Simon, et al.
Pubblicazione: (2026)
Refusal in Language Models Is Mediated by a Single Direction
di: Arditi, Andy, et al.
Pubblicazione: (2024)
di: Arditi, Andy, et al.
Pubblicazione: (2024)
Universal Jailbreak Backdoors from Poisoned Human Feedback
di: Rando, Javier, et al.
Pubblicazione: (2023)
di: Rando, Javier, et al.
Pubblicazione: (2023)
Beyond Mimicry to Contextual Guidance: Knowledge Distillation for Interactive AI
di: Wang, Tong, et al.
Pubblicazione: (2024)
di: Wang, Tong, et al.
Pubblicazione: (2024)
In-Context Fine-Tuning for Time-Series Foundation Models
di: Das, Abhimanyu, et al.
Pubblicazione: (2024)
di: Das, Abhimanyu, et al.
Pubblicazione: (2024)
Query-Based Adversarial Prompt Generation
di: Hayase, Jonathan, et al.
Pubblicazione: (2024)
di: Hayase, Jonathan, et al.
Pubblicazione: (2024)
Large Language Models for Medical Forecasting -- Foresight 2
di: Kraljevic, Zeljko, et al.
Pubblicazione: (2024)
di: Kraljevic, Zeljko, et al.
Pubblicazione: (2024)
Consistency Is the Key: Detecting Hallucinations in LLM Generated Text By Checking Inconsistencies About Key Facts
di: Gupta, Raavi, et al.
Pubblicazione: (2025)
di: Gupta, Raavi, et al.
Pubblicazione: (2025)
Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts
di: Sharma, Kartik, et al.
Pubblicazione: (2025)
di: Sharma, Kartik, et al.
Pubblicazione: (2025)
Soft Self-Consistency Improves Language Model Agents
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
Uncovering Deceptive Tendencies in Language Models: A Simulated Company AI Assistant
di: Järviniemi, Olli, et al.
Pubblicazione: (2024)
di: Järviniemi, Olli, et al.
Pubblicazione: (2024)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
di: Rahman, Subhey Sadi, et al.
Pubblicazione: (2025)
di: Rahman, Subhey Sadi, et al.
Pubblicazione: (2025)
Fact-Checking the Output of Large Language Models via Token-Level Uncertainty Quantification
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
di: Fadeeva, Ekaterina, et al.
Pubblicazione: (2024)
An Adversarial Perspective on Machine Unlearning for AI Safety
di: Łucki, Jakub, et al.
Pubblicazione: (2024)
di: Łucki, Jakub, et al.
Pubblicazione: (2024)
Knowledge-based Consistency Testing of Large Language Models
di: Rajan, Sai Sathiesh, et al.
Pubblicazione: (2024)
di: Rajan, Sai Sathiesh, et al.
Pubblicazione: (2024)
The Consistency Hypothesis in Uncertainty Quantification for Large Language Models
di: Xiao, Quan, et al.
Pubblicazione: (2025)
di: Xiao, Quan, et al.
Pubblicazione: (2025)
Learning to Inject: Automated Prompt Injection via Reinforcement Learning
di: Chen, Xin, et al.
Pubblicazione: (2026)
di: Chen, Xin, et al.
Pubblicazione: (2026)
ConsistentEE: A Consistent and Hardness-Guided Early Exiting Method for Accelerating Language Models Inference
di: Zeng, Ziqian, et al.
Pubblicazione: (2023)
di: Zeng, Ziqian, et al.
Pubblicazione: (2023)
Probing Persona-Dependent Preferences in Language Models
di: Gilg, Oscar, et al.
Pubblicazione: (2026)
di: Gilg, Oscar, et al.
Pubblicazione: (2026)
Logically Consistent Language Models via Neuro-Symbolic Integration
di: Calanzone, Diego, et al.
Pubblicazione: (2024)
di: Calanzone, Diego, et al.
Pubblicazione: (2024)
Stepwise Self-Consistent Mathematical Reasoning with Large Language Models
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
di: Zhao, Zilong, et al.
Pubblicazione: (2024)
A decoder-only foundation model for time-series forecasting
di: Das, Abhimanyu, et al.
Pubblicazione: (2023)
di: Das, Abhimanyu, et al.
Pubblicazione: (2023)
Towards Consistent Natural-Language Explanations via Explanation-Consistency Finetuning
di: Chen, Yanda, et al.
Pubblicazione: (2024)
di: Chen, Yanda, et al.
Pubblicazione: (2024)
ConsistRM: Improving Generative Reward Models via Consistency-Aware Self-Training
di: Liang, Yu, et al.
Pubblicazione: (2026)
di: Liang, Yu, et al.
Pubblicazione: (2026)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
di: Szep, Marton, et al.
Pubblicazione: (2024)
di: Szep, Marton, et al.
Pubblicazione: (2024)
Competition Report: Finding Universal Jailbreak Backdoors in Aligned LLMs
di: Rando, Javier, et al.
Pubblicazione: (2024)
di: Rando, Javier, et al.
Pubblicazione: (2024)
Reward Models Identify Consistency, Not Causality
di: Xu, Yuhui, et al.
Pubblicazione: (2025)
di: Xu, Yuhui, et al.
Pubblicazione: (2025)
RePST: Language Model Empowered Spatio-Temporal Forecasting via Semantic-Oriented Reprogramming
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
A Data-Centric Approach To Generate Faithful and High Quality Patient Summaries with Large Language Models
di: Hegselmann, Stefan, et al.
Pubblicazione: (2024)
di: Hegselmann, Stefan, et al.
Pubblicazione: (2024)
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
CROW: Eliminating Backdoors from Large Language Models via Internal Consistency Regularization
di: Min, Nay Myat, et al.
Pubblicazione: (2024)
di: Min, Nay Myat, et al.
Pubblicazione: (2024)
Integrating Arithmetic Learning Improves Mathematical Reasoning in Smaller Models
di: Gangwar, Neeraj, et al.
Pubblicazione: (2025)
di: Gangwar, Neeraj, et al.
Pubblicazione: (2025)
STELLA: Guiding Large Language Models for Time Series Forecasting with Semantic Abstractions
di: Fan, Junjie, et al.
Pubblicazione: (2025)
di: Fan, Junjie, et al.
Pubblicazione: (2025)
GenTKG: Generative Forecasting on Temporal Knowledge Graph with Large Language Models
di: Liao, Ruotong, et al.
Pubblicazione: (2023)
di: Liao, Ruotong, et al.
Pubblicazione: (2023)
Teaching Language Models to Forecast Research Success Through Comparative Idea Evaluation
di: Mule, Srujan P, et al.
Pubblicazione: (2026)
di: Mule, Srujan P, et al.
Pubblicazione: (2026)
Reactive Transformer (RxT) -- Stateful Real-Time Processing for Event-Driven Reactive Language Models
di: Filipek, Adam
Pubblicazione: (2025)
di: Filipek, Adam
Pubblicazione: (2025)
Robust Probabilistic Model Checking with Continuous Reward Domains
di: Ji, Xiaotong, et al.
Pubblicazione: (2025)
di: Ji, Xiaotong, et al.
Pubblicazione: (2025)
GLaMoR: Consistency Checking of OWL Ontologies using Graph Language Models
di: Mücke, Justin, et al.
Pubblicazione: (2025)
di: Mücke, Justin, et al.
Pubblicazione: (2025)
RevOrder: A Novel Method for Enhanced Arithmetic in Language Models
di: Shen, Si, et al.
Pubblicazione: (2024)
di: Shen, Si, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Pitfalls in Evaluating Language Model Forecasters
di: Paleka, Daniel, et al.
Pubblicazione: (2025) -
Large-scale online deanonymization with LLMs
di: Lermen, Simon, et al.
Pubblicazione: (2026) -
Refusal in Language Models Is Mediated by a Single Direction
di: Arditi, Andy, et al.
Pubblicazione: (2024) -
Universal Jailbreak Backdoors from Poisoned Human Feedback
di: Rando, Javier, et al.
Pubblicazione: (2023) -
Beyond Mimicry to Contextual Guidance: Knowledge Distillation for Interactive AI
di: Wang, Tong, et al.
Pubblicazione: (2024)