Stratified Prediction-Powered Inference for Hybrid Language Model Evaluation
Fuente:
arXiv
Salvato in:
| Autori principali: | Fisch, Adam, Maynez, Joshua, Hofer, R. Alex, Dhingra, Bhuwan, Globerson, Amir, Cohen, William W. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bayesian Prediction-Powered Inference
di: Hofer, R. Alex, et al.
Pubblicazione: (2024)
di: Hofer, R. Alex, et al.
Pubblicazione: (2024)
Multiple-Prediction-Powered Inference
di: Cowen-Breen, Charlie, et al.
Pubblicazione: (2026)
di: Cowen-Breen, Charlie, et al.
Pubblicazione: (2026)
Vision2Code: A Multi-Domain Benchmark for Evaluating Image-to-Code Generation
di: Periasami, Ajay Vikram, et al.
Pubblicazione: (2026)
di: Periasami, Ajay Vikram, et al.
Pubblicazione: (2026)
RVPO: Risk-Sensitive Alignment via Variance Regularization
di: Montero, Ivan, et al.
Pubblicazione: (2026)
di: Montero, Ivan, et al.
Pubblicazione: (2026)
Calibrating Long-form Generations from Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2024)
di: Huang, Yukun, et al.
Pubblicazione: (2024)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2025)
di: Huang, Yukun, et al.
Pubblicazione: (2025)
Hierarchical Multi-Label Classification of Online Vaccine Concerns
di: Zhu, Chloe Qinyu, et al.
Pubblicazione: (2024)
di: Zhu, Chloe Qinyu, et al.
Pubblicazione: (2024)
Fast Inference via Hierarchical Speculative Decoding
di: Mohri, Clara, et al.
Pubblicazione: (2025)
di: Mohri, Clara, et al.
Pubblicazione: (2025)
Over-Searching in Search-Augmented Large Language Models
di: Xie, Roy, et al.
Pubblicazione: (2026)
di: Xie, Roy, et al.
Pubblicazione: (2026)
A Platform for Investigating Public Health Content with Efficient Concern Classification
di: Li, Christopher, et al.
Pubblicazione: (2025)
di: Li, Christopher, et al.
Pubblicazione: (2025)
InData: Towards Secure Multi-Step, Tool-Based Data Analysis
di: K, Karthikeyan, et al.
Pubblicazione: (2025)
di: K, Karthikeyan, et al.
Pubblicazione: (2025)
On the Optimization Landscape of Maximum Mean Discrepancy
di: Alon, Itai, et al.
Pubblicazione: (2021)
di: Alon, Itai, et al.
Pubblicazione: (2021)
ReCaLL: Membership Inference via Relative Conditional Log-Likelihoods
di: Xie, Roy, et al.
Pubblicazione: (2024)
di: Xie, Roy, et al.
Pubblicazione: (2024)
Provable Benefits of Complex Parameterizations for Structured State Space Models
di: Ran-Milo, Yuval, et al.
Pubblicazione: (2024)
di: Ran-Milo, Yuval, et al.
Pubblicazione: (2024)
When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training
di: Chen, Sanxing, et al.
Pubblicazione: (2025)
di: Chen, Sanxing, et al.
Pubblicazione: (2025)
Cost-Optimal Active AI Model Evaluation
di: Angelopoulos, Anastasios N., et al.
Pubblicazione: (2025)
di: Angelopoulos, Anastasios N., et al.
Pubblicazione: (2025)
Implicit Bias of Policy Gradient in Linear Quadratic Control: Extrapolation to Unseen Initial States
di: Razin, Noam, et al.
Pubblicazione: (2024)
di: Razin, Noam, et al.
Pubblicazione: (2024)
The Interpretable and Effective Graph Neural Additive Networks
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2024)
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2024)
TREE-G: Decision Trees Contesting Graph Neural Networks
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2022)
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2022)
Conformal Language Modeling
di: Quach, Victor, et al.
Pubblicazione: (2023)
di: Quach, Victor, et al.
Pubblicazione: (2023)
GenEOL: Harnessing the Generative Power of LLMs for Training-Free Sentence Embeddings
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2024)
di: Thirukovalluru, Raghuveer, et al.
Pubblicazione: (2024)
Block Transformer: Global-to-Local Language Modeling for Fast Inference
di: Ho, Namgyu, et al.
Pubblicazione: (2024)
di: Ho, Namgyu, et al.
Pubblicazione: (2024)
Calibrated Selective Classification
di: Fisch, Adam, et al.
Pubblicazione: (2022)
di: Fisch, Adam, et al.
Pubblicazione: (2022)
Cost-Aware Learning
di: Mohri, Clara, et al.
Pubblicazione: (2026)
di: Mohri, Clara, et al.
Pubblicazione: (2026)
Scratchpad Patching: Decoupling Compute from Patch Size in Byte-Level Language Models
di: Zheng, Lin, et al.
Pubblicazione: (2026)
di: Zheng, Lin, et al.
Pubblicazione: (2026)
Generalized Prediction-Powered Inference, with Application to Binary Classifier Evaluation
di: Zou, Runjia, et al.
Pubblicazione: (2026)
di: Zou, Runjia, et al.
Pubblicazione: (2026)
Demystifying Prediction Powered Inference
di: Song, Yilin, et al.
Pubblicazione: (2026)
di: Song, Yilin, et al.
Pubblicazione: (2026)
Synthetic-Powered Predictive Inference
di: Bashari, Meshi, et al.
Pubblicazione: (2025)
di: Bashari, Meshi, et al.
Pubblicazione: (2025)
Prediction-Powered Causal Inferences
di: Cadei, Riccardo, et al.
Pubblicazione: (2025)
di: Cadei, Riccardo, et al.
Pubblicazione: (2025)
Prediction-Powered Conditional Inference
di: Sui, Yang, et al.
Pubblicazione: (2026)
di: Sui, Yang, et al.
Pubblicazione: (2026)
Power Analysis for Prediction-Powered Inference
di: Chen, Yiqun T., et al.
Pubblicazione: (2026)
di: Chen, Yiqun T., et al.
Pubblicazione: (2026)
DeciMamba: Exploring the Length Extrapolation Potential of Mamba
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2024)
di: Ben-Kish, Assaf, et al.
Pubblicazione: (2024)
MT-PingEval: Evaluating Multi-Turn Collaboration with Private Information Games
di: Eisenstein, Jacob, et al.
Pubblicazione: (2026)
di: Eisenstein, Jacob, et al.
Pubblicazione: (2026)
Graph Neural Networks Use Graphs When They Shouldn't
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2023)
di: Bechler-Speicher, Maya, et al.
Pubblicazione: (2023)
Provable Generalization in Overparameterized Neural Nets
di: Dhingra, Aviral
Pubblicazione: (2025)
di: Dhingra, Aviral
Pubblicazione: (2025)
Local Prediction-Powered Inference
di: Gu, Yanwu, et al.
Pubblicazione: (2024)
di: Gu, Yanwu, et al.
Pubblicazione: (2024)
Cross-Prediction-Powered Inference
di: Zrnic, Tijana, et al.
Pubblicazione: (2023)
di: Zrnic, Tijana, et al.
Pubblicazione: (2023)
Rich Insights from Cheap Signals: Efficient Evaluations via Tensor Factorization
di: Polo, Felipe Maia, et al.
Pubblicazione: (2026)
di: Polo, Felipe Maia, et al.
Pubblicazione: (2026)
Prediction-Powered Inference Across Many Tasks for AI Evaluation & Social Science Research
di: Emmenegger, Nicolas, et al.
Pubblicazione: (2026)
di: Emmenegger, Nicolas, et al.
Pubblicazione: (2026)
Nationwide EHR-Based Chronic Rhinosinusitis Prediction Using Demographic-Stratified Models
di: Chang, Sicong, et al.
Pubblicazione: (2026)
di: Chang, Sicong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Bayesian Prediction-Powered Inference
di: Hofer, R. Alex, et al.
Pubblicazione: (2024) -
Multiple-Prediction-Powered Inference
di: Cowen-Breen, Charlie, et al.
Pubblicazione: (2026) -
Vision2Code: A Multi-Domain Benchmark for Evaluating Image-to-Code Generation
di: Periasami, Ajay Vikram, et al.
Pubblicazione: (2026) -
RVPO: Risk-Sensitive Alignment via Variance Regularization
di: Montero, Ivan, et al.
Pubblicazione: (2026) -
Calibrating Long-form Generations from Large Language Models
di: Huang, Yukun, et al.
Pubblicazione: (2024)