Test-time Verification via Optimal Transport: Coverage, ROC, & Sub-optimality
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mukherjee, Arpan, Bullo, Marcello, Basu, Debabrota, Gündüz, Deniz |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences
par: Mukherjee, Arpan, et autres
Publié: (2025)
par: Mukherjee, Arpan, et autres
Publié: (2025)
Sustainable Edge Intelligence Through Energy-Aware Early Exiting
par: Bullo, Marcello, et autres
Publié: (2023)
par: Bullo, Marcello, et autres
Publié: (2023)
Energy-Aware Dynamic Neural Inference
par: Bullo, Marcello, et autres
Publié: (2024)
par: Bullo, Marcello, et autres
Publié: (2024)
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
par: Basu, Debabrota, et autres
Publié: (2025)
par: Basu, Debabrota, et autres
Publié: (2025)
Learning to Explore with Lagrangians for Bandits under Unknown Linear Constraints
par: Das, Udvas, et autres
Publié: (2024)
par: Das, Udvas, et autres
Publié: (2024)
Auditing Fairness under Model Updates: Fundamental Complexity and Property-Preserving Updates
par: Ajarra, Ayoub, et autres
Publié: (2026)
par: Ajarra, Ayoub, et autres
Publié: (2026)
The Fair Game: Auditing & Debiasing AI Algorithms Over Time
par: Basu, Debabrota, et autres
Publié: (2025)
par: Basu, Debabrota, et autres
Publié: (2025)
Active Fourier Auditor for Estimating Distributional Properties of ML Models
par: Ajarra, Ayoub, et autres
Publié: (2024)
par: Ajarra, Ayoub, et autres
Publié: (2024)
FraPPE: Fast and Efficient Preference-based Pure Exploration
par: Das, Udvas, et autres
Publié: (2025)
par: Das, Udvas, et autres
Publié: (2025)
Remote Action Generation: Remote Control with Minimal Communication
par: Kobus, Szymon, et autres
Publié: (2026)
par: Kobus, Szymon, et autres
Publié: (2026)
Inverse Reinforcement Learning with Sub-optimal Experts
par: Poiani, Riccardo, et autres
Publié: (2024)
par: Poiani, Riccardo, et autres
Publié: (2024)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
par: Mukherjee, Arpan, et autres
Publié: (2024)
par: Mukherjee, Arpan, et autres
Publié: (2024)
DOT: Dynamic Knob Selection and Online Sampling for Automated Database Tuning
par: Wang, Yifan, et autres
Publié: (2026)
par: Wang, Yifan, et autres
Publié: (2026)
Efficient line search for optimizing Area Under the ROC Curve in gradient descent
par: Fowler, Jadon, et autres
Publié: (2024)
par: Fowler, Jadon, et autres
Publié: (2024)
Agentic AI-based Coverage Closure for Formal Verification
par: Pothireddypalli, Sivaram, et autres
Publié: (2026)
par: Pothireddypalli, Sivaram, et autres
Publié: (2026)
CLOVER: A Test Case Generation Benchmark with Coverage, Long-Context, and Verification
par: Xu, Jiacheng, et autres
Publié: (2025)
par: Xu, Jiacheng, et autres
Publié: (2025)
Learned Digital Codes for Over-the-Air Computation in Federated Edge Learning
par: Tarizzo, Antonio, et autres
Publié: (2025)
par: Tarizzo, Antonio, et autres
Publié: (2025)
Multi-hop Deep Joint Source-Channel Coding with Deep Hash Distillation for Semantically Aligned Image Recovery
par: Bergström, Didrik, et autres
Publié: (2025)
par: Bergström, Didrik, et autres
Publié: (2025)
Private Collaborative Edge Inference via Over-the-Air Computation
par: Yilmaz, Selim F., et autres
Publié: (2024)
par: Yilmaz, Selim F., et autres
Publié: (2024)
Budget-aware Test-time Scaling via Discriminative Verification
par: Montgomery, Kyle, et autres
Publié: (2025)
par: Montgomery, Kyle, et autres
Publié: (2025)
Rethinking Optimal Verification Granularity for Compute-Efficient Test-Time Scaling
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
SubFLOT: Submodel Extraction for Efficient and Personalized Federated Learning via Optimal Transport
par: Jiang, Zheng, et autres
Publié: (2026)
par: Jiang, Zheng, et autres
Publié: (2026)
Learning to Interfere in Non-Orthogonal Multiple-Access Joint Source-Channel Coding
par: Yilmaz, Selim F., et autres
Publié: (2025)
par: Yilmaz, Selim F., et autres
Publié: (2025)
Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification
par: Wan, Yuxuan, et autres
Publié: (2026)
par: Wan, Yuxuan, et autres
Publié: (2026)
Predicting Blood Type: Assessing Model Performance with ROC Analysis
par: Altayar, Malik A., et autres
Publié: (2025)
par: Altayar, Malik A., et autres
Publié: (2025)
Trust but Verify! A Survey on Verification Design for Test-time Scaling
par: Venktesh, V, et autres
Publié: (2025)
par: Venktesh, V, et autres
Publié: (2025)
Counterfactual Identifiability via Dynamic Optimal Transport
par: Ribeiro, Fabio De Sousa, et autres
Publié: (2025)
par: Ribeiro, Fabio De Sousa, et autres
Publié: (2025)
Byzantines can also Learn from History: Fall of Centered Clipping in Federated Learning
par: Ozfatura, Kerem, et autres
Publié: (2022)
par: Ozfatura, Kerem, et autres
Publié: (2022)
Efficient Computation of Blackwell Optimal Policies using Rational Functions
par: Mukherjee, Dibyangshu, et autres
Publié: (2025)
par: Mukherjee, Dibyangshu, et autres
Publié: (2025)
Optimizing Decomposition for Optimal Claim Verification
par: Lu, Yining, et autres
Publié: (2025)
par: Lu, Yining, et autres
Publié: (2025)
Compact Optimality Verification for Optimization Proxies
par: Chen, Wenbo, et autres
Publié: (2024)
par: Chen, Wenbo, et autres
Publié: (2024)
T1: Tool-integrated Verification for Test-time Compute Scaling in Small Language Models
par: Kang, Minki, et autres
Publié: (2025)
par: Kang, Minki, et autres
Publié: (2025)
Optimizing Coverage-Driven Verification Using Machine Learning and PyUVM: A Novel Approach
par: Kumari, Suruchi, et autres
Publié: (2025)
par: Kumari, Suruchi, et autres
Publié: (2025)
On the Effectiveness of LLMs for Manual Test Verifications
par: Peixoto, Myron David Lucena Campos, et autres
Publié: (2024)
par: Peixoto, Myron David Lucena Campos, et autres
Publié: (2024)
interwhen: A Generalizable Framework for Steering Reasoning Models with Test-time Verification
par: Bhat, Vishak K, et autres
Publié: (2026)
par: Bhat, Vishak K, et autres
Publié: (2026)
Do I Really Know? Learning Factual Self-Verification for Hallucination Reduction
par: Altinisik, Enes, et autres
Publié: (2026)
par: Altinisik, Enes, et autres
Publié: (2026)
Computing Approximate Graph Edit Distance via Optimal Transport
par: Cheng, Qihao, et autres
Publié: (2024)
par: Cheng, Qihao, et autres
Publié: (2024)
Supervised Distributional Reduction via Optimal Transport and Dependence Maximization
par: Ramesh, Sai-Aakash, et autres
Publié: (2026)
par: Ramesh, Sai-Aakash, et autres
Publié: (2026)
Cross-Domain Imitation Learning via Optimal Transport
par: Fickinger, Arnaud, et autres
Publié: (2021)
par: Fickinger, Arnaud, et autres
Publié: (2021)
SubTokenTest: A Practical Benchmark for Real-World Sub-token Understanding
par: Hou, Shuyang, et autres
Publié: (2026)
par: Hou, Shuyang, et autres
Publié: (2026)
Documents similaires
-
SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences
par: Mukherjee, Arpan, et autres
Publié: (2025) -
Sustainable Edge Intelligence Through Energy-Aware Early Exiting
par: Bullo, Marcello, et autres
Publié: (2023) -
Energy-Aware Dynamic Neural Inference
par: Bullo, Marcello, et autres
Publié: (2024) -
Performative Policy Gradient: Optimality in Performative Reinforcement Learning
par: Basu, Debabrota, et autres
Publié: (2025) -
Learning to Explore with Lagrangians for Bandits under Unknown Linear Constraints
par: Das, Udvas, et autres
Publié: (2024)