Enregistré dans:
| Auteurs principaux: | Salvy, Nicolas, Talbot, Hugues, Thirion, Bertrand |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.16449 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhanced Generative Model Evaluation with Clipped Density and Coverage
par: Salvy, Nicolas, et autres
Publié: (2025)
par: Salvy, Nicolas, et autres
Publié: (2025)
Riemannian Flow Matching for Brain Connectivity Matrices via Pullback Geometry
par: Collas, Antoine, et autres
Publié: (2025)
par: Collas, Antoine, et autres
Publié: (2025)
A foundation for exact binarized morphological neural networks
par: Aouad, Theodore, et autres
Publié: (2024)
par: Aouad, Theodore, et autres
Publié: (2024)
Adaptive Repetition for Mitigating Position Bias in LLM-Based Ranking
par: Vardasbi, Ali, et autres
Publié: (2025)
par: Vardasbi, Ali, et autres
Publié: (2025)
Performance Prediction of Hub-Based Swarms
par: Jain, Puneet, et autres
Publié: (2024)
par: Jain, Puneet, et autres
Publié: (2024)
Distance-Based Tree-Sliced Wasserstein Distance
par: Tran, Hoang V., et autres
Publié: (2025)
par: Tran, Hoang V., et autres
Publié: (2025)
Logistics Hub Location Optimization: A K-Means and P-Median Model Hybrid Approach Using Road Network Distances
par: Rahman, Muhammad Abdul, et autres
Publié: (2023)
par: Rahman, Muhammad Abdul, et autres
Publié: (2023)
SPD Matrix Learning for Neuroimaging Analysis: Perspectives, Methods, and Challenges
par: Ju, Ce, et autres
Publié: (2025)
par: Ju, Ce, et autres
Publié: (2025)
Predicting Treatment Response in Body Dysmorphic Disorder with Interpretable Machine Learning
par: Costilla-Reyes, Omar, et autres
Publié: (2025)
par: Costilla-Reyes, Omar, et autres
Publié: (2025)
Diffusion-Based, Data-Assimilation-Enabled Super-Resolution of Hub-height Winds
par: Ma, Xiaolong, et autres
Publié: (2025)
par: Ma, Xiaolong, et autres
Publié: (2025)
Generalized Tree Edit Distance (GTED): A Faithful Evaluation Metric for Statement Autoformalization
par: Liu, Yuntian, et autres
Publié: (2025)
par: Liu, Yuntian, et autres
Publié: (2025)
Model-Based Offline Reinforcement Learning with Reliability-Guaranteed Sequence Modeling
par: He, Shenghong
Publié: (2025)
par: He, Shenghong
Publié: (2025)
HEAL: Resilient and Self-* Hub-based Learning
par: Legheraba, Mohamed Amine, et autres
Publié: (2026)
par: Legheraba, Mohamed Amine, et autres
Publié: (2026)
CDRRM: Contrast-Driven Rubric Generation for Reliable and Interpretable Reward Modeling
par: Liu, Dengcan, et autres
Publié: (2026)
par: Liu, Dengcan, et autres
Publié: (2026)
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
par: Kim, Eunsu, et autres
Publié: (2025)
par: Kim, Eunsu, et autres
Publié: (2025)
Soft Prompts for Evaluation: Measuring Conditional Distance of Capabilities
par: Nordby, Ross
Publié: (2025)
par: Nordby, Ross
Publié: (2025)
OptunaHub: A Platform for Black-Box Optimization
par: Ozaki, Yoshihiko, et autres
Publié: (2025)
par: Ozaki, Yoshihiko, et autres
Publié: (2025)
Revisiting the robustness of post-hoc interpretability methods
par: Wei, Jiawen, et autres
Publié: (2024)
par: Wei, Jiawen, et autres
Publié: (2024)
Enhancing Reliability in LLM-Based Secure Code Generation
par: Kharma, Mohammed F., et autres
Publié: (2026)
par: Kharma, Mohammed F., et autres
Publié: (2026)
CARE: Confounder-Aware Aggregation for Reliable LLM Evaluation
par: Zhao, Jitian, et autres
Publié: (2026)
par: Zhao, Jitian, et autres
Publié: (2026)
Mitigating Exposure Bias in Score-Based Generation of Molecular Conformations
par: Wang, Sijia, et autres
Publié: (2024)
par: Wang, Sijia, et autres
Publié: (2024)
Reliable and Efficient Amortized Model-based Evaluation
par: Truong, Sang, et autres
Publié: (2025)
par: Truong, Sang, et autres
Publié: (2025)
Evaluation of post-hoc interpretability methods in time-series classification
par: Turbé, Hugues, et autres
Publié: (2022)
par: Turbé, Hugues, et autres
Publié: (2022)
Understanding and Mitigating Memorization in Generative Models via Sharpness of Probability Landscapes
par: Jeon, Dongjae, et autres
Publié: (2024)
par: Jeon, Dongjae, et autres
Publié: (2024)
Evaluating Large Language Models for Fair and Reliable Organ Allocation
par: Kim, Brian Hyeongseok, et autres
Publié: (2025)
par: Kim, Brian Hyeongseok, et autres
Publié: (2025)
Towards Reliable Evaluation of Adversarial Robustness for Spiking Neural Networks
par: Wang, Jihang, et autres
Publié: (2025)
par: Wang, Jihang, et autres
Publié: (2025)
A Reliable Cryptographic Framework for Empirical Machine Unlearning Evaluation
par: Tu, Yiwen, et autres
Publié: (2024)
par: Tu, Yiwen, et autres
Publié: (2024)
Auxiliary Reward Generation with Transition Distance Representation Learning
par: Li, Siyuan, et autres
Publié: (2024)
par: Li, Siyuan, et autres
Publié: (2024)
Beyond Reasoning Gains: Mitigating General Capabilities Forgetting in Large Reasoning Models
par: Phan, Hoang, et autres
Publié: (2025)
par: Phan, Hoang, et autres
Publié: (2025)
Quantification of Credal Uncertainty: A Distance-Based Approach
par: Gonzalez-Garcia, Xabier, et autres
Publié: (2026)
par: Gonzalez-Garcia, Xabier, et autres
Publié: (2026)
Learn-to-Distance: Distance Learning for Detecting LLM-Generated Text
par: Zhou, Hongyi, et autres
Publié: (2026)
par: Zhou, Hongyi, et autres
Publié: (2026)
Causally Reliable Concept Bottleneck Models
par: De Felice, Giovanni, et autres
Publié: (2025)
par: De Felice, Giovanni, et autres
Publié: (2025)
Breaking the Mirror: Activation-Based Mitigation of Self-Preference in LLM Evaluators
par: Roytburg, Dani, et autres
Publié: (2025)
par: Roytburg, Dani, et autres
Publié: (2025)
Embedding Reliability Verification Constraints into Generation Expansion Planning
par: Liu, Peng, et autres
Publié: (2025)
par: Liu, Peng, et autres
Publié: (2025)
Evaluating the Reliability and Fidelity of Automated Judgment Systems of Large Language Models
par: Biskupski, Tom, et autres
Publié: (2026)
par: Biskupski, Tom, et autres
Publié: (2026)
Reliable Evaluation and Benchmarks for Statement Autoformalization
par: Poiroux, Auguste, et autres
Publié: (2024)
par: Poiroux, Auguste, et autres
Publié: (2024)
How to Mitigate Overfitting in Weak-to-strong Generalization?
par: Shi, Junhao, et autres
Publié: (2025)
par: Shi, Junhao, et autres
Publié: (2025)
Revisiting Gradient Staleness: Evaluating Distance Metrics for Asynchronous Federated Learning Aggregation
par: Wilhelm, Patrick, et autres
Publié: (2026)
par: Wilhelm, Patrick, et autres
Publié: (2026)
Utilizing Class Separation Distance for the Evaluation of Corruption Robustness of Machine Learning Classifiers
par: Siedel, Georg, et autres
Publié: (2022)
par: Siedel, Georg, et autres
Publié: (2022)
Interactive Critique-Revision Training for Reliable Structured LLM Generation
par: Yu, Fei Xu, et autres
Publié: (2026)
par: Yu, Fei Xu, et autres
Publié: (2026)
Documents similaires
-
Enhanced Generative Model Evaluation with Clipped Density and Coverage
par: Salvy, Nicolas, et autres
Publié: (2025) -
Riemannian Flow Matching for Brain Connectivity Matrices via Pullback Geometry
par: Collas, Antoine, et autres
Publié: (2025) -
A foundation for exact binarized morphological neural networks
par: Aouad, Theodore, et autres
Publié: (2024) -
Adaptive Repetition for Mitigating Position Bias in LLM-Based Ranking
par: Vardasbi, Ali, et autres
Publié: (2025) -
Performance Prediction of Hub-Based Swarms
par: Jain, Puneet, et autres
Publié: (2024)