A Theoretical Framework for Adaptive Utility-Weighted Benchmarking
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Waggoner, Philip |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Taxonomy of Omnicidal Futures Involving Artificial Intelligence
par: Critch, Andrew, et autres
Publié: (2025)
par: Critch, Andrew, et autres
Publié: (2025)
Feature Relevancy, Necessity and Usefulness: Complexity and Algorithms
par: Capdevielle, Tomás, et autres
Publié: (2025)
par: Capdevielle, Tomás, et autres
Publié: (2025)
From Language Models to Practical Self-Improving Computer Agents
par: Sheng, Alex
Publié: (2024)
par: Sheng, Alex
Publié: (2024)
Intelligence as Computation
par: Brock, Oliver
Publié: (2024)
par: Brock, Oliver
Publié: (2024)
Quantifying Behavioral Dissimilarity Between Mathematical Expressions
par: Mežnar, Sebastian, et autres
Publié: (2024)
par: Mežnar, Sebastian, et autres
Publié: (2024)
Charting the Future of Scholarly Knowledge with AI: A Community Perspective
par: Jiomekong, Azanzi, et autres
Publié: (2025)
par: Jiomekong, Azanzi, et autres
Publié: (2025)
On the Invariants of Softmax Attention
par: Lee, Wonsuk
Publié: (2026)
par: Lee, Wonsuk
Publié: (2026)
Return of the Schema: Building Complete Datasets for Machine Learning and Reasoning on Knowledge Graphs
par: Diliso, Ivan, et autres
Publié: (2026)
par: Diliso, Ivan, et autres
Publié: (2026)
ATEX-CF: Attack-Informed Counterfactual Explanations for Graph Neural Networks
par: Zhang, Yu, et autres
Publié: (2026)
par: Zhang, Yu, et autres
Publié: (2026)
Attack Selection Reduces Safety in Concentrated AI Control Settings against Trusted Monitoring
par: Schaeffer, Joachim, et autres
Publié: (2026)
par: Schaeffer, Joachim, et autres
Publié: (2026)
Compressible Softmax-Attended Language under Incompressible Attention
par: Lee, Wonsuk
Publié: (2026)
par: Lee, Wonsuk
Publié: (2026)
Instilling Organisational Values in Firefighters through Simulation-Based Training
par: Osman, Nardine, et autres
Publié: (2025)
par: Osman, Nardine, et autres
Publié: (2025)
Value-Aware Multiagent Systems
par: Osman, Nardine
Publié: (2025)
par: Osman, Nardine
Publié: (2025)
Dynamic Observation Policies in Observation Cost-Sensitive Reinforcement Learning
par: Bellinger, Colin, et autres
Publié: (2023)
par: Bellinger, Colin, et autres
Publié: (2023)
Heckerthoughts
par: Heckerman, David
Publié: (2023)
par: Heckerman, David
Publié: (2023)
Achieving Distributive Justice in Federated Learning via Uncertainty Quantification
par: Carey, Alycia, et autres
Publié: (2025)
par: Carey, Alycia, et autres
Publié: (2025)
On Privacy Leakage in Tabular Diffusion Models: Influential Factors, Attacker Knowledge, and Metrics
par: Shafieinejad, Masoumeh, et autres
Publié: (2026)
par: Shafieinejad, Masoumeh, et autres
Publié: (2026)
Combination of Weak Learners eXplanations to Improve Random Forest eXplicability Robustness
par: Pala, Riccardo, et autres
Publié: (2024)
par: Pala, Riccardo, et autres
Publié: (2024)
Ideological Isolation in Online Social Networks: A Survey of Computational Definitions, Metrics, and Mitigation Strategies
par: Wang, Xiaodan, et autres
Publié: (2026)
par: Wang, Xiaodan, et autres
Publié: (2026)
Vibe-Creation: The Epistemology of Human-AI Emergent Cognition
par: Levin, Ilya
Publié: (2026)
par: Levin, Ilya
Publié: (2026)
An Automatic Text Classification Method Based on Hierarchical Taxonomies, Neural Networks and Document Embedding: The NETHIC Tool
par: Lomasto, Luigi, et autres
Publié: (2026)
par: Lomasto, Luigi, et autres
Publié: (2026)
A computational framework for human values
par: Osman, Nardine, et autres
Publié: (2023)
par: Osman, Nardine, et autres
Publié: (2023)
Taxonomy to Regulation: A (Geo)Political Taxonomy for AI Risks and Regulatory Measures in the EU AI Act
par: Arda, Sinan
Publié: (2024)
par: Arda, Sinan
Publié: (2024)
VACoDe: Visual Augmented Contrastive Decoding
par: Kim, Sihyeon, et autres
Publié: (2024)
par: Kim, Sihyeon, et autres
Publié: (2024)
SHARP: Social Harm Analysis via Risk Profiles for Measuring Inequities in Large Language Models
par: Abhishek, Alok, et autres
Publié: (2026)
par: Abhishek, Alok, et autres
Publié: (2026)
Reasoning Promotes Robustness in Theory of Mind Tasks
par: de Haan, Ian B., et autres
Publié: (2026)
par: de Haan, Ian B., et autres
Publié: (2026)
Data and AI governance: Promoting equity, ethics, and fairness in large language models
par: Abhishek, Alok, et autres
Publié: (2025)
par: Abhishek, Alok, et autres
Publié: (2025)
BEATS: Bias Evaluation and Assessment Test Suite for Large Language Models
par: Abhishek, Alok, et autres
Publié: (2025)
par: Abhishek, Alok, et autres
Publié: (2025)
A Mixed User-Centered Approach to Enable Augmented Intelligence in Intelligent Tutoring Systems: The Case of MathAIde app
par: Guerino, Guilherme, et autres
Publié: (2025)
par: Guerino, Guilherme, et autres
Publié: (2025)
Proceedings of the 20th International Conference on Knowledge, Information and Creativity Support Systems (KICSS 2025)
par: Hayama, Edited by Tessai, et autres
Publié: (2025)
par: Hayama, Edited by Tessai, et autres
Publié: (2025)
March Madness Tournament Predictions Model: A Mathematical Modeling Approach
par: McIver, Christian, et autres
Publié: (2025)
par: McIver, Christian, et autres
Publié: (2025)
A Modular Cognitive Architecture for Assisted Reasoning: The Nemosine Framework
par: Melo, Edervaldo
Publié: (2025)
par: Melo, Edervaldo
Publié: (2025)
Synthetic emotions and consciousness: exploring architectural boundaries
par: Borotschnig, Hermann
Publié: (2025)
par: Borotschnig, Hermann
Publié: (2025)
Interpretability Guarantees with Merlin-Arthur Classifiers
par: Wäldchen, Stephan, et autres
Publié: (2022)
par: Wäldchen, Stephan, et autres
Publié: (2022)
Report of the 2025 Workshop on Next-Generation Ecosystems for Scientific Computing: Harnessing Community, Software, and AI for Cross-Disciplinary Team Science
par: McInnes, Lois Curfman, et autres
Publié: (2025)
par: McInnes, Lois Curfman, et autres
Publié: (2025)
Unlocking the Potential of Metaverse in Innovative and Immersive Digital Health
par: Ebrahimzadeh, Fatemeh, et autres
Publié: (2024)
par: Ebrahimzadeh, Fatemeh, et autres
Publié: (2024)
Evaluating the Application of SOLID Principles in Modern AI Framework Architectures
par: Shrestha, Jonesh
Publié: (2025)
par: Shrestha, Jonesh
Publié: (2025)
ECG-FM: An Open Electrocardiogram Foundation Model
par: McKeen, Kaden, et autres
Publié: (2024)
par: McKeen, Kaden, et autres
Publié: (2024)
Enhancing PyKEEN with Multiple Negative Sampling Solutions for Knowledge Graph Embedding Models
par: d'Amato, Claudia, et autres
Publié: (2025)
par: d'Amato, Claudia, et autres
Publié: (2025)
Understanding Input Selectivity in Mamba: Impact on Approximation Power, Memorization, and Associative Recall Capacity
par: Huang, Ningyuan, et autres
Publié: (2025)
par: Huang, Ningyuan, et autres
Publié: (2025)
Documents similaires
-
A Taxonomy of Omnicidal Futures Involving Artificial Intelligence
par: Critch, Andrew, et autres
Publié: (2025) -
Feature Relevancy, Necessity and Usefulness: Complexity and Algorithms
par: Capdevielle, Tomás, et autres
Publié: (2025) -
From Language Models to Practical Self-Improving Computer Agents
par: Sheng, Alex
Publié: (2024) -
Intelligence as Computation
par: Brock, Oliver
Publié: (2024) -
Quantifying Behavioral Dissimilarity Between Mathematical Expressions
par: Mežnar, Sebastian, et autres
Publié: (2024)