Position: AI for Science Should Treat Measurement-to-Dataset Pipelines as Inference Components
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhan, Ling, Yu, Xiaoyao, Jia, Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Pairwise Connections: Extracting High-Order Functional Brain Network Structures under Global Constraints
par: Zhan, Ling, et autres
Publié: (2025)
par: Zhan, Ling, et autres
Publié: (2025)
Accelerating Benchmarking of Functional Connectivity Modeling via Structure-aware Core-set Selection
par: Zhan, Ling, et autres
Publié: (2026)
par: Zhan, Ling, et autres
Publié: (2026)
Automating Data Science Pipelines with Tensor Completion
par: Pakala, Shaan, et autres
Publié: (2024)
par: Pakala, Shaan, et autres
Publié: (2024)
Position: AI Security Policy Should Target Systems, Not Models
par: Riegler, Michael A., et autres
Publié: (2026)
par: Riegler, Michael A., et autres
Publié: (2026)
Position: AI Evaluations Should be Grounded on a Theory of Capability
par: Jo, Nathanael, et autres
Publié: (2025)
par: Jo, Nathanael, et autres
Publié: (2025)
Position: Weight Space Should Be a First-Class Generative AI Modality
par: Wang, Zhangyang, et autres
Publié: (2026)
par: Wang, Zhangyang, et autres
Publié: (2026)
Position: Ideas Should be the Center of Machine Learning Research
par: Diaz-Rodriguez, Jairo
Publié: (2026)
par: Diaz-Rodriguez, Jairo
Publié: (2026)
Watermarking Should Be Treated as a Monitoring Primitive
par: Aremu, Toluwani, et autres
Publié: (2026)
par: Aremu, Toluwani, et autres
Publié: (2026)
Position: Curvature Matrices Should Be Democratized via Linear Operators
par: Dangel, Felix, et autres
Publié: (2025)
par: Dangel, Felix, et autres
Publié: (2025)
Position: Measure Dataset Diversity, Don't Just Claim It
par: Zhao, Dora, et autres
Publié: (2024)
par: Zhao, Dora, et autres
Publié: (2024)
Benchmarked Yet Not Measured -- Generative AI Should be Evaluated Against Real-World Utility
par: Mondal, Ishani, et autres
Publié: (2026)
par: Mondal, Ishani, et autres
Publié: (2026)
IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference
par: Zhong, Wanli, et autres
Publié: (2025)
par: Zhong, Wanli, et autres
Publié: (2025)
SpecPipe: Accelerating Pipeline Parallelism-based LLM Inference with Speculative Decoding
par: Yin, Haofei, et autres
Publié: (2025)
par: Yin, Haofei, et autres
Publié: (2025)
Statistical Testing Framework for Clustering Pipelines by Selective Inference
par: Miyata, Yugo, et autres
Publié: (2026)
par: Miyata, Yugo, et autres
Publié: (2026)
Statistical Test for Feature Selection Pipelines by Selective Inference
par: Shiraishi, Tomohiro, et autres
Publié: (2024)
par: Shiraishi, Tomohiro, et autres
Publié: (2024)
When Should an AI Workflow Release? Always-Valid Inference for Black-Box Generate-Verify Systems
par: Cho, Young Hyun, et autres
Publié: (2026)
par: Cho, Young Hyun, et autres
Publié: (2026)
LLM Benchmark Datasets Should Be Contamination-Resistant
par: Al-Lawati, Ali, et autres
Publié: (2026)
par: Al-Lawati, Ali, et autres
Publié: (2026)
A Multimodal Data Processing Pipeline for MIMIC-IV Dataset
par: Adiba, Farzana Islam, et autres
Publié: (2026)
par: Adiba, Farzana Islam, et autres
Publié: (2026)
Position: Capability Control Should be a Separate Goal From Alignment
par: Siddiqui, Shoaib Ahmed, et autres
Publié: (2026)
par: Siddiqui, Shoaib Ahmed, et autres
Publié: (2026)
Position: Federated Foundation Language Model Post-Training Should Focus on Open-Source Models
par: Agrawal, Nikita, et autres
Publié: (2025)
par: Agrawal, Nikita, et autres
Publié: (2025)
Linear Convergence of Black-Box Variational Inference: Should We Stick the Landing?
par: Kim, Kyurae, et autres
Publié: (2023)
par: Kim, Kyurae, et autres
Publié: (2023)
Prediction-Powered Inference Across Many Tasks for AI Evaluation & Social Science Research
par: Emmenegger, Nicolas, et autres
Publié: (2026)
par: Emmenegger, Nicolas, et autres
Publié: (2026)
Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline
par: Fang, Zhiyuan, et autres
Publié: (2025)
par: Fang, Zhiyuan, et autres
Publié: (2025)
Thermodynamic Focusing for Inference-Time Search: Practical Methods for Target-Conditioned Sampling and Prompted Inference
par: Zhang, Zhan
Publié: (2025)
par: Zhang, Zhan
Publié: (2025)
AI Progress Should Be Measured by Capability-Per-Resource, Not Scale Alone: A Framework for Gradient-Guided Resource Allocation in LLMs
par: McCoy, David, et autres
Publié: (2025)
par: McCoy, David, et autres
Publié: (2025)
Generative Principal Component Regression via Variational Inference
par: Talbot, Austin, et autres
Publié: (2024)
par: Talbot, Austin, et autres
Publié: (2024)
Biathlon: Harnessing Model Resilience for Accelerating ML Inference Pipelines
par: Chang, Chaokun, et autres
Publié: (2024)
par: Chang, Chaokun, et autres
Publié: (2024)
PiCME: Pipeline for Contrastive Modality Evaluation and Encoding in the MIMIC Dataset
par: Golovanevsky, Michal, et autres
Publié: (2025)
par: Golovanevsky, Michal, et autres
Publié: (2025)
Position: Beyond Euclidean -- Foundation Models Should Embrace Non-Euclidean Geometries
par: He, Neil, et autres
Publié: (2025)
par: He, Neil, et autres
Publié: (2025)
Position: Intelligent Coding Systems Should Write Programs with Justifications
par: Xu, Xiangzhe, et autres
Publié: (2025)
par: Xu, Xiangzhe, et autres
Publié: (2025)
Position: Mechanistic Interpretability Should Prioritize Feature Consistency in SAEs
par: Song, Xiangchen, et autres
Publié: (2025)
par: Song, Xiangchen, et autres
Publié: (2025)
Causal Inference on Stopped Random Walks in Online Advertising
par: Yu, Jia Yuan
Publié: (2026)
par: Yu, Jia Yuan
Publié: (2026)
Measuring What AI Systems Might Do: Towards A Measurement Science in AI
par: Voudouris, Konstantinos, et autres
Publié: (2026)
par: Voudouris, Konstantinos, et autres
Publié: (2026)
X-MethaneWet: A Cross-scale Global Wetland Methane Emission Benchmark Dataset for Advancing Science Discovery with AI
par: Sun, Yiming, et autres
Publié: (2025)
par: Sun, Yiming, et autres
Publié: (2025)
Learning Rate Should Scale Inversely with High-Order Data Moments in High-Dimensional Online Independent Component Analysis
par: Gultekin, M. Oguzhan, et autres
Publié: (2025)
par: Gultekin, M. Oguzhan, et autres
Publié: (2025)
Post Reinforcement Learning Inference
par: Syrgkanis, Vasilis, et autres
Publié: (2023)
par: Syrgkanis, Vasilis, et autres
Publié: (2023)
PreMoE: Proactive Inference for Efficient Mixture-of-Experts
par: Pei, Zehua, et autres
Publié: (2025)
par: Pei, Zehua, et autres
Publié: (2025)
Prior-Fitted Networks Scale to Larger Datasets When Treated as Weak Learners
par: Wang, Yuxin, et autres
Publié: (2025)
par: Wang, Yuxin, et autres
Publié: (2025)
AMDP: Asynchronous Multi-Directional Pipeline Parallelism for Large-Scale Models Training
par: Chen, Ling, et autres
Publié: (2026)
par: Chen, Ling, et autres
Publié: (2026)
Distance Measure Based on an Embedding of the Manifold of K-Component Gaussian Mixture Models into the Manifold of Symmetric Positive Definite Matrices
par: Vishwakarma, Amit, et autres
Publié: (2025)
par: Vishwakarma, Amit, et autres
Publié: (2025)
Documents similaires
-
Beyond Pairwise Connections: Extracting High-Order Functional Brain Network Structures under Global Constraints
par: Zhan, Ling, et autres
Publié: (2025) -
Accelerating Benchmarking of Functional Connectivity Modeling via Structure-aware Core-set Selection
par: Zhan, Ling, et autres
Publié: (2026) -
Automating Data Science Pipelines with Tensor Completion
par: Pakala, Shaan, et autres
Publié: (2024) -
Position: AI Security Policy Should Target Systems, Not Models
par: Riegler, Michael A., et autres
Publié: (2026) -
Position: AI Evaluations Should be Grounded on a Theory of Capability
par: Jo, Nathanael, et autres
Publié: (2025)