ML-Tool-Bench: Tool-Augmented Planning for ML Tasks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chittepu, Yaswanth, Addanki, Raghavendra, Mai, Tung, Rao, Anup, Kveton, Branislav |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Control
par: Chittepu, Yaswanth, et autres
Publié: (2026)
par: Chittepu, Yaswanth, et autres
Publié: (2026)
Adaptive Margin RLHF via Preference over Preferences
par: Chittepu, Yaswanth, et autres
Publié: (2025)
par: Chittepu, Yaswanth, et autres
Publié: (2025)
AdvantageFlow: Advantage-Weighted Least Squares for RL in Flow Models
par: Kveton, Branislav, et autres
Publié: (2026)
par: Kveton, Branislav, et autres
Publié: (2026)
Limits of Approximating the Median Treatment Effect
par: Addanki, Raghavendra, et autres
Publié: (2024)
par: Addanki, Raghavendra, et autres
Publié: (2024)
Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints
par: Chittepu, Yaswanth, et autres
Publié: (2025)
par: Chittepu, Yaswanth, et autres
Publié: (2025)
Pessimistic Off-Policy Optimization for Learning to Rank
par: Cief, Matej, et autres
Publié: (2022)
par: Cief, Matej, et autres
Publié: (2022)
Machine Learning as a Tool (MLAT): A Framework for Integrating Statistical ML Models as Callable Tools within LLM Agent Workflows
par: Chen, Edwin, et autres
Publié: (2026)
par: Chen, Edwin, et autres
Publié: (2026)
Partial Policy Gradients for RL in LLMs
par: Mathur, Puneet, et autres
Publié: (2026)
par: Mathur, Puneet, et autres
Publié: (2026)
COSAC: Counterfactual Credit Assignment in Sequential Cooperative Teams
par: Deshmukh, Shripad, et autres
Publié: (2026)
par: Deshmukh, Shripad, et autres
Publié: (2026)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
par: Mukherjee, Subhojyoti, et autres
Publié: (2025)
par: Mukherjee, Subhojyoti, et autres
Publié: (2025)
Spectral bandits
par: Kocák, Tomáš, et autres
Publié: (2026)
par: Kocák, Tomáš, et autres
Publié: (2026)
Scaling Laws for Reward Model Overoptimization in Direct Alignment Algorithms
par: Rafailov, Rafael, et autres
Publié: (2024)
par: Rafailov, Rafael, et autres
Publié: (2024)
Tool Unlearning for Tool-Augmented LLMs
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
RADAR: Reasoning-Ability and Difficulty-Aware Routing for Reasoning LLMs
par: Fernandez, Nigel, et autres
Publié: (2025)
par: Fernandez, Nigel, et autres
Publié: (2025)
rule4ml: An Open-Source Tool for Resource Utilization and Latency Estimation for ML Models on FPGA
par: Rahimifar, Mohammad Mehdi, et autres
Publié: (2024)
par: Rahimifar, Mohammad Mehdi, et autres
Publié: (2024)
Tool Zero: Training Tool-Augmented LLMs via Pure RL from Scratch
par: Zeng, Yirong, et autres
Publié: (2025)
par: Zeng, Yirong, et autres
Publié: (2025)
Selective Uncertainty Propagation in Offline RL
par: Krishnamurthy, Sanath Kumar, et autres
Publié: (2023)
par: Krishnamurthy, Sanath Kumar, et autres
Publié: (2023)
CubicML: Automated ML for Large ML Systems Co-design with ML Prediction of Performance
par: Wen, Wei, et autres
Publié: (2024)
par: Wen, Wei, et autres
Publié: (2024)
Credence: Augmenting Datacenter Switch Buffer Sharing with ML Predictions
par: Addanki, Vamsi, et autres
Publié: (2024)
par: Addanki, Vamsi, et autres
Publié: (2024)
LitBench: A Graph-Centric Large Language Model Benchmarking Tool For Literature Tasks
par: Varvarigos, Andreas, et autres
Publié: (2026)
par: Varvarigos, Andreas, et autres
Publié: (2026)
nanoML for Human Activity Recognition
par: Bacellar, Alan T. L., et autres
Publié: (2025)
par: Bacellar, Alan T. L., et autres
Publié: (2025)
Evaluating the printability of stl files with ML
par: Henn, Janik, et autres
Publié: (2025)
par: Henn, Janik, et autres
Publié: (2025)
Optimizing ML Training with Metagradient Descent
par: Engstrom, Logan, et autres
Publié: (2025)
par: Engstrom, Logan, et autres
Publié: (2025)
Problem-oriented AutoML in Clustering
par: da Silva, Matheus Camilo, et autres
Publié: (2024)
par: da Silva, Matheus Camilo, et autres
Publié: (2024)
Language-Model Prior Overcomes Cold-Start Items
par: Wang, Shiyu, et autres
Publié: (2024)
par: Wang, Shiyu, et autres
Publié: (2024)
Robustness of AutoML on Dirty Categorical Data
par: Bueno, Marcos L. P., et autres
Publié: (2026)
par: Bueno, Marcos L. P., et autres
Publié: (2026)
Taming Data Challenges in ML-based Security Tasks Using Generative AI
par: Kanchi, Shravya, et autres
Publié: (2025)
par: Kanchi, Shravya, et autres
Publié: (2025)
Hallucination Diversity-Aware Active Learning for Text Summarization
par: Xia, Yu, et autres
Publié: (2024)
par: Xia, Yu, et autres
Publié: (2024)
MetaTool: Facilitating Large Language Models to Master Tools with Meta-task Augmentation
par: Wang, Xiaohan, et autres
Publié: (2024)
par: Wang, Xiaohan, et autres
Publié: (2024)
Recoverability Has a Law: The ERR Measure for Tool-Augmented Agents
par: Vuddanti, Sri Vatsa, et autres
Publié: (2026)
par: Vuddanti, Sri Vatsa, et autres
Publié: (2026)
Exploring the impact of fairness-aware criteria in AutoML
par: Simões, Joana, et autres
Publié: (2026)
par: Simões, Joana, et autres
Publié: (2026)
Hyperparameter Importance Analysis for Multi-Objective AutoML
par: Theodorakopoulos, Daphne, et autres
Publié: (2024)
par: Theodorakopoulos, Daphne, et autres
Publié: (2024)
TinyML-Enabled IoT for Sustainable Precision Irrigation
par: Taueatsoala, Kamogelo, et autres
Publié: (2026)
par: Taueatsoala, Kamogelo, et autres
Publié: (2026)
Initializing Services in Interactive ML Systems for Diverse Users
par: Bose, Avinandan, et autres
Publié: (2023)
par: Bose, Avinandan, et autres
Publié: (2023)
Probabilistic ML Verification via Weighted Model Integration
par: Morettin, Paolo, et autres
Publié: (2024)
par: Morettin, Paolo, et autres
Publié: (2024)
TML-Bench: Benchmark for Data Science Agents on Tabular ML Tasks
par: Pinchuk, Mykola
Publié: (2026)
par: Pinchuk, Mykola
Publié: (2026)
Sparse Attention Regression Network Based Soil Fertility Prediction With Ummaso
par: Rao, R V Raghavendra, et autres
Publié: (2024)
par: Rao, R V Raghavendra, et autres
Publié: (2024)
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024)
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024)
CAD-Assistant: Tool-Augmented VLLMs as Generic CAD Task Solvers
par: Mallis, Dimitrios, et autres
Publié: (2024)
par: Mallis, Dimitrios, et autres
Publié: (2024)
In-Context Decision Making for Optimizing Complex AutoML Pipelines
par: Balef, Amir Rezaei, et autres
Publié: (2025)
par: Balef, Amir Rezaei, et autres
Publié: (2025)
Documents similaires
-
Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Control
par: Chittepu, Yaswanth, et autres
Publié: (2026) -
Adaptive Margin RLHF via Preference over Preferences
par: Chittepu, Yaswanth, et autres
Publié: (2025) -
AdvantageFlow: Advantage-Weighted Least Squares for RL in Flow Models
par: Kveton, Branislav, et autres
Publié: (2026) -
Limits of Approximating the Median Treatment Effect
par: Addanki, Raghavendra, et autres
Publié: (2024) -
Reinforcement Learning from Human Feedback with High-Confidence Safety Constraints
par: Chittepu, Yaswanth, et autres
Publié: (2025)