Enabling High Data Throughput Reinforcement Learning on GPUs: A Domain Agnostic Framework for Data-Driven Scientific Research
Fuente:
arXiv
Salvato in:
| Autori principali: | Lan, Tian, Wang, Huan, Xiong, Caiming, Savarese, Silvio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Text2Data: Low-Resource Data Generation with Textual Control
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
di: Wang, Shiyu, et al.
Pubblicazione: (2024)
Unified Training of Universal Time Series Forecasting Transformers
di: Woo, Gerald, et al.
Pubblicazione: (2024)
di: Woo, Gerald, et al.
Pubblicazione: (2024)
Causal Layering via Conditional Entropy
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning
di: Zhang, Jianguo, et al.
Pubblicazione: (2024)
di: Zhang, Jianguo, et al.
Pubblicazione: (2024)
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
Editing Arbitrary Propositions in LLMs without Subject Labels
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024)
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback
di: Hoang, Thai, et al.
Pubblicazione: (2025)
di: Hoang, Thai, et al.
Pubblicazione: (2025)
LZ Penalty: An information-theoretic repetition penalty for autoregressive language models
di: Ginart, Antonio A., et al.
Pubblicazione: (2025)
di: Ginart, Antonio A., et al.
Pubblicazione: (2025)
Strefer: Empowering Video LLMs with Space-Time Referring and Reasoning via Synthetic Instruction Data
di: Zhou, Honglu, et al.
Pubblicazione: (2025)
di: Zhou, Honglu, et al.
Pubblicazione: (2025)
APIGen-MT: Agentic Pipeline for Multi-Turn Data Generation via Simulated Agent-Human Interplay
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
di: Prabhakar, Akshara, et al.
Pubblicazione: (2025)
Prompt Optimization Via Diffusion Language Models
di: Wang, Shiyu, et al.
Pubblicazione: (2026)
di: Wang, Shiyu, et al.
Pubblicazione: (2026)
Reinforcement Learning-based Feature Generation Algorithm for Scientific Data
di: Xiao, Meng, et al.
Pubblicazione: (2025)
di: Xiao, Meng, et al.
Pubblicazione: (2025)
Composite Flow Matching for Reinforcement Learning with Shifted-Dynamics Data
di: Kong, Lingkai, et al.
Pubblicazione: (2025)
di: Kong, Lingkai, et al.
Pubblicazione: (2025)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
di: Wen, Xiaoyu, et al.
Pubblicazione: (2024)
SSR: Socratic Self-Refine for Large Language Model Reasoning
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
DeepFaith: A Domain-Free and Model-Agnostic Unified Framework for Highly Faithful Explanations
di: Guo, Yuhan, et al.
Pubblicazione: (2025)
di: Guo, Yuhan, et al.
Pubblicazione: (2025)
Principled Approximation Methods for Efficient and Scalable Deep Learning
di: Savarese, Pedro
Pubblicazione: (2025)
di: Savarese, Pedro
Pubblicazione: (2025)
UserBench: An Interactive Gym Environment for User-Centric Agents
di: Qian, Cheng, et al.
Pubblicazione: (2025)
di: Qian, Cheng, et al.
Pubblicazione: (2025)
TranDRL: A Transformer-Driven Deep Reinforcement Learning Enabled Prescriptive Maintenance Framework
di: Zhao, Yang, et al.
Pubblicazione: (2023)
di: Zhao, Yang, et al.
Pubblicazione: (2023)
Agnostic Reinforcement Learning: Foundations and Algorithms
di: Li, Gene
Pubblicazione: (2025)
di: Li, Gene
Pubblicazione: (2025)
Goal-Conditioned Reinforcement Learning for Data-Driven Maritime Navigation
di: Vaidheeswaran, Vaishnav, et al.
Pubblicazione: (2025)
di: Vaidheeswaran, Vaishnav, et al.
Pubblicazione: (2025)
REX: Rapid Exploration and eXploitation for AI Agents
di: Murthy, Rithesh, et al.
Pubblicazione: (2023)
di: Murthy, Rithesh, et al.
Pubblicazione: (2023)
The Role of Environment Access in Agnostic Reinforcement Learning
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2025)
di: Krishnamurthy, Akshay, et al.
Pubblicazione: (2025)
Variable-Agnostic Causal Exploration for Reinforcement Learning
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2024)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2024)
Operator-Guided Invariance Learning for Continuous Reinforcement Learning
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
di: Chen, Haolin, et al.
Pubblicazione: (2024)
di: Chen, Haolin, et al.
Pubblicazione: (2024)
WALT: Web Agents that Learn Tools
di: Prabhu, Viraj, et al.
Pubblicazione: (2025)
di: Prabhu, Viraj, et al.
Pubblicazione: (2025)
MoE-Lightning: High-Throughput MoE Inference on Memory-constrained GPUs
di: Cao, Shiyi, et al.
Pubblicazione: (2024)
di: Cao, Shiyi, et al.
Pubblicazione: (2024)
Training Data Selection with Gradient Orthogonality for Efficient Domain Adaptation
di: Zhang, Xiyang, et al.
Pubblicazione: (2026)
di: Zhang, Xiyang, et al.
Pubblicazione: (2026)
RealAC: A Domain-Agnostic Framework for Realistic and Actionable Counterfactual Explanations
di: Arefeen, Asiful, et al.
Pubblicazione: (2025)
di: Arefeen, Asiful, et al.
Pubblicazione: (2025)
Scalable Option Learning in High-Throughput Environments
di: Henaff, Mikael, et al.
Pubblicazione: (2025)
di: Henaff, Mikael, et al.
Pubblicazione: (2025)
Diversity Empowers Intelligence: Integrating Expertise of Software Engineering Agents
di: Zhang, Kexun, et al.
Pubblicazione: (2024)
di: Zhang, Kexun, et al.
Pubblicazione: (2024)
Can One Domain Help Others? A Data-Centric Study on Multi-Domain Reasoning via Reinforcement Learning
di: Li, Yu, et al.
Pubblicazione: (2025)
di: Li, Yu, et al.
Pubblicazione: (2025)
Helix 1.0: An Open-Source Framework for Reproducible and Interpretable Machine Learning on Tabular Scientific Data
di: Aguilar-Bejarano, Eduardo, et al.
Pubblicazione: (2025)
di: Aguilar-Bejarano, Eduardo, et al.
Pubblicazione: (2025)
Matrix-Space Reinforcement Learning for Reusing Local Transition Geometry
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
di: Zhang, Zuyuan, et al.
Pubblicazione: (2026)
Comparing Task-Agnostic Embedding Models for Tabular Data
di: Hoppe, Frederik, et al.
Pubblicazione: (2025)
di: Hoppe, Frederik, et al.
Pubblicazione: (2025)
Collapsing Sequence-Level Data-Policy Coverage via Poisoning Attack in Offline Reinforcement Learning
di: Zhou, Xue, et al.
Pubblicazione: (2025)
di: Zhou, Xue, et al.
Pubblicazione: (2025)
Self-Guided Masked Autoencoders for Domain-Agnostic Self-Supervised Learning
di: Xie, Johnathan, et al.
Pubblicazione: (2024)
di: Xie, Johnathan, et al.
Pubblicazione: (2024)
Domain Elastic Transform: Bayesian Function Registration for High-Dimensional Scientific Data
di: Hirose, Osamu, et al.
Pubblicazione: (2026)
di: Hirose, Osamu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Text2Data: Low-Resource Data Generation with Textual Control
di: Wang, Shiyu, et al.
Pubblicazione: (2024) -
Unified Training of Universal Time Series Forecasting Transformers
di: Woo, Gerald, et al.
Pubblicazione: (2024) -
Causal Layering via Conditional Entropy
di: Feigenbaum, Itai, et al.
Pubblicazione: (2024) -
AgentOhana: Design Unified Data and Training Pipeline for Effective Agent Learning
di: Zhang, Jianguo, et al.
Pubblicazione: (2024) -
UserRL: Training Interactive User-Centric Agent via Reinforcement Learning
di: Qian, Cheng, et al.
Pubblicazione: (2025)