Enregistré dans:
| Auteurs principaux: | Korkmaz, Buse Sibel, Nair, Rahul, Daly, Elizabeth M., Chanona, Antonio del Rio |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2505.19327 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Foundation Models at Work: Fine-Tuning for Fairness in Algorithmic Hiring
par: Korkmaz, Buse Sibel, et autres
Publié: (2025)
par: Korkmaz, Buse Sibel, et autres
Publié: (2025)
Learning with Embedded Linear Equality Constraints via Variational Bayesian Inference
par: Marsh, Matthew, et autres
Publié: (2026)
par: Marsh, Matthew, et autres
Publié: (2026)
Human-Algorithm Collaborative Bayesian Optimization for Engineering Systems
par: Savage, Tom, et autres
Publié: (2024)
par: Savage, Tom, et autres
Publié: (2024)
A Representation-Level Assessment of Bias Mitigation in Foundation Models
par: Nizhnichenkov, Svetoslav, et autres
Publié: (2026)
par: Nizhnichenkov, Svetoslav, et autres
Publié: (2026)
Humble AI in the real-world: the case of algorithmic hiring
par: Nair, Rahul, et autres
Publié: (2025)
par: Nair, Rahul, et autres
Publié: (2025)
Ranking Large Language Models without Ground Truth
par: Dhurandhar, Amit, et autres
Publié: (2024)
par: Dhurandhar, Amit, et autres
Publié: (2024)
SoDaDE: Solvent Data-Driven Embeddings with Small Transformer Models
par: Gibberd, Gabriel Kitso, et autres
Publié: (2025)
par: Gibberd, Gabriel Kitso, et autres
Publié: (2025)
Mitigating the Alignment Tax of RLHF
par: Lin, Yong, et autres
Publié: (2023)
par: Lin, Yong, et autres
Publié: (2023)
Applying Multi-Fidelity Bayesian Optimization in Chemistry: Open Challenges and Major Considerations
par: Judge, Edmund, et autres
Publié: (2024)
par: Judge, Edmund, et autres
Publié: (2024)
Machine Learning-Assisted Discovery of Flow Reactor Designs
par: Savage, Tom, et autres
Publié: (2023)
par: Savage, Tom, et autres
Publié: (2023)
What Is the Alignment Tax?
par: Young, Robin
Publié: (2026)
par: Young, Robin
Publié: (2026)
Understanding and Diagnosing Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2024)
par: Korkmaz, Ezgi
Publié: (2024)
A Survey Analyzing Generalization in Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2024)
par: Korkmaz, Ezgi
Publié: (2024)
Holistic Bioprocess Development Across Scales Using Multi-Fidelity Batch Bayesian Optimization
par: Martens, Adrian, et autres
Publié: (2025)
par: Martens, Adrian, et autres
Publié: (2025)
bioLeak: Leakage-Aware Modeling and Diagnostics for Machine Learning in R
par: Korkmaz, Selçuk
Publié: (2026)
par: Korkmaz, Selçuk
Publié: (2026)
Counteractive RL: Rethinking Core Principles for Efficient and Scalable Deep Reinforcement Learning
par: Korkmaz, Ezgi
Publié: (2026)
par: Korkmaz, Ezgi
Publié: (2026)
Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
par: Sun, Guanglong, et autres
Publié: (2026)
par: Sun, Guanglong, et autres
Publié: (2026)
A Guide to Bayesian Optimization in Bioprocess Engineering
par: Siska, Maximilian, et autres
Publié: (2025)
par: Siska, Maximilian, et autres
Publié: (2025)
Black-box Uncertainty Quantification Method for LLM-as-a-Judge
par: Wagner, Nico, et autres
Publié: (2024)
par: Wagner, Nico, et autres
Publié: (2024)
Prompt Smart, Pay Less: Cost-Aware APO for Real-World Applications
par: Choudhari, Jayesh, et autres
Publié: (2025)
par: Choudhari, Jayesh, et autres
Publié: (2025)
Paying Less Generalization Tax: A Cross-Domain Generalization Study of RL Training for LLM Agents
par: Liu, Zhihan, et autres
Publié: (2026)
par: Liu, Zhihan, et autres
Publié: (2026)
Reinforcement learning meets bioprocess control through behaviour cloning: Real-world deployment in an industrial photobioreactor
par: Gil, Juan D., et autres
Publié: (2025)
par: Gil, Juan D., et autres
Publié: (2025)
Mitigating the Safety Alignment Tax with Null-Space Constrained Policy Optimization
par: Niu, Yifan, et autres
Publié: (2025)
par: Niu, Yifan, et autres
Publié: (2025)
Reducing the Safety Tax in LLM Safety Alignment with On-Policy Self-Distillation
par: Fu, Yu, et autres
Publié: (2026)
par: Fu, Yu, et autres
Publié: (2026)
MILE: Model-based Intervention Learning
par: Korkmaz, Yigit, et autres
Publié: (2025)
par: Korkmaz, Yigit, et autres
Publié: (2025)
Capacity Provisioning Motivated Online Non-Convex Optimization Problem with Memory and Switching Cost
par: Vaze, Rahul, et autres
Publié: (2024)
par: Vaze, Rahul, et autres
Publié: (2024)
Online Merging Optimizers for Boosting Rewards and Mitigating Tax in Alignment
par: Lu, Keming, et autres
Publié: (2024)
par: Lu, Keming, et autres
Publié: (2024)
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
par: McCarthy, James, et autres
Publié: (2025)
par: McCarthy, James, et autres
Publié: (2025)
Contrastive Diffusion Alignment: Learning Structured Latents for Controllable Generation
par: Sandilya, Ruchi, et autres
Publié: (2025)
par: Sandilya, Ruchi, et autres
Publié: (2025)
On the Alignment Between Supervised and Self-Supervised Contrastive Learning
par: Luthra, Achleshwar, et autres
Publié: (2025)
par: Luthra, Achleshwar, et autres
Publié: (2025)
Graph Contrastive Learning via Spectral Graph Alignment
par: Nguyen, Manh
Publié: (2025)
par: Nguyen, Manh
Publié: (2025)
Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax
par: Su, Zeli, et autres
Publié: (2026)
par: Su, Zeli, et autres
Publié: (2026)
Deep Kernel Bayesian Optimisation for Closed-Loop Electrode Microstructure Design with User-Defined Properties based on GANs
par: Gayon-Lombardo, Andrea, et autres
Publié: (2025)
par: Gayon-Lombardo, Andrea, et autres
Publié: (2025)
Multi-Alignment Contrastive Learning for Enzyme--Reaction Retrieval
par: Zhou, Gengmo, et autres
Publié: (2025)
par: Zhou, Gengmo, et autres
Publié: (2025)
Shapelets-Enriched Selective Forecasting using Time Series Foundation Models
par: Tomar, Shivani, et autres
Publié: (2026)
par: Tomar, Shivani, et autres
Publié: (2026)
fastml: Guarded Resampling Workflows for Safer Automated Machine Learning in R
par: Korkmaz, Selcuk, et autres
Publié: (2026)
par: Korkmaz, Selcuk, et autres
Publié: (2026)
Cross-View Topology-Aware Graph Representation Learning
par: Korkmaz, Ahmet Sami, et autres
Publié: (2025)
par: Korkmaz, Ahmet Sami, et autres
Publié: (2025)
Perfect Alignment May be Poisonous to Graph Contrastive Learning
par: Liu, Jingyu, et autres
Publié: (2023)
par: Liu, Jingyu, et autres
Publié: (2023)
Leveraging Graph Neural Networks and Multi-Agent Reinforcement Learning for Inventory Control in Supply Chains
par: Kotecha, Niki, et autres
Publié: (2024)
par: Kotecha, Niki, et autres
Publié: (2024)
Cross-Modal Diffusion for Biomechanical Dynamical Systems Through Local Manifold Alignment
par: Dey, Sharmita, et autres
Publié: (2025)
par: Dey, Sharmita, et autres
Publié: (2025)
Documents similaires
-
Foundation Models at Work: Fine-Tuning for Fairness in Algorithmic Hiring
par: Korkmaz, Buse Sibel, et autres
Publié: (2025) -
Learning with Embedded Linear Equality Constraints via Variational Bayesian Inference
par: Marsh, Matthew, et autres
Publié: (2026) -
Human-Algorithm Collaborative Bayesian Optimization for Engineering Systems
par: Savage, Tom, et autres
Publié: (2024) -
A Representation-Level Assessment of Bias Mitigation in Foundation Models
par: Nizhnichenkov, Svetoslav, et autres
Publié: (2026) -
Humble AI in the real-world: the case of algorithmic hiring
par: Nair, Rahul, et autres
Publié: (2025)