Generative Adversarial Model-Based Optimization via Source Critic Regularization
Fuente:
arXiv
Salvato in:
| Autori principali: | Yao, Michael S., Zeng, Yimeng, Bastani, Hamsa, Gardner, Jacob, Gee, James C., Bastani, Osbert |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diversity By Design: Leveraging Distribution Matching for Offline Model-Based Optimization
di: Yao, Michael S., et al.
Pubblicazione: (2025)
di: Yao, Michael S., et al.
Pubblicazione: (2025)
Beating the Winner's Curse via Inference-Aware Policy Optimization
di: Bastani, Hamsa, et al.
Pubblicazione: (2025)
di: Bastani, Hamsa, et al.
Pubblicazione: (2025)
Are AI Capabilities Increasing Exponentially? A Competing Hypothesis
di: Ge, Haosen, et al.
Pubblicazione: (2026)
di: Ge, Haosen, et al.
Pubblicazione: (2026)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
di: Ge, Haosen, et al.
Pubblicazione: (2024)
di: Ge, Haosen, et al.
Pubblicazione: (2024)
Rethinking Algorithmic Fairness for Human-AI Collaboration
di: Ge, Haosen, et al.
Pubblicazione: (2023)
di: Ge, Haosen, et al.
Pubblicazione: (2023)
Winner's Curse Drives False Promises in Data-Driven Decisions: A Case Study in Refugee Matching
di: Bastani, Hamsa, et al.
Pubblicazione: (2026)
di: Bastani, Hamsa, et al.
Pubblicazione: (2026)
Improving Human Sequential Decision-Making with Reinforcement Learning
di: Bastani, Hamsa, et al.
Pubblicazione: (2021)
di: Bastani, Hamsa, et al.
Pubblicazione: (2021)
Improving Structural Diversity of Blackbox LLMs via Chain-of-Specification Prompting
di: Young, Halley, et al.
Pubblicazione: (2024)
di: Young, Halley, et al.
Pubblicazione: (2024)
Asymptotic Normality of Generalized Low-Rank Matrix Sensing via Riemannian Geometry
di: Bastani, Osbert
Pubblicazione: (2024)
di: Bastani, Osbert
Pubblicazione: (2024)
Group-Sparse Matrix Factorization for Transfer Learning of Word Embeddings
di: Xu, Kan, et al.
Pubblicazione: (2021)
di: Xu, Kan, et al.
Pubblicazione: (2021)
Stochastic Bandits with ReLU Neural Networks
di: Xu, Kan, et al.
Pubblicazione: (2024)
di: Xu, Kan, et al.
Pubblicazione: (2024)
Conformal Constrained Policy Optimization for Cost-Effective LLM Agents
di: Si, Wenwen, et al.
Pubblicazione: (2025)
di: Si, Wenwen, et al.
Pubblicazione: (2025)
Knowledgeable Language Models as Black-Box Optimizers for Personalized Medicine
di: Yao, Michael S., et al.
Pubblicazione: (2025)
di: Yao, Michael S., et al.
Pubblicazione: (2025)
Adversarial Query Synthesis via Bayesian Optimization
di: Tao, Jeffrey, et al.
Pubblicazione: (2026)
di: Tao, Jeffrey, et al.
Pubblicazione: (2026)
Eurekaverse: Environment Curriculum Generation via Large Language Models
di: Liang, William, et al.
Pubblicazione: (2024)
di: Liang, William, et al.
Pubblicazione: (2024)
Multitask Learning and Bandits via Robust Statistics
di: Xu, Kan, et al.
Pubblicazione: (2021)
di: Xu, Kan, et al.
Pubblicazione: (2021)
Learning Performance-Improving Code Edits
di: Shypula, Alexander, et al.
Pubblicazione: (2023)
di: Shypula, Alexander, et al.
Pubblicazione: (2023)
LLM Program Optimization via Retrieval Augmented Search
di: Anupam, Sagnik, et al.
Pubblicazione: (2025)
di: Anupam, Sagnik, et al.
Pubblicazione: (2025)
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
di: Guo, Wentao, et al.
Pubblicazione: (2024)
di: Guo, Wentao, et al.
Pubblicazione: (2024)
BrowserArena: Evaluating LLM Agents on Real-World Web Navigation Tasks
di: Anupam, Sagnik, et al.
Pubblicazione: (2025)
di: Anupam, Sagnik, et al.
Pubblicazione: (2025)
One-Shot Safety Alignment for Large Language Models via Optimal Dualization
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
Policy-Guided Stepwise Model Routing for Cost-Effective Reasoning
di: Si, Wenwen, et al.
Pubblicazione: (2026)
di: Si, Wenwen, et al.
Pubblicazione: (2026)
Eureka: Human-Level Reward Design via Coding Large Language Models
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2023)
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2023)
Uncertainty Quantification for Neurosymbolic Programs via Compositional Conformal Prediction
di: Ramalingam, Ramya, et al.
Pubblicazione: (2024)
di: Ramalingam, Ramya, et al.
Pubblicazione: (2024)
Uncertainty in Language Models: Assessment through Rank-Calibration
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
di: Huang, Xinmeng, et al.
Pubblicazione: (2024)
DrEureka: Language Model Guided Sim-To-Real Transfer
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2024)
di: Ma, Yecheng Jason, et al.
Pubblicazione: (2024)
Conformal Structured Prediction
di: Zhang, Botong, et al.
Pubblicazione: (2024)
di: Zhang, Botong, et al.
Pubblicazione: (2024)
Decaf: Improving Neural Decompilation with Automatic Feedback and Search
di: Shypula, Alexander, et al.
Pubblicazione: (2026)
di: Shypula, Alexander, et al.
Pubblicazione: (2026)
Strategic Hiring under Algorithmic Monoculture
di: Baek, Jackie, et al.
Pubblicazione: (2025)
di: Baek, Jackie, et al.
Pubblicazione: (2025)
TRAQ: Trustworthy Retrieval Augmented Question Answering via Conformal Prediction
di: Li, Shuo, et al.
Pubblicazione: (2023)
di: Li, Shuo, et al.
Pubblicazione: (2023)
SPARLING: Learning Latent Representations with Extremely Sparse Activations
di: Gupta, Kavi, et al.
Pubblicazione: (2023)
di: Gupta, Kavi, et al.
Pubblicazione: (2023)
Prior-Agnostic Incentive-Compatible Exploration
di: Ramalingam, Ramya, et al.
Pubblicazione: (2026)
di: Ramalingam, Ramya, et al.
Pubblicazione: (2026)
A Fast, Reliable, and Secure Programming Language for LLM Agents with Code Actions
di: Mell, Stephen, et al.
Pubblicazione: (2025)
di: Mell, Stephen, et al.
Pubblicazione: (2025)
Evidence Is All You Need: Ordering Imaging Studies via Language Model Alignment with the ACR Appropriateness Criteria
di: Yao, Michael S., et al.
Pubblicazione: (2024)
di: Yao, Michael S., et al.
Pubblicazione: (2024)
SeekerGym: A Benchmark for Reliable Information Seeking
di: Kim, Remy, et al.
Pubblicazione: (2026)
di: Kim, Remy, et al.
Pubblicazione: (2026)
Effective Reinforcement Learning for Reasoning in Language Models
di: Huang, Lianghuan, et al.
Pubblicazione: (2025)
di: Huang, Lianghuan, et al.
Pubblicazione: (2025)
RAPID: An Efficient Reinforcement Learning Algorithm for Small Language Models
di: Huang, Lianghuan, et al.
Pubblicazione: (2025)
di: Huang, Lianghuan, et al.
Pubblicazione: (2025)
Large Scale Multi-Task Bayesian Optimization with Large Language Models
di: Zeng, Yimeng, et al.
Pubblicazione: (2025)
di: Zeng, Yimeng, et al.
Pubblicazione: (2025)
Permutation Picture of Graph Combinatorial Optimization Problems
di: Min, Yimeng
Pubblicazione: (2024)
di: Min, Yimeng
Pubblicazione: (2024)
Latent Adversarial Regularization for Offline Preference Optimization
di: Jiang, Enyi, et al.
Pubblicazione: (2026)
di: Jiang, Enyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Diversity By Design: Leveraging Distribution Matching for Offline Model-Based Optimization
di: Yao, Michael S., et al.
Pubblicazione: (2025) -
Beating the Winner's Curse via Inference-Aware Policy Optimization
di: Bastani, Hamsa, et al.
Pubblicazione: (2025) -
Are AI Capabilities Increasing Exponentially? A Competing Hypothesis
di: Ge, Haosen, et al.
Pubblicazione: (2026) -
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
di: Ge, Haosen, et al.
Pubblicazione: (2024) -
Rethinking Algorithmic Fairness for Human-AI Collaboration
di: Ge, Haosen, et al.
Pubblicazione: (2023)