Enregistré dans:
| Auteurs principaux: | Gupta, Kavi, Bastani, Osbert, Solar-Lezama, Armando |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2302.01976 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Randomly Sampled Language Reasoning Problems Elucidate Limitations of In-Context Learning
par: Gupta, Kavi, et autres
Publié: (2025)
par: Gupta, Kavi, et autres
Publié: (2025)
Group-Sparse Matrix Factorization for Transfer Learning of Word Embeddings
par: Xu, Kan, et autres
Publié: (2021)
par: Xu, Kan, et autres
Publié: (2021)
Asymptotic Normality of Generalized Low-Rank Matrix Sensing via Riemannian Geometry
par: Bastani, Osbert
Publié: (2024)
par: Bastani, Osbert
Publié: (2024)
Rethinking Algorithmic Fairness for Human-AI Collaboration
par: Ge, Haosen, et autres
Publié: (2023)
par: Ge, Haosen, et autres
Publié: (2023)
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
par: Ge, Haosen, et autres
Publié: (2024)
par: Ge, Haosen, et autres
Publié: (2024)
Improving Human Sequential Decision-Making with Reinforcement Learning
par: Bastani, Hamsa, et autres
Publié: (2021)
par: Bastani, Hamsa, et autres
Publié: (2021)
Beating the Winner's Curse via Inference-Aware Policy Optimization
par: Bastani, Hamsa, et autres
Publié: (2025)
par: Bastani, Hamsa, et autres
Publié: (2025)
Winner's Curse Drives False Promises in Data-Driven Decisions: A Case Study in Refugee Matching
par: Bastani, Hamsa, et autres
Publié: (2026)
par: Bastani, Hamsa, et autres
Publié: (2026)
When Do Skills Help Reinforcement Learning? A Theoretical Analysis of Temporal Abstractions
par: Li, Zhening, et autres
Publié: (2024)
par: Li, Zhening, et autres
Publié: (2024)
Stochastic Bandits with ReLU Neural Networks
par: Xu, Kan, et autres
Publié: (2024)
par: Xu, Kan, et autres
Publié: (2024)
Conformal Structured Prediction
par: Zhang, Botong, et autres
Publié: (2024)
par: Zhang, Botong, et autres
Publié: (2024)
LLM Program Optimization via Retrieval Augmented Search
par: Anupam, Sagnik, et autres
Publié: (2025)
par: Anupam, Sagnik, et autres
Publié: (2025)
Uncertainty Quantification for Neurosymbolic Programs via Compositional Conformal Prediction
par: Ramalingam, Ramya, et autres
Publié: (2024)
par: Ramalingam, Ramya, et autres
Publié: (2024)
Prior-Agnostic Incentive-Compatible Exploration
par: Ramalingam, Ramya, et autres
Publié: (2026)
par: Ramalingam, Ramya, et autres
Publié: (2026)
MeMo: Meaningful, Modular Controllers via Noise Injection
par: Tjandrasuwita, Megan, et autres
Publié: (2024)
par: Tjandrasuwita, Megan, et autres
Publié: (2024)
Diversity By Design: Leveraging Distribution Matching for Offline Model-Based Optimization
par: Yao, Michael S., et autres
Publié: (2025)
par: Yao, Michael S., et autres
Publié: (2025)
Adaptive Problem Generation via Symbolic Representations
par: Yeo, Teresa, et autres
Publié: (2026)
par: Yeo, Teresa, et autres
Publié: (2026)
SeekerGym: A Benchmark for Reliable Information Seeking
par: Kim, Remy, et autres
Publié: (2026)
par: Kim, Remy, et autres
Publié: (2026)
MathDSL: A Domain-Specific Language for Concise Mathematical Solutions Via Program Synthesis
par: Anupam, Sagnik, et autres
Publié: (2024)
par: Anupam, Sagnik, et autres
Publié: (2024)
RAPID: An Efficient Reinforcement Learning Algorithm for Small Language Models
par: Huang, Lianghuan, et autres
Publié: (2025)
par: Huang, Lianghuan, et autres
Publié: (2025)
EnCompass: Enhancing Agent Programming with Search Over Program Execution Paths
par: Li, Zhening, et autres
Publié: (2025)
par: Li, Zhening, et autres
Publié: (2025)
Improving Structural Diversity of Blackbox LLMs via Chain-of-Specification Prompting
par: Young, Halley, et autres
Publié: (2024)
par: Young, Halley, et autres
Publié: (2024)
Conformal Constrained Policy Optimization for Cost-Effective LLM Agents
par: Si, Wenwen, et autres
Publié: (2025)
par: Si, Wenwen, et autres
Publié: (2025)
Generative Adversarial Model-Based Optimization via Source Critic Regularization
par: Yao, Michael S., et autres
Publié: (2024)
par: Yao, Michael S., et autres
Publié: (2024)
An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models
par: Sun, Mingzhong, et autres
Publié: (2026)
par: Sun, Mingzhong, et autres
Publié: (2026)
BrowserArena: Evaluating LLM Agents on Real-World Web Navigation Tasks
par: Anupam, Sagnik, et autres
Publié: (2025)
par: Anupam, Sagnik, et autres
Publié: (2025)
Knowledgeable Language Models as Black-Box Optimizers for Personalized Medicine
par: Yao, Michael S., et autres
Publié: (2025)
par: Yao, Michael S., et autres
Publié: (2025)
CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution
par: Gu, Alex, et autres
Publié: (2024)
par: Gu, Alex, et autres
Publié: (2024)
Alignment of large language models with constrained learning
par: Zhang, Botong, et autres
Publié: (2025)
par: Zhang, Botong, et autres
Publié: (2025)
Zeroth-Order Fine-Tuning of LLMs with Extreme Sparsity
par: Guo, Wentao, et autres
Publié: (2024)
par: Guo, Wentao, et autres
Publié: (2024)
A Tale of Two Temperatures: Simple, Efficient, and Diverse Sampling from Diffusion Language Models
par: Olausson, Theo X., et autres
Publié: (2026)
par: Olausson, Theo X., et autres
Publié: (2026)
One-Shot Safety Alignment for Large Language Models via Optimal Dualization
par: Huang, Xinmeng, et autres
Publié: (2024)
par: Huang, Xinmeng, et autres
Publié: (2024)
Eurekaverse: Environment Curriculum Generation via Large Language Models
par: Liang, William, et autres
Publié: (2024)
par: Liang, William, et autres
Publié: (2024)
Adversarial Query Synthesis via Bayesian Optimization
par: Tao, Jeffrey, et autres
Publié: (2026)
par: Tao, Jeffrey, et autres
Publié: (2026)
The Counterfeit Conundrum: Can Code Language Models Grasp the Nuances of Their Incorrect Generations?
par: Gu, Alex, et autres
Publié: (2024)
par: Gu, Alex, et autres
Publié: (2024)
Multitask Learning and Bandits via Robust Statistics
par: Xu, Kan, et autres
Publié: (2021)
par: Xu, Kan, et autres
Publié: (2021)
Uncertainty in Language Models: Assessment through Rank-Calibration
par: Huang, Xinmeng, et autres
Publié: (2024)
par: Huang, Xinmeng, et autres
Publié: (2024)
Power Term Polynomial Algebra for Boolean Logic
par: Sansone, Emanuele, et autres
Publié: (2026)
par: Sansone, Emanuele, et autres
Publié: (2026)
Learning Performance-Improving Code Edits
par: Shypula, Alexander, et autres
Publié: (2023)
par: Shypula, Alexander, et autres
Publié: (2023)
Are AI Capabilities Increasing Exponentially? A Competing Hypothesis
par: Ge, Haosen, et autres
Publié: (2026)
par: Ge, Haosen, et autres
Publié: (2026)
Documents similaires
-
Randomly Sampled Language Reasoning Problems Elucidate Limitations of In-Context Learning
par: Gupta, Kavi, et autres
Publié: (2025) -
Group-Sparse Matrix Factorization for Transfer Learning of Word Embeddings
par: Xu, Kan, et autres
Publié: (2021) -
Asymptotic Normality of Generalized Low-Rank Matrix Sensing via Riemannian Geometry
par: Bastani, Osbert
Publié: (2024) -
Rethinking Algorithmic Fairness for Human-AI Collaboration
par: Ge, Haosen, et autres
Publié: (2023) -
Stochastic Online Conformal Prediction with Semi-Bandit Feedback
par: Ge, Haosen, et autres
Publié: (2024)