TextBO: Bayesian Optimization in Language Space for Eval-Efficient Self-Improving AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Enoch Hyunwook, Yoganarasimhan, Hema |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
An Empirical Risk Minimization Approach for Offline Inverse RL and Dynamic Discrete Choice Model
par: Kang, Enoch H., et autres
Publié: (2025)
par: Kang, Enoch H., et autres
Publié: (2025)
Reasonably reasoning AI agents can avoid game-theoretic failures in zero-shot, provably
par: Kang, Enoch Hyunwook
Publié: (2026)
par: Kang, Enoch Hyunwook
Publié: (2026)
LLM Personas as a Substitute for Field Experiments in Method Benchmarking
par: Kang, Enoch Hyunwook
Publié: (2025)
par: Kang, Enoch Hyunwook
Publié: (2025)
Impact of AI Search Summaries on Website Traffic: Evidence from Google AI Overviews and Wikipedia
par: Khosravi, Mehrzad, et autres
Publié: (2026)
par: Khosravi, Mehrzad, et autres
Publié: (2026)
Personalized Alignment Revisited: The Necessity and Sufficiency of User Diversity
par: Kang, Enoch Hyunwook
Publié: (2026)
par: Kang, Enoch Hyunwook
Publié: (2026)
Demystifying the unreasonable effectiveness of online alignment methods
par: Kang, Enoch Hyunwook
Publié: (2026)
par: Kang, Enoch Hyunwook
Publié: (2026)
Rectification Difficulty and Optimal Sample Allocation in LLM-Augmented Surveys
par: Ye, Zikun, et autres
Publié: (2026)
par: Ye, Zikun, et autres
Publié: (2026)
A Lecture Note on Offline RL and IRL, Part II: Foundations of Inverse Reinforcement Learning and Dynamic Discrete Choice Models
par: Kang, Enoch Hyunwook
Publié: (2026)
par: Kang, Enoch Hyunwook
Publié: (2026)
Reasoning BO: Enhancing Bayesian Optimization with Long-Context Reasoning Power of LLMs
par: Yang, Zhuo, et autres
Publié: (2025)
par: Yang, Zhuo, et autres
Publié: (2025)
MTQ-Eval: Multilingual Text Quality Evaluation for Language Models
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
par: Pokharel, Rhitabrat, et autres
Publié: (2025)
Machine Learning and Optimization Techniques for Solving Inverse Kinematics in a 7-DOF Robotic Arm
par: Adediran, Enoch, et autres
Publié: (2024)
par: Adediran, Enoch, et autres
Publié: (2024)
Sample-Efficient Bayesian Optimization with Transfer Learning for Heterogeneous Search Spaces
par: Deshwal, Aryan, et autres
Publié: (2024)
par: Deshwal, Aryan, et autres
Publié: (2024)
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
par: Gu, Zhouhong, et autres
Publié: (2024)
par: Gu, Zhouhong, et autres
Publié: (2024)
AgenticEval: Toward Agentic and Self-Evolving Safety Evaluation of Large Language Models
par: Wang, Yixu, et autres
Publié: (2025)
par: Wang, Yixu, et autres
Publié: (2025)
Fair Document Valuation in LLM Summaries via Shapley Values
par: Ye, Zikun, et autres
Publié: (2025)
par: Ye, Zikun, et autres
Publié: (2025)
A Recursive Partitioning Approach for Dynamic Discrete Choice Modeling in High Dimensional Settings
par: Barzegary, Ebrahim, et autres
Publié: (2022)
par: Barzegary, Ebrahim, et autres
Publié: (2022)
AtelierEval: Agentic Evaluation of Humans & LLMs as Text-to-Image Prompters
par: Luo, Hanjun, et autres
Publié: (2026)
par: Luo, Hanjun, et autres
Publié: (2026)
Efficient Exploration of Image Classifier Failures with Bayesian Optimization and Text-to-Image Models
par: LeCoz, Adrien, et autres
Publié: (2024)
par: LeCoz, Adrien, et autres
Publié: (2024)
ProEval: Proactive Failure Discovery and Efficient Performance Estimation for Generative AI Evaluation
par: Huang, Yizheng, et autres
Publié: (2026)
par: Huang, Yizheng, et autres
Publié: (2026)
A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search
par: Seong-Eun, Baek, et autres
Publié: (2026)
par: Seong-Eun, Baek, et autres
Publié: (2026)
PyEvalAI: AI-assisted evaluation of Jupyter Notebooks for immediate personalized feedback
par: Wandel, Nils, et autres
Publié: (2025)
par: Wandel, Nils, et autres
Publié: (2025)
Transfer Learning for Bayesian Optimization on Heterogeneous Search Spaces
par: Fan, Zhou, et autres
Publié: (2023)
par: Fan, Zhou, et autres
Publié: (2023)
FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models
par: Yu, Zhuohao, et autres
Publié: (2024)
par: Yu, Zhuohao, et autres
Publié: (2024)
Forget and Explain: Transparent Verification of GNN Unlearning
par: Ahsan, Imran, et autres
Publié: (2025)
par: Ahsan, Imran, et autres
Publié: (2025)
Self-Improving AI Agents through Self-Play
par: Chojecki, Przemyslaw
Publié: (2025)
par: Chojecki, Przemyslaw
Publié: (2025)
PhysicsEval: Inference-Time Techniques to Improve the Reasoning Proficiency of Large Language Models on Physics Problems
par: Siddique, Oshayer, et autres
Publié: (2025)
par: Siddique, Oshayer, et autres
Publié: (2025)
Training-Efficient Text-to-Music Generation with State-Space Modeling
par: Lee, Wei-Jaw, et autres
Publié: (2026)
par: Lee, Wei-Jaw, et autres
Publié: (2026)
TimeStampEval: A Simple LLM Eval and a Little Fuzzy Matching Trick to Improve Search Accuracy
par: McCammon, James
Publié: (2025)
par: McCammon, James
Publié: (2025)
ReviewEval: An Evaluation Framework for AI-Generated Reviews
par: Garg, Madhav Krishan, et autres
Publié: (2025)
par: Garg, Madhav Krishan, et autres
Publié: (2025)
Check-Eval: A Checklist-based Approach for Evaluating Text Quality
par: Pereira, Jayr, et autres
Publié: (2024)
par: Pereira, Jayr, et autres
Publié: (2024)
Self-Improving Robust Preference Optimization
par: Choi, Eugene, et autres
Publié: (2024)
par: Choi, Eugene, et autres
Publié: (2024)
AdaptEval: A Benchmark for Evaluating Large Language Models on Code Snippet Adaptation
par: Zhang, Tanghaoran, et autres
Publié: (2026)
par: Zhang, Tanghaoran, et autres
Publié: (2026)
SEA-Eval: A Benchmark for Evaluating Self-Evolving Agents Beyond Episodic Assessment
par: Jiang, Sihang, et autres
Publié: (2026)
par: Jiang, Sihang, et autres
Publié: (2026)
Continuous-Variable Quantum Encoding Techniques: A Comparative Study of Embedding Techniques and Their Impact on Machine Learning Performance
par: Rath, Minati, et autres
Publié: (2025)
par: Rath, Minati, et autres
Publié: (2025)
Quantum-Assisted Simulation: A Framework for Developing Machine Learning Models in Quantum Computing
par: Rath, Minati, et autres
Publié: (2023)
par: Rath, Minati, et autres
Publié: (2023)
Enhancing Visual Reliance in Text Generation: A Bayesian Perspective on Mitigating Hallucination in Large Vision-Language Models
par: Hu, Nanxing, et autres
Publié: (2025)
par: Hu, Nanxing, et autres
Publié: (2025)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
Bayesian Optimization for Enhanced Language Models: Optimizing Acquisition Functions
par: Bao, Zishuo, et autres
Publié: (2025)
par: Bao, Zishuo, et autres
Publié: (2025)
BUSTED at AraGenEval Shared Task: A Comparative Study of Transformer-Based Models for Arabic AI-Generated Text Detection
par: Zain, Ali, et autres
Publié: (2025)
par: Zain, Ali, et autres
Publié: (2025)
Team QUST at SemEval-2024 Task 8: A Comprehensive Study of Monolingual and Multilingual Approaches for Detecting AI-generated Text
par: Xu, Xiaoman, et autres
Publié: (2024)
par: Xu, Xiaoman, et autres
Publié: (2024)
Documents similaires
-
An Empirical Risk Minimization Approach for Offline Inverse RL and Dynamic Discrete Choice Model
par: Kang, Enoch H., et autres
Publié: (2025) -
Reasonably reasoning AI agents can avoid game-theoretic failures in zero-shot, provably
par: Kang, Enoch Hyunwook
Publié: (2026) -
LLM Personas as a Substitute for Field Experiments in Method Benchmarking
par: Kang, Enoch Hyunwook
Publié: (2025) -
Impact of AI Search Summaries on Website Traffic: Evidence from Google AI Overviews and Wikipedia
par: Khosravi, Mehrzad, et autres
Publié: (2026) -
Personalized Alignment Revisited: The Necessity and Sufficiency of User Diversity
par: Kang, Enoch Hyunwook
Publié: (2026)