REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Peiyan, Jin, Haibo, Hu, Leyang, Li, Xinnuo, Kang, Liying, Luo, Man, Song, Yangqiu, Wang, Haohan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing
par: Zhang, Peiyan, et autres
Publié: (2025)
par: Zhang, Peiyan, et autres
Publié: (2025)
Can AI Assist in Olympiad Coding
par: Ren, Samuel
Publié: (2025)
par: Ren, Samuel
Publié: (2025)
TrafficRAG: A Multimodal RAG Framework for Traffic Accident Liability Determination
par: Li, Xu, et autres
Publié: (2026)
par: Li, Xu, et autres
Publié: (2026)
ChatGPT4PCG 2 Competition: Prompt Engineering for Science Birds Level Generation
par: Taveekitworachai, Pittawat, et autres
Publié: (2024)
par: Taveekitworachai, Pittawat, et autres
Publié: (2024)
Open-TI: Open Traffic Intelligence with Augmented Language Model
par: Da, Longchao, et autres
Publié: (2023)
par: Da, Longchao, et autres
Publié: (2023)
Critical Insights into Leading Conversational AI Models
par: Kohli, Urja, et autres
Publié: (2025)
par: Kohli, Urja, et autres
Publié: (2025)
FATHOMS-RAG: A Framework for the Assessment of Thinking and Observation in Multimodal Systems that use Retrieval Augmented Generation
par: Hildebrand, Samuel, et autres
Publié: (2025)
par: Hildebrand, Samuel, et autres
Publié: (2025)
Survey Transfer Learning: Recycling Data with Silicon Responses
par: Amini, Ali
Publié: (2025)
par: Amini, Ali
Publié: (2025)
Evo-DKD: Dual-Knowledge Decoding for Autonomous Ontology Evolution in Large Language Models
par: Raman, Vishal, et autres
Publié: (2025)
par: Raman, Vishal, et autres
Publié: (2025)
GraphWalk: Enabling Reasoning in Large Language Models through Tool-Based Graph Navigation
par: Ghandi, Taraneh, et autres
Publié: (2026)
par: Ghandi, Taraneh, et autres
Publié: (2026)
How Clued up are LLMs? Evaluating Multi-Step Deductive Reasoning in a Text-Based Game Environment
par: Ansell, Rebecca, et autres
Publié: (2026)
par: Ansell, Rebecca, et autres
Publié: (2026)
When Words Change the Model: Sensitivity of LLMs for Constraint Programming Modelling
par: Pellegrino, Alessio, et autres
Publié: (2025)
par: Pellegrino, Alessio, et autres
Publié: (2025)
ChatGPT4PCG Competition: Character-like Level Generation for Science Birds
par: Taveekitworachai, Pittawat, et autres
Publié: (2023)
par: Taveekitworachai, Pittawat, et autres
Publié: (2023)
Dynamic Policy Induction for Adaptive Prompt Optimization: Bridging the Efficiency-Accuracy Gap via Lightweight Reinforcement Learning
par: Xu, Jiexi
Publié: (2025)
par: Xu, Jiexi
Publié: (2025)
ConfProBench: A Confidence Evaluation Benchmark for MLLM-Based Process Judges
par: Zhou, Yue, et autres
Publié: (2025)
par: Zhou, Yue, et autres
Publié: (2025)
MOCHA: Multi-Objective Chebyshev Annealing for Agent Skill Optimization
par: Tanjim, Md Mehrab, et autres
Publié: (2026)
par: Tanjim, Md Mehrab, et autres
Publié: (2026)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
par: Fang, Qitong, et autres
Publié: (2026)
par: Fang, Qitong, et autres
Publié: (2026)
On the Limits of Learned Importance Scoring for KV Cache Compression
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
par: Steele, Brady, et autres
Publié: (2026)
par: Steele, Brady, et autres
Publié: (2026)
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
par: Luyten, Max Ruiz, et autres
Publié: (2026)
par: Luyten, Max Ruiz, et autres
Publié: (2026)
From Search to Reasoning: A Five-Level RAG Capability Framework for Enterprise Data
par: Gill, Gurbinder, et autres
Publié: (2025)
par: Gill, Gurbinder, et autres
Publié: (2025)
The Single-File Test: A Longitudinal Public-Interface Evaluation of First-Output LLM Web Generation with Social Reach Tracking
par: Palacios, Diego Cabezas
Publié: (2026)
par: Palacios, Diego Cabezas
Publié: (2026)
HELEA: Hard-Negative Benchmark and LLM-based Reranking for Robust Entity Alignment
par: Jang, Yoonjin, et autres
Publié: (2026)
par: Jang, Yoonjin, et autres
Publié: (2026)
Random-Key Algorithms for Optimizing Integrated Operating Room Scheduling
par: Vieira, Bruno Salezze, et autres
Publié: (2025)
par: Vieira, Bruno Salezze, et autres
Publié: (2025)
Improving Existing Optimization Algorithms with LLMs
par: Sartori, Camilo Chacón, et autres
Publié: (2025)
par: Sartori, Camilo Chacón, et autres
Publié: (2025)
ToolForge: A Data Synthesis Pipeline for Multi-Hop Search without Real-World APIs
par: Chen, Hao, et autres
Publié: (2025)
par: Chen, Hao, et autres
Publié: (2025)
An Explainable Collaborative Dialogue System using a Theory of Mind
par: Cohen, Philip R., et autres
Publié: (2023)
par: Cohen, Philip R., et autres
Publié: (2023)
REMoH: A Reflective Evolution of Multi-objective Heuristics approach via Large Language Models
par: Forniés-Tabuenca, Diego, et autres
Publié: (2025)
par: Forniés-Tabuenca, Diego, et autres
Publié: (2025)
MESS+: Dynamically Learned Inference-Time LLM Routing in Model Zoos with Service Level Guarantees
par: Woisetschläger, Herbert, et autres
Publié: (2025)
par: Woisetschläger, Herbert, et autres
Publié: (2025)
CSR: Infinite-Horizon Real-Time Policies with Massive Cached State Representations
par: Karlsson, Robin, et autres
Publié: (2026)
par: Karlsson, Robin, et autres
Publié: (2026)
Learning, Fast and Slow: Towards LLMs That Adapt Continually
par: Tiwari, Rishabh, et autres
Publié: (2026)
par: Tiwari, Rishabh, et autres
Publié: (2026)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
par: Chua, Jaymari, et autres
Publié: (2025)
par: Chua, Jaymari, et autres
Publié: (2025)
Dynamics of COVID-19 Misinformation: An Analysis of Conspiracy Theories, Fake Remedies, and False Reports
par: Thakur, Nirmalya, et autres
Publié: (2025)
par: Thakur, Nirmalya, et autres
Publié: (2025)
EMR-AGENT: Automating Cohort and Feature Extraction from EMR Databases
par: Lee, Kwanhyung, et autres
Publié: (2025)
par: Lee, Kwanhyung, et autres
Publié: (2025)
TRACE: Temporal Rule-Anchored Chain-of-Evidence on Knowledge Graphs for Interpretable Stock Movement Prediction
par: Ding, Qianggang, et autres
Publié: (2026)
par: Ding, Qianggang, et autres
Publié: (2026)
REPOT: Recoverable Program-of-Thought via Checkpoint Repair
par: Mazaheri, Parsa
Publié: (2026)
par: Mazaheri, Parsa
Publié: (2026)
Assisting humans in complex comparisons: automated information comparison at scale
par: Yuen, Truman, et autres
Publié: (2024)
par: Yuen, Truman, et autres
Publié: (2024)
Reinforced Language Models for Sequential Decision Making
par: Dilkes, Jim, et autres
Publié: (2025)
par: Dilkes, Jim, et autres
Publié: (2025)
CoupleEvo: Evolving Heuristics for Coupled Optimization Problems Using Large Language Models
par: Bömer, Thomas, et autres
Publié: (2026)
par: Bömer, Thomas, et autres
Publié: (2026)
EMOS: Embodiment-aware Heterogeneous Multi-robot Operating System with LLM Agents
par: Chen, Junting, et autres
Publié: (2024)
par: Chen, Junting, et autres
Publié: (2024)
Documents similaires
-
GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing
par: Zhang, Peiyan, et autres
Publié: (2025) -
Can AI Assist in Olympiad Coding
par: Ren, Samuel
Publié: (2025) -
TrafficRAG: A Multimodal RAG Framework for Traffic Accident Liability Determination
par: Li, Xu, et autres
Publié: (2026) -
ChatGPT4PCG 2 Competition: Prompt Engineering for Science Birds Level Generation
par: Taveekitworachai, Pittawat, et autres
Publié: (2024) -
Open-TI: Open Traffic Intelligence with Augmented Language Model
par: Da, Longchao, et autres
Publié: (2023)