Language-Guided Tuning: Enhancing Numeric Optimization with Textual Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Lu, Yuxing, Hu, Yucheng, Sun, Nan, Zhao, Xukai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DoctorRAG: Medical RAG Fusing Knowledge with Patient Analogy through Textual Gradients
por: Lu, Yuxing, et al.
Publicado: (2025)
por: Lu, Yuxing, et al.
Publicado: (2025)
Language Agents as Optimizable Graphs
por: Zhuge, Mingchen, et al.
Publicado: (2024)
por: Zhuge, Mingchen, et al.
Publicado: (2024)
LLM-as-RNN: A Recurrent Language Model for Memory Updates and Sequence Prediction
por: Lu, Yuxing, et al.
Publicado: (2026)
por: Lu, Yuxing, et al.
Publicado: (2026)
Multi-Objective Reinforcement Learning for Large Language Model Optimization: Visionary Perspective
por: Kong, Lingxiao, et al.
Publicado: (2025)
por: Kong, Lingxiao, et al.
Publicado: (2025)
AgentRec: Agent Recommendation Using Sentence Embeddings Aligned to Human Feedback
por: Park, Joshua, et al.
Publicado: (2025)
por: Park, Joshua, et al.
Publicado: (2025)
In-the-Flow Agentic System Optimization for Effective Planning and Tool Use
por: Li, Zhuofeng, et al.
Publicado: (2025)
por: Li, Zhuofeng, et al.
Publicado: (2025)
Multi-Agent Design: Optimizing Agents with Better Prompts and Topologies
por: Zhou, Han, et al.
Publicado: (2025)
por: Zhou, Han, et al.
Publicado: (2025)
Dipper: Diversity in Prompts for Producing Large Language Model Ensembles in Reasoning tasks
por: Lau, Gregory Kang Ruey, et al.
Publicado: (2024)
por: Lau, Gregory Kang Ruey, et al.
Publicado: (2024)
ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents
por: Lu, Yuxing, et al.
Publicado: (2026)
por: Lu, Yuxing, et al.
Publicado: (2026)
Recursive Agent Optimization
por: Gandhi, Apurva, et al.
Publicado: (2026)
por: Gandhi, Apurva, et al.
Publicado: (2026)
Optimizing Model Selection for Compound AI Systems
por: Chen, Lingjiao, et al.
Publicado: (2025)
por: Chen, Lingjiao, et al.
Publicado: (2025)
MASPO: Joint Prompt Optimization for LLM-based Multi-Agent Systems
por: Wang, Zhexuan, et al.
Publicado: (2026)
por: Wang, Zhexuan, et al.
Publicado: (2026)
Communicating Sound Through Natural Language
por: Rossi, Emanuele, et al.
Publicado: (2026)
por: Rossi, Emanuele, et al.
Publicado: (2026)
One Panel Does Not Fit All: Case-Adaptive Multi-Agent Deliberation for Clinical Prediction
por: Lu, Yuxing, et al.
Publicado: (2026)
por: Lu, Yuxing, et al.
Publicado: (2026)
In-Context Environments Induce Evaluation-Awareness in Language Models
por: Chaudhary, Maheep
Publicado: (2026)
por: Chaudhary, Maheep
Publicado: (2026)
$\textit{Agents Under Siege}$: Breaking Pragmatic Multi-Agent LLM Systems with Optimized Prompt Attacks
por: Khan, Rana Muhammad Shahroz, et al.
Publicado: (2025)
por: Khan, Rana Muhammad Shahroz, et al.
Publicado: (2025)
Training Language Models for Social Deduction with Multi-Agent Reinforcement Learning
por: Sarkar, Bidipta, et al.
Publicado: (2025)
por: Sarkar, Bidipta, et al.
Publicado: (2025)
RDMA: Cost Effective Agent-Driven Rare Disease Mining from Electronic Health Records
por: Wu, John, et al.
Publicado: (2025)
por: Wu, John, et al.
Publicado: (2025)
Iteration of Thought: Leveraging Inner Dialogue for Autonomous Large Language Model Reasoning
por: Radha, Santosh Kumar, et al.
Publicado: (2024)
por: Radha, Santosh Kumar, et al.
Publicado: (2024)
Exploring Natural Language-Based Strategies for Efficient Number Learning in Children through Reinforcement Learning
por: Mittra, Tirthankar
Publicado: (2024)
por: Mittra, Tirthankar
Publicado: (2024)
Persuade Me if You Can: A Framework for Evaluating Persuasion Effectiveness and Susceptibility Among Large Language Models
por: Bozdag, Nimet Beyza, et al.
Publicado: (2025)
por: Bozdag, Nimet Beyza, et al.
Publicado: (2025)
Collaborative Memory: Multi-User Memory Sharing in LLM Agents with Dynamic Access Control
por: Rezazadeh, Alireza, et al.
Publicado: (2025)
por: Rezazadeh, Alireza, et al.
Publicado: (2025)
MedAgentBoard: Benchmarking Multi-Agent Collaboration with Conventional Methods for Diverse Medical Tasks
por: Zhu, Yinghao, et al.
Publicado: (2025)
por: Zhu, Yinghao, et al.
Publicado: (2025)
MAGIC: A Co-Evolving Attacker-Defender Adversarial Game for Robust LLM Safety
por: Wen, Xiaoyu, et al.
Publicado: (2026)
por: Wen, Xiaoyu, et al.
Publicado: (2026)
HealthFlow: A Self-Evolving AI Agent with Meta Planning for Autonomous Healthcare Research
por: Zhu, Yinghao, et al.
Publicado: (2025)
por: Zhu, Yinghao, et al.
Publicado: (2025)
ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning
por: Wan, Ziyu, et al.
Publicado: (2025)
por: Wan, Ziyu, et al.
Publicado: (2025)
DroidSpeak: KV Cache Sharing for Cross-LLM Communication and Multi-LLM Serving
por: Liu, Yuhan, et al.
Publicado: (2024)
por: Liu, Yuhan, et al.
Publicado: (2024)
MLZero: A Multi-Agent System for End-to-end Machine Learning Automation
por: Fang, Haoyang, et al.
Publicado: (2025)
por: Fang, Haoyang, et al.
Publicado: (2025)
ToolOrchestra: Elevating Intelligence via Efficient Model and Tool Orchestration
por: Su, Hongjin, et al.
Publicado: (2025)
por: Su, Hongjin, et al.
Publicado: (2025)
Agent Trading Arena: A Study on Numerical Understanding in LLM-Based Agents
por: Ma, Tianmi, et al.
Publicado: (2025)
por: Ma, Tianmi, et al.
Publicado: (2025)
Chain of Uncertain Rewards with Large Language Models for Reinforcement Learning
por: Mo, Shentong
Publicado: (2026)
por: Mo, Shentong
Publicado: (2026)
Chain of Questions: Guiding Multimodal Curiosity in Language Models
por: Iji, Nima, et al.
Publicado: (2025)
por: Iji, Nima, et al.
Publicado: (2025)
LLM Review: Enhancing Creative Writing via Blind Peer Review Feedback
por: Li, Weiyue, et al.
Publicado: (2026)
por: Li, Weiyue, et al.
Publicado: (2026)
LLM-based Multi-Agent Reinforcement Learning: Current and Future Directions
por: Sun, Chuanneng, et al.
Publicado: (2024)
por: Sun, Chuanneng, et al.
Publicado: (2024)
NeKo: Cross-Modality Post-Recognition Error Correction with Tasks-Guided Mixture-of-Experts Language Model
por: Lin, Yen-Ting, et al.
Publicado: (2024)
por: Lin, Yen-Ting, et al.
Publicado: (2024)
Editing Personality for Large Language Models
por: Mao, Shengyu, et al.
Publicado: (2023)
por: Mao, Shengyu, et al.
Publicado: (2023)
Mnemosyne: An Unsupervised, Human-Inspired Long-Term Memory Architecture for Edge-Based LLMs
por: Jonelagadda, Aneesh, et al.
Publicado: (2025)
por: Jonelagadda, Aneesh, et al.
Publicado: (2025)
Build Your Personalized Research Group: A Multiagent Framework for Continual and Interactive Science Automation
por: Li, Ed, et al.
Publicado: (2025)
por: Li, Ed, et al.
Publicado: (2025)
Verification-Aware Planning for Multi-Agent Systems
por: Xu, Tianyang, et al.
Publicado: (2025)
por: Xu, Tianyang, et al.
Publicado: (2025)
DR. WELL: Dynamic Reasoning and Learning with Symbolic World Model for Embodied LLM-Based Multi-Agent Collaboration
por: Nourzad, Narjes, et al.
Publicado: (2025)
por: Nourzad, Narjes, et al.
Publicado: (2025)
Ejemplares similares
-
DoctorRAG: Medical RAG Fusing Knowledge with Patient Analogy through Textual Gradients
por: Lu, Yuxing, et al.
Publicado: (2025) -
Language Agents as Optimizable Graphs
por: Zhuge, Mingchen, et al.
Publicado: (2024) -
LLM-as-RNN: A Recurrent Language Model for Memory Updates and Sequence Prediction
por: Lu, Yuxing, et al.
Publicado: (2026) -
Multi-Objective Reinforcement Learning for Large Language Model Optimization: Visionary Perspective
por: Kong, Lingxiao, et al.
Publicado: (2025) -
AgentRec: Agent Recommendation Using Sentence Embeddings Aligned to Human Feedback
por: Park, Joshua, et al.
Publicado: (2025)