Language Guided Exploration for RL Agents in Text Environments
Fuente:
arXiv
Salvato in:
| Autori principali: | Golchha, Hitesh, Yerawar, Sahil, Patel, Dhruvesh, Dan, Soham, Murugesan, Keerthiram |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
di: Gruppi, Mauricio, et al.
Pubblicazione: (2024)
di: Gruppi, Mauricio, et al.
Pubblicazione: (2024)
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
di: Basavatia, Shreyas, et al.
Pubblicazione: (2024)
di: Basavatia, Shreyas, et al.
Pubblicazione: (2024)
CTBench: A Comprehensive Benchmark for Evaluating Language Model Capabilities in Clinical Trial Design
di: Neehal, Nafis, et al.
Pubblicazione: (2024)
di: Neehal, Nafis, et al.
Pubblicazione: (2024)
EXPLORER: Exploration-guided Reasoning for Textual Reinforcement Learning
di: Basu, Kinjal, et al.
Pubblicazione: (2024)
di: Basu, Kinjal, et al.
Pubblicazione: (2024)
AgentRouter: A Knowledge-Graph-Guided LLM Router for Collaborative Multi-Agent Question Answering
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)
Towards Aligning Language Models with Textual Feedback
di: Lloret, Saüc Abadal, et al.
Pubblicazione: (2024)
di: Lloret, Saüc Abadal, et al.
Pubblicazione: (2024)
NG-Router: Graph-Supervised Multi-Agent Collaboration for Nutrition Question Answering
di: Shi, Kaiwen, et al.
Pubblicazione: (2025)
di: Shi, Kaiwen, et al.
Pubblicazione: (2025)
Cross-Examiner: Evaluating Consistency of Large Language Model-Generated Explanations
di: Villa, Danielle, et al.
Pubblicazione: (2025)
di: Villa, Danielle, et al.
Pubblicazione: (2025)
Food4All: A Multi-Agent Framework for Real-time Free Food Discovery with Integrated Nutritional Metadata
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
di: Yuan, Zhengqing, et al.
Pubblicazione: (2025)
BAGEL: Bootstrapping Agents by Guiding Exploration with Language
di: Murty, Shikhar, et al.
Pubblicazione: (2024)
di: Murty, Shikhar, et al.
Pubblicazione: (2024)
Automated Detection and Analysis of Power Words in Persuasive Text Using Natural Language Processing
di: Garje, Sahil
Pubblicazione: (2024)
di: Garje, Sahil
Pubblicazione: (2024)
KnowRL: Teaching Language Models to Know What They Know
di: Kale, Sahil, et al.
Pubblicazione: (2025)
di: Kale, Sahil, et al.
Pubblicazione: (2025)
Mitigating Misalignment Contagion by Steering with Implicit Traits
di: Chang, Maria, et al.
Pubblicazione: (2026)
di: Chang, Maria, et al.
Pubblicazione: (2026)
Protecting Users From Themselves: Safeguarding Contextual Privacy in Interactions with Conversational Agents
di: Ngong, Ivoline, et al.
Pubblicazione: (2025)
di: Ngong, Ivoline, et al.
Pubblicazione: (2025)
An Exploration of Self-Supervised Mutual Information Alignment for Multi-Task Settings
di: Govande, Soham V.
Pubblicazione: (2024)
di: Govande, Soham V.
Pubblicazione: (2024)
Insertion Language Models: Sequence Generation with Arbitrary-Position Insertions
di: Patel, Dhruvesh, et al.
Pubblicazione: (2025)
di: Patel, Dhruvesh, et al.
Pubblicazione: (2025)
XLM: A Python package for non-autoregressive language models
di: Patel, Dhruvesh, et al.
Pubblicazione: (2025)
di: Patel, Dhruvesh, et al.
Pubblicazione: (2025)
AccessEval: Benchmarking Disability Bias in Large Language Models
di: Panda, Srikant, et al.
Pubblicazione: (2025)
di: Panda, Srikant, et al.
Pubblicazione: (2025)
Tokenization Matters: Improving Zero-Shot NER for Indic Languages
di: Pattnayak, Priyaranjan, et al.
Pubblicazione: (2025)
di: Pattnayak, Priyaranjan, et al.
Pubblicazione: (2025)
Exploration of Plan-Guided Summarization for Narrative Texts: the Case of Small Language Models
di: Grenander, Matt, et al.
Pubblicazione: (2025)
di: Grenander, Matt, et al.
Pubblicazione: (2025)
Endless Terminals: Scaling RL Environments for Terminal Agents
di: Gandhi, Kanishk, et al.
Pubblicazione: (2026)
di: Gandhi, Kanishk, et al.
Pubblicazione: (2026)
PilotRL: Training Language Model Agents via Global Planning-Guided Progressive Reinforcement Learning
di: Lu, Keer, et al.
Pubblicazione: (2025)
di: Lu, Keer, et al.
Pubblicazione: (2025)
Words as Beacons: Guiding RL Agents with High-Level Language Prompts
di: Ruiz-Gonzalez, Unai, et al.
Pubblicazione: (2024)
di: Ruiz-Gonzalez, Unai, et al.
Pubblicazione: (2024)
IOLBENCH: Benchmarking LLMs on Linguistic Reasoning
di: Goyal, Satyam, et al.
Pubblicazione: (2025)
di: Goyal, Satyam, et al.
Pubblicazione: (2025)
OjaKV: Context-Aware Online Low-Rank KV Cache Compression
di: Zhu, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhu, Yuxuan, et al.
Pubblicazione: (2025)
$τ^2$-Bench: Evaluating Conversational Agents in a Dual-Control Environment
di: Barres, Victor, et al.
Pubblicazione: (2025)
di: Barres, Victor, et al.
Pubblicazione: (2025)
Guided Navigation in Knowledge-Dense Environments: Structured Semantic Exploration with Guidance Graphs
di: Tao, Dehao, et al.
Pubblicazione: (2025)
di: Tao, Dehao, et al.
Pubblicazione: (2025)
Benchmarking LLM Guardrails in Handling Multilingual Toxicity
di: Yang, Yahan, et al.
Pubblicazione: (2024)
di: Yang, Yahan, et al.
Pubblicazione: (2024)
SPENCE: A Syntactic Probe for Detecting Contamination in NL2SQL Benchmarks
di: Safarzadeh, Mohammadtaher, et al.
Pubblicazione: (2026)
di: Safarzadeh, Mohammadtaher, et al.
Pubblicazione: (2026)
Dissecting the Ledger: Locating and Suppressing "Liar Circuits" in Financial Large Language Models
di: Mirajkar, Soham
Pubblicazione: (2025)
di: Mirajkar, Soham
Pubblicazione: (2025)
Multilingual Needle in a Haystack: Investigating Long-Context Behavior of Multilingual Large Language Models
di: Hengle, Amey, et al.
Pubblicazione: (2024)
di: Hengle, Amey, et al.
Pubblicazione: (2024)
SLM-SQL: An Exploration of Small Language Models for Text-to-SQL
di: Sheng, Lei, et al.
Pubblicazione: (2025)
di: Sheng, Lei, et al.
Pubblicazione: (2025)
Robust Audio-Text Retrieval via Cross-Modal Attention and Hybrid Loss
di: Liu, Meizhu, et al.
Pubblicazione: (2026)
di: Liu, Meizhu, et al.
Pubblicazione: (2026)
FlexSQL: Flexible Exploration and Execution Make Better Text-to-SQL Agents
di: Pham, Quang Hieu, et al.
Pubblicazione: (2026)
di: Pham, Quang Hieu, et al.
Pubblicazione: (2026)
PExA: Parallel Exploration Agent for Complex Text-to-SQL
di: Parekh, Tanmay, et al.
Pubblicazione: (2026)
di: Parekh, Tanmay, et al.
Pubblicazione: (2026)
ZoomR: Memory Efficient Reasoning through Multi-Granularity Key Value Retrieval
di: Yang, David H., et al.
Pubblicazione: (2026)
di: Yang, David H., et al.
Pubblicazione: (2026)
SpeechWeave: Diverse Multilingual Synthetic Text & Audio Data Generation Pipeline for Training Text to Speech Models
di: Dua, Karan, et al.
Pubblicazione: (2025)
di: Dua, Karan, et al.
Pubblicazione: (2025)
Exploring the Robustness of Language Models for Tabular Question Answering via Attention Analysis
di: Bhandari, Kushal Raj, et al.
Pubblicazione: (2024)
di: Bhandari, Kushal Raj, et al.
Pubblicazione: (2024)
Exploration of Masked and Causal Language Modelling for Text Generation
di: Micheletti, Nicolo, et al.
Pubblicazione: (2024)
di: Micheletti, Nicolo, et al.
Pubblicazione: (2024)
MrGuard: A Multilingual Reasoning Guardrail for Universal LLM Safety
di: Yang, Yahan, et al.
Pubblicazione: (2025)
di: Yang, Yahan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
di: Gruppi, Mauricio, et al.
Pubblicazione: (2024) -
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
di: Basavatia, Shreyas, et al.
Pubblicazione: (2024) -
CTBench: A Comprehensive Benchmark for Evaluating Language Model Capabilities in Clinical Trial Design
di: Neehal, Nafis, et al.
Pubblicazione: (2024) -
EXPLORER: Exploration-guided Reasoning for Textual Reinforcement Learning
di: Basu, Kinjal, et al.
Pubblicazione: (2024) -
AgentRouter: A Knowledge-Graph-Guided LLM Router for Collaborative Multi-Agent Question Answering
di: Zhang, Zheyuan, et al.
Pubblicazione: (2025)