Salvato in:
| Autori principali: | Wang, Haonan, Zhao, Mingjia, Sun, Junfeng, Liu, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2509.03479 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Research on the Integration of Embodied Intelligence and Reinforcement Learning in Textual Domains
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
ByteSized32Refactored: Towards an Extensible Interactive Text Games Corpus for LLM World Modeling and Evaluation
di: Wang, Haonan, et al.
Pubblicazione: (2025)
di: Wang, Haonan, et al.
Pubblicazione: (2025)
Research on geometric figure classification algorithm based on Deep Learning
di: Wang, Ruiyang, et al.
Pubblicazione: (2024)
di: Wang, Ruiyang, et al.
Pubblicazione: (2024)
Learning to Rewrite: Generalized LLM-Generated Text Detection
di: Li, Ran, et al.
Pubblicazione: (2024)
di: Li, Ran, et al.
Pubblicazione: (2024)
Playing 20 Question Game with Policy-Based Reinforcement Learning
di: Hu, Huang, et al.
Pubblicazione: (2018)
di: Hu, Huang, et al.
Pubblicazione: (2018)
Monte Carlo Planning with Large Language Model for Text-Based Game Agents
di: Shi, Zijing, et al.
Pubblicazione: (2025)
di: Shi, Zijing, et al.
Pubblicazione: (2025)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
Persona Dynamics: Unveiling the Impact of Personality Traits on Agents in Text-Based Games
di: Lim, Seungwon, et al.
Pubblicazione: (2025)
di: Lim, Seungwon, et al.
Pubblicazione: (2025)
GAP: Graph-Based Agent Planning with Parallel Tool Use and Reinforcement Learning
di: Wu, Jiaqi, et al.
Pubblicazione: (2025)
di: Wu, Jiaqi, et al.
Pubblicazione: (2025)
DynaWeb: Model-Based Reinforcement Learning of Web Agents
di: Ding, Hang, et al.
Pubblicazione: (2026)
di: Ding, Hang, et al.
Pubblicazione: (2026)
A Text-to-Game Engine for UGC-Based Role-Playing Games
di: Zhang, Lei, et al.
Pubblicazione: (2024)
di: Zhang, Lei, et al.
Pubblicazione: (2024)
Looking Beyond Text: Reducing Language bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance
di: Zhao, Haozhe, et al.
Pubblicazione: (2024)
di: Zhao, Haozhe, et al.
Pubblicazione: (2024)
Reinforcing Code Generation: Improving Text-to-SQL with Execution-Based Learning
di: Kulkarni, Atharv, et al.
Pubblicazione: (2025)
di: Kulkarni, Atharv, et al.
Pubblicazione: (2025)
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning
di: Gruppi, Mauricio, et al.
Pubblicazione: (2024)
di: Gruppi, Mauricio, et al.
Pubblicazione: (2024)
EVA: Efficient Reinforcement Learning for End-to-End Video Agent
di: Zhang, Yaolun, et al.
Pubblicazione: (2026)
di: Zhang, Yaolun, et al.
Pubblicazione: (2026)
TextQuests: How Good are LLMs at Text-Based Video Games?
di: Phan, Long, et al.
Pubblicazione: (2025)
di: Phan, Long, et al.
Pubblicazione: (2025)
Dynamic Optimizations of LLM Ensembles with Two-Stage Reinforcement Learning Agents
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2025)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2025)
Balancing Rewards in Text Summarization: Multi-Objective Reinforcement Learning via HyperVolume Optimization
di: Song, Junjie, et al.
Pubblicazione: (2025)
di: Song, Junjie, et al.
Pubblicazione: (2025)
Well Begun, Half Done: Reinforcement Learning with Prefix Optimization for LLM Reasoning
di: Sun, Yiliu, et al.
Pubblicazione: (2025)
di: Sun, Yiliu, et al.
Pubblicazione: (2025)
EPO: Entropy-regularized Policy Optimization for LLM Agents Reinforcement Learning
di: Xu, Wujiang, et al.
Pubblicazione: (2025)
di: Xu, Wujiang, et al.
Pubblicazione: (2025)
MHPO: Modulated Hazard-aware Policy Optimization for Stable Reinforcement Learning
di: Wang, Hongjun, et al.
Pubblicazione: (2026)
di: Wang, Hongjun, et al.
Pubblicazione: (2026)
Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System
di: Chen, Weize, et al.
Pubblicazione: (2024)
di: Chen, Weize, et al.
Pubblicazione: (2024)
GAPD: Gold-Action Policy Distillation for Agentic Reinforcement Learning in Knowledge Base Question Answering
di: Sun, Xin, et al.
Pubblicazione: (2026)
di: Sun, Xin, et al.
Pubblicazione: (2026)
Reinforcement Learning for Compositional Generalization with Outcome-Level Optimization
di: Fu, Xiyan, et al.
Pubblicazione: (2026)
di: Fu, Xiyan, et al.
Pubblicazione: (2026)
AgentGL: Towards Agentic Graph Learning with LLMs via Reinforcement Learning
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
Commonsense Knowledge Editing Based on Free-Text in LLMs
di: Huang, Xiusheng, et al.
Pubblicazione: (2024)
di: Huang, Xiusheng, et al.
Pubblicazione: (2024)
Beyond the Turn-Based Game: Enabling Real-Time Conversations with Duplex Models
di: Zhang, Xinrong, et al.
Pubblicazione: (2024)
di: Zhang, Xinrong, et al.
Pubblicazione: (2024)
Monocle: Hybrid Local-Global In-Context Evaluation for Long-Text Generation with Uncertainty-Based Active Learning
di: Wang, Xiaorong, et al.
Pubblicazione: (2025)
di: Wang, Xiaorong, et al.
Pubblicazione: (2025)
TextAtari: 100K Frames Game Playing with Language Agents
di: Li, Wenhao, et al.
Pubblicazione: (2025)
di: Li, Wenhao, et al.
Pubblicazione: (2025)
Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning
di: Lin, Jiacheng, et al.
Pubblicazione: (2025)
di: Lin, Jiacheng, et al.
Pubblicazione: (2025)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
di: Liu, Bo, et al.
Pubblicazione: (2025)
di: Liu, Bo, et al.
Pubblicazione: (2025)
AMONGAGENTS: Evaluating Large Language Models in the Interactive Text-Based Social Deduction Game
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
di: Chi, Yizhou, et al.
Pubblicazione: (2024)
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
di: Qi, Zehan, et al.
Pubblicazione: (2024)
di: Qi, Zehan, et al.
Pubblicazione: (2024)
Multi-Dimensional Optimization for Text Summarization via Reinforcement Learning
di: Ryu, Sangwon, et al.
Pubblicazione: (2024)
di: Ryu, Sangwon, et al.
Pubblicazione: (2024)
TDAG: A Multi-Agent Framework based on Dynamic Task Decomposition and Agent Generation
di: Wang, Yaoxiang, et al.
Pubblicazione: (2024)
di: Wang, Yaoxiang, et al.
Pubblicazione: (2024)
Sticking to the Mean: Detecting Sticky Tokens in Text Embedding Models
di: Chen, Kexin, et al.
Pubblicazione: (2025)
di: Chen, Kexin, et al.
Pubblicazione: (2025)
Large Language Models as Agents in Two-Player Games
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
InfoFlow: Reinforcing Search Agent Via Reward Density Optimization
di: Luo, Kun, et al.
Pubblicazione: (2025)
di: Luo, Kun, et al.
Pubblicazione: (2025)
GTA: Supervised-Guided Reinforcement Learning for Text Classification with Large Language Models
di: Zeng, Min, et al.
Pubblicazione: (2025)
di: Zeng, Min, et al.
Pubblicazione: (2025)
Dynamic Affective Memory Management for Personalized LLM Agents
di: Lu, Junfeng, et al.
Pubblicazione: (2025)
di: Lu, Junfeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Research on the Integration of Embodied Intelligence and Reinforcement Learning in Textual Domains
di: Wang, Haonan, et al.
Pubblicazione: (2025) -
ByteSized32Refactored: Towards an Extensible Interactive Text Games Corpus for LLM World Modeling and Evaluation
di: Wang, Haonan, et al.
Pubblicazione: (2025) -
Research on geometric figure classification algorithm based on Deep Learning
di: Wang, Ruiyang, et al.
Pubblicazione: (2024) -
Learning to Rewrite: Generalized LLM-Generated Text Detection
di: Li, Ran, et al.
Pubblicazione: (2024) -
Playing 20 Question Game with Policy-Based Reinforcement Learning
di: Hu, Huang, et al.
Pubblicazione: (2018)