Salvato in:
| Autori principali: | Tan, Weihao, Jiang, Changjiu, Duan, Yu, Lei, Mingcong, Li, Jiageng, Hong, Yitian, Wang, Xinrun, An, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2507.07445 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CrafterDojo: A Suite of Foundation Models for Building Open-Ended Embodied Agents in Crafter
di: Park, Junyeong, et al.
Pubblicazione: (2025)
di: Park, Junyeong, et al.
Pubblicazione: (2025)
JaxLife: An Open-Ended Agentic Simulator
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
Democratizing Game Modding with GenAI: A Case Study of StarCharM, a Stardew Valley Character Maker
di: Miralvand, Hamid Zand, et al.
Pubblicazione: (2025)
di: Miralvand, Hamid Zand, et al.
Pubblicazione: (2025)
True Knowledge Comes from Practice: Aligning LLMs with Embodied Environments via Reinforcement Learning
di: Tan, Weihao, et al.
Pubblicazione: (2024)
di: Tan, Weihao, et al.
Pubblicazione: (2024)
OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments
di: Xie, Tianbao, et al.
Pubblicazione: (2024)
di: Xie, Tianbao, et al.
Pubblicazione: (2024)
PuzzleWorld: A Benchmark for Multimodal, Open-Ended Reasoning in Puzzlehunts
di: Li, Hengzhi, et al.
Pubblicazione: (2025)
di: Li, Hengzhi, et al.
Pubblicazione: (2025)
KASER: Knowledge-Aligned Student Error Simulator for Open-Ended Coding Tasks
di: Duan, Zhangqi, et al.
Pubblicazione: (2026)
di: Duan, Zhangqi, et al.
Pubblicazione: (2026)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
di: Shaar, Shaden, et al.
Pubblicazione: (2026)
di: Shaar, Shaden, et al.
Pubblicazione: (2026)
CrafText Benchmark: Advancing Instruction Following in Complex Multimodal Open-Ended World
di: Volovikova, Zoya, et al.
Pubblicazione: (2025)
di: Volovikova, Zoya, et al.
Pubblicazione: (2025)
Grading Open‐Ended Questions Using LLMs and RAG
di: Jacobo Farray Rodríguez, et al.
Pubblicazione: (2025)
di: Jacobo Farray Rodríguez, et al.
Pubblicazione: (2025)
DeepPHY: Benchmarking Agentic VLMs on Physical Reasoning
di: Xu, Xinrun, et al.
Pubblicazione: (2025)
di: Xu, Xinrun, et al.
Pubblicazione: (2025)
OpenEP: Open-Ended Future Event Prediction
di: Guan, Yong, et al.
Pubblicazione: (2024)
di: Guan, Yong, et al.
Pubblicazione: (2024)
Open-Ended Video Game Glitch Detection with Agentic Reasoning and Temporal Grounding
di: Zheng, Muyang, et al.
Pubblicazione: (2026)
di: Zheng, Muyang, et al.
Pubblicazione: (2026)
How Intrinsic Motivation Underlies Embodied Open-Ended Behavior
di: Moreno-Bote, Rubén, et al.
Pubblicazione: (2026)
di: Moreno-Bote, Rubén, et al.
Pubblicazione: (2026)
Dojo: A Differentiable Physics Engine for Robotics
di: Howell, Taylor A., et al.
Pubblicazione: (2022)
di: Howell, Taylor A., et al.
Pubblicazione: (2022)
Can LLMs Reliably Simulate Human Learner Actions? A Simulation Authoring Framework for Open-Ended Learning Environments
di: Mannekote, Amogh, et al.
Pubblicazione: (2024)
di: Mannekote, Amogh, et al.
Pubblicazione: (2024)
Agentic Learner with Grow-and-Refine Multimodal Semantic Memory
di: Bo, Weihao, et al.
Pubblicazione: (2025)
di: Bo, Weihao, et al.
Pubblicazione: (2025)
Generating Planning Feedback for Open-Ended Programming Exercises with LLMs
di: Demirtaş, Mehmet Arif, et al.
Pubblicazione: (2025)
di: Demirtaş, Mehmet Arif, et al.
Pubblicazione: (2025)
Quality Control in Open-Ended Crowdsourcing: A Survey
di: Chai, Lei, et al.
Pubblicazione: (2024)
di: Chai, Lei, et al.
Pubblicazione: (2024)
On Creativity and Open-Endedness
di: Soros, L. B., et al.
Pubblicazione: (2024)
di: Soros, L. B., et al.
Pubblicazione: (2024)
R2-Write: Reflection and Revision for Open-Ended Writing with Deep Reasoning
di: Liu, Wanlong, et al.
Pubblicazione: (2026)
di: Liu, Wanlong, et al.
Pubblicazione: (2026)
LeakDojo: Decoding the Leakage Threats of RAG Systems
di: Zhang, Maosen, et al.
Pubblicazione: (2026)
di: Zhang, Maosen, et al.
Pubblicazione: (2026)
The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation
di: Carlsson, Fredrik, et al.
Pubblicazione: (2024)
di: Carlsson, Fredrik, et al.
Pubblicazione: (2024)
Craftax: A Lightning-Fast Benchmark for Open-Ended Reinforcement Learning
di: Matthews, Michael, et al.
Pubblicazione: (2024)
di: Matthews, Michael, et al.
Pubblicazione: (2024)
MORQA: Benchmarking Evaluation Metrics for Medical Open-Ended Question Answering
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
di: Yim, Wen-wai, et al.
Pubblicazione: (2025)
Too Open for Opinion? Embracing Open-Endedness in Large Language Models for Social Simulation
di: Ma, Bolei, et al.
Pubblicazione: (2025)
di: Ma, Bolei, et al.
Pubblicazione: (2025)
MLE-Dojo: Interactive Environments for Empowering LLM Agents in Machine Learning Engineering
di: Qiang, Rushi, et al.
Pubblicazione: (2025)
di: Qiang, Rushi, et al.
Pubblicazione: (2025)
Enabling Adaptive Agent Training in Open-Ended Simulators by Targeting Diversity
di: Costales, Robby, et al.
Pubblicazione: (2024)
di: Costales, Robby, et al.
Pubblicazione: (2024)
A cross-modal pre-training framework with video data for improving performance and generalization of distributed acoustic sensing
di: Duan, Junyi, et al.
Pubblicazione: (2025)
di: Duan, Junyi, et al.
Pubblicazione: (2025)
DAS-MAE: A self-supervised pre-training framework for universal and high-performance representation learning of distributed fiber-optic acoustic sensing
di: Duan, Junyi, et al.
Pubblicazione: (2025)
di: Duan, Junyi, et al.
Pubblicazione: (2025)
ChinaTravel: An Open-Ended Travel Planning Benchmark with Compositional Constraint Validation for Language Agents
di: Shao, Jie-Jing, et al.
Pubblicazione: (2024)
di: Shao, Jie-Jing, et al.
Pubblicazione: (2024)
3DTTNet: Multimodal Fusion-Based 3D Traversable Terrain Modeling for Off-Road Environments
di: Chen, Zitong, et al.
Pubblicazione: (2024)
di: Chen, Zitong, et al.
Pubblicazione: (2024)
PerfDojo: Automated ML Library Generation for Heterogeneous Architectures
di: Ivanov, Andrei, et al.
Pubblicazione: (2025)
di: Ivanov, Andrei, et al.
Pubblicazione: (2025)
BeamDojo: Learning Agile Humanoid Locomotion on Sparse Footholds
di: Wang, Huayi, et al.
Pubblicazione: (2025)
di: Wang, Huayi, et al.
Pubblicazione: (2025)
Training Language Model Agents to Find Vulnerabilities with CTF-Dojo
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2025)
di: Zhuo, Terry Yue, et al.
Pubblicazione: (2025)
CausalEvolve: Towards Open-Ended Discovery with Causal Scratchpad
di: Chen, Yongqiang, et al.
Pubblicazione: (2026)
di: Chen, Yongqiang, et al.
Pubblicazione: (2026)
StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs
di: Jeune, Pierre Le, et al.
Pubblicazione: (2026)
di: Jeune, Pierre Le, et al.
Pubblicazione: (2026)
Unveiling the Potential of Vision-Language-Action Models with Open-Ended Multimodal Instructions
di: Zhao, Wei, et al.
Pubblicazione: (2025)
di: Zhao, Wei, et al.
Pubblicazione: (2025)
GUIDE: A Benchmark for Understanding and Assisting Users in Open-Ended GUI Tasks
di: Yang, Saelyne, et al.
Pubblicazione: (2026)
di: Yang, Saelyne, et al.
Pubblicazione: (2026)
Assessing Bias in Metric Models for LLM Open-Ended Generation Bias Benchmarks
di: Demchak, Nathaniel, et al.
Pubblicazione: (2024)
di: Demchak, Nathaniel, et al.
Pubblicazione: (2024)
Documenti analoghi
-
CrafterDojo: A Suite of Foundation Models for Building Open-Ended Embodied Agents in Crafter
di: Park, Junyeong, et al.
Pubblicazione: (2025) -
JaxLife: An Open-Ended Agentic Simulator
di: Lu, Chris, et al.
Pubblicazione: (2024) -
Democratizing Game Modding with GenAI: A Case Study of StarCharM, a Stardew Valley Character Maker
di: Miralvand, Hamid Zand, et al.
Pubblicazione: (2025) -
True Knowledge Comes from Practice: Aligning LLMs with Embodied Environments via Reinforcement Learning
di: Tan, Weihao, et al.
Pubblicazione: (2024) -
OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments
di: Xie, Tianbao, et al.
Pubblicazione: (2024)