Salvato in:
| Autori principali: | Yan, Hang, Che, Xinyu, Xu, Fangzhi, Sun, Qiushi, Ding, Zichen, Cheng, Kanzhi, Zhang, Jian, Qin, Tao, Liu, Jun, Lin, Qika |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.02196 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OpenMobile: Building Open Mobile Agents with Task and Trajectory Synthesis
di: Cheng, Kanzhi, et al.
Pubblicazione: (2026)
di: Cheng, Kanzhi, et al.
Pubblicazione: (2026)
Interactive Evolution: A Neural-Symbolic Self-Training Framework For Large Language Models
di: Xu, Fangzhi, et al.
Pubblicazione: (2024)
di: Xu, Fangzhi, et al.
Pubblicazione: (2024)
OdysseyArena: Benchmarking Large Language Models For Long-Horizon, Active and Inductive Interactions
di: Xu, Fangzhi, et al.
Pubblicazione: (2026)
di: Xu, Fangzhi, et al.
Pubblicazione: (2026)
SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents
di: Cheng, Kanzhi, et al.
Pubblicazione: (2024)
di: Cheng, Kanzhi, et al.
Pubblicazione: (2024)
Genius: A Generalizable and Purely Unsupervised Self-Training Framework For Advanced Reasoning
di: Xu, Fangzhi, et al.
Pubblicazione: (2025)
di: Xu, Fangzhi, et al.
Pubblicazione: (2025)
OS-ATLAS: A Foundation Action Model for Generalist GUI Agents
di: Wu, Zhiyong, et al.
Pubblicazione: (2024)
di: Wu, Zhiyong, et al.
Pubblicazione: (2024)
OS-Genesis: Automating GUI Agent Trajectory Construction via Reverse Task Synthesis
di: Sun, Qiushi, et al.
Pubblicazione: (2024)
di: Sun, Qiushi, et al.
Pubblicazione: (2024)
CapArena: Benchmarking and Analyzing Detailed Image Captioning in the LLM Era
di: Cheng, Kanzhi, et al.
Pubblicazione: (2025)
di: Cheng, Kanzhi, et al.
Pubblicazione: (2025)
$ϕ$-Decoding: Adaptive Foresight Sampling for Balanced Inference-Time Exploration and Exploitation
di: Xu, Fangzhi, et al.
Pubblicazione: (2025)
di: Xu, Fangzhi, et al.
Pubblicazione: (2025)
Symbol-LLM: Towards Foundational Symbol-centric Interface For Large Language Models
di: Xu, Fangzhi, et al.
Pubblicazione: (2023)
di: Xu, Fangzhi, et al.
Pubblicazione: (2023)
OS-Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows
di: Sun, Qiushi, et al.
Pubblicazione: (2025)
di: Sun, Qiushi, et al.
Pubblicazione: (2025)
OS-Symphony: A Holistic Framework for Robust and Generalist Computer-Using Agent
di: Yang, Bowen, et al.
Pubblicazione: (2026)
di: Yang, Bowen, et al.
Pubblicazione: (2026)
ScienceBoard: Evaluating Multimodal Autonomous Agents in Realistic Scientific Workflows
di: Sun, Qiushi, et al.
Pubblicazione: (2025)
di: Sun, Qiushi, et al.
Pubblicazione: (2025)
A Semantic Mention Graph Augmented Model for Document-Level Event Argument Extraction
di: Zhang, Jian, et al.
Pubblicazione: (2024)
di: Zhang, Jian, et al.
Pubblicazione: (2024)
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
di: Xu, Fangzhi, et al.
Pubblicazione: (2023)
di: Xu, Fangzhi, et al.
Pubblicazione: (2023)
TIDE-Bench: Task-Aware and Diagnostic Evaluation of Tool-Integrated Reasoning
di: Li, Yize, et al.
Pubblicazione: (2026)
di: Li, Yize, et al.
Pubblicazione: (2026)
PathReasoner: Modeling Reasoning Path with Equivalent Extension for Logical Question Answering
di: Xu, Fangzhi, et al.
Pubblicazione: (2024)
di: Xu, Fangzhi, et al.
Pubblicazione: (2024)
Vision-Language Models Can Self-Improve Reasoning via Reflection
di: Cheng, Kanzhi, et al.
Pubblicazione: (2024)
di: Cheng, Kanzhi, et al.
Pubblicazione: (2024)
MAPS: Multi-Agent Personality Shaping for Collaborative Reasoning
di: Zhang, Jian, et al.
Pubblicazione: (2025)
di: Zhang, Jian, et al.
Pubblicazione: (2025)
$A^3$-Bench: Benchmarking Memory-Driven Scientific Reasoning via Anchor and Attractor Activation
di: Zhang, Jian, et al.
Pubblicazione: (2026)
di: Zhang, Jian, et al.
Pubblicazione: (2026)
MUR: Momentum Uncertainty guided Reasoning for Large Language Models
di: Yan, Hang, et al.
Pubblicazione: (2025)
di: Yan, Hang, et al.
Pubblicazione: (2025)
AgentStore: Scalable Integration of Heterogeneous Agents As Specialized Generalist Computer Assistant
di: Jia, Chengyou, et al.
Pubblicazione: (2024)
di: Jia, Chengyou, et al.
Pubblicazione: (2024)
Breaking the Data Barrier -- Building GUI Agents Through Task Generalization
di: Zhang, Junlei, et al.
Pubblicazione: (2025)
di: Zhang, Junlei, et al.
Pubblicazione: (2025)
Geo-TIDE
di: Eamer, Danika, et al.
Pubblicazione: (2025)
di: Eamer, Danika, et al.
Pubblicazione: (2025)
OS-Copilot: Towards Generalist Computer Agents with Self-Improvement
di: Wu, Zhiyong, et al.
Pubblicazione: (2024)
di: Wu, Zhiyong, et al.
Pubblicazione: (2024)
MFC-EQ: Mean-Field Control with Envelope Q-Learning for Moving Decentralized Agents in Formation
di: Lin, Qiushi, et al.
Pubblicazione: (2024)
di: Lin, Qiushi, et al.
Pubblicazione: (2024)
MAXS: Meta-Adaptive Exploration with LLM Agents
di: Zhang, Jian, et al.
Pubblicazione: (2026)
di: Zhang, Jian, et al.
Pubblicazione: (2026)
TIDE: Tuning-Integrated Dynamic Evolution for LLM-Based Automated Heuristic Design
di: Chen, Chentong, et al.
Pubblicazione: (2026)
di: Chen, Chentong, et al.
Pubblicazione: (2026)
Towards Unified Neurosymbolic Reasoning on Knowledge Graphs
di: Lin, Qika, et al.
Pubblicazione: (2025)
di: Lin, Qika, et al.
Pubblicazione: (2025)
GKG-LLM: A Unified Framework for Generalized Knowledge Graph Construction
di: Zhang, Jian, et al.
Pubblicazione: (2025)
di: Zhang, Jian, et al.
Pubblicazione: (2025)
TIDE: Temporal Incremental Draft Engine for Self-Improving LLM Inference
di: Park, Jiyoung, et al.
Pubblicazione: (2026)
di: Park, Jiyoung, et al.
Pubblicazione: (2026)
AgentHER: Hindsight Experience Replay for LLM Agent Trajectory Relabeling
di: Ding, Liang
Pubblicazione: (2026)
di: Ding, Liang
Pubblicazione: (2026)
TIDE: Textual Identity Detection for Evaluating and Augmenting Classification and Language Models
di: Klu, Emmanuel, et al.
Pubblicazione: (2023)
di: Klu, Emmanuel, et al.
Pubblicazione: (2023)
Self-Improving LLM Agents at Test-Time
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
IMAGES OF DISASTER, TSUNAMI TIDE OF GRIEF
di: THOMAS, EVAN
Pubblicazione: (2005)
di: THOMAS, EVAN
Pubblicazione: (2005)
Self-supervised Quantized Representation for Seamlessly Integrating Knowledge Graphs with Large Language Models
di: Lin, Qika, et al.
Pubblicazione: (2025)
di: Lin, Qika, et al.
Pubblicazione: (2025)
MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt Optimization
di: Zhang, Jian, et al.
Pubblicazione: (2025)
di: Zhang, Jian, et al.
Pubblicazione: (2025)
ARISE: An Adaptive Resolution-Aware Metric for Test-Time Scaling Evaluation in Large Reasoning Models
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
TIDE: Training Locally Interpretable Domain Generalization Models Enables Test-time Correction
di: Agarwal, Aishwarya, et al.
Pubblicazione: (2024)
di: Agarwal, Aishwarya, et al.
Pubblicazione: (2024)
Test-Time-Matching: Decouple Personality, Memory, and Linguistic Style in LLM-based Role-Playing Language Agent
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
OpenMobile: Building Open Mobile Agents with Task and Trajectory Synthesis
di: Cheng, Kanzhi, et al.
Pubblicazione: (2026) -
Interactive Evolution: A Neural-Symbolic Self-Training Framework For Large Language Models
di: Xu, Fangzhi, et al.
Pubblicazione: (2024) -
OdysseyArena: Benchmarking Large Language Models For Long-Horizon, Active and Inductive Interactions
di: Xu, Fangzhi, et al.
Pubblicazione: (2026) -
SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents
di: Cheng, Kanzhi, et al.
Pubblicazione: (2024) -
Genius: A Generalizable and Purely Unsupervised Self-Training Framework For Advanced Reasoning
di: Xu, Fangzhi, et al.
Pubblicazione: (2025)