Learning, Reasoning, Refinement: A Framework for Kahneman's Dual-System Intelligence in GUI Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Jinjie, Liu, Jiyao, Liu, Lihao, Hu, Ming, Ning, Junzhi, Li, Mingcheng, Yin, Weijie, He, Junjun, Liang, Xiao, Feng, Chao, Yang, Dingkang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MedAide: Information Fusion and Anatomy of Medical Intents via LLM-based Agent Collaboration
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
Open World MRI Reconstruction with Bias-Calibrated Adaptation
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
THE-Tree: Can Tracing Historical Evolution Enhance Scientific Verification and Reasoning?
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
MedQ-Engine: A Closed-Loop Data Engine for Evolving MLLMs in Medical Image Quality Assessment
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
MedQ-UNI: Toward Unified Medical Image Quality Assessment and Restoration via Vision-Language Modeling
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
SAILViT: Towards Robust and Generalizable Visual Backbones for MLLMs via Gradual Feature Refinement
di: Yin, Weijie, et al.
Pubblicazione: (2025)
di: Yin, Weijie, et al.
Pubblicazione: (2025)
Multi-modal MRI Translation via Evidential Regression and Distribution Calibration
di: Liu, Jiyao, et al.
Pubblicazione: (2024)
di: Liu, Jiyao, et al.
Pubblicazione: (2024)
MedQ-Bench: Evaluating and Exploring Medical Image Quality Assessment Abilities in MLLMs
di: Liu, Jiyao, et al.
Pubblicazione: (2025)
di: Liu, Jiyao, et al.
Pubblicazione: (2025)
MedGround-R1: Advancing Medical Image Grounding via Spatial-Semantic Rewarded Group Relative Policy Optimization
di: Xu, Huihui, et al.
Pubblicazione: (2025)
di: Xu, Huihui, et al.
Pubblicazione: (2025)
MedQ-Deg: A Multidimensional Benchmark for Evaluating MLLMs Across Medical Image Quality Degradations
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
di: Liu, Jiyao, et al.
Pubblicazione: (2026)
GMAI-VL-R1: Harnessing Reinforcement Learning for Multimodal Medical Reasoning
di: Su, Yanzhou, et al.
Pubblicazione: (2025)
di: Su, Yanzhou, et al.
Pubblicazione: (2025)
Ophora: A Large-Scale Data-Driven Text-Guided Ophthalmic Surgical Video Generation Model
di: Li, Wei, et al.
Pubblicazione: (2025)
di: Li, Wei, et al.
Pubblicazione: (2025)
Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
RetinaLogos: Fine-Grained Synthesis of High-Resolution Retinal Images Through Captions
di: Ning, Junzhi, et al.
Pubblicazione: (2025)
di: Ning, Junzhi, et al.
Pubblicazione: (2025)
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
di: Li, Mingcheng, et al.
Pubblicazione: (2025)
di: Li, Mingcheng, et al.
Pubblicazione: (2025)
MMBench-GUI: Hierarchical Multi-Platform Evaluation Framework for GUI Agents
di: Wang, Xuehui, et al.
Pubblicazione: (2025)
di: Wang, Xuehui, et al.
Pubblicazione: (2025)
Can LLMs' Tuning Methods Work in Medical Multimodal Domain?
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
Efficiency in Focus: LayerNorm as a Catalyst for Fine-tuning Medical Visual Language Pre-trained Models
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
GUI-ReWalk: Massive Data Generation for GUI Agent via Stochastic Exploration and Intent-Aware Reasoning
di: Lin, Musen, et al.
Pubblicazione: (2025)
di: Lin, Musen, et al.
Pubblicazione: (2025)
MemGUI-Bench: Benchmarking Memory of Mobile GUI Agents in Dynamic Environments
di: Liu, Guangyi, et al.
Pubblicazione: (2026)
di: Liu, Guangyi, et al.
Pubblicazione: (2026)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
di: Xue, Wei, et al.
Pubblicazione: (2026)
di: Xue, Wei, et al.
Pubblicazione: (2026)
MPR-GUI: Benchmarking and Enhancing Multilingual Perception and Reasoning in GUI Agents
di: Chen, Ruihan, et al.
Pubblicazione: (2025)
di: Chen, Ruihan, et al.
Pubblicazione: (2025)
GUI-Rise: Structured Reasoning and History Summarization for GUI Navigation
di: Liu, Tao, et al.
Pubblicazione: (2025)
di: Liu, Tao, et al.
Pubblicazione: (2025)
Debiased Multimodal Understanding for Human Language Sequences
di: Xu, Zhi, et al.
Pubblicazione: (2024)
di: Xu, Zhi, et al.
Pubblicazione: (2024)
Uncertainty-Aware GUI Agent: Adaptive Perception through Component Recommendation and Human-in-the-Loop Refinement
di: Hao, Chao, et al.
Pubblicazione: (2025)
di: Hao, Chao, et al.
Pubblicazione: (2025)
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
Continual GUI Agents
di: Liu, Ziwei, et al.
Pubblicazione: (2026)
di: Liu, Ziwei, et al.
Pubblicazione: (2026)
DisCo-Layout: Disentangling and Coordinating Semantic and Physical Refinement in a Multi-Agent Framework for 3D Indoor Layout Synthesis
di: Gao, Jialin, et al.
Pubblicazione: (2025)
di: Gao, Jialin, et al.
Pubblicazione: (2025)
MMRareBench: A Rare-Disease Multimodal and Multi-Image Medical Benchmark
di: Ning, Junzhi, et al.
Pubblicazione: (2026)
di: Ning, Junzhi, et al.
Pubblicazione: (2026)
ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents
di: Tang, Fei, et al.
Pubblicazione: (2026)
di: Tang, Fei, et al.
Pubblicazione: (2026)
ADAgent: LLM Agent for Alzheimer's Disease Analysis with Collaborative Coordinator
di: Hou, Wenlong, et al.
Pubblicazione: (2025)
di: Hou, Wenlong, et al.
Pubblicazione: (2025)
Unified Medical Image Tokenizer for Autoregressive Synthesis and Understanding
di: Ma, Chenglong, et al.
Pubblicazione: (2025)
di: Ma, Chenglong, et al.
Pubblicazione: (2025)
PIRA-Bench: A Transition from Reactive GUI Agents to GUI-based Proactive Intent Recommendation Agents
di: Chai, Yuxiang, et al.
Pubblicazione: (2026)
di: Chai, Yuxiang, et al.
Pubblicazione: (2026)
Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation
di: Qu, Heng, et al.
Pubblicazione: (2026)
di: Qu, Heng, et al.
Pubblicazione: (2026)
A Class-Aware Representation Refinement Framework for Graph Classification
di: Xu, Jiaxing, et al.
Pubblicazione: (2022)
di: Xu, Jiaxing, et al.
Pubblicazione: (2022)
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
di: Hou, Xiaolu, et al.
Pubblicazione: (2025)
di: Hou, Xiaolu, et al.
Pubblicazione: (2025)
History-Aware Reasoning for GUI Agents
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
Daniel Kahneman y la Psicología Económica
di: ISMAEL QUINTANILLA
Pubblicazione: (2002)
di: ISMAEL QUINTANILLA
Pubblicazione: (2002)
A Novel Ophthalmic Benchmark for Evaluating Multimodal Large Language Models with Fundus Photographs and OCT Images
di: Liang, Xiaoyi, et al.
Pubblicazione: (2025)
di: Liang, Xiaoyi, et al.
Pubblicazione: (2025)
ReInAgent: A Context-Aware GUI Agent Enabling Human-in-the-Loop Mobile Task Navigation
di: Jia, Haitao, et al.
Pubblicazione: (2025)
di: Jia, Haitao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MedAide: Information Fusion and Anatomy of Medical Intents via LLM-based Agent Collaboration
di: Yang, Dingkang, et al.
Pubblicazione: (2024) -
Open World MRI Reconstruction with Bias-Calibrated Adaptation
di: Liu, Jiyao, et al.
Pubblicazione: (2026) -
THE-Tree: Can Tracing Historical Evolution Enhance Scientific Verification and Reasoning?
di: Wang, Xin, et al.
Pubblicazione: (2025) -
MedQ-Engine: A Closed-Loop Data Engine for Evolving MLLMs in Medical Image Quality Assessment
di: Liu, Jiyao, et al.
Pubblicazione: (2026) -
MedQ-UNI: Toward Unified Medical Image Quality Assessment and Restoration via Vision-Language Modeling
di: Liu, Jiyao, et al.
Pubblicazione: (2026)