FineState-Bench: Benchmarking State-Conditioned Grounding for Fine-grained GUI State Setting
Fuente:
arXiv
Saved in:
| Main Authors: | Ji, Fengxian, Yang, Jingpu, Song, Zirui, Wang, Yuanxi, Cui, Zhexuan, Li, Yuke, Jiang, Qian, Chen, Xiuying |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
by: Ji, Fengxian, et al.
Published: (2025)
by: Ji, Fengxian, et al.
Published: (2025)
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
by: Cui, Mingxuan, et al.
Published: (2026)
by: Cui, Mingxuan, et al.
Published: (2026)
ServImage: An Image Generation and Editing Benchmark from Real-world Commercial Imaging Services
by: Ji, Fengxian, et al.
Published: (2026)
by: Ji, Fengxian, et al.
Published: (2026)
Learning Fine-grained Domain Generalization via Hyperbolic State Space Hallucination
by: Bi, Qi, et al.
Published: (2025)
by: Bi, Qi, et al.
Published: (2025)
D2E-An Autonomous Decision-making Dataset involving Driver States and Human Evaluation
by: Ke, Zehong, et al.
Published: (2024)
by: Ke, Zehong, et al.
Published: (2024)
Data Guard: A Fine-grained Purpose-based Access Control System for Large Data Warehouses
by: Tran, Khai, et al.
Published: (2025)
by: Tran, Khai, et al.
Published: (2025)
FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding
by: Faure, Gueter Josmy, et al.
Published: (2026)
by: Faure, Gueter Josmy, et al.
Published: (2026)
Improving DBMS Scheduling Decisions with Fine-grained Performance Prediction on Concurrent Queries -- Extended
by: Wu, Ziniu, et al.
Published: (2025)
by: Wu, Ziniu, et al.
Published: (2025)
GUI-C$^2$: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning
by: Li, Junlong, et al.
Published: (2026)
by: Li, Junlong, et al.
Published: (2026)
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
by: Hong, Wenyi, et al.
Published: (2025)
by: Hong, Wenyi, et al.
Published: (2025)
TokBench: Evaluating Your Visual Tokenizer before Visual Generation
by: Wu, Junfeng, et al.
Published: (2025)
by: Wu, Junfeng, et al.
Published: (2025)
FIER: Fine-Grained and Efficient KV Cache Retrieval for Long-context LLM Inference
by: Wang, Dongwei, et al.
Published: (2025)
by: Wang, Dongwei, et al.
Published: (2025)
TemporalBench: Benchmarking Fine-grained Temporal Understanding for Multimodal Video Models
by: Cai, Mu, et al.
Published: (2024)
by: Cai, Mu, et al.
Published: (2024)
Supporting Better Insights of Data Science Pipelines with Fine-grained Provenance
by: Chapman, Adriane, et al.
Published: (2023)
by: Chapman, Adriane, et al.
Published: (2023)
FineSkiing: A Fine-grained Benchmark for Skiing Action Quality Assessment
by: Zhang, Yongji, et al.
Published: (2025)
by: Zhang, Yongji, et al.
Published: (2025)
Dinkel: State-Aware and Granular Framework for Validating Graph Databases
by: Wüst, Celine, et al.
Published: (2024)
by: Wüst, Celine, et al.
Published: (2024)
LST-Bench: Benchmarking Log-Structured Tables in the Cloud
by: Camacho-Rodríguez, Jesús, et al.
Published: (2023)
by: Camacho-Rodríguez, Jesús, et al.
Published: (2023)
KOR-Bench: Benchmarking Language Models on Knowledge-Orthogonal Reasoning Tasks
by: Ma, Kaijing, et al.
Published: (2024)
by: Ma, Kaijing, et al.
Published: (2024)
OS-W2S: An Automatic Labeling Engine for Language-Guided Open-Set Aerial Object Detection
by: Wei, Guoting, et al.
Published: (2025)
by: Wei, Guoting, et al.
Published: (2025)
VCapsBench: A Large-scale Fine-grained Benchmark for Video Caption Quality Evaluation
by: Zhang, Shi-Xue, et al.
Published: (2025)
by: Zhang, Shi-Xue, et al.
Published: (2025)
Beyond Model Base Retrieval: Weaving Knowledge to Master Fine-grained Neural Network Design
by: Wang, Jialiang, et al.
Published: (2025)
by: Wang, Jialiang, et al.
Published: (2025)
Fine-grained Spatiotemporal Grounding on Egocentric Videos
by: Liang, Shuo, et al.
Published: (2025)
by: Liang, Shuo, et al.
Published: (2025)
OxyEcomBench: Benchmarking Multimodal Foundation Models across E-Commerce Ecosystems
by: Liu, Yong, et al.
Published: (2026)
by: Liu, Yong, et al.
Published: (2026)
Data Agents: Levels, State of the Art, and Open Problems
by: Luo, Yuyu, et al.
Published: (2026)
by: Luo, Yuyu, et al.
Published: (2026)
MA-Bench: Towards Fine-grained Micro-Action Understanding
by: Li, Kun, et al.
Published: (2026)
by: Li, Kun, et al.
Published: (2026)
Geolocation with Real Human Gameplay Data: A Large-Scale Dataset and Human-Like Reasoning Framework
by: Song, Zirui, et al.
Published: (2025)
by: Song, Zirui, et al.
Published: (2025)
KPM-Bench: A Kinematic Parsing Motion Benchmark for Fine-grained Motion-centric Video Understanding
by: Lin, Boda, et al.
Published: (2026)
by: Lin, Boda, et al.
Published: (2026)
DriftBench: Defining and Generating Data and Query Workload Drift for Benchmarking
by: Liu, Guanli, et al.
Published: (2025)
by: Liu, Guanli, et al.
Published: (2025)
Generalist Scanner Meets Specialist Locator: A Synergistic Coarse-to-Fine Framework for Robust GUI Grounding
by: Li, Zhecheng, et al.
Published: (2025)
by: Li, Zhecheng, et al.
Published: (2025)
OODBench: Out-of-Distribution Benchmark for Large Vision-Language Models
by: Lin, Ling, et al.
Published: (2026)
by: Lin, Ling, et al.
Published: (2026)
HiVG: Hierarchical Multimodal Fine-grained Modulation for Visual Grounding
by: Xiao, Linhui, et al.
Published: (2024)
by: Xiao, Linhui, et al.
Published: (2024)
SHARP: Shared State Reduction for Efficient Matching of Sequential Patterns
by: Yu, Cong, et al.
Published: (2025)
by: Yu, Cong, et al.
Published: (2025)
PandasBench: A Benchmark for the Pandas API
by: Broihier, Alex, et al.
Published: (2025)
by: Broihier, Alex, et al.
Published: (2025)
Enhancing LLM Fine-tuning for Text-to-SQLs by SQL Quality Measurement
by: Sarker, Shouvon, et al.
Published: (2024)
by: Sarker, Shouvon, et al.
Published: (2024)
Compression and In-Situ Query Processing for Fine-Grained Array Lineage
by: Zhao, Jinjin, et al.
Published: (2024)
by: Zhao, Jinjin, et al.
Published: (2024)
The State of Scientific Poster Sharing and Reuse
by: Gasimova, Aydan, et al.
Published: (2026)
by: Gasimova, Aydan, et al.
Published: (2026)
VenusBench-GD: A Comprehensive Multi-Platform GUI Benchmark for Diverse Grounding Tasks
by: Zhou, Beitong, et al.
Published: (2025)
by: Zhou, Beitong, et al.
Published: (2025)
NeurBench: A Benchmark Suite for Learned Database Components with Drift Modeling
by: Zhao, Zhanhao, et al.
Published: (2025)
by: Zhao, Zhanhao, et al.
Published: (2025)
F$^3$Set: Towards Analyzing Fast, Frequent, and Fine-grained Events from Videos
by: Liu, Zhaoyu, et al.
Published: (2025)
by: Liu, Zhaoyu, et al.
Published: (2025)
gMatch: Fine-Grained and Hardware-Efficient Subgraph Matching on GPUs
by: Chen, Weitian, et al.
Published: (2026)
by: Chen, Weitian, et al.
Published: (2026)
Similar Items
-
FineState-Bench: A Comprehensive Benchmark for Fine-Grained State Control in GUI Agents
by: Ji, Fengxian, et al.
Published: (2025) -
TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards
by: Cui, Mingxuan, et al.
Published: (2026) -
ServImage: An Image Generation and Editing Benchmark from Real-world Commercial Imaging Services
by: Ji, Fengxian, et al.
Published: (2026) -
Learning Fine-grained Domain Generalization via Hyperbolic State Space Hallucination
by: Bi, Qi, et al.
Published: (2025) -
D2E-An Autonomous Decision-making Dataset involving Driver States and Human Evaluation
by: Ke, Zehong, et al.
Published: (2024)