UI-Venus-1.5 Technical Report
Fuente:
arXiv
Guardado en:
| Autores principales: | Venus Team, Gao, Changlong, Gu, Zhangxuan, Liu, Yulin, Qiu, Xinyu, Shen, Shuheng, Wen, Yue, Xia, Tianyu, Xu, Zhenyu, Zeng, Zhengwen, Zhou, Beitong, Zhou, Xingran, Chen, Weizhi, Dai, Sunhao, Dou, Jingya, Gong, Yichen, Guo, Yuan, Guo, Zhenlin, Li, Feng, Li, Qian, Lin, Jinzhen, Zhou, Yuqi, Zhu, Linchao, Chen, Liang, Guo, Zhenyu, Meng, Changhua, Wang, Weiqiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UI-Venus Technical Report: Building High-performance UI Agents with RFT
por: Gu, Zhangxuan, et al.
Publicado: (2025)
por: Gu, Zhangxuan, et al.
Publicado: (2025)
VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability Diagnostics
por: Gong, Yichen, et al.
Publicado: (2026)
por: Gong, Yichen, et al.
Publicado: (2026)
VenusBench-GD: A Comprehensive Multi-Platform GUI Benchmark for Diverse Grounding Tasks
por: Zhou, Beitong, et al.
Publicado: (2025)
por: Zhou, Beitong, et al.
Publicado: (2025)
DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Data
por: Venus Team, et al.
Publicado: (2026)
por: Venus Team, et al.
Publicado: (2026)
MVP: Multiple View Prediction Improves GUI Grounding
por: Zhang, Yunzhu, et al.
Publicado: (2025)
por: Zhang, Yunzhu, et al.
Publicado: (2025)
Mitigating Conversational Inertia in Multi-Turn Agents
por: Wan, Yang, et al.
Publicado: (2026)
por: Wan, Yang, et al.
Publicado: (2026)
Unified Generation and Self-Verification for Vision-Language Models via Advantage Decoupled Preference Optimization
por: Qiu, Xinyu, et al.
Publicado: (2026)
por: Qiu, Xinyu, et al.
Publicado: (2026)
E-ANT: A Large-Scale Dataset for Efficient Automatic GUI NavigaTion
por: Wang, Ke, et al.
Publicado: (2024)
por: Wang, Ke, et al.
Publicado: (2024)
Decoupling Knowledge and Reasoning in Transformers: A Modular Architecture with Generalized Cross-Attention
por: Guo, Zhenyu, et al.
Publicado: (2025)
por: Guo, Zhenyu, et al.
Publicado: (2025)
Semidefinite programming relaxations and debiasing for MAXCUT-based clustering
por: Zhou, Shuheng
Publicado: (2024)
por: Zhou, Shuheng
Publicado: (2024)
Semidefinite programming on population clustering: a local analysis
por: Zhou, Shuheng
Publicado: (2023)
por: Zhou, Shuheng
Publicado: (2023)
Thresholded Lasso for high dimensional variable selection
por: Zhou, Shuheng
Publicado: (2023)
por: Zhou, Shuheng
Publicado: (2023)
Condense to sense: a new path for plant osmosensing
por: Zhenyu Wang, et al.
Publicado: (2026)
por: Zhenyu Wang, et al.
Publicado: (2026)
GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents
por: Zhou, Yuqi, et al.
Publicado: (2025)
por: Zhou, Yuqi, et al.
Publicado: (2025)
Length-Induced Embedding Collapse in PLM-based Models
por: Zhou, Yuqi, et al.
Publicado: (2024)
por: Zhou, Yuqi, et al.
Publicado: (2024)
Exponential sums with polynomials and their applications to primes in sparse sets
por: Guo, Lingyu, et al.
Publicado: (2025)
por: Guo, Lingyu, et al.
Publicado: (2025)
Additive problems on $\lfloor p^c \rfloor$
por: Guo, Lingyu, et al.
Publicado: (2025)
por: Guo, Lingyu, et al.
Publicado: (2025)
Attacking LLMs and AI Agents: Advertisement Embedding Attacks Against Large Language Models
por: Guo, Qiming, et al.
Publicado: (2025)
por: Guo, Qiming, et al.
Publicado: (2025)
Structured Vocalisation as a Module of Affective Regulation: The Impact of Choral Participation on Anxiety, Frustration and Stress Resilience in Non‐Musician Students
por: Zhenyu Zhou, et al.
Publicado: (2025)
por: Zhenyu Zhou, et al.
Publicado: (2025)
UI-UG: A Unified MLLM for UI Understanding and Generation
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Group Relative Knowledge Distillation: Learning from Teacher's Relational Inductive Bias
por: Li, Chao, et al.
Publicado: (2025)
por: Li, Chao, et al.
Publicado: (2025)
PLReMix: Combating Noisy Labels with Pseudo-Label Relaxed Contrastive Representation Learning
por: Liu, Xiaoyu, et al.
Publicado: (2024)
por: Liu, Xiaoyu, et al.
Publicado: (2024)
Venus-DeFakerOne: Unified Fake Image Detection & Localization
por: GuangJian Team
Publicado: (2026)
por: GuangJian Team
Publicado: (2026)
Revisiting Modularity Maximization for Graph Clustering: A Contrastive Learning Perspective
por: Liu, Yunfei, et al.
Publicado: (2024)
por: Liu, Yunfei, et al.
Publicado: (2024)
Images and flares of geodesic hotspots around a Kerr black hole
por: Huang, Jiewei, et al.
Publicado: (2024)
por: Huang, Jiewei, et al.
Publicado: (2024)
A new analytical model of magnetofluids surrounding rotating black holes
por: Hou, Yehui, et al.
Publicado: (2023)
por: Hou, Yehui, et al.
Publicado: (2023)
Scalable tensor network algorithm for quantum impurity problems
por: Sun, Zhijie, et al.
Publicado: (2025)
por: Sun, Zhijie, et al.
Publicado: (2025)
Infinite Grassmann time-evolving matrix product operators for quantum impurity problems after a quench
por: Sun, Zhijie, et al.
Publicado: (2024)
por: Sun, Zhijie, et al.
Publicado: (2024)
Imaging thick accretion disks and jets surrounding black holes
por: Zhang, Zhenyu, et al.
Publicado: (2024)
por: Zhang, Zhenyu, et al.
Publicado: (2024)
Fast ODE-based Sampling for Diffusion Models in Around 5 Steps
por: Zhou, Zhenyu, et al.
Publicado: (2023)
por: Zhou, Zhenyu, et al.
Publicado: (2023)
Finite sample rates of convergence for the Bigraphical and Tensor graphical Lasso estimators
por: Zhou, Shuheng, et al.
Publicado: (2023)
por: Zhou, Shuheng, et al.
Publicado: (2023)
Non-thermal Synchrotron Emission and Polarization Signatures during Black Hole Flux Eruptions
por: Zhou, Fan, et al.
Publicado: (2025)
por: Zhou, Fan, et al.
Publicado: (2025)
Observational signatures of rotating black holes in the semiclassical gravity with trace anomaly
por: Zhang, Zhenyu, et al.
Publicado: (2023)
por: Zhang, Zhenyu, et al.
Publicado: (2023)
Efficient and accurate tensor network algorithm for Anderson impurity problems
por: Sun, Zhijie, et al.
Publicado: (2025)
por: Sun, Zhijie, et al.
Publicado: (2025)
Distributionally Robust Learning for Multi-source Unsupervised Domain Adaptation
por: Wang, Zhenyu, et al.
Publicado: (2023)
por: Wang, Zhenyu, et al.
Publicado: (2023)
MambaVLT: Time-Evolving Multimodal State Space Model for Vision-Language Tracking
por: Liu, Xinqi, et al.
Publicado: (2024)
por: Liu, Xinqi, et al.
Publicado: (2024)
PC$^2$: Pseudo-Classification Based Pseudo-Captioning for Noisy Correspondence Learning in Cross-Modal Retrieval
por: Duan, Yue, et al.
Publicado: (2024)
por: Duan, Yue, et al.
Publicado: (2024)
ConsentDiff at Scale: Longitudinal Audits of Web Privacy Policy Changes and UI Frictions
por: Guo, Haoze
Publicado: (2025)
por: Guo, Haoze
Publicado: (2025)
Beyond Screenshots: Evaluating VLMs' Understanding of UI Animations
por: Liang, Chen, et al.
Publicado: (2026)
por: Liang, Chen, et al.
Publicado: (2026)
Refining Time Series Anomaly Detectors using Large Language Models
por: Yang, Alan, et al.
Publicado: (2025)
por: Yang, Alan, et al.
Publicado: (2025)
Ejemplares similares
-
UI-Venus Technical Report: Building High-performance UI Agents with RFT
por: Gu, Zhangxuan, et al.
Publicado: (2025) -
VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability Diagnostics
por: Gong, Yichen, et al.
Publicado: (2026) -
VenusBench-GD: A Comprehensive Multi-Platform GUI Benchmark for Diverse Grounding Tasks
por: Zhou, Beitong, et al.
Publicado: (2025) -
DR-Venus: Towards Frontier Edge-Scale Deep Research Agents with Only 10K Open Data
por: Venus Team, et al.
Publicado: (2026) -
MVP: Multiple View Prediction Improves GUI Grounding
por: Zhang, Yunzhu, et al.
Publicado: (2025)