Pix2Fact: When Vision Is Not Enough -- Benchmarking Fine-Grained VQA with Web Verification on High-Resolution Real-World Scenes
Fuente:
arXiv
Saved in:
| Main Authors: | Jiang, Yifan, Zhang, Cong, Zhang, Bofei, Zheng, Qiaofeng, Yang, Yifan, Wang, Bingzhang, Ong, Yew-Soon |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FactLens: Benchmarking Fine-Grained Fact Verification
by: Mitra, Kushan, et al.
Published: (2024)
by: Mitra, Kushan, et al.
Published: (2024)
Finding Sets of Pareto Sets in Real-World Scenarios -- A Multitask Multiobjective Perspective
by: Liu, Jiao, et al.
Published: (2026)
by: Liu, Jiao, et al.
Published: (2026)
Mastering Continual Reinforcement Learning through Fine-Grained Sparse Network Allocation and Dormant Neuron Exploration
by: Zheng, Chengqi, et al.
Published: (2025)
by: Zheng, Chengqi, et al.
Published: (2025)
GRASP: Gradient Realignment via Active Shared Perception for Multi-Agent Collaborative Optimization
by: Zhou, Sihan, et al.
Published: (2026)
by: Zhou, Sihan, et al.
Published: (2026)
An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems
by: Zhang, Ni, et al.
Published: (2025)
by: Zhang, Ni, et al.
Published: (2025)
Hybrid Memetic Search for Electric Vehicle Routing with Time Windows, Simultaneous Pickup-Delivery, and Partial Recharges
by: Zheng, Zubin, et al.
Published: (2024)
by: Zheng, Zubin, et al.
Published: (2024)
Fine-grained Abnormality Prompt Learning for Zero-shot Anomaly Detection
by: Zhu, Jiawen, et al.
Published: (2024)
by: Zhu, Jiawen, et al.
Published: (2024)
Hierarchically Robust Zero-shot Vision-language Models
by: Dong, Junhao, et al.
Published: (2026)
by: Dong, Junhao, et al.
Published: (2026)
Generative AI-based Prompt Evolution Engineering Design Optimization With Vision-Language Model
by: Wong, Melvin, et al.
Published: (2024)
by: Wong, Melvin, et al.
Published: (2024)
Retrieval Augmented Fact Verification by Synthesizing Contrastive Arguments
by: Yue, Zhenrui, et al.
Published: (2024)
by: Yue, Zhenrui, et al.
Published: (2024)
Make Me Happier: Evoking Emotions Through Image Diffusion Models
by: Lin, Qing, et al.
Published: (2024)
by: Lin, Qing, et al.
Published: (2024)
Is Contrastive Distillation Enough for Learning Comprehensive 3D Representations?
by: Zhang, Yifan, et al.
Published: (2024)
by: Zhang, Yifan, et al.
Published: (2024)
Automated Large-scale CVRP Solver Design via LLM-assisted Flexible MCTS
by: Guo, Tong, et al.
Published: (2026)
by: Guo, Tong, et al.
Published: (2026)
EvoSpeak: Large Language Models for Interpretable Genetic Programming-Evolved Heuristics
by: Xu, Meng, et al.
Published: (2025)
by: Xu, Meng, et al.
Published: (2025)
Bayesian Inverse Transfer in Evolutionary Multiobjective Optimization
by: Liu, Jiao, et al.
Published: (2023)
by: Liu, Jiao, et al.
Published: (2023)
Multi-Task Learning with Multi-Task Optimization
by: Bai, Lu, et al.
Published: (2024)
by: Bai, Lu, et al.
Published: (2024)
Learning with Foresight: Enhancing Neural Routing Policy via Multi-Node Lookahead Prediction
by: Jiang, Xia, et al.
Published: (2026)
by: Jiang, Xia, et al.
Published: (2026)
Dynamic-Aware Video Distillation: Optimizing Temporal Resolution Based on Video Semantics
by: Zhao, Yinjie, et al.
Published: (2025)
by: Zhao, Yinjie, et al.
Published: (2025)
Language Model Evolutionary Algorithms for Recommender Systems: Benchmarks and Algorithm Comparisons
by: Liu, Jiao, et al.
Published: (2024)
by: Liu, Jiao, et al.
Published: (2024)
Neural Influence Estimator: Towards Real-time Solutions to Influence Blocking Maximization
by: Chen, Wenjie, et al.
Published: (2023)
by: Chen, Wenjie, et al.
Published: (2023)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
by: Yang, Shuo, et al.
Published: (2025)
by: Yang, Shuo, et al.
Published: (2025)
OpenEarthSensing: Large-Scale Fine-Grained Benchmark for Open-World Remote Sensing
by: Xiang, Xiang, et al.
Published: (2025)
by: Xiang, Xiang, et al.
Published: (2025)
Web World Models
by: Feng, Jichen, et al.
Published: (2025)
by: Feng, Jichen, et al.
Published: (2025)
Neural Theorem Proving for Verification Conditions: A Real-World Benchmark
by: Xu, Qiyuan, et al.
Published: (2026)
by: Xu, Qiyuan, et al.
Published: (2026)
Agentic Spatio-Temporal Grounding via Collaborative Reasoning
by: Zhao, Heng, et al.
Published: (2026)
by: Zhao, Heng, et al.
Published: (2026)
The Digital Ecosystem of Beliefs: does evolution favour AI over humans?
by: Bossens, David M., et al.
Published: (2024)
by: Bossens, David M., et al.
Published: (2024)
A Continuous Encoding-Based Representation for Efficient Multi-Fidelity Multi-Objective Neural Architecture Search
by: Wei, Zhao, et al.
Published: (2025)
by: Wei, Zhao, et al.
Published: (2025)
FineDialFact: A benchmark for Fine-grained Dialogue Fact Verification
by: Chen, Xiangyan, et al.
Published: (2025)
by: Chen, Xiangyan, et al.
Published: (2025)
MToP: A MATLAB Benchmarking Platform for Evolutionary Multitasking
by: Li, Yanchi, et al.
Published: (2023)
by: Li, Yanchi, et al.
Published: (2023)
Your Super Resolution Model is not Enough for Tackling Real-World Scenarios
by: Yoon, Dongsik, et al.
Published: (2025)
by: Yoon, Dongsik, et al.
Published: (2025)
Generative Multi-Form Bayesian Optimization
by: Guo, Zhendong, et al.
Published: (2025)
by: Guo, Zhendong, et al.
Published: (2025)
Factcheck-Bench: Fine-Grained Evaluation Benchmark for Automatic Fact-checkers
by: Wang, Yuxia, et al.
Published: (2023)
by: Wang, Yuxia, et al.
Published: (2023)
Road Network Representation Learning with the Third Law of Geography
by: Zhou, Haicang, et al.
Published: (2024)
by: Zhou, Haicang, et al.
Published: (2024)
LIST: Learning to Index Spatio-Textual Data for Embedding based Spatial Keyword Queries
by: Yin, Ziqi, et al.
Published: (2024)
by: Yin, Ziqi, et al.
Published: (2024)
SiamNAS: Siamese Surrogate Model for Dominance Relation Prediction in Multi-objective Neural Architecture Search
by: Zhou, Yuyang, et al.
Published: (2025)
by: Zhou, Yuyang, et al.
Published: (2025)
A Simple Yet Effective Approach for Diversified Session-Based Recommendation
by: Yin, Qing, et al.
Published: (2024)
by: Yin, Qing, et al.
Published: (2024)
Quality Diversity Genetic Programming for Learning Scheduling Heuristics
by: Xu, Meng, et al.
Published: (2025)
by: Xu, Meng, et al.
Published: (2025)
Lightweight and Accurate Multi-View Stereo with Confidence-Aware Diffusion Model
by: Wang, Fangjinhua, et al.
Published: (2025)
by: Wang, Fangjinhua, et al.
Published: (2025)
TransGP: Task-Conditioned Transformer-Guided Genetic Programming for Multitask Dynamic Flexible Job Shop Scheduling
by: Xu, Meng, et al.
Published: (2026)
by: Xu, Meng, et al.
Published: (2026)
Co-Learning Bayesian Optimization
by: Guo, Zhendong, et al.
Published: (2025)
by: Guo, Zhendong, et al.
Published: (2025)
Similar Items
-
FactLens: Benchmarking Fine-Grained Fact Verification
by: Mitra, Kushan, et al.
Published: (2024) -
Finding Sets of Pareto Sets in Real-World Scenarios -- A Multitask Multiobjective Perspective
by: Liu, Jiao, et al.
Published: (2026) -
Mastering Continual Reinforcement Learning through Fine-Grained Sparse Network Allocation and Dormant Neuron Exploration
by: Zheng, Chengqi, et al.
Published: (2025) -
GRASP: Gradient Realignment via Active Shared Perception for Multi-Agent Collaborative Optimization
by: Zhou, Sihan, et al.
Published: (2026) -
An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems
by: Zhang, Ni, et al.
Published: (2025)