Pix2Fact: When Vision Is Not Enough -- Benchmarking Fine-Grained VQA with Web Verification on High-Resolution Real-World Scenes
Fuente:
arXiv
Guardado en:
| Autores principales: | Jiang, Yifan, Zhang, Cong, Zhang, Bofei, Zheng, Qiaofeng, Yang, Yifan, Wang, Bingzhang, Ong, Yew-Soon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FactLens: Benchmarking Fine-Grained Fact Verification
por: Mitra, Kushan, et al.
Publicado: (2024)
por: Mitra, Kushan, et al.
Publicado: (2024)
Finding Sets of Pareto Sets in Real-World Scenarios -- A Multitask Multiobjective Perspective
por: Liu, Jiao, et al.
Publicado: (2026)
por: Liu, Jiao, et al.
Publicado: (2026)
Mastering Continual Reinforcement Learning through Fine-Grained Sparse Network Allocation and Dormant Neuron Exploration
por: Zheng, Chengqi, et al.
Publicado: (2025)
por: Zheng, Chengqi, et al.
Publicado: (2025)
GRASP: Gradient Realignment via Active Shared Perception for Multi-Agent Collaborative Optimization
por: Zhou, Sihan, et al.
Publicado: (2026)
por: Zhou, Sihan, et al.
Publicado: (2026)
An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems
por: Zhang, Ni, et al.
Publicado: (2025)
por: Zhang, Ni, et al.
Publicado: (2025)
Hybrid Memetic Search for Electric Vehicle Routing with Time Windows, Simultaneous Pickup-Delivery, and Partial Recharges
por: Zheng, Zubin, et al.
Publicado: (2024)
por: Zheng, Zubin, et al.
Publicado: (2024)
Fine-grained Abnormality Prompt Learning for Zero-shot Anomaly Detection
por: Zhu, Jiawen, et al.
Publicado: (2024)
por: Zhu, Jiawen, et al.
Publicado: (2024)
Hierarchically Robust Zero-shot Vision-language Models
por: Dong, Junhao, et al.
Publicado: (2026)
por: Dong, Junhao, et al.
Publicado: (2026)
Generative AI-based Prompt Evolution Engineering Design Optimization With Vision-Language Model
por: Wong, Melvin, et al.
Publicado: (2024)
por: Wong, Melvin, et al.
Publicado: (2024)
Retrieval Augmented Fact Verification by Synthesizing Contrastive Arguments
por: Yue, Zhenrui, et al.
Publicado: (2024)
por: Yue, Zhenrui, et al.
Publicado: (2024)
Make Me Happier: Evoking Emotions Through Image Diffusion Models
por: Lin, Qing, et al.
Publicado: (2024)
por: Lin, Qing, et al.
Publicado: (2024)
Is Contrastive Distillation Enough for Learning Comprehensive 3D Representations?
por: Zhang, Yifan, et al.
Publicado: (2024)
por: Zhang, Yifan, et al.
Publicado: (2024)
Automated Large-scale CVRP Solver Design via LLM-assisted Flexible MCTS
por: Guo, Tong, et al.
Publicado: (2026)
por: Guo, Tong, et al.
Publicado: (2026)
EvoSpeak: Large Language Models for Interpretable Genetic Programming-Evolved Heuristics
por: Xu, Meng, et al.
Publicado: (2025)
por: Xu, Meng, et al.
Publicado: (2025)
Bayesian Inverse Transfer in Evolutionary Multiobjective Optimization
por: Liu, Jiao, et al.
Publicado: (2023)
por: Liu, Jiao, et al.
Publicado: (2023)
Multi-Task Learning with Multi-Task Optimization
por: Bai, Lu, et al.
Publicado: (2024)
por: Bai, Lu, et al.
Publicado: (2024)
Learning with Foresight: Enhancing Neural Routing Policy via Multi-Node Lookahead Prediction
por: Jiang, Xia, et al.
Publicado: (2026)
por: Jiang, Xia, et al.
Publicado: (2026)
Dynamic-Aware Video Distillation: Optimizing Temporal Resolution Based on Video Semantics
por: Zhao, Yinjie, et al.
Publicado: (2025)
por: Zhao, Yinjie, et al.
Publicado: (2025)
Language Model Evolutionary Algorithms for Recommender Systems: Benchmarks and Algorithm Comparisons
por: Liu, Jiao, et al.
Publicado: (2024)
por: Liu, Jiao, et al.
Publicado: (2024)
Neural Influence Estimator: Towards Real-time Solutions to Influence Blocking Maximization
por: Chen, Wenjie, et al.
Publicado: (2023)
por: Chen, Wenjie, et al.
Publicado: (2023)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
por: Yang, Shuo, et al.
Publicado: (2025)
por: Yang, Shuo, et al.
Publicado: (2025)
OpenEarthSensing: Large-Scale Fine-Grained Benchmark for Open-World Remote Sensing
por: Xiang, Xiang, et al.
Publicado: (2025)
por: Xiang, Xiang, et al.
Publicado: (2025)
Web World Models
por: Feng, Jichen, et al.
Publicado: (2025)
por: Feng, Jichen, et al.
Publicado: (2025)
Neural Theorem Proving for Verification Conditions: A Real-World Benchmark
por: Xu, Qiyuan, et al.
Publicado: (2026)
por: Xu, Qiyuan, et al.
Publicado: (2026)
Agentic Spatio-Temporal Grounding via Collaborative Reasoning
por: Zhao, Heng, et al.
Publicado: (2026)
por: Zhao, Heng, et al.
Publicado: (2026)
The Digital Ecosystem of Beliefs: does evolution favour AI over humans?
por: Bossens, David M., et al.
Publicado: (2024)
por: Bossens, David M., et al.
Publicado: (2024)
A Continuous Encoding-Based Representation for Efficient Multi-Fidelity Multi-Objective Neural Architecture Search
por: Wei, Zhao, et al.
Publicado: (2025)
por: Wei, Zhao, et al.
Publicado: (2025)
FineDialFact: A benchmark for Fine-grained Dialogue Fact Verification
por: Chen, Xiangyan, et al.
Publicado: (2025)
por: Chen, Xiangyan, et al.
Publicado: (2025)
MToP: A MATLAB Benchmarking Platform for Evolutionary Multitasking
por: Li, Yanchi, et al.
Publicado: (2023)
por: Li, Yanchi, et al.
Publicado: (2023)
Your Super Resolution Model is not Enough for Tackling Real-World Scenarios
por: Yoon, Dongsik, et al.
Publicado: (2025)
por: Yoon, Dongsik, et al.
Publicado: (2025)
Generative Multi-Form Bayesian Optimization
por: Guo, Zhendong, et al.
Publicado: (2025)
por: Guo, Zhendong, et al.
Publicado: (2025)
Factcheck-Bench: Fine-Grained Evaluation Benchmark for Automatic Fact-checkers
por: Wang, Yuxia, et al.
Publicado: (2023)
por: Wang, Yuxia, et al.
Publicado: (2023)
Road Network Representation Learning with the Third Law of Geography
por: Zhou, Haicang, et al.
Publicado: (2024)
por: Zhou, Haicang, et al.
Publicado: (2024)
LIST: Learning to Index Spatio-Textual Data for Embedding based Spatial Keyword Queries
por: Yin, Ziqi, et al.
Publicado: (2024)
por: Yin, Ziqi, et al.
Publicado: (2024)
SiamNAS: Siamese Surrogate Model for Dominance Relation Prediction in Multi-objective Neural Architecture Search
por: Zhou, Yuyang, et al.
Publicado: (2025)
por: Zhou, Yuyang, et al.
Publicado: (2025)
A Simple Yet Effective Approach for Diversified Session-Based Recommendation
por: Yin, Qing, et al.
Publicado: (2024)
por: Yin, Qing, et al.
Publicado: (2024)
Quality Diversity Genetic Programming for Learning Scheduling Heuristics
por: Xu, Meng, et al.
Publicado: (2025)
por: Xu, Meng, et al.
Publicado: (2025)
Lightweight and Accurate Multi-View Stereo with Confidence-Aware Diffusion Model
por: Wang, Fangjinhua, et al.
Publicado: (2025)
por: Wang, Fangjinhua, et al.
Publicado: (2025)
TransGP: Task-Conditioned Transformer-Guided Genetic Programming for Multitask Dynamic Flexible Job Shop Scheduling
por: Xu, Meng, et al.
Publicado: (2026)
por: Xu, Meng, et al.
Publicado: (2026)
Co-Learning Bayesian Optimization
por: Guo, Zhendong, et al.
Publicado: (2025)
por: Guo, Zhendong, et al.
Publicado: (2025)
Ejemplares similares
-
FactLens: Benchmarking Fine-Grained Fact Verification
por: Mitra, Kushan, et al.
Publicado: (2024) -
Finding Sets of Pareto Sets in Real-World Scenarios -- A Multitask Multiobjective Perspective
por: Liu, Jiao, et al.
Publicado: (2026) -
Mastering Continual Reinforcement Learning through Fine-Grained Sparse Network Allocation and Dormant Neuron Exploration
por: Zheng, Chengqi, et al.
Publicado: (2025) -
GRASP: Gradient Realignment via Active Shared Perception for Multi-Agent Collaborative Optimization
por: Zhou, Sihan, et al.
Publicado: (2026) -
An Agentic Framework with LLMs for Solving Complex Vehicle Routing Problems
por: Zhang, Ni, et al.
Publicado: (2025)