WCXB: A Multi-Type Web Content Extraction Benchmark
Fuente:
arXiv
Salvato in:
| Autore principale: | Foley, Murrough |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LiveWeb-IE: A Benchmark For Online Web Information Extraction
di: Yang, Seungbin, et al.
Pubblicazione: (2026)
di: Yang, Seungbin, et al.
Pubblicazione: (2026)
An Index-based Approach for Efficient and Effective Web Content Extraction
di: Chen, Yihan, et al.
Pubblicazione: (2025)
di: Chen, Yihan, et al.
Pubblicazione: (2025)
WebMall -- A Multi-Shop Benchmark for Evaluating Web Agents
di: Peeters, Ralph, et al.
Pubblicazione: (2025)
di: Peeters, Ralph, et al.
Pubblicazione: (2025)
MultiADE: A Multi-domain Benchmark for Adverse Drug Event Extraction
di: Dai, Xiang, et al.
Pubblicazione: (2024)
di: Dai, Xiang, et al.
Pubblicazione: (2024)
Wikidata as a seed for Web Extraction
di: Guo, Kunpeng, et al.
Pubblicazione: (2024)
di: Guo, Kunpeng, et al.
Pubblicazione: (2024)
SciEvent: Benchmarking Multi-domain Scientific Event Extraction
di: Dong, Bofu, et al.
Pubblicazione: (2025)
di: Dong, Bofu, et al.
Pubblicazione: (2025)
DITING: A Multi-Agent Evaluation Framework for Benchmarking Web Novel Translation
di: Zhang, Enze, et al.
Pubblicazione: (2025)
di: Zhang, Enze, et al.
Pubblicazione: (2025)
Multi-Record Web Page Information Extraction From News Websites
di: Kustenkov, Alexander, et al.
Pubblicazione: (2025)
di: Kustenkov, Alexander, et al.
Pubblicazione: (2025)
WebWalker: Benchmarking LLMs in Web Traversal
di: Wu, Jialong, et al.
Pubblicazione: (2025)
di: Wu, Jialong, et al.
Pubblicazione: (2025)
GuideWeb: A Benchmark for Automatic In-App Guide Generation on Real-World Web UIs
di: Gan, Chengguang, et al.
Pubblicazione: (2026)
di: Gan, Chengguang, et al.
Pubblicazione: (2026)
AXE: Low-Cost Cross-Domain Web Structured Information Extraction
di: Mansour, Abdelrahman, et al.
Pubblicazione: (2026)
di: Mansour, Abdelrahman, et al.
Pubblicazione: (2026)
Needle in the Web: A Benchmark for Retrieving Targeted Web Pages in the Wild
di: Wang, Yumeng, et al.
Pubblicazione: (2025)
di: Wang, Yumeng, et al.
Pubblicazione: (2025)
PAGED: A Benchmark for Procedural Graphs Extraction from Documents
di: Du, Weihong, et al.
Pubblicazione: (2024)
di: Du, Weihong, et al.
Pubblicazione: (2024)
WebUIBench: A Comprehensive Benchmark for Evaluating Multimodal Large Language Models in WebUI-to-Code
di: Lin, Zhiyu, et al.
Pubblicazione: (2025)
di: Lin, Zhiyu, et al.
Pubblicazione: (2025)
X-WebAgentBench: A Multilingual Interactive Web Benchmark for Evaluating Global Agentic System
di: Wang, Peng, et al.
Pubblicazione: (2025)
di: Wang, Peng, et al.
Pubblicazione: (2025)
MARCA: A Checklist-Based Benchmark for Multilingual Web Search
di: Almeida, Thales Sales, et al.
Pubblicazione: (2026)
di: Almeida, Thales Sales, et al.
Pubblicazione: (2026)
EconWebArena: Benchmarking Autonomous Agents on Economic Tasks in Realistic Web Environments
di: Liu, Zefang, et al.
Pubblicazione: (2025)
di: Liu, Zefang, et al.
Pubblicazione: (2025)
Web(er) of Hate: A Survey on How Hate Speech Is Typed
di: Wang, Luna, et al.
Pubblicazione: (2025)
di: Wang, Luna, et al.
Pubblicazione: (2025)
Multilingual Attribute Extraction from News Web Pages
di: Bedrin, Pavel, et al.
Pubblicazione: (2025)
di: Bedrin, Pavel, et al.
Pubblicazione: (2025)
VideoAVE: A Multi-Attribute Video-to-Text Attribute Value Extraction Dataset and Benchmark Models
di: Cheng, Ming, et al.
Pubblicazione: (2025)
di: Cheng, Ming, et al.
Pubblicazione: (2025)
SCRIBES: Web-Scale Script-Based Semi-Structured Data Extraction with Reinforcement Learning
di: Liu, Shicheng, et al.
Pubblicazione: (2025)
di: Liu, Shicheng, et al.
Pubblicazione: (2025)
WebDS: An End-to-End Benchmark for Web-based Data Science
di: Hsu, Ethan, et al.
Pubblicazione: (2025)
di: Hsu, Ethan, et al.
Pubblicazione: (2025)
Cross-Domain Web Information Extraction at Pinterest
di: Farag, Michael, et al.
Pubblicazione: (2025)
di: Farag, Michael, et al.
Pubblicazione: (2025)
WebPie: A Tiny Slice of Dependent Typing
di: Scholliers, Christophe
Pubblicazione: (2024)
di: Scholliers, Christophe
Pubblicazione: (2024)
Beyond the Numbers: Transparency in Relation Extraction Benchmark Creation and Leaderboards
di: Arzt, Varvara, et al.
Pubblicazione: (2024)
di: Arzt, Varvara, et al.
Pubblicazione: (2024)
Towards Event Extraction with Massive Types: LLM-based Collaborative Annotation and Partitioning Extraction
di: Liu, Wenxuan, et al.
Pubblicazione: (2025)
di: Liu, Wenxuan, et al.
Pubblicazione: (2025)
Ego2Web: A Web Agent Benchmark Grounded in Egocentric Videos
di: Yu, Shoubin, et al.
Pubblicazione: (2026)
di: Yu, Shoubin, et al.
Pubblicazione: (2026)
READoc: A Unified Benchmark for Realistic Document Structured Extraction
di: Li, Zichao, et al.
Pubblicazione: (2024)
di: Li, Zichao, et al.
Pubblicazione: (2024)
MAPEX: A Multi-Agent Pipeline for Keyphrase Extraction
di: Zhang, Liting, et al.
Pubblicazione: (2025)
di: Zhang, Liting, et al.
Pubblicazione: (2025)
Combining Language and Graph Models for Semi-structured Information Extraction on the Web
di: Hong, Zhi, et al.
Pubblicazione: (2024)
di: Hong, Zhi, et al.
Pubblicazione: (2024)
SinhaLegal: A Benchmark Corpus for Information Extraction and Analysis in Sinhala Legislative Texts
di: Lasandi, Minduli, et al.
Pubblicazione: (2026)
di: Lasandi, Minduli, et al.
Pubblicazione: (2026)
TextEE: Benchmark, Reevaluation, Reflections, and Future Challenges in Event Extraction
di: Huang, Kuan-Hao, et al.
Pubblicazione: (2023)
di: Huang, Kuan-Hao, et al.
Pubblicazione: (2023)
LexRel: Benchmarking Legal Relation Extraction for Chinese Civil Cases
di: Cai, Yida, et al.
Pubblicazione: (2025)
di: Cai, Yida, et al.
Pubblicazione: (2025)
Knowledge Extraction on Semi-Structured Content: Does It Remain Relevant for Question Answering in the Era of LLMs?
di: Sun, Kai, et al.
Pubblicazione: (2025)
di: Sun, Kai, et al.
Pubblicazione: (2025)
K-BrowseComp: A Web Browsing Agent Benchmark Grounded in Korean Contexts
di: Lee, Nahyun, et al.
Pubblicazione: (2026)
di: Lee, Nahyun, et al.
Pubblicazione: (2026)
Persona2Web: Benchmarking Personalized Web Agents for Contextual Reasoning with User History
di: Kim, Serin, et al.
Pubblicazione: (2026)
di: Kim, Serin, et al.
Pubblicazione: (2026)
Benchmarking and Improving LVLMs on Event Extraction from Multimedia Documents
di: Xing, Fuyu, et al.
Pubblicazione: (2025)
di: Xing, Fuyu, et al.
Pubblicazione: (2025)
Beyond Isolated Dots: Benchmarking Structured Table Construction as Deep Knowledge Extraction
di: Zhong, Tianyun, et al.
Pubblicazione: (2025)
di: Zhong, Tianyun, et al.
Pubblicazione: (2025)
Beyond Single-Event Extraction: Towards Efficient Document-Level Multi-Event Argument Extraction
di: Liu, Wanlong, et al.
Pubblicazione: (2024)
di: Liu, Wanlong, et al.
Pubblicazione: (2024)
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
di: Wang, Junlin, et al.
Pubblicazione: (2024)
di: Wang, Junlin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LiveWeb-IE: A Benchmark For Online Web Information Extraction
di: Yang, Seungbin, et al.
Pubblicazione: (2026) -
An Index-based Approach for Efficient and Effective Web Content Extraction
di: Chen, Yihan, et al.
Pubblicazione: (2025) -
WebMall -- A Multi-Shop Benchmark for Evaluating Web Agents
di: Peeters, Ralph, et al.
Pubblicazione: (2025) -
MultiADE: A Multi-domain Benchmark for Adverse Drug Event Extraction
di: Dai, Xiang, et al.
Pubblicazione: (2024) -
Wikidata as a seed for Web Extraction
di: Guo, Kunpeng, et al.
Pubblicazione: (2024)