WikiAutoGen: Towards Multi-Modal Wikipedia-Style Article Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Zhongyu, Chen, Jun, Xu, Dannong, Fei, Junjie, Shen, Xiaoqian, Zhao, Liangbing, Feng, Chun-Mei, Elhoseiny, Mohamed |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Document Haystacks: Vision-Language Reasoning Over Piles of 1000+ Documents
di: Chen, Jun, et al.
Pubblicazione: (2024)
di: Chen, Jun, et al.
Pubblicazione: (2024)
StoryGPT-V: Large Language Models as Consistent Story Visualizers
di: Shen, Xiaoqian, et al.
Pubblicazione: (2023)
di: Shen, Xiaoqian, et al.
Pubblicazione: (2023)
Vgent: Graph-based Retrieval-Reasoning-Augmented Generation For Long Video Understanding
di: Shen, Xiaoqian, et al.
Pubblicazione: (2025)
di: Shen, Xiaoqian, et al.
Pubblicazione: (2025)
From Statics to Dynamics: Physics-Aware Image Editing with Latent Transition Priors
di: Zhao, Liangbing, et al.
Pubblicazione: (2026)
di: Zhao, Liangbing, et al.
Pubblicazione: (2026)
Neural Catalog: Scaling Species Recognition with Catalog of Life-Augmented Generation
di: Khan, Faizan Farooq, et al.
Pubblicazione: (2025)
di: Khan, Faizan Farooq, et al.
Pubblicazione: (2025)
Wiki Live Challenge: Challenging Deep Research Agents with Expert-Level Wikipedia Articles
di: Wang, Shaohan, et al.
Pubblicazione: (2026)
di: Wang, Shaohan, et al.
Pubblicazione: (2026)
ToddlerDiffusion: Interactive Structured Image Generation with Cascaded Schrödinger Bridge
di: Abdelrahman, Eslam, et al.
Pubblicazione: (2023)
di: Abdelrahman, Eslam, et al.
Pubblicazione: (2023)
Wikis und die Wikipedia verstehen
di: van Dijk, Ziko
Pubblicazione: (2021)
di: van Dijk, Ziko
Pubblicazione: (2021)
Wiki-Quantities and Wiki-Measurements: Datasets of Quantities and their Measurement Context from Wikipedia
di: Göpfert, Jan, et al.
Pubblicazione: (2025)
di: Göpfert, Jan, et al.
Pubblicazione: (2025)
MultiHaystack: Benchmarking Multimodal Retrieval and Reasoning over 40K Images, Videos, and Documents
di: Xu, Dannong, et al.
Pubblicazione: (2026)
di: Xu, Dannong, et al.
Pubblicazione: (2026)
WikiReaD (Wikipedia Readability Dataset)
di: Trokhymovych, Mykola, et al.
Pubblicazione: (2024)
di: Trokhymovych, Mykola, et al.
Pubblicazione: (2024)
Script: Graph-Structured and Query-Conditioned Semantic Token Pruning for Multimodal Large Language Models
di: Yang, Zhongyu, et al.
Pubblicazione: (2025)
di: Yang, Zhongyu, et al.
Pubblicazione: (2025)
iMotion-LLM: Instruction-Conditioned Trajectory Generation
di: Felemban, Abdulwahab, et al.
Pubblicazione: (2024)
di: Felemban, Abdulwahab, et al.
Pubblicazione: (2024)
WikiVideo: Article Generation from Multiple Videos
di: Martin, Alexander, et al.
Pubblicazione: (2025)
di: Martin, Alexander, et al.
Pubblicazione: (2025)
WikiTexVC: MediaWiki's native LaTeX to MathML converter for Wikipedia
di: Stegmüller, Johannes, et al.
Pubblicazione: (2024)
di: Stegmüller, Johannes, et al.
Pubblicazione: (2024)
Web2Wiki: Characterizing Wikipedia Linking Across the Web
di: Veselovsky, Veniamin, et al.
Pubblicazione: (2025)
di: Veselovsky, Veniamin, et al.
Pubblicazione: (2025)
Kestrel: 3D Multimodal LLM for Part-Aware Grounded Description
di: Ahmed, Mahmoud, et al.
Pubblicazione: (2024)
di: Ahmed, Mahmoud, et al.
Pubblicazione: (2024)
No Culture Left Behind: ArtELingo-28, a Benchmark of WikiArt with Captions in 28 Languages
di: Mohamed, Youssef, et al.
Pubblicazione: (2024)
di: Mohamed, Youssef, et al.
Pubblicazione: (2024)
Orphan Articles: The Dark Matter of Wikipedia
di: Arora, Akhil, et al.
Pubblicazione: (2023)
di: Arora, Akhil, et al.
Pubblicazione: (2023)
Wiki-TabNER: Integrating Named Entity Recognition into Wikipedia Tables
di: Koleva, Aneta, et al.
Pubblicazione: (2024)
di: Koleva, Aneta, et al.
Pubblicazione: (2024)
MAGNET: A Multi-agent Framework for Finding Audio-Visual Needles by Reasoning over Multi-Video Haystacks
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
di: Chowdhury, Sanjoy, et al.
Pubblicazione: (2025)
El proyecto Wiki Learning: Wikipedia como entorno de aprendizaje abierto
di: Paola Ricaurte-Quijano
Pubblicazione: (2016)
di: Paola Ricaurte-Quijano
Pubblicazione: (2016)
WikiSQE: A Large-Scale Dataset for Sentence Quality Estimation in Wikipedia
di: Ando, Kenichiro, et al.
Pubblicazione: (2023)
di: Ando, Kenichiro, et al.
Pubblicazione: (2023)
Zoom-Zero: Reinforced Coarse-to-Fine Video Understanding via Temporal Zoom-in
di: Shen, Xiaoqian, et al.
Pubblicazione: (2025)
di: Shen, Xiaoqian, et al.
Pubblicazione: (2025)
ASL STEM Wiki: Dataset and Benchmark for Interpreting STEM Articles
di: Yin, Kayo, et al.
Pubblicazione: (2024)
di: Yin, Kayo, et al.
Pubblicazione: (2024)
From Reflection to Perfection: Scaling Inference-Time Optimization for Text-to-Image Diffusion Models via Reflection Tuning
di: Zhuo, Le, et al.
Pubblicazione: (2025)
di: Zhuo, Le, et al.
Pubblicazione: (2025)
WikiTermBase: An AI-Augmented Term Base to Standardize Arabic Translation on Wikipedia
di: Bakni, Michel, et al.
Pubblicazione: (2025)
di: Bakni, Michel, et al.
Pubblicazione: (2025)
ViWikiFC: Fact-Checking for Vietnamese Wikipedia-Based Textual Knowledge Source
di: Le, Hung Tuan, et al.
Pubblicazione: (2024)
di: Le, Hung Tuan, et al.
Pubblicazione: (2024)
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
di: Borkakoty, Hsuvas, et al.
Pubblicazione: (2024)
di: Borkakoty, Hsuvas, et al.
Pubblicazione: (2024)
MiniGPT4-Video: Advancing Multimodal LLMs for Video Understanding with Interleaved Visual-Textual Tokens
di: Ataallah, Kirolos, et al.
Pubblicazione: (2024)
di: Ataallah, Kirolos, et al.
Pubblicazione: (2024)
MMAR: Towards Lossless Multi-Modal Auto-Regressive Probabilistic Modeling
di: Yang, Jian, et al.
Pubblicazione: (2024)
di: Yang, Jian, et al.
Pubblicazione: (2024)
StyleTextGen: Style-Conditioned Multilingual Scene Text Generation
di: Chen, Zeyu, et al.
Pubblicazione: (2026)
di: Chen, Zeyu, et al.
Pubblicazione: (2026)
WikiContradict: A Benchmark for Evaluating LLMs on Real-World Knowledge Conflicts from Wikipedia
di: Hou, Yufang, et al.
Pubblicazione: (2024)
di: Hou, Yufang, et al.
Pubblicazione: (2024)
Wikipedia is Not a Dictionary, Delete! Text Classification as a Proxy for Analysing Wiki Deletion Discussions
di: Borkakoty, Hsuvas, et al.
Pubblicazione: (2025)
di: Borkakoty, Hsuvas, et al.
Pubblicazione: (2025)
WikiChat: Stopping the Hallucination of Large Language Model Chatbots by Few-Shot Grounding on Wikipedia
di: Semnani, Sina J., et al.
Pubblicazione: (2023)
di: Semnani, Sina J., et al.
Pubblicazione: (2023)
WikiVQABench: A Knowledge-Grounded Visual Question Answering Benchmark from Wikipedia and Wikidata
di: Shbita, Basel, et al.
Pubblicazione: (2026)
di: Shbita, Basel, et al.
Pubblicazione: (2026)
More than Just Wikipedia: Creating a Collaborative Research Library Using a Wiki
di: Munoz, Caroline Lego
Pubblicazione: (2012)
di: Munoz, Caroline Lego
Pubblicazione: (2012)
XProvence: Zero-Cost Multilingual Context Pruning for Retrieval-Augmented Generation
di: Mohamed, Youssef, et al.
Pubblicazione: (2026)
di: Mohamed, Youssef, et al.
Pubblicazione: (2026)
Affective Visual Dialog: A Large-Scale Benchmark for Emotional Reasoning Based on Visually Grounded Conversations
di: Haydarov, Kilichbek, et al.
Pubblicazione: (2023)
di: Haydarov, Kilichbek, et al.
Pubblicazione: (2023)
CLAPS: A CLIP-Unified Auto-Prompt Segmentation for Multi-Modal Retinal Imaging
di: Zhao, Zhihao, et al.
Pubblicazione: (2025)
di: Zhao, Zhihao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Document Haystacks: Vision-Language Reasoning Over Piles of 1000+ Documents
di: Chen, Jun, et al.
Pubblicazione: (2024) -
StoryGPT-V: Large Language Models as Consistent Story Visualizers
di: Shen, Xiaoqian, et al.
Pubblicazione: (2023) -
Vgent: Graph-based Retrieval-Reasoning-Augmented Generation For Long Video Understanding
di: Shen, Xiaoqian, et al.
Pubblicazione: (2025) -
From Statics to Dynamics: Physics-Aware Image Editing with Latent Transition Priors
di: Zhao, Liangbing, et al.
Pubblicazione: (2026) -
Neural Catalog: Scaling Species Recognition with Catalog of Life-Augmented Generation
di: Khan, Faizan Farooq, et al.
Pubblicazione: (2025)